רוצים לגרום לתמונה סטטית לדבר—פורטרט שפותח את הפה, ממצמץ ואומר כל מה שתקלידו? עם VisionStory אפשר לעשות בדיוק את זה מתמונה אחת, ישירות בדפדפן, בלי מצלמה ובלי ניסיון בעריכה. הסרטון למעלה מציג את כל התהליך, והמדריך צעד אחר צעד למטה מכסה כל חלק בפירוט.
במהלך התהליך תעלו פורטרט אחד ותכינו אותו כ-אווטאר אישי לשימוש חוזר. משתמשים אחרים לא יכולים לראות אותו, ותוכלו לבחור בו שוב לסרטונים עתידיים במקום להעלות את אותה התמונה בכל פעם. הכול פועל בתוך כלי התמונה המדברת של VisionStory עם חשבון חינמי.
שלב 1: העלו פורטרט ברור אחד
פתחו וידאו בינה מלאכותית. בפאנל Characters בחרו Upload ובחרו תמונה מהמכשיר שלכם, או גררו את התמונה ישירות לאזור ההעלאה. השתמשו באדם אחד ברור שמביט קדימה, כשהפנים והכתפיים נראות, העיניים והפה ללא חסימה, ויש קצת מרווח סביב הנושא כדי לאפשר מסגור מחדש בהמשך.
- קבצים נתמכים: JPG, JPEG, PNG, WebP ו-HEIC.
- גודל קובץ מקסימלי: 30 MB.
- גודל התחלתי מומלץ: לפחות 512 x 768 פיקסלים לפורטרט.
- אופן העלאה: תמונת מקור אחת בכל פעם.

התאימו את הקומפוזיציה של תמונת המקור ליעד שבו הסרטון יפורסם. פורטרט חתוך מאוד יכול לעבוד ב-9:16, אבל להפוך לחיתוך פנים צפוף ולא נוח ב-16:9, כי אין שטח תמונה משמאל ומימין כדי למלא את המסגרת הרחבה יותר.
שלב 2: תנו ל-VisionStory לאמת ולהכין את האווטאר
אחרי ההעלאה, VisionStory בודק אם התמונה מכילה אדם שניתן להשתמש בו ומכין אותה כדמות. העלאה שנכשלה כמעט תמיד קשורה לתמונת המקור: ייתכן שהפנים קטנות מדי, מכוסות מאוד, מופנות יותר מדי הצידה, מטושטשות, או קרובות מדי לפנים אחרות.
אם ההכנה נכשלת, אל תמשיכו לנסות שוב ושוב עם אותו חיתוך. בחרו מקור חד יותר עם פנים אחת גדולה יותר, זווית ישירה יותר, כתפיים גלויות, תאורה אחידה ופחות חסימות.

כשהעיבוד מסתיים, האווטאר מופיע מעל ספריית הדמויות הציבורית ונפתח בתצוגה המקדימה של האווטאר. הוא גלוי רק לכם.
שלב 3: האזינו לתצוגה מקדימה של הקול שהוקצה או החליפו אותו
VisionStory מקצה אוטומטית קול התחלתי מתאים לפי הגיל והמגדר הנראים של האדם. אפשר להשאיר אותו, לשמוע תצוגה מקדימה, או להחליף לקול אחר.
- בחרו בקול הנוכחי כדי לפתוח את ספריית הקולות.
- השתמשו בכפתור הניגון שמימין לקול כדי לשמוע דוגמה.
- אם זה לא מתאים, סננו לפי שפה, מגדר, גיל ו-Use Case.
- האזינו לכמה חלופות, ואז בחרו את הקול שמתאים גם לאווטאר וגם למטרת הסרטון.

קול יכול להתאים לגיל ולמגדר הנראים של האדם ועדיין להרגיש לא נכון לקריינות, חינוך, פרסום או תוכן שיחתי. התאימו את האדם ואת המטרה — לא רק את הדמוגרפיה.
שלב 4: מסגרו מחדש את התמונה לפי היעד
השתמשו בתצוגה המקדימה של האווטאר כדי להחליט כמה מהאדם יופיע בסרטון הסופי. גררו את התמונה כדי למקם מחדש את הנושא, והשתמשו בפקדי הזום כדי להתקרב או להתרחק. לאחר מכן בחרו את יחס הגובה-רוחב שמתאים למקום שבו תפרסמו:
- 9:16 אנכי ל-TikTok, Instagram Reels, YouTube Shorts ומיקומים נוספים שמיועדים למובייל.
- 1:1 ריבוע לפוסטים ריבועיים ברשתות, פריסות שמבוססות על פרופיל והטמעות גמישות.
- 16:9 אופקי ל-YouTube, מצגות, אתרים וקורסים במסך רחב.

זום לא יכול לחשוף פיקסלים שלא קיימים. אם האדם כבר נוגע בכל קצה של תמונת המקור, התחילו מתמונה עם יותר רקע במקום לכפות חיתוך רחב יותר.
שלב 5: מה עושים Change Look ו-Generate Image
לצד האווטאר נמצאים שני כלי תמונות בינה מלאכותית, וכדאי להבין את ההבדל ביניהם לפני שמשתמשים.
Change Look פותח צ'אט AI כשהאווטאר הנוכחי כבר מצורף, כך שתוכלו לתאר לבוש חדש, סביבה או סגנון. זהו תהליך image-to-image, והאווטאר המקורי נשאר זמין. Generate Image מתחיל מתיאור כתוב של דמות במקום מתמונה, ולכן זהו תהליך text-to-image. בשני המקרים אפשר להמשיך בצ'אט כדי לחדד את התוצאה.

בקיצור: השתמשו ב-Change Look כשהדמות כבר קיימת וצריכה מראה חדש, והשתמשו ב-Generate Image כשאתם רוצים ליצור דמות מפרומפט.
שלב 6: הוסיפו תסריט קצר וצרו את סרטון הדיבור
כשהאווטאר שהעליתם מסומן, הקלידו משפט אחד קצר ושיחתי בתיבת התסריט. שורה קצרה נרנדרת מהר יותר ומקלה להעריך יחד את התמונה, החיתוך, הקול, סנכרון השפתיים והתנועה.
לחצו Generate Talking Video. VisionStory מנפיש את הפנים, מסנכרן את השפתיים לקול ומוסיף מצמוצים ותנועות ראש מציאותיות באמצעות האווטאר, המסגור, התסריט והקול שנבחרו. הרינדור לוקח כמה דקות.

התייחסו לתוצאה הראשונה הזו כבדיקה מעשית של תמונת המקור. בדקו 4 דברים:
- הפנים נשארות חדות מספיק בגודל הסופי.
- העיניים והפה נשארים ללא חסימה במהלך התנועה.
- הראש והכתפיים יושבים בנוחות בתוך היחס שנבחר.
- האווטאר בתנועה עדיין נראה כמו האדם שבתמונת המקור.
אם החיתוך צפוף מדי או שהפנים נראות רכות בזמן תנועה, תקנו קודם את תמונת המקור או את המסגור. שינוי התסריט לא יפתור בעיית קומפוזיציה.
שלב 7: השתמשו שוב באווטאר התמונה המדברת או הסירו אותו
בחזרה לרשימת Characters, האווטאר שהעליתם יופיע מעל ספריית הדמויות הציבורית, ואפשר לבחור בו בכל פעם שתרצו את אותו המגיש שוב. משתמשים אחרים לא יכולים לראות אותו, ומנויים יכולים ליצור ולשמור אווטארים ללא הגבלה.
- שימוש חוזר: בחרו באווטאר במקום להעלות שוב את התמונה.
- החלפת מראה: פתחו את האווטאר ובחרו אחת מתמונות הממוזערות של המראות השמורים שלו.
- הסרה: רחפו מעל האווטאר כדי לחשוף את כפתור המחיקה בפינה הימנית העליונה, ואז אשרו לפני מחיקת האווטאר והמראות שלו.

פתרון בעיות נפוצות בתמונות
VisionStory לא מצליח למצוא פנים שניתן להשתמש בהן. השתמשו בתמונה בהירה וחדה יותר עם פנים אחת גדולה יותר שמביטה קדימה. הימנעו מעיניים או פה מכוסים, זוויות פרופיל חזקות ותמונות שבהן פנים אחרות קרובות לנושא הראשי.
החיתוך האופקי קרוב מדי. כנראה שאין מספיק שטח תמונה בצדדים בפורטרט המקורי. השתמשו במקור רחב יותר, או כזה עם יותר מרווח ריק סביב האדם.
האווטאר עדיין בהכנה. המתינו לסיום ההכנה לפני שמשתמשים בדמות. אם זה נתקע, רעננו את תצוגת Characters ובדקו אם האווטאר כבר הופיע לפני שאתם מעלים עותק נוסף.
התוצאה נראית רכה. התחילו מתמונה ברזולוציה גבוהה יותר, בפוקוס, והימנעו מהגדלה אגרסיבית מדי של פנים קטנות. רזולוציית הפלט לא יכולה להחזיר פרטים שחסרו במקור.
זה כל מה שצריך כדי לגרום לתמונה לדבר: העלו פורטרט אחד, התאימו קול, מסגרו וצרו. התמונה שלכם היא עכשיו אווטאר מדבר לשימוש חוזר שתוכלו להשתמש בו שוב בכל פעם שתצטרכו.
מוכנים לתהליך המלא של תסריט, קול, הגדרות, קרדיטים ותהליך יצירה? עקבו אחרי How to Create an AI Talking Avatar, או הפכו תסריטים מלאים ל-סרטוני וידאו בינה מלאכותית בקנה מידה גדול. או פשוט התחילו עכשיו: צרו את התמונה המדברת הראשונה שלכם בחינם.
