בנו סרטוני אווטאר מדבר עם סנכרון שפתיים מטקסט או מאודיו באמצעות ה-REST API של VisionStory או ה-Python SDK. גלו את המודלים, האווטארים והקולות העדכניים, שלחו משימה אסינכרונית והורידו את קובץ ה-MP4 המוכן — או בצעו אוטומציה לאותו תהליך עם ה-CLI, שרת MCP או Agent Skill.
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:curl -fsSL https://developers.visionstory.ai/cli | bashnpx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
חדשים כאן?
צרו מפתח API, ואז שלחו את הפרומפט הזה לסוכן הקידוד שלכם. הוא ילווה אתכם בהתחברות ל-visionstory, יאמת קרדיטים, וייצור את הווידאו בלי לחשוף את המפתח שלכם.
כלי המפתחים של VisionStory
בחרו את שילוב ה-API המתאים לסטאק שלכם.
REST, ה-Python SDK, ה-CLI, שרת MCP ו-Agent Skill כולם משתמשים באותו API מאומת של VisionStory ובאותם מזהי משאבים. התחילו עם ממשק אחד, ואז העבירו את אותו תהליך עבודה של וידאו אווטאר ל-Backend, לפייפליין CI או לסוכן כתיבת קוד.
צרו מפתח API בצד השרת, בדקו את יתרת הקרדיטים שלכם וגלו את מזהי המודל, האווטאר והקול העדכניים. שלחו text_script או audio_script ל-POST /api/v1/video, בצעו polling בערך כל 5 שניות עד שהמשימה נוצרת, ואז הורידו את ה-MP4. כתובות URL של סרטונים שהושלמו נשמרות למשך 7 ימים.
create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payloadclient = VisionStoryClient.from_env()payload = build_video_payload(avatar_id="YOUR_AVATAR_ID",text="Hello from my product.",voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))
קטלוג המודלים של VisionStory
בחרו את המודל לתוצאה שאתם צריכים.
התחילו מהמשימה שאתם צריכים להשלים, ואז שלפו בזמן ריצה את קטלוג המודלים העדכני. תגובת ה-API היא מקור האמת למזהים הזמינים, לפרמטרים המתקבלים ולמגבלות הפלט.
השתמשו במפתח API אחד כדי ליצור מגישים מדברים, לסנתז דיבור טבעי, לעשות שימוש חוזר באווטארים מותאמים אישית, קולות ונכסי מדיה, וליצור קליפים משלימים. בנו סרטוני הסבר מותאמים לשפה, אונבורדינג אישי, חינוך, פנייה למכירות או מדיה שנוצרה על ידי סוכן — בלי לחבר בין ספקים נפרדים.
תשובות ישירות על אימות, בקשות, משימות אסינכרוניות, SDKs, אוטומציה ב-CLI, MCP ושימוש בפרודקשן.
API לוידאו אווטאר בינה מלאכותית הופך מגיש דיגיטלי יחד עם טקסט או אודיו מוקלט לסרטון מסונכרן לשפתיים שאפליקציה יכולה לייצר באופן תכנותי. VisionStory מקבלת בקשות מאומתות מצד השרת, מחזירה מיד מזהה וידאו, מרנדרת את המשימה בצורה אסינכרונית ומספקת כתובת URL של MP4 כשהיצירה מסתיימת.
צרו מפתח API של VisionStory, ודאו שיש לכם קרדיטים, שלפו את מזהי המודל, האווטאר והקול העדכניים, ואז שלחו ל-POST /api/v1/video או text_script או audio_script. ה-API מחזיר מיד מזהה וידאו. בצעו polling למשימה בערך כל חמש שניות עד שהסטטוס שלה הוא created, ואז הורידו את ה-MP4 מתוך video_url.
השתמשו ב-REST כשאתם צריכים שליטה שאינה תלויה בשפה, ב-Python SDK כשאתם בונים שירות או notebook ב-Python, וב-CLI לאוטומציה בטרמינל, ל-CI או ליצירה באצווה. שלושת הממשקים משתמשים באותם משאבי VisionStory ובאותו תהליך עבודה אסינכרוני של וידאו.
כן. התקינו את VisionStory Agent Skill או התחברו לשרת VisionStory MCP. סוכן קוד נתמך יכול לוודא קרדיטים, להציג את המודלים, האווטארים והקולות העדכניים, להכין בקשה תקינה, להתחיל את משימת הווידאו, לנטר אותה ולהוריד את התוצאה — בזמן שמפתח ה-API נשאר בסביבת העבודה שלכם או באחסון הסודות של MCP.
כן. שלחו audio_script כשאתם רוצים שהאווטאר ידבר מאודיו מוקלט, או שלחו text_script עם מזהה קול כש-VisionStory צריכה לסנתז את הדיבור. השתמשו בסוג תסריט אחד לכל בקשה במקום לשלוח את שניהם.
התייחסו ליצירת הווידאו כאל משימה אסינכרונית. שמרו את מזהה בקשת הלקוח שלכם ואת מזהה הווידאו שהוחזר, בצעו polling בערך כל חמש שניות, ועצרו כשהמשימה מגיעה ל-created או ל-failed. כתובות URL של וידאו שהושלמו נשמרות למשך שבעה ימים, לכן העבירו מדיה שהסתיימה לאחסון הקבוע שלכם לפי הצורך.
שמרו את VISIONSTORY_API_KEY במשתנה סביבה בשרת, בסוד של CI או במאגר סודות של לקוח MCP, ושלחו אותו דרך כותרת הבקשה X-API-Key. לעולם אל תטמיעו את המפתח בקוד דפדפן, בחבילת אפליקציה למובייל, במאגר ציבורי, בצילומי מסך, בלוגים או בהודעת צ׳אט עם AI.
אפשר לשלב וידאו אווטאר עם טקסט לדיבור, קולות ציבוריים או משובטים, נכסי תמונה ואודיו לשימוש חוזר, תמלול, יצירת תמונות בינה מלאכותית ומודלים מתקדמים של וידאו. אבני הבניין האלה תומכות בסרטוני הסבר מותאמים לשפה, פנייה אישית, תוכן למידה אוטומטי ותהליכי עבודה במדיה עם סוכני AI.
התחילו עם בקשה מאומתת אחת
בנו את אינטגרציית הווידאו אווטאר בינה מלאכותית הראשונה שלכם.
צרו מפתח API, ודאו את הקרדיטים שלכם, והריצו את ה-quickstart של אווטאר מדבר בחמישה שלבים. התחילו עם REST או Python, ואז הוסיפו אוטומציה ב-CLI, כלי MCP או את Agent Skill ככל שתהליך העבודה שלכם מתרחב. בצעו שאילתה ל-endpoints של משאבים חיים במקום לקבע מראש מזהי מודל, אווטאר או קול בקוד.