Δημιουργήστε βίντεο talking-avatar με συγχρονισμό χειλιών από κείμενο ή ήχο με το VisionStory REST API ή το Python SDK. Ανακαλύψτε τα τρέχοντα μοντέλα, avatars και φωνές, υποβάλετε μια ασύγχρονη εργασία και κατεβάστε το τελικό MP4 — ή αυτοματοποιήστε την ίδια ροή εργασίας με το CLI, τον MCP server ή το Agent Skill.
Στείλτε αυτό το prompt εγκατάστασης στο Claude Code
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:curl -fsSL https://developers.visionstory.ai/cli | bashnpx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
Πρώτη φορά εδώ;
Δημιουργήστε ένα API key και έπειτα στείλτε αυτό το prompt στον coding agent σας. Θα σας καθοδηγήσει στη σύνδεση στο visionstory, θα επαληθεύσει τις Μονάδες και θα δημιουργήσει το βίντεο χωρίς να εκθέσει το key σας.
Εργαλεία developers του VisionStory
Επιλέξτε την ενσωμάτωση API για το stack σας.
Το REST, το Python SDK, το CLI, ο MCP server και το Agent Skill χρησιμοποιούν όλα το ίδιο authenticated VisionStory API και τα ίδια resource IDs. Ξεκινήστε με μία διεπαφή και μετά μεταφέρετε την ίδια ροή εργασίας για avatar video σε backend, CI pipeline ή coding agent.
Δημιουργήστε ένα server-side API key, επαληθεύστε το υπόλοιπο των μονάδων σας και βρείτε τα τρέχοντα IDs για model, avatar και voice. Υποβάλετε ένα text_script ή audio_script στο POST /api/v1/video, κάντε poll περίπου κάθε 5 δευτερόλεπτα μέχρι να δημιουργηθεί η εργασία και μετά κατεβάστε το MP4. Τα URLs των ολοκληρωμένων βίντεο διατηρούνται για 7 ημέρες.
create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payloadclient = VisionStoryClient.from_env()payload = build_video_payload(avatar_id="YOUR_AVATAR_ID",text="Hello from my product.",voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))
Κατάλογος μοντέλων VisionStory
Επιλέξτε το μοντέλο για το αποτέλεσμα που χρειάζεστε.
Ξεκινήστε από την εργασία που θέλετε να ολοκληρώσετε και στη συνέχεια ανακτήστε τον τρέχοντα κατάλογο μοντέλων στο runtime. Η απάντηση του API είναι η έγκυρη πηγή για διαθέσιμα IDs, αποδεκτές παραμέτρους και όρια αποτελέσματος.
Χρησιμοποιήστε ένα API key για να δημιουργείτε talking παρουσιαστές, να συνθέτετε φυσική ομιλία, να επαναχρησιμοποιείτε custom avatars, φωνές και media assets και να δημιουργείτε συμπληρωματικά video clips. Φτιάξτε τοπικοποιημένα explainer βίντεο, εξατομικευμένο onboarding, εκπαίδευση, προσέγγιση πωλήσεων ή media που δημιουργούνται από agents, χωρίς να συνδυάζετε διαφορετικούς παρόχους.
Άμεσες απαντήσεις για έλεγχο ταυτότητας, αιτήματα, ασύγχρονες εργασίες, SDKs, αυτοματοποίηση CLI, MCP και χρήση σε παραγωγή.
Ένα API βίντεο AI avatar μετατρέπει έναν ψηφιακό παρουσιαστή μαζί με κείμενο ή ηχογραφημένο ήχο σε βίντεο με lip-sync, το οποίο μια εφαρμογή μπορεί να δημιουργεί προγραμματιστικά. Το VisionStory δέχεται πιστοποιημένα server-side αιτήματα, επιστρέφει άμεσα ένα video ID, εκτελεί την εργασία ασύγχρονα και παρέχει ένα MP4 URL όταν ολοκληρωθεί η δημιουργία.
Δημιουργήστε ένα VisionStory API key, επιβεβαιώστε τις μονάδες σας, ανακτήστε τα τρέχοντα model, avatar και voice IDs και, στη συνέχεια, υποβάλετε είτε ένα text_script είτε ένα audio_script με POST /api/v1/video. Το API επιστρέφει άμεσα ένα video ID. Κάντε polling την εργασία περίπου κάθε 5 δευτερόλεπτα μέχρι το status να γίνει created και μετά κατεβάστε το MP4 από το video_url.
Χρησιμοποιήστε REST όταν χρειάζεστε έλεγχο ανεξάρτητο από γλώσσα, το Python SDK όταν φτιάχνετε ένα Python service ή notebook και το CLI για αυτοματοποίηση σε τερματικό, CI ή μαζική δημιουργία. Και οι 3 διεπαφές χρησιμοποιούν τους ίδιους πόρους του VisionStory και την ίδια ασύγχρονη ροή εργασίας βίντεο.
Ναι. Εγκαταστήστε το VisionStory Agent Skill ή συνδέστε τον VisionStory MCP server. Ένας υποστηριζόμενος coding agent μπορεί να επιβεβαιώσει μονάδες, να εμφανίσει τα τρέχοντα models, avatars και voices, να ετοιμάσει ένα έγκυρο αίτημα, να ξεκινήσει την εργασία βίντεο, να την παρακολουθεί και να κατεβάσει το αποτέλεσμα, ενώ το API key παραμένει στο περιβάλλον σας ή στο MCP secret storage.
Ναι. Στείλτε ένα audio_script όταν θέλετε το avatar να μιλήσει από ηχογραφημένο ήχο ή στείλτε ένα text_script με ένα voice ID όταν το VisionStory πρέπει να συνθέσει την ομιλία. Χρησιμοποιήστε έναν τύπο script ανά αίτημα αντί να στέλνετε και τα δύο.
Αντιμετωπίστε τη δημιουργία βίντεο ως ασύγχρονη εργασία. Αποθηκεύστε το client request ID και το video ID που επιστρέφεται, κάντε polling περίπου κάθε 5 δευτερόλεπτα και σταματήστε όταν η εργασία γίνει created ή failed. Τα URL των ολοκληρωμένων βίντεο διατηρούνται για 7 ημέρες, οπότε αντιγράψτε τα τελικά αρχεία στο δικό σας μόνιμο χώρο αποθήκευσης όταν χρειάζεται.
Διατηρήστε το VISIONSTORY_API_KEY σε μια server environment variable, σε CI secret ή στο MCP client secret store και στείλτε το μέσω του X-API-Key request header. Μην ενσωματώνετε ποτέ το key σε κώδικα browser, σε bundle εφαρμογής για κινητό, σε δημόσιο αποθετήριο, σε screenshots, σε logs ή σε μήνυμα συνομιλίας με AI.
Μπορείτε να συνδυάσετε βίντεο avatar με Μετατροπή Κειμένου σε Ομιλία, δημόσιες ή κλωνοποιημένες φωνές, επαναχρησιμοποιήσιμα image και audio assets, απομαγνητοφώνηση, δημιουργία AI εικόνων και πρωτοποριακά video models. Αυτά τα δομικά στοιχεία υποστηρίζουν τοπικοποιημένα explainer βίντεο, εξατομικευμένη επικοινωνία, αυτοματοποιημένο εκπαιδευτικό περιεχόμενο και media workflows με AI agents.
Ξεκινήστε με ένα πιστοποιημένο αίτημα
Φτιάξτε την πρώτη σας ενσωμάτωση βίντεο AI avatar.
Δημιουργήστε ένα API key, επιβεβαιώστε τις μονάδες σας και τρέξτε το talking-avatar quickstart σε 5 βήματα. Ξεκινήστε με REST ή Python και, καθώς μεγαλώνει η ροή εργασίας σας, προσθέστε αυτοματοποίηση CLI, εργαλεία MCP ή το Agent Skill. Κάντε query σε live resource endpoints αντί να κάνετε hard-code model, avatar ή voice IDs.