فارسی

API VisionStory
ساخته‌شده برای توسعه‌دهندگان

با REST API VisionStory یا Python SDK، از متن یا صوت ویدیوهای آواتارِ سخنگو با لیپ‌سینک بسازید. مدل‌ها، آواتارها و صداهای فعلی را پیدا کنید، یک کارِ asynchronous ارسال کنید و MP4 نهایی را دانلود کنید—یا همین گردش‌کار را با CLI، سرور MCP یا Agent Skill خودکار کنید.

POST /api/v1/video
  • REST API
  • Python SDK
  • CLI
  • MCP
  • Agent Skill
آماده برای ایجنت‌ها

همان‌جایی کار می‌کند که ایجنت‌های شما کار می‌کنند.

یک پیام راه‌اندازی را برای ایجنت کدنویس‌تان کپی کنید، یا سرور MCP را متصل کنید و VisionStory را به‌عنوان یک ابزار قابل استفاده مجدد در دسترس قرار دهید.

VisionStory CLI

یک‌بار نصب کنید. همه APIها را از ترمینال‌تان استفاده کنید.

نصب‌کننده در یک محیط ایزوله به آخرین نسخه PyPI ارتقا می‌دهد. پروژه‌های Python فعلی شما دست‌نخورده می‌مانند.

curl -fsSL https://developers.visionstory.ai/cli | bash
macOS · Linux · WSLگزینه‌های نصب
این پرامپت راه‌اندازی را برای Claude Code بفرستید
Help me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill:   curl -fsSL https://developers.visionstory.ai/cli | bash   npx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
تازه‌واردید؟

یک API Key بسازید، سپس این پرامپت را برای ایجنت کدنویس‌تان بفرستید. ایجنت شما را در ورود به visionstory راهنمایی می‌کند، اعتبارها را بررسی می‌کند و بدون افشای کلیدتان ویدیو را می‌سازد.

ابزارهای توسعه‌دهندگان VisionStory

ادغام API مناسب استک‌تان را انتخاب کنید.

REST، Python SDK، CLI، سرور MCP و Agent Skill همگی از همان API احراز هویت‌شده VisionStory و همان شناسه‌های منبع استفاده می‌کنند. با یک رابط شروع کنید و سپس همین گردش‌کارِ ویدیوی آواتار را به بک‌اند، پایپ‌لاین CI یا یک عامل کدنویسی منتقل کنید.

01REST

REST API را فراخوانی کنید

VisionStory را از هر زبان بک‌اندی فراخوانی کنید. مدل‌ها، آواتارها و صداهای فعلی را لیست کنید؛ یک text_script یا audio_script را به POST /api/v1/video بفرستید؛ تا زمان ساخته‌شدن Job آن را poll کنید؛ سپس MP4 را دانلود کنید.

رفرنس REST API را ببینید
02PYTHON

با Python SDK بسازید

از کلاینت Python تایپ‌شده و بدون وابستگی برای احراز هویت مبتنی بر محیط، ساخت payload، آپلود، poll کردن Job و دانلود استفاده کنید. برای اپلیکیشن‌های Python، نوت‌بوک‌ها و سرویس‌های رسانه‌ای داخلی مناسب است.

کوییک‌استارت Python SDK را بخوانید
03CLI

با CLI خودکارسازی کنید

دستور visionstory doctor را اجرا کنید، اعتبارها را بررسی کنید، شناسه‌های منبع را پیدا کنید، ویدیوهای آواتار تولید کنید، Taskها را بررسی کنید و خروجی‌ها را از ترمینال، اسکریپت شِل یا Job در CI دانلود کنید—بدون اینکه اول یک اپلیکیشن بسازید.

CLI را نصب و تأیید کنید
04MCP / SKILL

یک عامل کدنویسی هوش مصنوعی متصل کنید

سرور MCPِ VisionStory را وصل کنید یا Agent Skill را نصب کنید تا Codex، Claude Code، Cursor، Windsurf، Cline و Gemini بتوانند منابع را پیدا کنند، رسانه تولید کنند و نتایج را دانلود کنند—در حالی که کلید API در فضای امن محلی باقی می‌ماند.

MCP یا Agent Skill را وصل کنید

کوییک‌استارت API آواتارِ سخنگو

اولین ویدیوی آواتارِ سخنگوی خود را بسازید.

یک کلید API سمت‌سرور بسازید، موجودی اعتبار خود را بررسی کنید و شناسه‌های مدل، آواتار و صدای فعلی را پیدا کنید. یک text_script یا audio_script را به POST /api/v1/video ارسال کنید، حدود هر 5 ثانیه یک‌بار تا ساخته‌شدن Job آن را poll کنید و سپس MP4 را دانلود کنید. URLهای ویدیوی تکمیل‌شده تا 7 روز نگه‌داری می‌شوند.

create_video.py
from pathlib import Pathfrom visionstory import VisionStoryClient, build_video_payload client = VisionStoryClient.from_env()payload = build_video_payload(    avatar_id="YOUR_AVATAR_ID",    text="Hello from my product.",    voice_id="YOUR_VOICE_ID",)video = client.generate_video(payload)client.download(video["video_url"], Path("result.mp4"))

کاتالوگ مدل‌های VisionStory

مدل مناسب خروجی موردنیازتان را انتخاب کنید.

از Jobی که باید انجام دهید شروع کنید، سپس کاتالوگ مدل فعلی را در زمان اجرا دریافت کنید. پاسخ API مرجع اصلی برای شناسه‌های موجود، پارامترهای قابل‌قبول و محدودیت‌های خروجی است.

APIهای رسانه هوش مصنوعیِ ترکیب‌پذیر

APIهای آواتار، صدا و ویدیوی هوش مصنوعی را ترکیب کنید.

با یک کلید API مجری‌های سخنگو بسازید، گفتار طبیعی را سنتز کنید، آواتارها، صداها و دارایی‌های رسانه‌ای سفارشی را دوباره استفاده کنید و کلیپ‌های ویدیویی مکمل تولید کنید. بدون کنار هم چسباندن سرویس‌دهنده‌های جداگانه، ویدیوهای توضیحی بومی‌سازی‌شده، آنبوردینگ شخصی‌سازی‌شده، آموزش، ارتباط فروش یا رسانه‌های ساخته‌شده توسط عامل‌ها را بسازید.

تبدیل ورودیِ پرتره و صوت به یک ویدیوی آواتارِ سخنگو از طریق VisionStory API

گردش‌کار اصلی آواتار

API ویدیوی آواتارِ سخنگو

از متن یا صوت ضبط‌شده یک ویدیوی مجری با لیپ‌سینک تولید کنید. یک آواتار عمومی انتخاب کنید یا از یک پرتره یک آواتار سفارشیِ قابل‌استفاده‌مجدد بسازید، یک صدای عمومی یا شبیه‌سازی‌شده انتخاب کنید و پس از پایان Job asynchronous یک MP4 قابل دانلود دریافت کنید.

تبدیل یک متن به شکل موج صوتی از طریق API تبدیل متن به گفتار VisionStory

لایه صدا و گفتار

API تبدیل متن به گفتار و صدا

متن را با یک صدای عمومی یا شبیه‌سازی‌شده به گفتار طبیعی MP3 تبدیل کنید، سپس همان صدا را در ویدیوهای آواتار و محتوای بومی‌سازی‌شده دوباره استفاده کنید. به‌جای هاردکد کردن شناسه‌های صدا، فهرست صداها را در زمان اجرا کوئری کنید.

تبدیل یک پرامپت به ویدیوی تولیدشده از طریق VisionStory API ویدیوی هوش مصنوعی

ساخت با هدایت ایجنت

API تولید ویدیوی هوش مصنوعی

کلیپ‌های متن‌به‌ویدیو، تصویر‌به‌ویدیو و مبتنی‌بر رفرنس را با مدلی که از کاتالوگ زنده انتخاب می‌شود تولید کنید. یک ایجنت هوش مصنوعی می‌تواند پرامپت‌ها و دارایی‌ها را آماده کند، اعتبارها را برآورد کند، کار را ارسال کند و خروجی را با یک ارائه‌دهنده آواتار ترکیب کند.

سوالات متداول API ویدیوی آواتار هوش مصنوعی

پاسخ‌های مستقیم درباره احراز هویت، درخواست‌ها، کارهای ناهمگام، SDKها، خودکارسازی CLI، MCP و استفاده در محیط پروداکشن.

  • API ویدیوی آواتار هوش مصنوعی یک ارائه‌دهنده دیجیتال را همراه با متن یا صوت ضبط‌شده به یک ویدیوی لب‌خوانی‌شده تبدیل می‌کند که یک اپلیکیشن می‌تواند به‌صورت برنامه‌نویسی تولیدش کند. VisionStory درخواست‌های احراز هویت‌شده سمت سرور را می‌پذیرد، فوراً یک شناسه ویدیو برمی‌گرداند، کار را به‌صورت ناهمگام رندر می‌کند و پس از تکمیل تولید، یک URL برای MP4 ارائه می‌دهد.

با یک درخواستِ احراز هویت‌شده شروع کنید

اولین یکپارچه‌سازی ویدیوی آواتار هوش مصنوعی خود را بسازید.

یک API key بسازید، اعتبارهای خود را بررسی کنید و راه‌اندازی سریع آواتارِ سخنگو در 5 مرحله را اجرا کنید. با REST یا Python شروع کنید و سپس با رشد گردش‌کار، خودکارسازی CLI، ابزارهای MCP یا Agent Skill را اضافه کنید. به‌جای هاردکد کردن شناسه‌های مدل، آواتار یا صدا، اندپوینت‌های منابع زنده را کوئری کنید.