فارسی

چه چیزی وارد می‌شود و چه چیزی تحویل می‌گیرید

مناسبِ چه کسانی است

استودیوهای بومی‌سازی و تیم‌های دوبله

مدیران تولید در استودیوهای بومی‌سازی، خانه‌های دوبلاژ و ارائه‌دهندگان خدمات زبانی که قیمت را به‌ازای هر دقیقه برای هر زبان تعیین می‌کنند و باید مطابق ضرب‌الاجلِ مشتری و فرایند بازبینیِ مشتری تحویل بدهند.

با چه چیزی شروع می‌کنید

یک کاتِ منبعِ قفل‌شده و واژه‌نامهٔ مشتری

ویدیوی منبعِ تأییدشده، ترم‌بیسِ مشتری، نام‌های محصول و عبارت‌های بازبینی‌شدهٔ حقوقی؛ به‌علاوه اگر قصد دارید از صدای خودِ گوینده دوباره استفاده کنید، یک رضایت‌نامهٔ کتبیِ صدا.

چه چیزی دریافت می‌کنید

مسترهای جداگانه برای هر زبان، تحویل به‌صورت فایل

نسخه‌های دوبله‌شده و دارای لب‌خوانی هماهنگ برای هر زبانی که سفارش داده شده؛ هرکدام یک مسترِ قابل‌تحویل هستند، نه یک پیش‌نویس داخلی. VisionStory فایل‌ها را برمی‌گرداند و همان‌جا کارش تمام می‌شود: نه رابطهٔ مشتری را مدیریت می‌کند، نه از طرف کسی ترجمه‌ای را تأیید می‌کند و نه منتشر می‌کند. دورِ بازبینیِ محلی و تأیید نهایی همچنان با شما و مشتری‌تان می‌ماند.

چه چیزی تغییر می‌کند وقتی زبان‌ها دیگر «جلسه ضبط» نیستند

یک سفارش بومی‌سازی از نظر قیمت‌گذاری شبیه تولید انبوه است و از نظر زمان‌بندی شبیه یک آژانس رزرو. پیش‌فاکتور یک حساب‌وکتاب ساده است: دقیقه ضربدر زبان‌ها. اما تاریخ تحویل به اتاق‌های ضبط، تقویم استعدادها و یک دور تأیید وابسته است که دستِ یکی در سمت مشتری است. همین فاصله بین «چیزی که می‌توانید قیمت بدهید» و «چیزی که می‌توانید تضمین کنید» جایی است که یک کسب‌وکار بومی‌سازی یا مقیاس می‌گیرد یا گیر می‌کند—و معمولاً در پنج نقطهٔ قابل‌پیش‌بینی باز می‌شود.

زبان‌هایی را بگیرید که تقویم اتاق ضبط جلویشان را می‌گرفت

یک برند یک فیلم محصولِ 12 دقیقه‌ای را در 9 زبان می‌خواهد و سه هفته دیگر موعد تحویل است. نرخ‌نامه به‌ازای هر دقیقه برای هر زبان است، پس پیش‌فاکتور خودش نوشته می‌شود. اما برنامه‌ریزی نه. دو اتاق ضبط دارید، 4 تا از 9 صدا فریلنسر هستند و تقویم خودشان را دارند، و برای یک زبان فقط یک استعدادِ قابل‌استفاده در شهر وجود دارد. یا باید تاریخی را اعلام کنید که مشتری نمی‌پذیرد، یا سه زبان را به یک شریک بسپارید و سودِ آن‌ها را واگذار کنید.

تولید آن نسخه‌ها از روی کاتِ قفل‌شده، آن‌ها را از تقویمِ اتاق ضبط خارج می‌کند. منبع همان یک فایل می‌ماند و هر زبان به‌جای «جلسه»، تبدیل به «رندر» می‌شود؛ بنابراین یک سفارشِ 9 زبانه دیگر وابسته به این نیست که 9 رزرو در همان دو هفته کنار هم بنشینند. در نتیجه، زمان استودیو به جایی می‌رود که بیشترین بازده را دارد: زبانِ اصلی، استعدادِ جلوی دوربین که مشتری روی آن اصرار داشته، و اصلاحیه‌ها بعد از بازبینی—نه دنبالهٔ بلندِ کارهایی که از اول هم کسی دلش نمی‌خواست برایشان وقت رزرو کند.

یک اصطلاح را یک‌بار درست کنید، نه در هر زبان

در پاس اول، نام محصول در 5 تا از 8 زبان مثل یک اسم معمولی ترجمه می‌شود، هیچ‌کدام از اندازه‌گیری‌ها تبدیل نمی‌شوند، و برای اصطلاحی که تیم حقوقیِ مشتری قبلا به‌صورت مکتوب روی آن به جمع‌بندی رسیده بود، یک واژهٔ روزمره انتخاب می‌شود. از نظر لغت‌نامه‌ای هیچ‌کدام «غلط» نیست، اما همه‌چیز در بازبینی علامت می‌خورد؛ و این یعنی با هزینهٔ بالا تازه می‌فهمید واژه‌نامه اصلا به دست کسانی که کار را انجام می‌دادند نرسیده است.

نهایی‌کردن واژه‌نامه قبل از اینکه چیزی دوبله شود همان چیزی است که آن دور را کوتاه نگه می‌دارد. نام‌های محصول، شماره‌مدل‌ها، عبارت‌های بازبینی‌شدهٔ حقوقی و واحدهایی که بازار هدف واقعا استفاده می‌کند وارد اسکریپت می‌شوند و هر نسخه آن‌ها را به ارث می‌برد. VisionStory ترم‌بیس شما را نگه نمی‌دارد و آن را به‌جای شما اعمال نمی‌کند: یک نفر از سمت شما آن را اعمال می‌کند و بازبینِ مشتری نتیجه را تأیید می‌کند. تفاوت اینجاست که اصلاح یک اصطلاح، هزینهٔ یک بار رندرِ مجدد دارد نه 8 جلسه ضبط.

قبل از رندرِ اولین زبان، بازبینِ داخل کشور را مشخص کنید

هر نسخه در نهایت به نظر یک نفر وابسته است: لید بازاریابیِ توزیع‌کننده در مونیخ، رابط کامپلاینس در توکیو، مدیر کشور در سائو پائولو. فقط همان شخص می‌تواند حکم کند که مثلا یک ادعا را نمی‌شود آن‌طور در آلمانی بیان کرد، عناوین محترمانه برای مخاطب اشتباه‌اند، یا اساسا اجازه ندارید آن مقایسه را در آن بازار منتشر کنید. در بیشتر سفارش‌ها تا وقتی نسخهٔ اول ساخته نشده و در یک پوشهٔ اشتراکی منتظر نظر نمانده، اسم هیچ‌کس مشخص نمی‌شود.

در جلسهٔ شروع، نام و ساعات کاری را بگیرید تا یک زبان دیگر جایی نباشد که کار در آن گم می‌شود. به آن بازبین نسخه‌ای بدهید که دوبله، زیرنویس‌ها و متن‌های روی تصویر از قبل سر جای خودشان باشند؛ آن‌وقت یادداشت‌ها دقیق برمی‌گردند، نه فقط یک حس مبهم که «یه چیزی درست نیست». بعد هر یادداشت، می‌شود رندرِ مجددِ همان یک زبان از همان منبعِ قفل‌شده، نه رزرو دوبارهٔ استودیو. تأیید نهایی همچنان با بازبینِ داخل کشورِ مشتری است و هیچ‌چیز در هیچ بازاری منتشر نمی‌شود مگر اینکه همان شخص امضا کند.

صدایی که می‌نشیند و دهانی که نمی‌نشیند

مشتری اولین زبانی را که خودش می‌تواند قضاوت کند تماشا می‌کند—معمولا زبانی که مدیرعاملش صحبت می‌کند—و در کمتر از 10 ثانیه می‌گوید «یه چیزی درست نیست». متن دقیق است، اجرا خوب انجام شده، زمان‌بندی داخل شات می‌نشیند، اما دهانِ مجری هنوز دارد جملهٔ انگلیسی را شکل می‌دهد. این همان ایرادی است که حتی یک غیرمتخصص هم فوری می‌بیند و بی‌سروصدا اعتمادشان را به 7 زبان دیگری که راهی برای بررسی‌شان ندارند پایین می‌آورد.

دوبلهٔ دارای لب‌خوانی هماهنگ این نشانه را از بین می‌برد. از کاتِ منبعِ قفل‌شده، هر زبان طوری تولید می‌شود که دهانِ گوینده با صدای جدید هماهنگ باشد؛ بنابراین بیننده‌ای که زبانِ منبع را بلد نیست، هیچ دلیلی ندارد اصلا متوجه شود نسخهٔ دیگری وجود داشته است. زمان‌بندی به تصویر گره می‌خورد؛ و وقتی یک نوشتهٔ حقوقی (legal super) یا یک ادعا باید روی یک فریم ثابت بنشیند، این موضوع مهم است. اگر مشتری چهره‌ای را ارائه کرده که حق استفادهٔ مجدد از آن را ندارد، گرفتن آن مجوز بر عهدهٔ خودِ اوست و باید قبل از اینکه شما چیزی بسازید فراهم شود.

متنِ روی تصویر به شکل‌هایی می‌شکند که صدا هرگز نمی‌شکند

دوبله همان بخشی است که همه برایش برنامه دارند؛ اما چیزی که واقعا با علامت‌گذاری برمی‌گردد، نوشته‌های روی تصویر است. آلمانی از انگلیسیِ مبدا طولانی‌تر می‌شود و یک زیرنویس را از محدودهٔ امن بیرون می‌زند یا روی یک lower third دوخطی می‌افتد. یک نوشتهٔ حقوقی (legal super) روی یک فریم ثابت می‌نشیند و متنِ ترجمه‌شده دیگر در همان چند ثانیه‌ای که اجازه دارد نمایش داده شود جا نمی‌شود. عربی و عبری به چیدمانِ آینه‌ای نیاز دارند، نه صرفا جابه‌جاییِ کلمات. هیچ‌کدام از این‌ها تا وقتی صدا تمام نشده و کسی بالاخره فایل را از اول تا آخر نگاه نکرده، خودش را نشان نمی‌دهد.

پس زیرنویس‌ها، lower thirdها و متنِ چسبیده به تصویر (burned-in) را بخشی از ساخت در نظر بگیرید، نه یک مرحلهٔ آخرِ کار. اول فریم‌هایی را که اطلاعات حمل می‌کنند بررسی کنید—در زبانی که بیشترین افزایش طول را دارد—و چیدمانِ راست‌به‌چپ را قبل از هر رندر نهایی کنید، نه بعد از آن. چون هر نسخه از همان کاتِ قفل‌شده می‌آید، زمان‌بندی تصویر ثابت می‌ماند؛ بنابراین یک ادعا یا یک نوشتهٔ حقوقی (legal super) همچنان روی همان فریمی می‌نشیند که مشتری تأیید کرده، و اصلاح یک کپشن یعنی رندرِ مجددِ یک زبان، نه بازسازیِ کل مجموعه.

تیم‌های بومی‌سازی و دوبله چگونه از VisionStory استفاده می‌کنند

هر مرحلهٔ زیر از یک کاتِ منبع شروع می‌شود که مشتری آن را قفل کرده است، و در هر مرحله مشخص می‌شود پیش از تحویل و صدور صورتحسابِ هر نسخه، چه چیزی هنوز باید توسط کسی از سمت مشتری تأیید شود.

قبل از تحویل هر نسخه، بازبینِ داخل کشورِ مشتری اصطلاحات، عبارت‌های بازبینی‌شدهٔ حقوقی، واحدها و تناسب فرهنگی را تأیید می‌کند؛ و تهیه‌کنندهٔ شما تأیید می‌کند که مجوز صدا (voice release) زبان‌ها، کانال‌ها و مدت‌زمانی را که این نسخه قرار است در آن‌ها استفاده شود پوشش می‌دهد.

  1. 01

    کاتِ منبعِ قفل‌شده را به همهٔ زبان‌های سفارش‌شده تبدیل کنید

    کاتِ منبعی را که مشتری تأیید کرده به AI Video Translator بدهید تا نسخه‌های دوبله‌شده و دارای لب‌خوانی هماهنگ را در 88 زبان برگرداند، در حالی که ترتیب شات‌ها، زمان‌بندیِ متن‌های روی تصویر و خودِ تصویر دقیقا همان‌طور که تأیید شده باقی می‌ماند. اول کات را قفل کنید. ویرایشِ دوباره بعد از آن، همهٔ زبان‌هایی را که ساخته‌اید و همهٔ دورهای بازبینی‌ای را که برایشان هزینه شده بی‌اعتبار می‌کند. قبل از اینکه چیزی رندر شود، واژه‌نامه را روی اسکریپت‌ها اعمال کنید؛ بعد هر نسخه را «کاندید بازبینی» بدانید نه یک خروجیِ نهایی.

    ابزار مترجم ویدیوی هوش مصنوعی
    مترجم ویدیوی هوش مصنوعی
    از یک ویدیوی منبعِ تأییدشده، نسخه‌های زبانی دوبله‌شده و دارای لب‌خوانی هماهنگ بسازید.
  2. 02

    گویندهٔ خودِ مشتری را به زبان‌هایی ببرید که هرگز برایشان ضبط نکرده است

    شبیه‌سازی صدا یک ضبطِ مجاز از مجری، بنیان‌گذار یا سخنگو را به یک صدای قابل‌استفادهٔ مجدد تبدیل می‌کند تا همان شخص در بازارهایی که هرگز برایشان وارد استودیو نشده، طوری به نظر برسد که انگار صحبت می‌کند. آن ضبط باید به‌صورت مکتوب توسط صاحب صدا مجاز شمرده شود و مجوز باید زبان‌ها، کانال‌ها و مدت‌زمان را مشخص کند، نه اینکه صرفا یک رضایت کلی باشد. اگر هیچ مجوزی وجود ندارد، به‌جایش از بین 1,000+ صدا در کتابخانه انتخاب کنید و به مشتری بگویید کدام نسخه‌ها از صدای انتخابی استفاده می‌کنند.

    ابزار شبیه‌سازی صدا
    شبیه‌سازی صدا
    از یک ضبط منبعِ مجاز، یک صدای قابل‌استفادهٔ مجدد بسازید.
  3. 03

    صدای منبعی را تمیز کنید که مشتری واقعاً برایتان فرستاده است

    مواد منبعی که مشتری ارائه می‌کند به‌ندرت مثل استودیو تمیز است: اتاق جلسه با صدای بلند تهویه، شلوغیِ کفِ نمایشگاه، یا ضبطِ موبایلی از بازدیدِ سایت. حذف نویز آن پس‌زمینه را کم می‌کند و در عین حال گفتار را واضح و قابل‌فهم نگه می‌دارد؛ و این مهم است چون اجرای منبع همان چیزی است که همه نسخه‌های زبانی بر اساس آن ساخته می‌شوند. این یک ترمیم است، نه نجات. وقتی یک جمله آن‌قدر زیر صداهای دیگر پنهان شده یا آن‌قدر بریده شده که قابل‌بازیابی نیست، همان اول بگویید و به‌جای تحویل ادعایی که هیچ‌کس نمی‌شنود، درخواست ضبطِ مجدد کنید.

    ویژگی حذف نویز
    حذف نویز
    در حالی که گفتار واضح و قابل‌فهم حفظ می‌شود، نویز پس‌زمینه را کاهش دهید.
  4. 04

    صدا را عوض کنید بدون اینکه اجرایی را که مشتری تأیید کرده از دست بدهید

    گاهی اجرا درست است اما صدا اشتباه. مشتری ریتم و تأکیدها را تأیید کرده، اما بعد سن، جنسیت یا رنگِ صوتیِ دیگری می‌خواهد—یا گوینده‌ای که ضبط کرده برای بازاری که این نسخه قرار است در آن منتشر شود مجوز ندارد. تغییر صدا صدای یک ضبطِ موجود را جایگزین می‌کند، در حالی که زمان‌بندی و اجرای اصلی دست‌نخورده می‌ماند؛ پس یک اصلاحِ دقیقه‌نودی برایتان هزینهٔ یک جلسهٔ جدید نمی‌تراشد. صدای هدفِ شبیه‌سازی‌شده هم به همان مجوزِ مستندِ صدای منبع نیاز دارد.

    ویژگی تغییر صدا
    تغییر صدا
    صدای خروجیِ یک ضبطِ موجود را تغییر دهید، در حالی که زمان‌بندی و اجرای اصلی حفظ می‌شود.
  5. 05

    مسترهایی تحویل دهید که با مشخصات پلتفرمِ مشتری جور است

    کارهای بومی‌سازی اغلب از هر چیزی شروع می‌شوند که از مشتری باقی مانده: خروجیِ فشرده از یک آژانس قبلی، فایلی که از یک پلتفرم برداشته شده، یا مسترِ یک کمپین قدیمی. ابزار ارتقای ویدیوی هوش مصنوعی وضوح تصویر را تا 4K بالا می‌برد تا هر زبان به‌عنوان مسترِ تحویل خارج شود، نه یک کپیِ واضحاً نرم‌تر از زبانِ اصلی. اول فریم‌هایی را بررسی کنید که حامل اطلاعات‌اند—مثل نوشته‌های حقوقی روی تصویر، متنِ بسته‌بندی و جزئیات محصول—و اگر منبع فراتر از ترمیم است، همان را اعلام کنید به‌جای اینکه با آپ‌اسکیل دورش بزنید.

    ابزار ابزار ارتقای ویدیوی هوش مصنوعی
    ابزار ارتقای ویدیوی هوش مصنوعی
    یک ویدیوی کم‌وضوحِ موجود را برای خروجی نهایی شارپ‌تر تا 4K آپ‌اسکیل کنید.

سوالات متداول

  • با یک نسخهٔ نهاییِ قفل‌شده از ویدیو که مشتری تثبیت کرده و یک واژه‌نامه شروع می‌شود که نام‌های محصول، عبارت‌های بازبینی‌شدهٔ حقوقی و واحدها را پوشش می‌دهد. بعد مترجم ویدیوی هوش مصنوعی از همان یک منبع، نسخه‌های دوبله‌شده و دارای لب‌خوانی هماهنگ را برای زبان‌های سفارش‌داده‌شده تولید می‌کند و شبیه‌سازی صدا هم—وقتی گوینده به‌صورت کتبی مجوز داده باشد—می‌تواند گویندهٔ اصلی را در همهٔ آن‌ها حفظ کند. هر نسخه برای بازبینِ محلیِ مشتری ارسال می‌شود و اصلاحات به‌صورت رندرِ مجددِ همان یک زبان برمی‌گردد، نه یک جلسهٔ ضبطِ تازه.

کاربران عاشق VisionStory هستند

کشف کنید چرا تولیدکنندگان محتوا و بازاریابان به VisionStory برای نیازهای ویدیوی هوش مصنوعی خود اعتماد دارند. از امکانات قدرتمند تا تجربه کاربری آسان، جامعه ما از نتایجی که با VisionStory به دست می‌آورند، شگفت‌زده‌اند.

همه بررسی‌ها را در G2 ببینید