Đầu vào và đầu ra gồm những gì

Dành cho ai

Các đội lập trình nội dung, phân phối và quản lý phiên bản

Các chủ sở hữu bản quyền, studio, mạng lưới và dịch vụ streaming đưa chính thư viện nội dung của mình vào thị trường mới, thay vì để nhà cung cấp ngôn ngữ báo giá một dự án bản địa hóa cho danh mục của người khác.

Điểm xuất phát của bạn

Bản master đã khóa và danh sách người nói

Bản dựng phát hành của từng tập, danh sách ai nói trong đó và văn bản đồng ý cho mọi giọng của nghệ sĩ biểu diễn mà bạn dự định tái tạo. VisionStory không xử lý việc xin/giải phóng quyền thay bạn.

Bạn nhận được gì

Bản lồng tiếng, đồng bộ khẩu hình theo từng thị trường

Mỗi lãnh thổ có 1 phiên bản đã được rà soát trong bất kỳ ngôn ngữ nào trong 88 ngôn ngữ, mỗi người nói giữ đúng giọng của họ, sẵn sàng cho quy trình duyệt của bạn và để bạn tự bàn giao cho nền tảng và đài phát sóng.

Điều gì thay đổi khi bạn tự làm phiên bản hóa trên chính thư viện của mình

Hầu hết các đội ngũ tìm đến trang này sau một lần “vấp” rất cụ thể: một mùa phim ra mắt ở thị trường mới và âm thanh có gì đó sai theo cách mà bảng tính không bao giờ ghi lại được. Với chủ sở hữu bản quyền, thư viện là của bạn, nên câu hỏi lặp lại là làm sao giữ cho cả một “line-up” nhất quán suốt nhiều tháng phát hành — chứ không phải cách định giá một dự án đơn lẻ cho khách hàng.

Cho mỗi người nói trong cảnh một giọng riêng

Trong phòng có 3 người. Host phản biện, khách mời nói lấn lời cô ấy, và giọng thứ 3 vang lên từ màn hình chậm hơn nửa giây. Đưa qua một hệ thống được xây cho thuyết minh, cả 3 sẽ bị “gom” thành một người biểu diễn giả giọng như đang trò chuyện. Lời thoại vẫn còn. Nhưng cảnh thì không — và khán giả ở thị trường đó sẽ nghe một phiên bản chương trình mà chẳng ai phê duyệt nếu đó là ngôn ngữ gốc.

Lồng tiếng video đa người nói coi dàn diễn viên đúng là dàn diễn viên. Mỗi người nói được gán một giọng riêng ở từng ngôn ngữ và giữ nhất quán, với đồng bộ khẩu hình bám theo hình ảnh để phản ứng vẫn “đúng mặt” người tạo ra nó. Bạn quyết định mức độ giống với diễn viên gốc: một chất giọng ấm hơn cho host, hoặc giản dị hơn cho chuyên gia phân tích chỉ xuất hiện ở đoạn mở đầu. VisionStory tạo ra các phiên bản; còn quyết định casting vẫn thuộc về những người hiểu rõ chương trình.

Để tập 14 nghe giống như tập 1

Không ai phàn nàn về tập 1. Lời phàn nàn xuất hiện ở tập 4, khi bản tiếng Đức trả về và nhân vật chính nghe như một người khác — vì lô đó được đặt sau 8 tuần, và người xử lý đã chọn theo hướng “hợp lý” nhưng không có hồ sơ của lựa chọn trước. Khán giả xem cả mùa trong một cuối tuần sẽ nghe ra “đường nối” ngay lập tức. Đội ngũ phải đứng ra giải trình thường chỉ biết chuyện từ một thread hỗ trợ, chứ không phải từ bất kỳ ai trong pipeline.

Cố định giọng cho từng người nói xuất hiện lặp lại sẽ biến việc đó thành quyết định bạn chỉ cần làm một lần. Một giọng nhân bản từ bản ghi đã được ủy quyền, hoặc một lựa chọn trong thư viện 1,000+ giọng, sẽ trở thành “mục” của nhân vật đó trong ngôn ngữ đó và được tái sử dụng khi lô tập tiếp theo chạy qua. Hãy lưu mapping người nói → giọng nói → ngôn ngữ ở nơi đội của bạn có thể tra được, vì một mùa kéo dài cả năm phát hành sẽ lâu hơn cả người đã thiết lập nó.

Khơi thông danh mục cũ đang mắc kẹt vì chi phí

Có hàng trăm giờ nội dung đang “nằm trên kệ”: chương trình đã hoàn thiện, nhạc đã được clearance, quyền vẫn còn hiệu lực nhiều năm. Chúng chưa vào thị trường mới vì một lý do: báo giá lồng tiếng quá cao, không ai có thể biện minh cho một tựa đã hoàn vốn. Thế là thư viện cứ nằm yên, và mọi cuộc trao đổi gia hạn ở khu vực đó lại bắt đầu từ cùng một danh sách tựa ngắn.

Khi lồng tiếng được triển khai nội bộ từ các bản master đã khóa mà bạn đang nắm giữ, bài toán chi phí sẽ thay đổi và các tựa cũ lại đáng để làm phiên bản. Hãy bắt đầu từ những tập có âm thanh rõ nhất và ít đoạn chồng lời nhất, vì chúng trả về cần ít rà soát nhất, rồi mở rộng dần. Vẫn có 2 “cửa” cần vượt qua và cả hai đều không phải kỹ thuật: quyền gốc của bạn phải bao phủ các bản phái sinh lồng tiếng ở lãnh thổ đó, và bất kỳ giọng nghệ sĩ biểu diễn nào bạn tái tạo đều cần sự đồng ý có phạm vi tới mức đó.

Theo dõi “cây phiên bản” trước khi nó bám lấy bạn

Một tập hiếm khi chỉ còn là một tập. Một cảnh bị cắt cho một đài, một thương hiệu bị che cho đài khác, một bảng phân loại độ tuổi được thêm ở lãnh thổ thứ ba — và mỗi bản cắt đó lại cần âm thanh riêng và file phụ đề riêng. Sau 6 tháng, một yêu cầu “phiên bản tiếng Pháp hiện tại” có đến 3 câu trả lời đều có vẻ đúng, còn người biết cái nào chính xác thì đang nghỉ phép. Không có gì lạ đời ở đây; chỉ là số lượng phiên bản nhân lên nhanh hơn mọi kế hoạch.

Kỷ luật giúp mọi thứ “giữ form” là chỉ lồng tiếng từ một bản dựng đã khóa, và khi bản dựng thay đổi thì dựng lại thay vì vá chắp. Mỗi phiên bản theo lãnh thổ được tạo từ một source master có tên rõ ràng, nên nếu có bản trim đến muộn, bạn sẽ phát hành lại các phiên bản bị ảnh hưởng từ master mới thay vì chắp âm thanh cũ lên đó. VisionStory trả lại các file kèm nguồn mà chúng được tạo ra; còn cách đặt tên, thời hạn quyền và hồ sơ phiên bản nào đang live vẫn nằm trong hệ thống quản lý media mà đội phân phối của bạn đang vận hành.

Chốt quyền giọng nói trước khi nhân bản bất kỳ ai

Yêu cầu nghe có vẻ vô hại trong một buổi họp sản xuất: giữ giọng người dẫn chuyện bằng tiếng Tây Ban Nha, khán giả đã quen rồi. Rồi có người hỏi hợp đồng gốc thực sự nói gì về việc tái tạo tổng hợp, và câu trả lời thường là: nó được viết từ trước khi bất kỳ ai phải nghĩ đến chuyện đó. Trong khi đó, nghệ sĩ có quan điểm riêng, người đại diện có quan điểm khác, còn một tựa phim đã được quảng bá cho một ngày phát hành thì đang phải chờ cả hai bên.

Hãy xem sự đồng ý là một phần của sản phẩm bàn giao. Nhân Bản Giọng Nói tại VisionStory yêu cầu một bản ghi mà người nói đã ủy quyền cho bạn sử dụng; còn với thư viện chương trình, giấy ủy quyền đó nên nêu rõ lãnh thổ áp dụng, thời hạn, các tựa phim được bao phủ và điều gì xảy ra khi giấy phép hết hiệu lực. Khi sự đồng ý bị thiếu hoặc không rõ ràng, hãy dùng một giọng trong thư viện thay thế để chương trình vẫn chạy. Bước kỹ thuật chỉ mất vài phút; giấy tờ mới là thứ quyết định một phiên bản có thể tiếp tục được phát hành trên thị trường hay không.

Cách đội ngũ lập lịch và phân phối dùng VisionStory

Bắt đầu từ bản master đã khóa và danh sách ai là người nói trong đó, rồi ghi chú ở từng bước những gì trưởng nhóm phân phối tại địa phương vẫn cần duyệt trước khi một phiên bản đến được nhà đài, nền tảng hoặc khán giả.

Trước khi phát hành bất kỳ phiên bản nào, trưởng nhóm phân phối tại địa phương xác nhận lời thoại đã dịch, bản địa hóa văn hóa, cũng như yêu cầu phân loại và cắt dựng cho lãnh thổ đó; đồng thời xác nhận rằng sự đồng ý đứng sau từng giọng được nhân bản đều bao phủ khu vực này và trong thời hạn này.

  1. 01

    Tạo phiên bản từ master đã khóa, không phải bản cắt vẫn đang duyệt

    Trình Dịch Video AI lấy bản master nguồn mà đội của bạn đã khóa và tạo ra các phiên bản được lồng tiếng, đồng bộ khẩu hình cho 88 ngôn ngữ, trong đó mỗi người nói trong cảnh được giữ như một giọng riêng biệt. Chỉ làm việc từ bản cắt đã phát hành. Một phiên bản được tạo từ bản vẫn đang duyệt sẽ phải phát hành lại ngay khi có chỉnh sửa cắt gọn, và đến lúc đó file có thể đã nằm ở phía nhà đài. Hãy ưu tiên các thị trường có ngày phát hành theo hợp đồng trước, và luôn gắn tên master nguồn với mọi phiên bản được tạo ra từ nó.

    Công cụ Trình Dịch Video AI
    Trình Dịch Video AI
    Tạo các phiên bản ngôn ngữ được lồng tiếng và đồng bộ khẩu hình từ một video nguồn đã được duyệt.
  2. 02

    Cố định giọng cho từng người nói xuất hiện lặp lại

    Nhân Bản Giọng Nói tạo một giọng nói có thể tái sử dụng từ bản ghi mà nghệ sĩ đã ủy quyền, nhờ vậy cùng một host vẫn nghe như đúng người đó ở tập 1 lẫn tập 20. Trước khi nhân bản bất kỳ ai, hãy xác nhận sự đồng ý bao phủ lãnh thổ, thời hạn và mục đích sử dụng này, và lưu cùng tựa phim thay vì để trong hộp thư của ai đó. Khi không có sự đồng ý, hãy chọn trong hơn 1 000 giọng của thư viện và ghi lại lựa chọn gắn với người nói đó. Dù theo cách nào, việc ánh xạ người nói → giọng nói → ngôn ngữ chính là nền móng để dựng nên cả một mùa.

    Công cụ Nhân Bản Giọng Nói
    Nhân Bản Giọng Nói
    Tạo một giọng nói có thể tái sử dụng từ bản ghi nguồn đã được ủy quyền.
  3. 03

    Làm sạch âm thanh nguồn gây “đánh nhau” với bản lồng tiếng

    Âm thanh hiện trường hiếm khi sạch. Âm nền phòng, tiếng điều hòa, xe cộ dưới cửa sổ, mic cài áo cọ vào áo khoác: tất cả nằm dưới phần thoại mà bạn đang tạo phiên bản, và tệ nhất đúng vào những tư liệu cũ mà bạn muốn đẩy đi trước. Khử Tiếng Ồn hạ lớp nền đó trong khi vẫn giữ lời nói rõ ràng, để bản đọc tham chiếu đưa vào lồng tiếng là màn trình diễn chứ không phải âm phòng. Hãy áp dụng bước này cho những tập bị gắn cờ trong khâu review, không phải cho mọi thứ, và nghe thử một đoạn có hai người nói chồng lời trước khi chấp nhận kết quả.

    Tính năng Khử Tiếng Ồn
    Khử Tiếng Ồn
    Giảm tiếng ồn nền trong khi vẫn giữ lời nói rõ ràng, dễ nghe.
  4. 04

    Sửa hình ảnh lưu trữ mà không dịch chuyển một khung hình nào

    Các tựa phim trong catalogue mang theo “di chứng” từ cách chúng từng được hoàn thiện: bản chuyển mềm, artefact nén từ lần bàn giao cũ, nhiễu ở mọi cảnh tối. Công Cụ Nâng Cấp Video AI loại bỏ mờ, nhiễu và hư hại do nén mà không thay đổi timeline hay âm thanh — điều quan trọng nhất ở đây, vì bản lồng tiếng đã đồng bộ với hình sẽ vẫn giữ đồng bộ. Hãy kiểm tra gương mặt ở cảnh cận và mọi chữ hiển thị trên màn hình mà từng lãnh thổ cần đọc, và chấp nhận rằng có những tựa phim “hết cứu” thì либо remaster cho đúng chuẩn, hoặc loại khỏi kế hoạch phát hành.

    Công cụ Công Cụ Nâng Cấp Video AI
    Công Cụ Nâng Cấp Video AI
    Khôi phục độ mờ, nhiễu và các lỗi do nén trong footage sẵn có mà không thay đổi thời lượng hay âm thanh.
  5. 05

    Bàn giao đúng độ phân giải mà nền tảng yêu cầu

    Thỏa thuận với nền tảng thường quy định rõ họ sẽ chấp nhận chuẩn nào, và một bản master SD từ 10 năm trước thường không đạt. Công Cụ Nâng Cấp Video AI tạo ra bản master bàn giao lớn hơn, sạch hơn lên đến 4K từ phiên bản bạn đã phục hồi, để một tựa phim cũ có thể phát hành theo cùng thông số với danh mục hiện tại thay vì bị xếp ở hạng thấp hơn. Hãy chạy bước này sau cùng — sau khi sửa hình và sau khi các phiên bản âm thanh đã được duyệt — rồi kiểm tra ngẫu nhiên chuyển động và tông da ở kích thước đầy đủ trước khi file được gửi lên nền tảng.

    Công cụ Công Cụ Nâng Cấp Video AI
    Công Cụ Nâng Cấp Video AI
    Nâng cấp video độ phân giải thấp sẵn có để cho ra bản xuất sắc nét hơn, lên đến 4K.

Câu hỏi thường gặp

  • Mỗi người nói được xem như một phần riêng thay vì gộp vào một track thuyết minh. Bạn gán một giọng riêng cho từng người nói ở từng ngôn ngữ và giữ nhất quán xuyên suốt, còn đồng bộ khẩu hình sẽ “khóa” lời thoại lồng tiếng vào hình để phản ứng vẫn rơi đúng vào gương mặt đã tạo ra nó. Lời thoại chồng lên nhau là ca khó nhất trong mọi quy trình lồng tiếng, vì vậy hãy review các đoạn đó trước: nếu một khoảnh khắc crosstalk vẫn nghe rõ trong bản lồng tiếng, thì các cảnh bình tĩnh hơn gần như chắc chắn cũng sẽ ổn.

Người dùng yêu thích VisionStory

Khám phá lý do tại sao các nhà sáng tạo nội dung và marketer tin tưởng VisionStory cho nhu cầu video AI của họ. Từ các tính năng mạnh mẽ đến trải nghiệm người dùng dễ dàng, cộng đồng của chúng tôi không ngừng khen ngợi kết quả đạt được với VisionStory.

Xem tất cả đánh giá trên G2