เสียงและเสียงพูด
VisionStory รองรับ 88 ภาษา รวมถึง ภาษาอังกฤษ, จีน, สเปน, อาหรับ, โปรตุเกส, รัสเซีย, ญี่ปุ่น, ปัญจาบี, เยอรมัน, ฝรั่งเศส, เกาหลี, ตุรกี, ทมิฬ, เวียดนาม, ฮินดี, เบงกาลี, อูรดู, เปอร์เซีย, อิตาลี, อินโดนีเซีย, ไทย, มราฐี, เตลูกู, ยูเครน, มาเลย์, โรมาเนีย, โปแลนด์, ดัตช์, คุชราต และกันนาดา
VisionStory มีเสียงพูดให้เลือก 1,000+ แบบในคลังเสียง ซึ่งสามารถกรองตามเพศ อายุ และลักษณะการใช้งานได้ หากไม่พบเสียงที่ต้องการ คุณยังสามารถสร้างเสียง AI เฉพาะตัวได้โดยการอัปโหลดหรือบันทึกเสียงของคุณเอง
ตัวเลือกเสียงที่มีจำนวนน้อยในบางภาษาเกิดจากการปรับแต่งเสียงให้เหมาะสมกับภาษานั้นโดยเฉพาะ อย่างไรก็ตาม ระบบของ VisionStory รองรับการใช้เสียงหลัก เช่น ภาษาอังกฤษ เพื่อพูดได้หลายภาษา จึงช่วยให้คุณมีความยืดหยุ่นในการเลือกเสียงมากขึ้น
การโคลนเสียงคือการสร้างเสียง AI เฉพาะตัวที่เลียนแบบเสียงของบุคคลใดบุคคลหนึ่ง โดยการอัปโหลดหรือบันทึกเสียงพูดของบุคคลนั้น เพื่อให้ได้ผลลัพธ์ที่ดีที่สุด ควรบันทึกเสียงในสภาพแวดล้อมที่เงียบและชัดเจน
หากต้องการใช้เสียงที่โคลนในการสร้างวิดีโอ คุณจำเป็นต้องสมัครแพ็กเกจ Pro ขึ้นไป
การโคลนเสียงรองรับฟรีมากกว่า 32 ภาษา รายชื่อภาษาที่รองรับอาจมีการเปลี่ยนแปลงได้ กรุณาตรวจสอบฟังก์ชันโคลนเสียงเพื่อดูตัวเลือกภาษาล่าสุด หมายเหตุ: แม้การโคลนเสียงจะฟรี แต่หากต้องการนำเสียงที่โคลนไปใช้สร้างวิดีโอ จำเป็นต้องสมัครสมาชิกแพ็กเกจ
พรีวิวเสียงคือฟีเจอร์ที่ให้คุณสร้างเสียงพูดสำหรับวิดีโอพูดได้ของคุณล่วงหน้าก่อนสร้างวิดีโอจริง ฟีเจอร์นี้ช่วยให้คุณตรวจสอบเสียงพูด การออกเสียง และจังหวะหยุด เพื่อให้แน่ใจว่าตรงตามที่ต้องการ คุณสามารถปรับแต่งเสียงก่อนสร้างวิดีโอได้ สำหรับผู้สมัครสมาชิกทุกแผนสามารถใช้ฟีเจอร์นี้ได้ฟรี โดยโควต้าพรีวิวจะรีเซ็ตใหม่ทุกวัน หากใช้โควต้าประจำวันหมดแล้ว คุณสามารถซื้อโควต้าเพิ่มได้ด้วยเครดิต
ไอคอนนาฬิกาจับเวลาและฟีเจอร์ +0.5s ใช้สำหรับแทรกการหยุดพูดชั่วคราว 0.5 วินาทีในเสียงที่สร้างขึ้น คุณสามารถเพิ่มไอคอนนี้ต่อเนื่องกันหลายครั้งเพื่อสร้างช่วงหยุดที่ยาวขึ้นตามต้องการในวิดีโอของคุณ
การนำเข้า URL คือฟีเจอร์ที่ให้คุณนำเข้าเสียงจากลิงก์ โดยระบบจะดาวน์โหลดและแยกเสียงจาก URL ที่ระบุไว้ เพื่อนำไปใช้สร้างวิดีโอ ปัจจุบันรองรับลิงก์จาก YouTube และ TikTok หากต้องการให้รองรับเว็บไซต์อื่นเพิ่มเติม กรุณาติดต่อเรา นอกจากนี้ คุณยังสามารถใช้ฟีเจอร์เปลี่ยนเสียง (Voice Changer) เพื่อปรับแต่งเสียงที่นำเข้าได้โดยยังคงเนื้อหาเดิมไว้
ฟีเจอร์ลบเสียงรบกวนช่วยขจัดเสียงรบกวนจากพื้นหลังในไฟล์เสียงเมื่อคุณนำเข้า หรือบันทึกเสียง เพื่อให้ได้คุณภาพเสียงที่ชัดเจนยิ่งขึ้นสำหรับวิดีโอของคุณ ฟีเจอร์นี้ต้องมีการสมัครใช้งาน Pro Plan หรือสูงกว่าในการใช้งาน
ฟีเจอร์เปลี่ยนเสียงช่วยให้คุณสามารถปรับเปลี่ยนเสียงพูดในคลิปเสียง เพื่อสร้างเวอร์ชันเสียงที่แตกต่างและไม่ซ้ำใคร โดยยังคงเนื้อหาต้นฉบับไว้ ฟีเจอร์นี้สำหรับผู้ใช้ที่สมัครแพ็กเกจ Pro ขึ้นไปเท่านั้น
อารมณ์ของเสียงพูดจะถูกถ่ายทอดผ่านข้อความที่คุณใส่ เมื่อคุณใช้ข้อความที่แตกต่างกัน ระบบแปลงข้อความเป็นเสียง (TTS) จะปรับอารมณ์ให้เหมาะสมโดยอัตโนมัติ ดังนั้นจึงไม่จำเป็นต้องควบคุมเพิ่มเติม
เมื่อใช้ฟีเจอร์นาฬิกาจับเวลา แต่ละอันจะแทนการหยุดพูด 0.5 วินาที และคุณสามารถใช้ต่อเนื่องกันเพื่อสร้างช่วงหยุดที่ยาวขึ้นได้สูงสุด 3 วินาที อย่างไรก็ตาม ควรหลีกเลี่ยงการใช้หยุดพักต่อเนื่องกันเกิน 2 ครั้งในข้อความเดียว เพราะอาจทำให้ AI สร้างเสียงหรือเอฟเฟกต์ที่ไม่คาดคิดขึ้นมาได้