
ห่วงโซ่อินพุตทั้งหมดอยู่ในหน้าเดียว
คลิปอวตารพูดได้ต้องการสามอย่าง: ใบหน้า เสียง และโมเดล ที่นี่ทั้งสามอย่างมาจากพื้นที่ทำงานเดียวกัน — สร้างภาพพอร์เทรตด้วย GPT Image 2 หรือ Seedream พิมพ์สคริปต์แล้วสังเคราะห์ด้วยหนึ่งใน 60 เสียงในตัว จากนั้นป้อนทั้งสองอย่างเข้า OmniHuman 1.5 ตรงๆ ทุกคลิปในหน้านี้ทำแบบนั้นเป๊ะ ตั้งแต่ต้นจนจบ โดยไม่ได้อัดเสียงแม้แต่วินาทีเดียวและไม่ได้อัปโหลดรูปคนจริงแม้แต่รูปเดียว











