
입력 사슬 전체가 한 페이지에 있습니다
토킹 아바타 클립에는 세 가지가 필요합니다: 얼굴, 목소리, 그리고 모델. 여기서는 셋 다 같은 작업 공간에서 나옵니다 — GPT Image 2나 Seedream으로 인물 사진을 만들고, 대본을 입력해 내장 음색 60개 중 하나로 합성한 다음, 둘을 곧장 OmniHuman 1.5에 넣으면 됩니다. 이 페이지의 모든 클립이 정확히 그렇게, 처음부터 끝까지 만들어졌고, 오디오를 1초도 녹음하지 않았으며 실존 인물의 사진도 한 장 올리지 않았습니다.











