
장면을 이끄는 세 가지 방법
순수 프롬프트에는 텍스트-투-비디오, 첫 프레임에 움직임을 줄 때는 이미지-투-비디오, 야심 찬 브리프에는 참조-투-비디오: 요청 하나에 이미지 9장, 영상 클립 3개, 오디오 트랙 3개까지 넣고 프롬프트에서 "Image 1", "Video 1", "Audio 1"로 지칭합니다. 클립 속 인물을 교체하거나, 사진 속 얼굴을 유지하거나, 보이스 트랙으로 대사를 이끌 수 있습니다.
AI 비디오 모델
MiniMax H3(Hailuo 3)를 브라우저에서 실행하세요: 텍스트 프롬프트, 첫 프레임 이미지, 또는 혼합 참조—요청 하나에 이미지 9장, 영상 클립 3개, 오디오 트랙 3개까지—로 네이티브 오디오가 포함된 4–15초 클립을 768p 또는 2K로 생성합니다. 크레딧은 초 단위로 계산되며 생성 전에 표시됩니다.
MiniMax H3를 다른 영상 모델과 비교해 보세요. 같은 워크스페이스에서 클릭 한 번으로 전환됩니다.
CreateVision AI의 AI 비디오 모델로 사람들이 만들어내는 작품을 살짝 엿보세요.








MiniMax의 플래그십 영상 모델은 텍스트, 첫 프레임 이미지, 또는 이미지·영상·오디오 혼합 참조로부터 네이티브 오디오가 포함된 4–15초 클립을 768p 또는 2K로 생성합니다. API 키도, 별도 계정도 필요 없습니다.

순수 프롬프트에는 텍스트-투-비디오, 첫 프레임에 움직임을 줄 때는 이미지-투-비디오, 야심 찬 브리프에는 참조-투-비디오: 요청 하나에 이미지 9장, 영상 클립 3개, 오디오 트랙 3개까지 넣고 프롬프트에서 "Image 1", "Video 1", "Audio 1"로 지칭합니다. 클립 속 인물을 교체하거나, 사진 속 얼굴을 유지하거나, 보이스 트랙으로 대사를 이끌 수 있습니다.

H3는 네이티브 오디오가 포함된 영상을 출력하며, 참조 모드에서는 제공된 보이스 트랙을 입 모양까지 맞춰 연기할 수 있습니다. 인물 사진과 오디오 클립을 건네고 연기 방식을 설명하면 됩니다. 참조 오디오는 무료이며, 과금되는 입력 초가 추가되는 것은 영상 참조뿐입니다.

생성 전에 초당 요금이 표시되는 두 가지 출력 티어: 768p는 초당 55크레딧, 2K는 90크레딧입니다. 4초짜리 768p 초안은 220크레딧이며, 움직임이 마음에 들면 같은 브리프를 2K로 다시 실행해 납품용으로 만드세요. 화면 비율은 9:16 세로형부터 21:9 울트라와이드까지 6가지입니다.

H3는 최대 7,000자의 프롬프트를 받아들입니다. 카메라 움직임, 동선, 의상, 분위기까지 한 번에 담아내기에 충분한 길이입니다. 모든 생성물은 프롬프트와 파라미터가 히스토리에 그대로 남으므로, 잘 나온 장면을 다음 주에도 똑같이 재현할 수 있습니다.
계정 하나로, 이미지와 영상 생성 워크플로 전체를.
매일 제공되는 크레딧으로 무료로 시작하세요. 프리미엄 모델, 더 빠른 생성, 4K 출력은 업그레이드로 누리세요.
연간 청구 · $240/year
연간 청구 · $300/year
영화 같은 캐릭터 연기와 멀티모달 참조 작업에 강합니다. 첫 프레임에 움직임을 불어넣고, 참조 사진 속 인물의 정체성을 유지하고, 제공된 오디오를 입 모양까지 맞춰 연기합니다. 출력은 네이티브 오디오가 포함된 768p 또는 2K의 4–15초 영상입니다.
출력 1초당 768p는 55크레딧, 2K는 90크레딧이므로 4초짜리 768p 클립은 220크레딧입니다. 참조 영상의 입력 초도 같은 요율로 과금되며, 참조 이미지는 5장을 초과하면 장당 30크레딧이 추가되고, 참조 오디오는 무료입니다. 정확한 총액은 생성 전에 표시됩니다.
네. H3는 MiniMax가 자사 영상 서비스 Hailuo에 탑재한 바로 그 모델입니다. CreateVision AI에서는 MiniMax 계정이나 API 키 없이 브라우저에서 바로 실행할 수 있습니다.
이미지 최대 9장, 영상 클립 3개(각 2–15초, 합산 15초), 오디오 트랙 3개, 전체 자산은 최대 12개입니다. 프롬프트에서는 순서대로 "Image 1", "Video 1", "Audio 1"로 지칭하세요.
4부터 15까지 정수 초 단위이며, 768p 또는 2K입니다. 텍스트·참조 모드는 16:9, 21:9, 4:3, 1:1, 3:4, 9:16을 지원하고(참조 모드는 자동 맞춤도 가능), 이미지-투-비디오는 첫 프레임의 비율을 따릅니다.
4–15초짜리 캐릭터·대사 중심 장면이라면 H3가 더 합리적인 선택입니다. Seedance 2.5는 최대 30초까지 지원하고 요청당 훨씬 많은 참조 자산을 받는 대신 초당 단가가 높습니다. 저렴한 초안용으로는 여전히 Seedance 2.0 Mini가 가성비 픽입니다.
생성 전후 작업은 원클릭으로 — 다듬기, 스타일 변경, 공유까지.