
모든 샷에 적용되는 아이덴티티 잠금
사진을 한 장 — 또는 최대 일곱 장까지 — 업로드하면 Grok Imagine이 이를 아이덴티티 앵커로 삼습니다. 같은 얼굴, 같은 체형, 같은 실루엣이 모든 컷에 그대로 이어지죠. 화제가 된 "같은 배우, 아홉 가지 영화 장르" 몽타주 영상을 만들어낸 엔진이 바로 이것이며, 제품이나 캐릭터의 일관성을 유지하는 데도 똑같이 잘 작동합니다.
xAI의 Grok Imagine 1.5로 사진을 살아 있는 장면으로 바꿔 보세요. 최대 7장의 레퍼런스 이미지로 아이덴티티 잠금이 적용된 움직임을 만들고, 플랫폼에서 가장 낮은 초당 가격으로 사운드 포함 1-15초 클립을 받아 보세요.
Generated here on 15 August 2026, first take. The source photo and reference clip are themselves outputs from models on this site — no stock footage.
The woman breathes gently and blinks, a few strands of hair drift in the light, subtle head turn toward camera, natural micro-expressions, the window light steady behind her.
Rain continues to fall on the wet cobblestones, steam drifting up from the grate, the sodium lamp flickering faintly, a slow push-in down the alley.
같은 워크스페이스에서 Grok Imagine 1.5를 다른 비디오 모델과 비교하고, 클릭 한 번으로 전환하세요.
xAI의 이미지-투-비디오 모델이 사진을 사운드가 포함된 1-15초 클립으로 움직이게 만듭니다. 최대 7장의 레퍼런스 이미지로 모든 샷에서 같은 인물을 알아볼 수 있게 유지하며, 초당 비용은 플랫폼의 어떤 비디오 모델보다도 낮습니다.

사진을 한 장 — 또는 최대 일곱 장까지 — 업로드하면 Grok Imagine이 이를 아이덴티티 앵커로 삼습니다. 같은 얼굴, 같은 체형, 같은 실루엣이 모든 컷에 그대로 이어지죠. 화제가 된 "같은 배우, 아홉 가지 영화 장르" 몽타주 영상을 만들어낸 엔진이 바로 이것이며, 제품이나 캐릭터의 일관성을 유지하는 데도 똑같이 잘 작동합니다.

초당 가격이 저희가 호스팅하는 어떤 모델보다도 낮게 시작합니다 — 잔액을 신경 쓰지 않고 자유롭게 반복하고, 밈 포맷을 실험하고, 소셜 클립을 대량으로 만들 수 있는 수준이죠. 정확한 크레딧 비용은 매번 생성 전에 표시되며, 실패한 생성은 자동으로 환불됩니다.

클립에는 생성된 오디오가 함께 담겨 나옵니다 — 주변음, 효과음, 그리고 프롬프트에 적어 넣은 대사까지. 한 번의 생성만으로 세로형이든 와이드형이든 피드에 바로 게시할 수 있는 결과물을 얻습니다.

480p 또는 720p에서 1초부터 15초까지 원하는 길이를 고르고, 비율은 auto, 1:1, 16:9, 9:16, 3:2, 2:3 중에서 선택하세요 — auto는 사진의 프레이밍을 그대로 따릅니다. 짧은 렌더링은 약 1분 만에 돌아오므로 빠른 템포의 크리에이티브 테스트가 현실적으로 가능해집니다.
빈 프롬프트 칸에서 완성된 클립까지, 세 단계.
모델 선택기를 열어 Grok Imagine 1.5 모델을 고르세요. 크레딧을 쓰기 전에 크레딧 비용, 해상도 옵션, 길이 제한이 패널에 표시됩니다.
피사체와 동작, 그리고 카메라가 어떻게 움직이는지 적으세요. 특정 이미지에서 시작하고 싶다면 첫 프레임을 첨부하세요.
클립을 내려받고, 길이를 늘리고, 추가 편집으로 넘기세요. 프롬프트와 모델, 설정은 기록에 그대로 남습니다.
계정 하나로, 이미지와 영상 생성 워크플로 전체를.
무료 등급의 매일 크레딧으로 Grok Imagine 1.5 모델을 쓰거나, 업그레이드해 프리미엄 모델과 더 빠른 생성, 4K 출력을 누리세요.
연간 청구 · $240/year
연간 청구 · $300/year
Grok Imagine 1.5는 xAI의 이미지-투-비디오 모델입니다. 사진 1-7장을 업로드하고 원하는 움직임을 설명하면, 사진 속 인물이나 피사체를 끝까지 알아볼 수 있게 유지한 사운드 포함 1-15초 클립을 돌려줍니다.
아니요 — Grok Imagine 1.5는 항상 최소 한 장의 이미지에서 시작합니다. 순수한 텍스트-투-비디오를 원하시면 Seedance 2.0 Fast나 Wan 2.7을 사용하세요. 먼저 정지 이미지를 생성한 뒤 여기서 움직이게 만들 수도 있습니다.
선택한 해상도(480p 또는 720p)의 출력 1초당 요금입니다 — 플랫폼의 어떤 비디오 모델보다도 낮은 초당 요율이죠. 정확한 비용은 생성 전에 표시되며, 실패한 생성은 자동으로 환불됩니다.
레퍼런스 이미지를 최대 7장까지 업로드하고 프롬프트에서 언급하세요(예: "Reference Image 1 as identity lock" — 레퍼런스 이미지 1을 아이덴티티 잠금으로 지정). 모델이 해당 피사체의 얼굴과 실루엣을 클립의 모든 샷에서 일관되게 유지합니다.
네 — 클립에는 생성된 사운드가 포함됩니다. 대사와 사운드 지시를 프롬프트에 직접 적어 넣을 수 있습니다.
영상 생성에 실패하면 크레딧이 자동으로 환불됩니다.
생성 전후 작업은 원클릭으로 — 다듬기, 스타일 변경, 공유까지.
Enabled upstream content-safety filtering for all Grok Imagine generations.
Grok Imagine 1.5 integrated for image-to-video generation.