프롬프트로 움직임 생성
피사체 동작, 카메라 이동, 리듬과 분위기를 지정해 영상을 만듭니다.
Veo, Kling, Seedance, Wan, Grok 등 AI 동영상 모델을 비교하고 한 화면에서 동영상을 생성하세요.
최대 6개 참조 파일 / JPG, PNG, WEBP / 각 20MB
최대 1개 참조 파일 / MP4 / 각 50MB
AI 동영상 모델은 텍스트, 이미지와 참조 자료 지원뿐 아니라 길이, 해상도, 오디오와 카메라 제어가 다릅니다. 최종 영상에 맞춰 모델을 선택하세요.
피사체 동작, 카메라 이동, 리듬과 분위기를 지정해 영상을 만듭니다.
첫 프레임이나 인물 외형을 유지해야 할 때 이미지 투 비디오를 사용합니다.
생성 전에 길이, 해상도, 비율, 오디오 지원과 크레딧을 비교합니다.
각 모델의 입력 자료, 출력 설정과 동영상 프롬프트 사례를 확인할 수 있습니다.
720p, 1080p, 4k
Cost-efficient Google Veo 3.1 for text-to-video, first/last-frame, and material-reference generation.
모델 열기720p, 1080p, 4k
Fast Google Veo 3.1 with synchronized audio for text, first/last-frame, material-reference, and extend.
모델 열기720p, 1080p, 4k
Flagship Google Veo 3.1 Quality for text-to-video and first/last-frame generation with synchronized audio.
모델 열기720p, 1080p, 4k
Cinematic Kling model with optional native audio, first/last-frame control, and 3-15 second generation.
모델 열기720p, 1080p
Lower-cost Kling V3 Turbo model for rapid text-to-video and first-frame animation.
모델 열기720p, 1080p, 4k
Any-input video model for turning text, images, audio, or clips into grounded, editable video.
모델 열기360p, 720p, 1080p, 4k
KIE Gemini Omni 1.1 Flash for fast multimodal video generation, first/last frames, and video references.
모델 열기480p, 720p
Fast creative video model for animating text or image ideas into short, shareable motion clips.
모델 열기480p, 720p
480p 또는 720p에서 유연한 1-15초 출력의 이미지 가이드 비디오 생성.
모델 열기720p, 1080p
Audio-video generation model for text, image, reference, and editing workflows with native lip-sync.
모델 열기720p, 1080p
Physically realistic video generation from text, a first-frame image, or up to nine ordered reference images.
모델 열기480p, 720p, 1080p, 4k
동기화된 오디오, 최대 4K 출력 및 이미지, 비디오 또는 오디오 참조가 있는 고충실도 멀티모달 비디오.
모델 열기480p, 720p
동기화된 오디오와 유연한 참조 입력이 있는 더 빠른 480p 또는 720p 멀티모달 비디오 초안.
모델 열기480p, 720p
480p 또는 720p 출력, 동기화된 오디오 및 멀티모달 참조가 있는 저비용 비디오 초안.
모델 열기720p, 1080p
Multi-reference video model for text-to-video, image-to-video, first-last frame control, and instruction-based editing.
모델 열기480p, 720p, 1080p
Alibaba Wan 3.0 for text, first/last-frame, and multimodal reference video generation up to 30 seconds.
모델 열기480p, 720p, 1080p
Faster Alibaba Wan 3.0 Prime for text, first/last-frame, and multimodal reference video generation up to 30 seconds.
모델 열기768p, 2k
MiniMax H3 for native-audio video generation from text, first/last frames, and multimodal references.
모델 열기