从提示词创建动态画面
描述主体动作、镜头运动、节奏和氛围,直接生成视频片段。
在线比较 AI 视频模型并直接生成视频,涵盖 Veo、Kling、Seedance、Wan、Grok 等主流视频生成模型。
最多 6 个参考素材 / JPG, PNG, WEBP / 每个 20MB
最多 1 个参考素材 / MP4 / 每个 50MB
不同 AI 视频模型支持的文生视频、图生视频、参考素材、时长、分辨率、音频和镜头控制并不相同。应围绕最终要交付的视频选择模型。
描述主体动作、镜头运动、节奏和氛围,直接生成视频片段。
需要保留首帧、人物外观或视觉风格时,使用图生视频工作流。
生成前比较时长、分辨率、画面比例、音频支持和积分成本。
进入模型工作流,可以查看支持的输入素材、输出设置和视频提示词案例。
720p, 1080p, 4k
Cost-efficient Google Veo 3.1 for text-to-video, first/last-frame, and material-reference generation.
打开模型720p, 1080p, 4k
Fast Google Veo 3.1 with synchronized audio for text, first/last-frame, material-reference, and extend.
打开模型720p, 1080p, 4k
Flagship Google Veo 3.1 Quality for text-to-video and first/last-frame generation with synchronized audio.
打开模型720p, 1080p, 4k
Cinematic Kling model with optional native audio, first/last-frame control, and 3-15 second generation.
打开模型720p, 1080p
Lower-cost Kling V3 Turbo model for rapid text-to-video and first-frame animation.
打开模型720p, 1080p, 4k
Any-input video model for turning text, images, audio, or clips into grounded, editable video.
打开模型360p, 720p, 1080p, 4k
KIE Gemini Omni 1.1 Flash for fast multimodal video generation, first/last frames, and video references.
打开模型480p, 720p
Fast creative video model for animating text or image ideas into short, shareable motion clips.
打开模型480p, 720p
参考图驱动的视频生成模型,支持 480p、720p 与 1 至 15 秒灵活时长。
打开模型720p, 1080p
Audio-video generation model for text, image, reference, and editing workflows with native lip-sync.
打开模型720p, 1080p
Physically realistic video generation from text, a first-frame image, or up to nine ordered reference images.
打开模型480p, 720p, 1080p, 4k
支持同步音频、最高 4K 输出及图片、视频、音频参考的高保真多模态视频模型。
打开模型480p, 720p
面向快速出片的 480p、720p 多模态视频模型,支持同步音频和多种参考素材。
打开模型480p, 720p
面向快速出片和低成本迭代的 480p、720p 视频模型,支持同步音频与多模态参考。
打开模型720p, 1080p
Multi-reference video model for text-to-video, image-to-video, first-last frame control, and instruction-based editing.
打开模型480p, 720p, 1080p
Alibaba Wan 3.0 for text, first/last-frame, and multimodal reference video generation up to 30 seconds.
打开模型480p, 720p, 1080p
Faster Alibaba Wan 3.0 Prime for text, first/last-frame, and multimodal reference video generation up to 30 seconds.
打开模型768p, 2k
MiniMax H3 for native-audio video generation from text, first/last frames, and multimodal references.
打开模型