AI 视频模型对比
对比 Sora、Veo、Kling、Runway、Pika、Luma、Hailuo、Seedance、Wan 等视频生成模型。重点看输入方式、最大时长、分辨率、镜头控制、一致性、价格单位和 API 可用性。
视频模型的比较维度
视频模型不是“上下文窗口 + token 价格”。需要按产物能力和生成成本建立新维度。
Text-to-Video
从提示词生成视频,重点看语义跟随、镜头控制、时长、分辨率和物理一致性。
PromptCameraPhysics
Image-to-Video
从首帧或参考图生成视频,重点看角色一致性、动作控制和风格稳定性。
Reference imageCharacterMotion
World Models
面向可交互场景、3D、机器人仿真和游戏环境。早期先追踪可用性和能力,不强行标价。
Simulation3DInteractive
优先收录对象
4OpenAI
Sora
OpenAI 视频生成模型,重点看 ChatGPT 套餐权益和未来 API 价格。
Text-to-videoOpenAI
Veo
Google 视频模型,需区分 Gemini App、Vertex AI 和 Ultra 权益。
VideoGoogle
Kuaishou
Kling
国内外都有使用入口,价格单位可能按 credits 和会员权益混合。
ChinaCredits
Runway
Runway Gen-4
成熟创作产品,适合优先补齐套餐、seconds 和 resolution。
CreativeAPI
目录追踪
V1 先追踪公开产品、单位和能力;精确价格经验证后进入套餐和 usage_prices 表。
产品
适合场景
Sora
OpenAI
text-to-videoimage-to-video
OpenAI-native video generation and ChatGPT workflows.
Veo
Google
text-to-videoimage-to-video
Google ecosystem video generation and API workflows.
Kling
Kuaishou
text-to-videoimage-to-video
High-quality clips with strong motion and character control.
Runway Gen-4
Runway
video generationediting
Professional creative teams and video iteration.
Pika
Pika
video generationeffects
Short clips, effects and social formats.
Luma Ray
Luma AI
video generationcinematic motion
Cinematic outputs and fast creative iteration.
Hailuo Video
MiniMax
text-to-videoimage-to-video
China-accessible video generation workflows.
Seedance
ByteDance / Volcano Engine
video generationAPI
Developer and enterprise video generation in ByteDance ecosystem.
Wan / Tongyi Wanxiang Video
Alibaba
text-to-videoimage-to-video
Alibaba Cloud and China-accessible video generation.
Vidu
ShengShu
video generationimage-to-video
Video generation with character and reference control.
计划追踪字段
价格单位:秒 / 次 / credit
最大时长与分辨率
文生视频 / 图生视频 / 视频生视频
镜头控制与角色一致性
API 可用性
商用许可与地区可用性
为什么先做视频
视频模型搜索需求增长快,公开模型和套餐正在快速增加。它是从文本 LLM 扩展到多模态模型对比的最佳第一步。