AI 视频生成模型分为文生视频(text-to-video)与图生视频(image-to-video)。目前主流产品均已支持 1080P 及以上、5~10 秒时长的片段生成。

主流工具

  • Sora(OpenAI):以物理一致性与长镜头见长,生成效果逼真,通过 ChatGPT 提供
  • 可灵(快手):国内头部,图生视频表现稳定,支持运动控制与运镜,短视频创作者常用
  • Runway(Gen-3/Gen-4):老牌创意工具,适合影视级风格化与特效
  • Vidu(生数科技):国产自研,长时生成与多主体一致性表现不错
  • 即梦、海螺、Luma、Pika 等:各有侧重,按「运镜、一致性、时长、价格」对比即可

当前局限

  • 生成时长通常有限(5~15 秒),长片需要拼接与剪辑
  • 人物一致性、复杂动作仍有翻车概率,需多次抽卡
  • 物理规律偶尔出错(手部、液体、穿帮),商用前要人工审片

工作流建议:文案脚本 → 分镜 → 图生视频(用生成的关键帧做起点)→ 剪辑配音,比纯文生视频可控性高很多。