Kling

Kling O3

Kling O3(Video 3.0 Omni)是 Kling 的统一多模态旗舰——由四个变体组成,将文本、图像、视频与音频输入融合到同一个模型。能力覆盖文本生成视频、带尾帧控制的图像生成视频、角色参考生成与提示引导的视频到视频编辑(Omni Edit),与 Kling 3.0 共用同一架构,支持原生 4K 最高 60fps 与多镜头叙事。

Kling O3 系列围绕"参考输入密集 + 多模态"的工作流构建。基础 O3 模型支持文本生成视频和带尾帧控制的图像生成视频,可同时锁定首帧和尾帧以精确规划运动。O3 Reference 增加角色参考图像以在片段间保持外观一致,并支持对单个元素的语音控制。O3 Video Edit(Omni Edit)可对现有素材进行提示引导的角色、环境或特定元素替换,同时保留原始运动与时序。O3 Video Ref 将视频到视频编辑与参考图像结合,提供最大程度的控制。所有变体共享 Kling 3.0 的原生 4K(3840×2160)、最高 60fps、16-bit HDR、最多 6 个镜头的多剪辑(最长 15 秒),以及英、中、日、韩、西五种语言的同步原生音频,全部提供标准与专业双档位。

Illustrative sample of a Kling O3 multimodal still showing a reference-consistent character in a restyled 4K scene on the Astorie canvas
示意样例 — 代表性输出,并非模型逐帧渲染结果

Kling O3 变体

变体说明
Kling O3文本和图像生成视频,支持尾帧(末帧)控制。
Kling O3 Reference增加角色参考图像,跨生成保持外观一致。
Kling O3 Video Edit视频到视频编辑,在保留运动的同时转换风格。
Kling O3 Video Reference视频到视频编辑,带参考图像引导风格和角色控制。

支持的功能

文本生成视频
图像生成视频
视频到视频
参考图像
尾帧控制
分镜编辑
音频驱动

支持的宽高比

16:99:161:1auto

质量档位

STD
PRO
4K

更高的质量档位通常提供更好的细节和一致性,但需要更多积分和生成时间。

最适合

  • 需要在多个片段间保持角色或产品识别度的参考密集型工作流
  • 可控的首尾帧过渡和变形效果
  • 通过 Omni Edit 对现有素材做风格转换与元素替换
  • 原生 4K 60fps 多镜头序列的电影级交付
  • 需要文本 + 图像 + 视频 + 音频多模态输入的制作管线

优势

  • 统一多模态模型:文本、图像、视频与音频共用同一架构
  • 与 Kling 3.0 共享的原生 4K(3840×2160)、最高 60fps、16-bit HDR
  • 一次最多 6 个镜头、最长 15 秒的多剪辑叙事
  • 尾帧控制实现精确的首尾运动规划
  • Omni Edit:替换角色、环境或特定元素的同时保留原始运动
  • 参考图像保持角色一致,并可对元素进行语音控制
  • 英、中、日、韩、西五种语言的原生音频
  • 四个变体均提供标准与专业双档位

局限性

  • 每个变体有特定用途——没有单一模型能做所有事
  • Video Edit 变体需要现有素材作为输入
  • 原生 4K 与专业档位会显著拉长长片段的总渲染时间
  • 若仅做提示驱动的电影级生成,原生 Kling 3.0 的画质上限往往更高

使用技巧

在基础 O3 上使用尾帧控制实现平滑的 A 到 B 变形或产品展示。
从多个角度上传特写参考图像以获得最佳角色匹配。
使用 Omni Edit 在保留原始运动的前提下替换现有素材中的角色或环境。
在统一管线中结合 O3 Reference 用于生成、O3 Video Ref 用于编辑。
需要参考输入或视频编辑时选 O3,需要纯提示驱动的极致电影画质时选原生 Kling 3.0。

Astorie 上使用 Kling O3

Astorie 的无限画布上将 Kling O3 与其他 AI 模型连接使用。无需 GPU,免费开始。

免费开始

相关功能

操作指南

延伸阅读

相关视频模型

返回所有视频模型