Kling

Kling 3

Kling 3 是 Kling 视频模型的最新一代,业界首个在扩散阶段直接生成 3840×2160 原生 4K 而非后期超分的视频模型。该系列包括支持原生 4K、多镜头叙事与同步音频的核心模型,以及带角色与运动参考的 Motion Control 变体。

Kling 3.0 为 Kling 系列树立新的质量标杆。原生 4K 模式由模型直接输出 3840×2160 像素精度的画面——纹理更锐利、胶片颗粒更准确、头发布料皮肤等细节远胜任何超分算法。多镜头叙事在最长 15 秒内渲染多个独立剪辑,并保持镜头之间的空间连续性;Omni Native Audio 在生成画面的同一遍次内生成对口型的人声与环境音(支持英、中、日、韩、西五种语言)。标准与专业双档位在预算与画质之间灵活取舍。Motion Control 变体增加角色与运动参考输入,可同时精细控制外观与运动。

Illustrative sample of a native-4K Kling 3 cinematic still showing razor-sharp texture and film grain detail on the Astorie canvas
示意样例 — 代表性输出,并非模型逐帧渲染结果

Kling 3 变体

变体说明
Kling 3.0最新一代,支持原生 4K(3840×2160)、最长 15 秒多镜头叙事,以及支持五种语言的同步原生音频。
Kling 3.0 Motion Control角色和运动参考输入,可控的外观和运动。

支持的功能

文本生成视频
图像生成视频
视频到视频
参考图像
尾帧控制
分镜编辑
音频驱动

支持的宽高比

16:99:161:1

质量档位

STD
PRO
4K
Standard
Pro

更高的质量档位通常提供更好的细节和一致性,但需要更多积分和生成时间。

最适合

  • 影院、流媒体和大屏的原生 4K 电影级交付
  • 一次生成最长 15 秒、包含多个镜头的连续叙事
  • 画面与对口型人声、环境音同步生成
  • 具有复杂运动的物理准确场景
  • 可控的角色和运动工作流

优势

  • 业界首个原生 4K(3840×2160)生成,无需后期超分
  • 多镜头叙事,剪辑之间保持空间连续性
  • Omni Native Audio:与视频同步生成的五语种对口型人声与环境音
  • 3D 时空联合注意力机制,达到电影级物理与运动表现
  • 标准与专业双质量档位,预算灵活

局限性

  • 原生 4K 渲染时间长于 1080p
  • Motion Control 变体需要上传参考素材
  • 不支持视频到视频编辑模式(请使用 Kling O3 Video Edit)

使用技巧

将原生 4K 留给关键镜头和终版母版——先用 1080p 出草稿以加快迭代速度。
把多镜头提示当成一份小型分镜表(远景 → 中景 → 特写)来写,便于模型保持空间连续性。
启用 Omni Native Audio,一步获得带同步声音的完整视频输出。
Motion Control 变体需上传清晰的角色参考和运动片段以同时引导外观和动作。

Astorie 上使用 Kling 3

Astorie 的无限画布上将 Kling 3 与其他 AI 模型连接使用。无需 GPU,免费开始。

免费开始

相关功能

操作指南

延伸阅读

相关视频模型

返回所有视频模型