Kling

如何使用 Kling 3.0 创建 AI 短片

Kling 3.0 是第一个在扩散阶段就直接渲染原生 4K(3840×2160)的主流视频模型——不靠后处理放大——纹理、电影颗粒、头发、布料和皮肤的细节比任何放大器能找回的更精致。一部要进电影节投影厅的短片,这层细节地板很重要。Kling 还把 Omni Native Audio 烤进同一次生成(英文、中文、日文、韩文、西班牙文),对白唇形同步和环境声不用走独立音频链就能交付。

分步指南

1

按 4K 投放标准做故事板

因为 Kling 3.0 渲染真 4K,故事板帧也要能撑这层细节。用 Midjourney v7(风格化 200-400)或 GPT Image 1.5 设计模式以 4K 比例出故事板。把最强的几帧作为各 Kling 镜头的起始帧钉上。低分辨率故事板浪费 Kling 的细节地板。

2

按镜头选择 Standard 或 Pro 档

Kling 3.0 Standard 在成本和保真度之间平衡,适合铺陈镜头;Pro 把质感和运动保真度推得更高,用于主镜头。在 3-5 镜头电影节短片上,铺陈走 Standard,开场建立镜头和高潮走 Pro。渲染时间:Standard 90-150 秒,Pro 在 4K 下 180-240 秒。

3

为紧凑的角色连贯性用 Motion Control 变体

Kling 3.0 的 Motion Control 变体接收角色参考 + 一段运动参考片段——模型遵循参考的外形和参考片段的运动。对需要击中特定走位的反复出镜主角,把人物设定页 + 一段替身表演片段放进 Motion Control 节点。当动作是编排好的时,这比 Sora 2 的图像条件更紧凑。

4

写包含相机 + 音频 + 环境的提示词

因为 Kling 3.0 在同一遍渲染音频,提示词里要写出环境:"低机位移动镜头穿过一间烛光教堂,大理石上的脚步声回响,远处合唱团哼唱,远处管风琴轻奏,8 秒。"如果在提示词里写一行台词,Kling 还能生成唇形同步对白——用于高潮对白镜头很合适。

5

用多镜头时序处理连贯走位

Kling 3.0 支持一次最多 15 秒里包含数个不同剪辑且保留空间连贯性。两镜要读成一个连贯动作时(相机从特写后拉到中景)很有用。在提示词里明示剪辑点和角度:"前 5 秒:手部特写;接下来 5 秒:后拉到中景双人镜头;最后 5 秒:环绕到反打角度。"

6

直接 4K 导出到 NLE

Kling 3.0 返回 4K 剪辑后,送到序列构建器、加标题或调色,再作为原生 4K 序列导出到 Premiere、DaVinci 或 Final Cut。不需要外接放大——Kling 已经按电影节投影分辨率交付。Omni Native Audio 的原生音频烤盘如果合适就直接用。

提示词示例

带原生环境音的开场建立镜头。Kling 在同一次生成里烤进合唱和管风琴——不用单独 SFX 节点。

Low-angle dolly through a candlelit cathedral, footsteps echo on marble, distant choir hum, soft organ in the distance, 4K, 8 seconds

带原生唇形同步的对白节拍。台词短时很合适——Kling 在同一次生成里渲染嘴部运动。

Medium two-shot, the protagonist whispers "I knew you would come", soft golden key light, slight handheld breathing, ambient room tone, 6 seconds, lip-sync English

配得上 Pro 档的大收尾。长后拉镜头加音乐推升把模型推到极致。

Closing pull-out from a tight close-up to a wide aerial shot of the cathedral courtyard at dawn, music swells, 4K, 12 seconds, Pro tier

参数技巧

以原生 4K 渲染——Kling 3.0 的细节地板是它的核心价值。低分辨率浪费了它的优势。

铺陈用 Standard,主镜头用 Pro;质感差异在特写上最明显。

在提示词里描写环境和对白——Omni Native Audio 在同一次生成里把两者都渲染。

为紧凑的角色连贯性切到 Motion Control 变体,配人物参考 + 替身运动片段。

当两镜空间相连时,把它们装进一段 15 秒的多镜头序列内可以省积分。

输出预期

Kling 3.0 以原生 4K(3840×2160)最高 60fps 输出,16 位 HDR——任何放大器都无法复制的电影节级别细节地板。Omni Native Audio 在同一次生成里渲染对白唇形同步和环境音,覆盖英文、中文、日文、韩文、西班牙文。渲染时间:Standard 90-150 秒,Pro 180-240 秒。多镜头时序支持 15 秒内最多 6 段剪辑。Motion Control 变体需要参考上传,是本场景里最强的编排动作选项。

Astorie 上使用 Kling 3.0

Astorie 的无限画布上将 Kling 3.0 与其他 AI 模型连接使用。无需 GPU,免费开始。

免费开始

相关功能

文档

延伸阅读

其他模型教程

如何创建 AI 短片