Zero Kit AI

可灵 Kling 3.0 Omni AI 视频生成器

快手旗下可灵 AI 的 Kling 3.0 Omni 能同时用多张参考图生成一条视频,你提供的人物、地点和画面风格会出现在同一个镜头里。

  • KlingKling
  • 最高 4K
  • 最多 7 张参考图
  • 每次最多出 4 条视频
  • 3–15 秒
  • 每秒 21 积分起
  • Plus 及以上套餐可用
一位穿梅紫色裙子的舞者在黄铜色灯光照亮的剧场舞台上排练,镜头环绕着她。

用 Kling 3.0 Omni 试试这些示例提示词

  • 狭窄的店里堆满布卷,一位裁缝在藏青色布料上用划粉画线。

    工作中的裁缝

    电影感 16:9 视频关键帧,镜头缓缓推近一位戴圆框眼镜的老裁缝,他在一张磨旧的木裁剪台上,用划粉在一段藏青色羊毛料上画线,身后的布卷一直堆到天花板,一盏黄铜台灯,脖子上挂着软尺。温暖的黄铜色光线,梅紫与藏青的布料色调,沉静而精准。

  • 果园里,一家人围着野餐垫欢笑,花瓣纷纷飘落。

    李树下的野餐

    电影感 16:9 视频关键帧,春天的李树果园里,镜头沿着一张野餐垫缓缓移动,奶奶、父母和一个小男孩围着面包和水果欢笑,白色的花瓣随微风飘落。柔和的午后光线,梅紫、奶油白与绿色调,温暖而自然。

  • 黄昏时,一名花样滑冰运动员在户外冰场上旋转,镜头贴近环绕。

    冰上旋转

    电影感 16:9 视频关键帧,近距离环绕镜头:黄昏时,一名穿深梅紫色演出服的花样滑冰运动员在户外冰场上旋转,冰刀下冰屑飞溅,身后的串灯和积雪的松树虚化成背景。冷蓝色的冰面映衬温暖的黄铜色串灯,动作利落,优雅。

  • 黎明时,一列骆驼翻越沙丘脊线,无人机缓缓跟拍。

    黎明的驼队

    电影感 16:9 视频关键帧,无人机从高处缓缓跟拍:黎明时,一列骆驼和裹着头巾的骑手翻过一座高大沙丘的脊顶,长长的影子铺在起伏的沙纹上,地平线上笼着淡淡的薄雾。黄铜金色的沙子配梅紫色天空,场面宏大,移动平缓。

示例图仅作示意,实际效果因模型而异。

关于 Kling 3.0 Omni

Kling 3.0 Omni 是可灵 AI(Kling AI)3.0 系列里的全能输入模型。Kling 称它是一个统一的多模态模型,会把你给的图片和文字当成同一段提示来理解,并表示它能记住视频里的主要角色、物品和场景,无论镜头怎么运动,都让它们的特征保持稳定。Kling 把它定位为 Kling O1 的升级版,主体更一致,画面畸变更少。

在 Zero Kit 上,它一次生成最多可以用 7 张参考图:一个角色、一件产品、一个地点,或者一幅你想借用其风格的画。它们怎么组合在一起,由你在提示词里描述。它也可以像 Kling 3.0 一样,从首帧开始,或者从首帧到尾帧。视频时长 3 到 15 秒,最高 4K;不用首帧时,可以从 3 种宽高比中任选。和 Kling 3.0 一样,提示词用 Kling 的分镜格式「镜头 1, 2, <描述>; 镜头 2, 3, <描述>;」来写时,它会把一条视频切成多个镜头。

当输入的素材比措辞更重要时,选 Omni:一个在每支广告里都得长得一样的品牌角色,一个真实的地点,一件来自商品目录照片的产品,一种插画风格。如果只用文字或单张首帧生成,Kling 3.0 更简单。在 Zero Kit 上,3.0 Omni 生成的视频没有声音:Kling 为这个模型提供了原生音频,但编辑器里没有它的声音开关。

Kling 3.0 Omni 擅长什么

一段提示词,多张参考图

Kling 3.0 Omni 能把多张参考图组合进同一个镜头,每张图提供场景里的一部分。示例里,三张卡片——一位穿黄色雨衣的女子、一座红白相间的灯塔和一辆复古红色自行车——变成了同一帧画面:她骑着那辆自行车经过那座灯塔。在 Zero Kit 上,参考模式保持在「全能参考」,加上图片,然后写一段提示词,说清每张图是什么、要发生什么:「穿黄色雨衣的女子骑着红色自行车沿海边小路经过红白相间的灯塔,跟拍镜头,傍晚的光线」。每张图只放一个主体,清晰、光线充足;画面太杂的照片会让模型有好几样东西可以照搬。上限是 7 张,但少而专一的参考图更容易在结果里逐一核对。

三张参考卡片分别是穿黄色雨衣的女子、红色灯塔和红色自行车,旁边是她骑着自行车经过灯塔的成片画面。

电影感 16:9 视频关键帧,一面创作工作室的墙:左边钉着三张参考卡片,一张穿黄色雨衣的年轻女子的肖像照,一张礁石岬角上红白相间灯塔的照片,一张复古红色自行车的照片;右边一台大显示器上是成片的电影感画面:同一位女子骑着同一辆自行车,沿海边小路经过同一座灯塔。参考图与画面之间的颜色和细节一致,温暖的黄铜色台灯光,没有可辨认的文字。

同一个角色,跨越多个场景

Kling 称 3.0 Omni 能记住视频里的主要角色,镜头运动时也让他们的特征保持稳定,适合反复出场的角色。加一张清晰的肖像作为参考图,比如示例里那位留着灰色长辫、围着梅紫色针织围巾、戴一枚小黄铜吊坠的女子,并在每次生成时都用同一张图:一条在图书馆,一条在黄昏的火车上,一条在雪夜的街道上。每次都用同样的话描述她,只改地点、动作和光线。想把这些场景放进同一条视频,就把它们写成分镜,比如一条 6 秒的视频写成「镜头 1, 2, 留着灰色辫子的女子在黄铜色灯光的图书馆里看书; 镜头 2, 2, 同一位女子在黄昏时望向火车窗外; 镜头 3, 2, 同一位女子夜里走在积雪的街道上;」。

同一位留着灰色长辫、围着梅紫色围巾的女子出现在三帧画面里:图书馆、火车和积雪的街道。

电影感 16:9 视频关键帧,三联画,用细细的深色间隔分开,展示同一位五十多岁的女子:一条灰色长辫搭在一侧肩上,围着梅紫色针织围巾,戴一枚小黄铜吊坠。左边,她在黄铜色灯光的图书馆里看书;中间,她在黄昏时望向火车窗外;右边,她夜里走在积雪的街道上。每一帧里的脸、辫子、围巾和吊坠完全相同,角色设计一致,电影感布光,没有文字。

沿用绘画风格

参考图提供的也可以是风格而不是主体;Kling 列出的参考图可设定的内容里,就包括风格和场景。加一幅你想要的画作或插画,比如示例里那幅笔触松散的渔港水彩,在提示词里描述新的场景,最后写上要沿用的风格:「小港湾里船只轻轻摇晃,海鸥在头顶盘旋,采用参考图那种松散的水彩风格,柔和的纸张纹理,晕染的边缘」。说清要从参考图里取哪些部分——配色、笔触还是纸张纹理——免得模型把这幅画当成要复刻的地点。想把风格和角色结合起来,就把两张图都加上,并说明每张图各提供什么。

一幅港口水彩画钉在板上,旁边是用同样水彩风格呈现的同一座港口的视频画面。

电影感 16:9 视频关键帧,左右并排的构图:左边钉在板上的是一幅小水彩画,画的是一座渔港,梅紫、赭黄和蓝色的松散晕染;右边是一帧真实港口的视频画面,船只和海鸥用同样松散的水彩风格呈现,柔和的纸张纹理和晕染的边缘,水面轻轻波动。配色和笔触一致,没有文字。

Kling 3.0 Omni 参数与价格

下面的价格都取自实时价目表,价格一调整,这里就跟着变。图片按张计费,视频按秒计费。

每秒积分
分辨率套餐积分
720pPlus21
1080pPlus28
4KPlus100

需要了解的局限

  • 在 Zero Kit 上,Kling 3.0 Omni 生成的视频没有声音。Kling 为这个模型提供了原生音频,但编辑器里没有它的声音开关;需要带声音的 Kling 视频,就用 Kling 3.0 Turbo,或者在剪辑软件里加声音。
  • 参考素材只能是图片:参考视频、视频编辑、Kling 的主体库和自定义音色在 Zero Kit 上都不可用。用了首帧时,视频跟随这张图的画幅,宽高比设置不起作用;尾帧也不能单独使用。
  • 手、小字和快速动作仍可能变形,所以要逐帧检查脸和手,标题留到剪辑软件里加。参考图必须是 JPG 或 PNG,每边至少 300 像素,宽高比在 1:2.5 到 2.5:1 之间。用真人的脸作参考图,需要征得本人同意。

Kling 3.0 Omni 提示词怎么写

  1. 在提示词里给每张参考图分配一个用途:「肖像照里的那位女子」「背景里的灯塔」「采用那幅画的风格」。
  2. 每张参考图只放一个主体,尽量用素净的背景;这个角色或产品每次再出场,都用同一张图。
  3. 写完参考图,接着写动作,再写运镜,最后写光线:「她转身望向大海,镜头缓缓推近,傍晚低垂的太阳」。
  4. 想在一条视频里放几个场景,就用分镜格式,并让各镜头时长加起来等于视频时长,比如 5 秒的视频写「镜头 1, 3, ...; 镜头 2, 2, ...;」。
  5. 先用低分辨率和较短时长测试,再把满意的那条以最高 4K 渲染。

Kling 3.0 Omni 常见问题

不免费。在 Zero Kit 上,Kling 3.0 Omni 需要 Plus 及以上套餐,每秒视频都要消耗积分。免费版仍然可以写提示词、查看价格;免费版包含哪些模型,可以在价格页查看。

准备好试试 Kling 3.0 Omni 了吗?

写一句描述,或挑一个示例提示词,然后点生成。

最近更新: