青虎 AI

快手可灵AI · 全新推出 3.0 系列

可灵 3.0 Omni

多模态指令深度解析与跨任务融合:文本、图片、音频、视频全模态输入,输出最长 15 秒、音画同步的多镜头视频——从青虎 LinkPix 开始可灵 3.0 Omni 创作。

查看模型官方介绍
官方输入输出
文本 · 图片 · 音频 · 视频
官方单次时长
最长 15 秒
原生音频
多语言 · 方言 · 口音
可灵 3.0 Omni 全模态视频生成:悬浮的电影帧与黄绿光效交织的暗色制片空间
All-in-One 原生多模态架构

文生视频、图生视频、参考生视频与视频内编辑,统一在同一个模型内完成。

01模型概览

重构光影与声音的叙事逻辑

可灵 3.0 Omni 属于快手可灵AI 2026 年 2 月 5 日全球上线的 3.0 系列模型。基于全面升级的底层架构,视频 3.0 与视频 3.0 Omni 原生支持多模态指令的深度解析与跨任务融合:遵循复杂叙事逻辑、实现精准镜头控制,并保持极高的提示遵循度。

全球创作者
超 6000 万
累计生成视频
超 6 亿条
企业客户
超 3 万家

可灵AI 官方公布数据

阅读可灵 3.0 系列发布说明

02官方功能

可灵 3.0 Omni 能做什么

从全模态输入输出、全能参考、智能分镜,到无界混说的原生音频,理解 3.0 Omni 的创作能力。

  1. 01

    全模态输入输出

    文本、图片、音频、视频均可作为输入,画面、动作、对白与声音同步输出;底层原生支持多模态指令的深度解析与跨任务融合。

  2. 02

    全能参考:更强一致性

    上传参考视频,模型提取人物的视觉特征和声音特征,在全新场景中忠实复现;音画同步升级,实现文本与视觉角色的精准映射。

  3. 03

    全能叙事:15s 智能分镜

    多镜头故事板为每个镜头指定时长、镜头大小、视角、叙事内容与镜头运动,从分镜阶段一键直出电影感成片。

  4. 04

    全能音画:语言无界混说

    生成中文、英文、日文、韩文、西班牙文,以及多种英语口音与中国方言;多人同框,想让谁说就谁来说,支持多语混说。

  5. 05

    智能多镜头叙事

    理解多场景、多镜头指令,动态调整机位角度与镜头,覆盖从正反打对话到交叉剪辑对话与旁白的镜头语言。

  6. 06

    文本保留与照片级真实

    品牌 Logo、字幕等文字在高精度保留的同时保持清晰可读;生成具有生动表情与动态表演的逼真人物。

03全能参考

视觉主体与听觉音色,双重绑定

可灵 3.0 Omni 在可灵视频 O1 元素构建能力之上,实现音画同步的特征解耦:上传一段参考视频,模型提取其中人物的视觉特征和声音特征,让同一位“演员”出现在全新场景里——形象、动作与声音保持一致。

参考素材的类型、数量与格式要求,以青虎生成页提供的字段为准。

同一位演员在雨夜霓虹街头、日光咖啡馆、黑色电影办公室与黄昏天台四个场景中保持一致
同一参考人物 · 四种全新场景

形象、动作与音色在跨场景生成中保持一致,音画同步输出。

04多镜头故事板

每个镜头,都由你定义

可灵 3.0 Omni 的多镜头故事板允许逐镜头控制成片结构,从分镜阶段直接指定专业镜头参数,一键直出电影感成片。

暗色剪辑室中的电影分镜墙:连续的镜头帧与场记板在黄绿光晕下排列
逐镜头编排的分镜结构

时长、景别、视角、叙事与运镜在故事板中逐镜指定。

  1. 时长DURATION

    为每个镜头单独分配秒数,组织整支影片的叙事节奏。

    如:开场 3 秒 · 对话 6 秒 · 收尾 2 秒
  2. 镜头大小SIZE

    控制每个镜头的景别远近,决定观众与主体的距离。

    如:远景 · 全景 · 中景 · 近景 · 特写
  3. 视角ANGLE

    指定镜头的观看角度,塑造场景的情绪与立场。

    如:平视 · 仰拍 · 俯拍 · 主观视角
  4. 叙事内容NARRATIVE

    写清该镜头内发生的动作、对白与情节推进。

    如:角色开口 · 产品转动 · 场景切换
  5. 镜头运动CAMERA

    指定镜头运动方式,让画面动起来。

    如:推 · 拉 · 摇 · 移 · 跟
黄绿色声波在纯黑背景中流动,与悬浮的电影帧交融
原生音频与画面同步生成

对白、语调与口型随画面一并输出。

05全能音画

语言无界,混说自由

生成中文、英文、日文、韩文、西班牙文的原生音频,覆盖多种英语口音与中国方言。多人同框时,每个角色可以使用不同语言,并控制发言内容、语调与顺序。

  • ZH中文
  • ENEnglish
  • JA日本語
  • KO한국어
  • ESEspañol

多角色对话支持多语混说,音画同步直出成片。

06青虎用法

如何在 LinkPix 使用可灵 3.0 Omni

选择可灵 3.0 Omni 后,依次准备提示词、参考素材和生成参数,再提交视频任务。

可灵 3.0 官方演示 · 全能叙事

15 秒多镜头叙事能力演示,素材来自可灵官网。

  1. 01

    选择可灵 3.0 Omni

    进入 LinkPix 视频生成,在模型列表中选择可灵 3.0 Omni,明确本次使用的创作能力。

  2. 02

    准备全模态输入

    用提示词写清叙事、镜头与语言方向,再按创作需要添加图片、音频或参考视频素材。

  3. 03

    选择生成参数

    在生成页选择本次可用的时长、比例和生成数量。

  4. 04

    生成并检查成片

    提交后等待视频任务完成,再逐镜检查人物一致性、动作、音频、文字和素材权利。

07版本差异

可灵视频 3.0 与 3.0 Omni 怎么选

视频 3.0 以电影级叙事与精准掌控为核心;3.0 Omni 进一步强化全能参考与极致一致性。青虎当前提供可灵 3.0 Omni 视频生成入口,具体时长与参数以生成页显示为准。

比较项可灵视频 3.0可灵 3.0 Omni
版本定位

电影级叙事与精准掌控

全能参考与极致一致性

参考生成

多张图像参考与参考视频,保持人物、物体与场景连贯

从参考视频提取人物视觉与声音特征,在全新场景忠实复现

声音特征

以画面元素一致性为主

形象与声音同时提取、同时复现

多镜头控制

智能多镜头叙事,动态调整机位与镜头

多镜头故事板,逐镜头指定时长、大小、视角、叙事与运镜

官方单次时长

最长 15 秒

最长 15 秒

原生音频

多语言、方言与口音

多语言、方言与口音

08使用边界

生成前后都要保留明确的创作条件

先根据模型能力确定创作方向,再按生成页提供的参数完成本次任务。

  1. 01

    官方发布时 3.0 系列面向 Ultra 订阅用户分阶段开放,具体能力与配额以可灵官方和青虎生成页实际显示为准。

  2. 02

    青虎生成页会展示本次可用的时长、比例、参考素材、生成数量和所需积分。

  3. 03

    人物、商品、Logo、文字和复杂物体在跨镜头时仍可能发生变化,发布前需要逐镜检查。

  4. 04

    使用真人肖像、音乐、商标、影视素材或其他受保护内容前,应取得相应授权并遵守发布平台规则。

09常见问题

关于可灵 3.0 Omni 的六个直接答案

从模型定位、版本差异、时长与语言,到故事板控制和青虎入口。

可灵 3.0 Omni 是什么模型?

可灵 3.0 Omni 是快手可灵AI 3.0 系列中的视频生成模型,2026 年 2 月 5 日全球上线。它基于 All-in-One 原生多模态架构,支持文本、图片、音频、视频全模态输入,并直接输出带原生音频的视频成片。

可灵 3.0 Omni 和可灵视频 3.0 有什么区别?

可灵视频 3.0 侧重电影级叙事与精准掌控;3.0 Omni 在此基础上强化全能参考:可从参考视频提取人物视觉特征与声音特征并在全新场景复现,同时提供逐镜头指定时长、大小、视角、叙事与运镜的多镜头故事板。

可灵 3.0 Omni 最长可以生成多少秒?

官方资料说明可灵 3.0 系列支持最长 15 秒视频生成。使用青虎 LinkPix 时,本次可选的时长与比例以生成页展示为准。

可灵 3.0 Omni 支持哪些语言的音频?

官方支持中文、英文、日文、韩文、西班牙文,以及多种英语口音和中国方言;多角色对话场景中每个角色可以使用不同语言,并可控制内容、语调与发言顺序。

多镜头故事板可以控制什么?

多镜头故事板允许为每个镜头单独指定时长、镜头大小、视角、叙事内容与镜头运动,从分镜阶段直接组织专业级镜头结构。

如何在青虎 LinkPix 使用可灵 3.0 Omni?

进入 LinkPix 视频生成并选择可灵 3.0 Omni,填写提示词、按需添加参考素材,选择时长和比例后提交生成。生成页会直接展示本次可用的输入与参数。

开始生成

开始可灵 3.0 Omni 视频创作

进入视频生成,选择可灵 3.0 Omni,并按实际显示的输入、时长和比例完成创作。

Customer support联系客服