快手可灵 2.6 全量上线 “音画同出”让AI创作更完整

快手旗下的可灵 AI 全量上线 可灵 2.6 模型。这是其首个实现“音画同出”的多模态模型,能够在一次生成中同时产出画面、自然语音、音效和环境氛围。
对创作者来说,原本需要分别生成视频、配音、音效、声场的过程现在可以一次完成,创作效率明显提升。

可灵 2.6 主要解决的是 AI 视频创作中“声音缺失”“氛围不足”“配音不自然”等痛点,让生成内容更完整,也更适合直接发布或二次剪辑。

详情入口:
https://app.klingai.com/cn/


提供两条创作路径 文生音画与图生音画灵活选择

可灵 2.6 支持 文生音画图生音画 两种创作方式,适配不同内容需求。

1. 文生音画:一句话生成完整音视频

用户只需输入描述,模型就可以根据文本自动生成对应画面、角色语音、动作、音效和环境声。
适合:

  • 旁白类视频
  • 情节短片
  • 角色独白
  • 宣传短内容

2. 图生音画:用现有画面补全声音和氛围

上传图片或画面后,可灵会根据画面内容自动生成语音、音效和场景声,同时构建与内容匹配的视觉表现。
适合:

  • 人物定格动画
  • 宣传海报动态化
  • 图像转叙事视频

两条路径都强调简单操作,让更多创作者可以快速得到成型内容。


适用场景更广 从独白到多人对白都能完成

可灵 2.6 的音画同步能力让其可应用于多种内容创作场景,包括:

单人独白

自然语气更接近真实表达,适合 vlog、角色扮演、情绪表达内容。

旁白解说

可用于知识类视频、故事讲述、广告脚本等长短内容。

多人对白

模型会根据角色身份和音色差异生成不同的声音,让画面和对白更协调。

音乐与表演场景

可灵能够生成节奏感更一致的画面与环境氛围,适合音乐展示、创意短片等玩法。


亮点提要

音画同步生成 一次生成包含画面、语音、音效、环境声
️ 提供 文生音画图生音画 两条创作路径
适用独白、旁白、对话、音乐等多种内容形式