快手可灵AI 2.6版推音画同出模型，大幅提升视频创作效率-人工智能-PHP中文网

快手可灵AI 2.6版推音画同出模型，大幅提升视频创作效率

看不見的法師

发布： 2025-12-13 11:58:31

原创

538人浏览过

近日，快手旗下可灵ai正式发布2.6版本，推出业内首个音画同出模型，支持“文生音画”与“图生音画”双模态创作方式，可一次性生成高清画面、自然流畅的语音、精准匹配的动作音效及沉浸式环境氛围音。该模型以“听见画面，看见声音”为产品内核，依托全球首创的音画同步生成技术，突破ai视频长期存在的视听割裂瓶颈，在算法能力与商业应用两个维度实现跨越式升级。

在底层架构上，可灵2.6深度融合扩散变换器（Diffusion Transformer）与3D时空联合注意力机制，在维持10秒1080P高清视频稳定输出的前提下，显著优化算力消耗——生成5秒视频仅需25积分，相较前代降低30%。模型核心能力完成三项关键跃迁：复杂语义指令的理解与响应效率提升15%；跨镜头角色一致性达行业领先水平；在与Seedance 1.0的匿名盲测中，胜率达285%，确立明显技术代差优势。

本次更新最具颠覆性的“音画同出”功能，彻底重构传统AI视频生产流程——告别“先画面后配音”的分步模式，单次推理即可输出含中英双语对白、动作音效、环境氛围音的完整音视频成品。同步升级文生音画与图生音画两大主干能力，创作者无需额外搜寻、剪辑或合成音频素材，真正实现从创意到成片的一键闭环。

该能力已覆盖多类高频创作场景，包括：

单人独白类（商品种草、生活Vlog、新闻播报、公开演讲）
旁白解说类（产品讲解、体育赛事解说、人文纪录片、有声故事）
多人对白类（访谈对话、竖屏短剧、情景演绎）
音乐表演类（清唱/说唱、多人合唱、乐器独奏与合奏）

显著压缩内容制作周期，为全量创作者提供开箱即用的专业级视听生产力工具。

可灵2.6提供两条低门槛创作路径：
? 文生音画——输入一句话描述，自动生成带语音、音效与画面的完整视频；
? 图生音画——让静态图片“开口说话、自主运动”，赋予图像动态表达力。
官方特别强调，用户可在生成过程中对语音语调、语速节奏、音效类型、环境声场等要素进行精细化调节，实现真正的可控创作。

在商业化落地上，可灵2.6将首批接入Artlist等国际主流专业创作平台，并开放场景延展接口与多元素协同编辑API，深度适配影视工业化流程、短剧工业化开发、品牌广告创意、MV全流程制作等高要求场景。技术演进路线图同步公布：2026年Q1将上线4K分辨率+60帧超高清版本，并开放自定义声线库，进一步拉低专业级AI视频创作门槛。

据第三方行业研报显示，该模型成功补全AI视频技术栈最后一环，可将传统后期配音与音效剪辑环节压缩50%以上，释放高达3倍的内容产能，加速AI创作工具由轻量娱乐“玩具”向硬核生产力“装备”跃迁。

神笔马良

神笔马良 - AI让剧本一键成片。

320

查看详情

从产业视角看，这一模型正在重写AI视频行业的底层规则。以往创作者需兼备视觉设计、音频工程、剪辑调度等多项复合能力；如今仅凭一段文字提示，即可输出视听俱佳的成片，创作准入门槛断崖式下降，有望催生更碎片化、人格化、实验性的内容新形态。而对接专业创作平台的战略，标志着AI工具已深度嵌入商业内容生产链路，为影视、广告、MCN等B端客户提供可量化降本、可规模化增效的技术底座，实现C端普惠与B端赋能的双向贯通。

对大众用户而言，可灵2.6的持续进化印证了AI技术平权化的不可逆趋势。过去依赖专业团队、昂贵设备与长周期打磨的视频制作，如今借助一部智能手机即可完成。这种技术民主化，正让每一个普通人的创意表达获得前所未有的落地可能。而2026年即将推出的4K超清版本与个性化声线定制功能，将进一步拓展创作的自由度与专属感，推动AI视频体验从“可用”迈向“好用”，再升维至“专属”。

值得一提的是，12月5日，可灵AI还同步上线“可灵O1主体库”与“对比模板”两项实用新功能：
✅ O1主体库支持一键复用并自由组合视频（最多7个）或图片（最多10个）中的多个主体，还可基于单张图像智能扩展视角并自动生成结构化描述；
✅ 对比模板则在发布页直观呈现AI生成前后的创意效果差异，帮助用户快速评估优化方向。

本月内，可灵AI已密集发布可灵2.6“音画同出”模型、数字人2.0及O1模型三大重磅更新，全面强化AI视频全链路创作能力。尤为值得关注的是，中国自研模型在此轮迭代中展现出鲜明的本土化竞争力——中英双语音频生成质量与语义贴合度显著优于海外同类产品，尤其在中文语音自然度、方言适配性、语境情感还原等方面形成技术护城河，打破海外模型在中文语音生成领域的长期主导格局，助力国产AI视频工具在全球竞争中赢得关键卡位。

未来AI视频技术还将在哪些方向迎来爆发？欢迎在评论区留下你的思考。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜