首页 资讯 财经 股市 证券 金融 投评 English
您现在所在的位置:首页 / 财经点评 / 正文
可灵2.6模型上线!语音、音效与画面一键直出 重构AI视频创作工作流
来源:
2025-12-04

12月3日,可灵推出视频生成2.6模型,该模型提供了里程碑式的“音画同出”能力,彻底改变了传统AI视频生成模型“先无声画面、后人工配音”的工作流程。它能够在单次生成中,输出包含自然语言、动作音效以及环境氛围音的完整视频,重构了AI视频创作工作流,极大提升创作效率。

重构AI视频创作工作流 中文语音生成效果全球领先

可灵2.6模型升级了文生音画、图生音画两大功能,输入文本或是输入图片结合提示词文本,均可直接生成带有语音、音效及环境音的视频。语音当前支持生成中文以及英文,生成视频长度最长支持10秒。

该升级重构了传统AI视频创作“先生成无声的视频,再结合其他软件完成后期声音制作”的工作流,创作者使用可灵2.6模型,能够直接生成包含人声、环境与效果音效的视频,极大提升了创作者的工作效率。

通过对物理世界声音与动态画面的深度语义对齐,可灵2.6模型在音画协同、音频质量和语义理解上表现亮眼。

音画协同上,可灵2.6模型生成的视频,在语音节奏、环境音与画面动作上紧密呼应,实现了对画面动态与声音节奏的深度对齐,避免了传统工作流可能产生的“画面一套、声音一套”的割裂体验。

音频质量上,在支持人声、音效、环境声等多类型声音生成的基础上,生成的音频音质更干净、层次更丰富,整体听感更接近真实的混音效果,满足专业级创作对声音细节的高要求。

语义理解上,该模型对多种场景下的文本描述、口语表达和复杂剧情有较强的语义理解能力,能够更准确地把握创作者意图,从而输出逻辑更严密、更贴合用户需求的音画内容。同时,可灵2.6模型在中文语音生成效果上保持全球领先。

CopyRight@2010-2025 中金网 All Right Reserved

工信备案号:沪ICP备 2021001869号