站长之家 - 业界 2026-06-23 17:10

豆包音频生成模型1.0正式发布:一次性直出影视级的成品音效

6月23日,火山引擎FORCE原动力大会正式举行,字节跳动旗下豆包品牌一举发布五项创新技术成果,分别为豆包 Pro 2.1、视频生成方案 Seedance 2.5 与 Seedance 2.0 4K版、图像创作工具 Seedream 5.0 Pro,以及全新亮相的音频生成系统 1.0(Seed-Audio 1.0)。这套音频系统的推出,将显著降低高品质语音内容规模化生产的门槛。

豆包音频生成系统 1.0 具备一次性同步编排角色对白、情绪语气、方言口音、背景音乐和拟音特效的能力,可直接输出影视级成品音效。该系统实现了文字生成音频与参考音频的深度联动,在有声书、播客和长篇剧集等长音频创作中,能够保持高度统一的音色,大幅削减后期修音工作量。同时,它支持零样本多模态参考,用户只需输入一段描述,系统即可推理出与之匹配的声音特征。该音频系统完整补足了豆包全链路创作的音频板块,加之同步推出的图文、视频创作工具,文字、画面、音频制作已全面实现一体化,为内容从业者提供了一套完整高效的一站式创作方案。

推荐关键词

24小时热搜

查看更多内容

大家正在看