火山引擎发布豆包音频生成模型1.0

6月23日,火山引擎正式发布豆包音频生成模型1.0(Doubao-Seed-Audio 1.0)。该模型支持文本或音频任一模态输入,端到端生成高质量目标音频,首次实现长时多角色音色一致性与全要素Prompt编排(含对白、情绪、音乐、环境音)。单次最长生成2分钟音频,并可通过参考音频持续延展。目前API已开启邀测,个人用户可在火山方舟体验中心免费使用30分钟额度,后续将接入剪映、即梦、番茄等产品。

免责声明:本文内容由开放的智能模型自动生成,仅供参考。

最新文章
Copyright © DoNews 2000-2026 All Rights Reserved
京ICP备2025120072号