字节跳动发布 Seed Audio 1.0 生成音频模型

By: t.me|2026/07/22 06:51:26

字节跳动发布音频创作模型 Seed Audio 1.0,能够通过一条 prompt 同时生成对白、音效和环境声,并按时间线控制声音进场。该模型支持文本和参考音频输入,时间控制精度为 100 毫秒,单次可生成约 2 分钟音频,并可继续延长,保持角色音色一致。Seed Audio 1.0 支持 20 多种语言,同一音色可跨语言迁移,且可切换语气和情绪。官方评测显示,多数场景的音频可用率超过 90%,大部分语言的自然度 MOS 超过 4 分。该模型已上线火山方舟体验中心,并开放 API 接入。

-- 价格

--
--
--

本内容仅供参考,不构成任何金融、投资、法律或税务建议。文中提及的任何活动、奖励、线上活动或相关信息,不应被视为对购买、出售或交易任何加密资产的推荐、招揽或邀请。加密资产具有高波动性,存在价值损失风险。WEEX服务、产品及相关活动的可用性可能因地区而异。用户在参与前有责任确保符合当地适用法律法规。

猜你喜欢

iconiconiconiconiconicon
客户服务:@weikecs
商务合作:@weikecs
量化做市商合作:bd@weex.com