>
正文
字節跳動發佈 Seed Audio 1.0 音頻生成模型
2026-07-22 14:51

據 Woofun AI 消息,字節跳動正式發佈 Seed Audio 1.0 音頻生成模型。該模型支持通過文本或參考音頻輸入,單次生成約 2 分鐘內容,並實現對話、音效及環境音的同步生成,時間控制精度達 100 毫秒。在延長生成時長時,模型能保持角色聲音一致性,支持 20 多種語言的語音轉換、音調及情緒調整。官方測試顯示,多數場景下音頻可用性率超過 90%,自然度 MOS 評分普遍高於 4 分。目前該模型已在 Volcano Ark 體驗中心上線,並向開發者開放 API 接口。

免責聲明:本內容為作者獨立觀點,不代表平臺立場。未經允許不得轉載,文中內容僅供參考,不作為實際操作建議,交易風險自擔。
標簽:
Seed Audio 1.0
Volcano Ark Experience Center
ByteDance
分享:
back