数码之家

 找回密码
 立即注册

QQ登录

只需一步,快速开始

搜索
查看: 59|回复: 0

[业界] 字节跳动发布Seed Audio 1.0音频创作模型,多数场景音频可用率达90%以上

[复制链接]
发表于 前天 17:15 | 显示全部楼层 |阅读模式

爱科技、爱创意、爱折腾、爱极致,我们都是技术控

您需要 登录 才可以下载或查看,没有账号?立即注册

x
凤凰网科技讯 7月20日,字节跳动Seed团队今日发布音频创作模型Seed Audio 1.0,面向完整声音场景,在统一框架下联合建模人声、音效和环境声等多种音频要素,端到端完成影视级音频创作。官方称,声音不再只是画面的补充,而是可以直接参与叙事,做到“听见”即“看见”。
该模型具备三大核心能力:多要素统一编排,支持精细时间控制,可按时间线精准控制对白、音效进场;音色风格可控、长时稳定,在长音频场景下保持角色一致性;支持20多种语种的自然音频生成。
官方评测显示,在影视、短剧、动漫、播客等多数场景中,音频可用率已达90%以上;多语言音频自然度方面,大部分语言MOS评分超过4分,音质达优秀水准。

目前,Seed Audio 1.0已在火山方舟体验中心上线。





您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

APP|手机版|小黑屋|关于我们|联系我们|法律条款|数码之家-技术知识分享平台

闽公网安备35020502000485号

闽ICP备2021002735号-2

GMT+8, 2026-7-22 04:43 , Processed in 0.078000 second(s), 8 queries , Gzip On, Redis On.

Powered by Discuz!

© MyDigit.Net Since 2006

快速回复 返回顶部 返回列表