当前位置: 首页 » 资讯 » 科技头条 » 正文

字节跳动发布Seed Audio 1.0音频创作模型,多数场景音频可用率达90%以上

IP属地 中国·北京 编辑:李娜 凤凰网科技 时间:2026-07-20 16:05:58

7月20日,字节跳动Seed团队今日发布音频创作模型Seed Audio 1.0,面向完整声音场景,在统一框架下联合建模人声、音效和环境声等多种音频要素,端到端完成影视级音频创作。官方称,声音不再只是画面的补充,而是可以直接参与叙事,做到“听见”即“看见”。

该模型具备三大核心能力:多要素统一编排,支持精细时间控制,可按时间线精准控制对白、音效进场;音色风格可控、长时稳定,在长音频场景下保持角色一致性;支持20多种语种的自然音频生成。

官方评测显示,在影视、短剧、动漫、播客等多数场景中,音频可用率已达90%以上;多语言音频自然度方面,大部分语言MOS评分超过4分,音质达优秀水准。

目前,Seed Audio 1.0已在火山方舟体验中心上线。

标签: 音频 场景 模型 音效 语言 声音 人声 火山 科技 音质 方舟 体验 凤凰网 水准 中心 上线 风格 音色 进场 短剧 动漫 建模 精准 播客 影视 框架 方面 环境 要素 能力 官方 核心 角色

免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。