品玩7月22日讯,字节跳动Seed团队近日正式发布音频创作模型Seed Audio 1.0。该模型采用统一框架,端到端生成包含人声、音效与环境声的完整音频场景,旨在实现“听见”即“看见”的沉浸式效果。
Seed Audio 1.0的核心能力包括:支持以100ms精度进行时间控制,精准编排各类声音元素的进入时机;支持零样本生成与长音频延展,单次可生成约2分钟音频并保持角色音色稳定;覆盖中、英、日、韩等20余种语言,支持同一音色在不同语言间的自然迁移。
评测结果显示,Seed Audio 1.0在文本生成音色任务中表现优异,在影视、播客、短剧等多数场景下的音频可用率超过90%。目前,该模型已在火山方舟体验中心上线。

星速配资提示:文章来自网络,不代表本站观点。