阶跃发布StepAudio3语音大模型

IT时代网9月15日消息,阶跃今日正式发布StepAudio 3系列语音模型,包含StepAudio3 Realtime、ASR、TTS、Gen与Music五款,目前均已上线阶跃星辰开放平台,其中多款在Artificial Analysis榜单中位列全球第一。

官方介绍,该系列分别面向真人级语音生成、完整音频内容生成、实时语音交互、复杂场景语音理解与音乐创作等核心场景。其中StepAudio 3 Realtime支持原生全双工实时对话,在Artificial Analysis Conversational Dynamics榜单以98.9%综合得分排名全球第一,并以99.7%的语音推理准确率位列Speech Reasoning榜单第一。

StepAudio 3 ASR在非流式语音识别准确性榜单中词错误率仅1.7%、并列全球第一,可处理方言、中英混说、长音频与专业领域术语;StepAudio 3 TTS则面向实时交互的真人级语音生成,能还原笑声、迟疑、重复等真实交流中的副语言表现。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。

编辑:林一舟

THE END