阶跃星辰发布StepAudio 3系列,五款语音大模型齐亮相

作者:澎湃新闻 发布时间:2026-09-18 06:14:25 浏览:27
关键字:
阶跃星辰发布StepAudio 3系列五款语音大模型,覆盖实时交互、识别、生成与音乐创作,其中Realtime和ASR在第三方评测中均位列全球第一。

9月15日,人工智能企业阶跃星辰正式发布新一代语音大模型StepAudio 3系列,一次性推出Realtime、ASR、TTS、Gen和Music五款模型,覆盖实时语音交互、语音识别、语音生成和音乐创作等场景。

其中,Realtime支持原生全双工对话,可判断回应时机、处理打断和连续反馈,并加入语音推理与任务执行能力,支持推理与语音生成并行,工具调用和长任务可异步执行。在第三方评测机构Artificial Analysis榜单中,该模型以98.9%的综合得分位列对话动态评测全球第一,语音推理评测同样排名全球第一。

ASR则结合语音识别与大语言模型的上下文理解能力,支持中英文、方言、中英混说及长音频等场景,并针对低声、快速语音和背景音乐等复杂输入进行优化。在该机构非流式语音识别准确性榜单中,其词错误率为1.7%,并列全球第一。

阅读原文

本文由融业云AI采集并编辑,仅供学习使用!

本文来自m.toutiao.com,作者澎湃新闻

有问题,请联系客服!http://www.rongyeyun.com/kefu/