阶跃星辰发布StepAudio 3

利多 6天前
人工智能企业阶跃星辰发布新一代语音大模型StepAudio 3系列。一次性推出Realtime、ASR、TTS、Gen和Music五款模型,覆盖实时语音交互、语音识别、语音生成和音乐创作。Realtime支持原生全双工对话,加入语音推理与任务执行能力。

能听会说,还能推理执行,阶跃星辰发布新一代语音大模型StepAudio 3系列

9月15日,人工智能企业阶跃星辰发布新一代语音大模型StepAudio3系列,一次性推出Realtime、ASR、TTS、Gen和Music五款模型,覆盖实时语音交互、语音识别、语音生成和音乐创作等场景。其中,Realtime支持原生全双工对话,可判断回应时机、处理打断和连续反馈,并加入语音推理与任务执行能力,支持推理与语音生成并行,工具调用和长任务可异步执行。在第三方评测机构ArtificialAnalysis榜单中,该模型以98.9%的综合得分位列对话动态评测全球第一,语音推理评测同样排名全球第一。ASR则结合语音识别与大语言模型的上下文理解能力,支持中英文、方言、中英混说及长音频等场景,