9月15日,人工智能企业阶跃星辰发布新一代语音大模型StepAudio 3系列,一次性推出Realtime、ASR、TTS、Gen和Music五款模型,覆盖实时语音交互、语音识别、语音生成和音乐创作等场景。
其中,Realtime支持原生全双工对话,可判断回应时机、处理打断和连续反馈,并加入语音推理与任务执行能力,支持推理与语音生成并行,工具调用和长任务可异步执行。在第三方评测机构Artificial Analysis榜单中,该模型以98.9%的综合得分位列对话动态评测全球第一,语音推理评测同样排名全球第一。
ASR则结合语音识别与大语言模型的上下文理解能力,支持中英文、方言、中英混说及长音频等场景,并针对低声、快速语音和背景音乐等复杂输入进行优化。在该机构非流式语音识别准确性榜单中,其词错误率为1.7%,并列全球第一。(澎湃新闻记者 秦盛)
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.