超越Grok、Gemini,阶跃星辰开源语音模型登顶全球榜首
创始人
2026-01-15 14:47:24

当地时间1月14日,据大模型评测榜单Artificial Analysis Speech Reasoning最新结果,中国大模型企业阶跃星辰的原生音频推理模型Step-Audio-R1.1登顶,超越Grok、Gemini、GPT-Realtime等。

该榜单是目前业界评估“原生语音模型”最权威的第三方基准之一,核心考量模型直接处理音频并进行复杂逻辑推理的能力,考察维度包括准确率、首包延迟等。

去年11月,阶跃星辰发布了Step-Audio-R1,可以在不增加额外时延的情况下,端到端理解语音内容。此次发布的Step-Audio-R1.1是R1的升级版,基于推理能力,R1.1不仅能准确识别声音,还可以捕捉到声音背后的情绪和心理状态、言外之意,并能基于环境音推导对物理世界的理解。

目前,阶跃星辰已开源该模型,chat模式也已搭载该模型核心,完整的实时语音API预计将于 2 月上线。(澎湃新闻记者 秦盛)

相关内容

热门资讯

谷歌再次暂停AI功能 文|陆弃 2026年7月30日,谷歌宣布在Google Earth网页版推出AI图像生成功能,用户可...
闽侯双遗址解码千年文脉   牛头山留存闽地先民向海足迹,昙石山铸就福建海洋文明根基  闽侯双遗址解码千年文脉  游客参观昙石...
民声“落地” 车位“上新” (来源:嘉兴日报)转自:嘉兴日报   ■记者 郑小梅 通讯员 薛一凡  本报讯 今年初以来,秀洲区王...
108堂AI课程送到市民身边 本报讯(记者 代丽丽)8月1日,北京市人力资源和社会保障局在海淀区AI原点社区举办“市民技能课堂——...
融资4.5亿美元,估值26亿美... 7月20日,英国AI材料公司CuspAI宣布完成4.5亿美元B轮融资,公司估值达到26亿美元。本轮融...