(文/张志峰 编辑/吕栋)
近日,国际表格AI评测SpreadsheetBench更新V2 Full榜单,WPS AI表格Agent以50.86%的综合成绩排名第一,超过Claude Opus 4.6、GPT-5.2、Gemini 3.1 Pro等国际主流AI模型,后三者成绩分别为34.89%、26.79%、23.68%。
这已是WPS表格Agent三个月内第三次登顶国际权威评测。
无独有偶,垂类赛道近月接连跑出“国产第一”。
教育领域,8月24日上线的飞象老师3.0让教师一句话生成可运行的教育应用,在AI教育赛道跑出了中国样本。
语音识别领域,无界方舟ARK-ASR登顶Open ASR总榜及1B以下参数组双第一,在标准英文语音测试集上词错误率低至1.03%。
界面定位领域,金智维KV-Ground今年3月以80.5分登顶ScreenSpot-Pro全榜,刷新谷歌Gemini 3 Pro保持的72.7分纪录,4B小模型拿下同组第一。
医疗领域,百川智能与清华联合发布的Baichuan-M4在HealthBench三个榜单同时位列世界第一,领先GPT-5.5超10分。
通用大模型的迭代从未停步,但垂类企业手里的场景数据、软件工具链、交付闭环,正在变成短期内难以复制的壁垒。
本文系观察者网独家稿件,未经授权,不得转载。