国产办公AI能力再上新台阶,最新智能体排名发布
国产办公AI能力再上新台阶,最新智能体排名发布
日前,AI测评机构SuperCLUE公布了第二期XClaw(龙虾)智能体完整榜单。本次测评聚焦国内主流办公类AI产品,共计10款国产模型参与测试,全面覆盖职场真实应用场景。结果显示,所有参测产品的三轮平均分均超过91分,整体能力较上一轮有明显跃升。
在总分排名上,百度文心助手位居第一,小米MiMo Claw紧随其后,拿下第二名。整体榜单竞争颇为激烈,10款产品的平均分达到94.53分,而榜首与末位之间的总分差仅有6.31分。尤其头部四款产品得分均在96分以上,展现出高度接近的综合实力。其中,第一名百度文心助手得分为97.62分,第二名小米MiMo Claw与第三名腾讯WorkBuddy的分差更是仅有0.13分,几乎可以忽略不计。

此次测评体系紧扣办公实务,设置了五大核心能力维度:数据处理、内容创作、记忆能力、代码开发和研究分析。为保证结果可靠性,每一项任务均独立执行三次,取平均成绩,从而有效降低单次偶然波动的影响。
从细分维度来看,不同能力板块之间呈现出明显的分化趋势。在内容创作和记忆能力两大板块,参测产品普遍接近满分,说明撰写文案、长对话上下文保留等基础办公需求,目前多数国产AI已能稳定满足。数据处理与行业调研方面的得分则居于中位水平。然而,代码开发维度成为最大的能力分水岭,该板块行业平均得分仅为86.99分,且最高分与最低分差距高达17.59分。
在代码开发这一短板明显的领域中,小米MiMo Claw表现尤为突出,取得97.22分的高分,以显著优势领先于其他参测产品,展现出编程辅助场景下的强劲实力。
除了能力得分,测评也重点考察了产品的稳定性,即三次测试分数之间的波动幅度。
波动越小,意味着日常使用中输出的一致性越高。结果显示,腾讯WorkBuddy和MaxClaw在稳定性上表现最佳,三次结果高度一致。而部分总分排名靠后的产品,则在重复测试中表现出较明显的输出差异,同样指令下生成内容参差不齐,可能在真实办公环境中带来不可预期的使用风险。
综合来看,当前国产办公AI已不再停留在基础功能满足层面,正逐步迈向精细化竞争阶段,比拼焦点转向细节体验、任务完成稳定性,以及在专业场景下的深度适配能力。对于日常文案撰写和简单表格处理,绝大多数参测产品均能游刃有余;而对于需要高频处理数据、编写或调试代码的企业用户,百度文心助手、小米MiMo Claw等头部产品则表现出更为突出的适用性,更贴合高要求的办公场景需求。
添加再生时代小助理微信:RTVIP68
答疑解惑+获取最新展会资讯



评论交流