首页 AI 视界 “国模一哥”小米MiMo2.6Pro测完了!
文章内容

“国模一哥”小米MiMo2.6Pro测完了!

2026年09月29日 14:21 AI 视界 4 阅读

小米真的是“营销学”大师,无论哪个领域都是,从手机到汽车,再到 AI!

MiMo2.6 还没发布,就把训练过程给直播了,话题十足! 模型未必第一,但是确实是第一个直播 RL 过程的!

模型发布之后,又在 AA 上拿下了“国模第一”的排名!

我是从小米的第一代模型开始测起的,一直跟到了 2.5。

我之前的结论是,它和 MiniMax 这两个 M 就是大模型界的“卧龙·凤雏”!

“凤雏”已经熄火了,“卧龙”还在进步中! 这个还是要点个赞的。

今天 MiMo2.6Pro 新鲜出炉,我们再来实测一波。看看这个头衔还能不能“保住”或者“摘掉”!

1、基础信息

关于 MiMo2.6Pro 我接触到的第一条信息是,听说它是“国模一哥了”,依据是下面这张图:

这是 Artificial Analysis 的一个榜单!

Artificial Analysis(artificialanalysis.ai)是一个独立的 AI 大语言模型及 API 推理服务商基准评测与分析平台。相当于 AI 领域的“懂车帝”。

上图显示的是综合智能指数(Intelligence Index):

通过严苛的复合评测集(包括代码生成、科学推理、长上下文长程推理、事实性与抗幻觉能力等),给出各大模型的综合得分与分项排名。

因为我对大模型竞技场已经毫无信任了,最近主要是看这个平台。

我整体来说还是比较信任它,但是……我们还是往下看吧!

现在先来看各种客观的数据!

AA 上显示它的综合得分情况是:

仅次于 Fable 5.1、GPT-5.6 Astra、Opus 5、Muse 1.3、GPT-5.6。

齐平最新的 Grok 4.7。

超过了所有国产模型,包括 Qwen 3.8 Max、GLM5.3 Max、Step5、Kimi K3。

从这个数据中确实可以得到国模综合第一的结论!

但是,榜单这个东西真的“很迷”的。

Muse 这个模型的水平,谁用谁知道,排名居然这么高!

关于 MiMo2.6 的第二印象来自官方发布页!

说实话,页面做得非常漂亮,我是蛮喜欢这种配