跑分疑似泄露

8月21日,Max For AI披露一张疑似小米下一代大模型MiMo-V3-Pro的Benchmark截图,该模型瞄准Coding Agent和通用Agent场景。

关键数据

  • SWE-Bench Pro:72.8分,高于GLM 5.3(67.9)和Kimi K3(65.8),距Claude Opus 5(74.6)和GPT-5.6 Sol Max(75.4)不到3分

  • Terminal-Bench 2.0:70.6分,接近Claude Opus 5(72.0)和GPT-5.6 Sol Max(73.5)

  • τ3-bench:76.4分,GPT-5.6 Sol Max为78.8分


官方未证实

若成绩经官方确认并能在正式版复现,MiMo-V3-Pro将进入全球顶尖模型第一梯队。目前截图真实性及测试条件未经小米官方确认。小米最新官方旗舰为MiMo-V2-Pro及V2.5-Pro,V3-Pro是否存在及发布时间待披露。