2
↑ 16

Grok 4.7

SpaceXAI

★100.0综合评分

综合智能编程强

基于 1 项计算

查看详情
1
↑ 16

Qwen: Qwen3.8 Max (0902)

Alibaba

★100.0综合评分

编程强综合智能

基于 1 项计算

查看详情
3
↑ 16

MiMo-V2.6-Flash

Xiaomi

★100.0综合评分

编程强综合智能

基于 1 项计算

查看详情
排名模型名称综合评分操作
4MiMo-V2.6-Pro开源★100.0查看
5SpaceXAI: Grok 4.6★100.0查看
6GLM 5.3 Flash开源★100.0查看
7Qwen: Qwen3.8 27B开源★100.0查看
8GPT-6 Luna★100.0查看
9Claude Opus 4.6★100.0查看
10Claude Opus 5.5★100.0查看

🏅本榜单由多维度数据综合评定

能力分位与成本分位的比值 —— 相对于最便宜的那批,你多花的钱换回了多少能力。

评测模型数
38+
数据来源
6个
更新时间
2026-10-07

本榜数据来自LMArena(真实用户盲测投票的能力评测)+OpenRouter(模型定价与上下文长度)

分数经分位数归一化后加权计算。本站不参与投票、不修改排名; 无数据源的维度一律留空,不使用其他指标冒充。

涨幅对比的是上一期排名,每 24 小时更新一次。

不知道选哪个?让 Advisor 按你的场景推荐

热门讨论

登录后可以发布讨论、点赞与评论

登录
  • 这样我终于知道平时该用哪个模型了

    这样我终于知道平时该用哪个模型了?模型千千万,都快不知道如何选了

    匿名用户·4 天前

  • 测试能不能讨论

    测试能不能讨论?陈青崖

    匿名用户·4 天前