2
—

Claude Fable 5

Anthropic

★92.1综合评分

视觉理解检索强写作强

基于 2 项计算

查看详情
1
—

Claude Opus 4.6

Anthropic

★92.1综合评分

写作强视觉理解综合智能

基于 2 项计算

查看详情
3
—

GPT-6.1 Sol

OpenAI

★78.6综合评分

编程强综合智能视觉理解

基于 2 项计算

查看详情
排名模型名称综合评分操作
4GPT-6 Astra★78.0查看
5Claude Opus 4.7★76.3查看
6Claude Fable 5.1★70.2查看
7Claude Opus 4.6★65.8查看
8gemini-4-argon-high★65.3查看
9Claude Opus 4.7★63.1查看
10Claude Opus 5★61.0查看

🏅本榜单由多维度数据综合评定

按「写代码」场景下的能力权重计算。

评测模型数
22+
数据来源
6个
更新时间
2026-10-07

本榜数据来自LMArena(真实用户盲测投票的能力评测)

分数经分位数归一化后加权计算。本站不参与投票、不修改排名; 无数据源的维度一律留空,不使用其他指标冒充。

涨幅对比的是上一期排名,每 24 小时更新一次。

不知道选哪个?让 Advisor 按你的场景推荐

热门讨论

登录后可以发布讨论、点赞与评论

登录
  • 这样我终于知道平时该用哪个模型了

    这样我终于知道平时该用哪个模型了?模型千千万,都快不知道如何选了

    匿名用户·4 天前

  • 测试能不能讨论

    测试能不能讨论?陈青崖

    匿名用户·4 天前