2
—

Claude Fable 5

Anthropic

★88.3综合评分

视觉理解检索强写作强

基于 2 项计算

查看详情
1
—

Claude Opus 4.6

Anthropic

★93.3综合评分

写作强视觉理解综合智能

基于 2 项计算

查看详情
3
—

gemini-4-argon-high

Google

★83.8综合评分

写作强编程强

基于 2 项计算

查看详情
排名模型名称综合评分操作
4Claude Opus 4.7★75.1查看
5GPT-6.1 Sol★72.3查看
6Claude Opus 4.6★67.0查看
7Claude Fable 5.1★66.4查看
8Claude Opus 4.7★65.3查看
9qwen3.8-max★65.1查看
10GPT-6 Astra★59.2查看

🏅本榜单由多维度数据综合评定

按「办公效率」场景下的能力权重计算。

评测模型数
22+
数据来源
6个
更新时间
2026-10-07

本榜数据来自LMArena(真实用户盲测投票的能力评测)

分数经分位数归一化后加权计算。本站不参与投票、不修改排名; 无数据源的维度一律留空,不使用其他指标冒充。

涨幅对比的是上一期排名,每 24 小时更新一次。

不知道选哪个?让 Advisor 按你的场景推荐

热门讨论

登录后可以发布讨论、点赞与评论

登录
  • 这样我终于知道平时该用哪个模型了

    这样我终于知道平时该用哪个模型了?模型千千万,都快不知道如何选了

    匿名用户·4 天前

  • 测试能不能讨论

    测试能不能讨论?陈青崖

    匿名用户·4 天前