⚡ 多源数据 · 实时聚合

大模型排行榜

Arena AI 盲测 Elo · Artificial Analysis 智能指数 · OpenRouter 实时价格
一站式追踪全球大模型能力、厂商格局与 API 成本

330+
收录模型
3
权威数据源
11
能力维度榜单
24h
更新频率

🏆 大模型能力排行榜 Arena AI

基于 600万+ 人类盲测投票的 Elo 排名 · 每日更新 · 点击模型名查看详情

💡 新模型会因评分人数过少造成排名偏低,等待数日即可恢复正常位置。数据更新可能有延迟。

# 模型 Elo 评分 票数
加载排行榜数据…

站长主观排行榜 主观

站长基于实际体验对模型的综合评价 · 10 分制 · 仅代表个人观点

# 模型 评分 备注
加载主观评分…

📈 本周排名变化 趋势

相比上一快照排名变化最大的模型 · 每日更新 · ↑ 排名上升 / ↓ 排名下降

# 模型 Elo 评分 变化
加载排名变化…

速度排行榜 Artificial Analysis

按推理输出速度 (tokens/s) 排序 · 附质量分与 API 价格参考

# 模型 速度 质量分 价格 (输入/输出)
加载速度数据…

🆕 最新上榜模型 New

今日快照中首次出现的模型 · 来自综合 / 代码 / 多模态榜单

加载新上榜模型…

🏢 AI 厂商综合实力排名 综合

精英模型数基于 Arena 综合对话榜 (40%) + 峰值百分位 (35%) + 覆盖广度 (25%) · 不堆数量,看质量

加载厂商排名…
🏟️ Arena AI 原 LMSYS Chatbot Arena,600万+ 人类盲测投票 Elo 排行,衡量「人觉得哪个更好」
📊 BenchLM 281 个模型 × 296 个基准,专项能力评测:指令遵循 / 科学推理 / 工具调用 / 学术知识
🎯 LiveBench 防作弊实时评测,每月更新题目,6 个维度:推理/编程/数学/数据分析/语言/指令遵循
🇨🇳 中文基准 聚合 SuperCLUE + C-Eval + CMMLU 三大中文评测,加权综合排名
📊 Artificial Analysis 质量/速度/价格三维对比,独立评测,含推理速度 (tokens/s) 和性价比分析
💰 OpenRouter 聚合 345+ 模型 API 价格,实时更新的输入/输出 token 单价和上下文窗口

💰 大模型 API 价格参考 USD

价格单位:美元 / 百万 tokens · 数据来源 OpenRouter · 支持筛选和排序

模型 输入价格 输出价格 上下文
加载价格数据…

数据来源:OpenRouter · 价格可能随时变动,请以官方为准 · 仅显示主流模型