AI Tools Hub | AI模型排行榜
返回首页

AI模型排行榜 2026

哪个 AI 大模型最强?GPT 还是 Claude?国产 GLM 排第几?Kimi K3 能不能打?

本榜单汇总全球公开基准测试数据,从综合智力、推理、编程、速度、价格五大维度对 AI 大模型排名,每日更新。

更新于 2026-09-04 · 数据来源:Artificial Analysis · 每日自动刷新

综合第一
Claude Fable 5.1
AA Intelligence Index 65.65
编程第一
Claude Fable 5.1
Terminal-Bench 91.4%
速度第一
Gemini 3.5 Flash-Lite
390.5 tokens/s
最便宜
GLM-5.3-Flash
$0.15/$0.50 per M
排名 模型 厂商 综合分 推理 编程 速度 输入$/M 输出$/M 上下文 开源 趋势

排行榜说明

这个排行榜是什么?汇总 Artificial Analysis 等全球公开基准测试的 AI 大模型性能排名

综合分(AA Intelligence Index v4.1)= 融合 GDPval、Terminal-Bench、SciCode、GPQA Diamond、HLE 等 9 项评估的综合指数;编程分为 Terminal-Bench 编码能力

速度为输出吞吐量(tokens/s),越高越快;价格为厂商 API 官方定价(美元/百万 tokens),越低越便宜

• 数据来源:Artificial Analysis 等公开榜单,每日自动更新

• 标记中国厂商(智谱/通义/月之暗面/MiniMax/DeepSeek);标记开源权重模型

首页· 文章· 评测· GitHub热门· · 工具导航
© 2026 AI Tools Hub · 数据来源 Artificial Analysis · 每日更新

模型深度评测

claude-mem 记忆插件深度评测 8.6分 pi-ai Agent Harness 深度评测 8.4分 ods 本地AI服务器深度评测 8.2分 Claude Opus 5 深度评测 8.8分 ChatGPT vs Claude 深度对比评测 Grok 4.5 vs GPT-5.6 vs GLM-5.2 三大模型横评 Kimi K3深度评测:全球最大开源模型 Cursor AI编辑器深度评测 GitHub Copilot vs Cursor 对比评测 Windsurf AI编辑器深度评测 Trae AI编辑器评测 Lovable AI深度评测 Manus AI Agent深度评测 Perplexity vs ChatGPT 搜索评测 Coze AI Agent平台评测 Midjourney vs DALL-E vs Stable Diffusion横评

热门文章

Humanizer:4万星Agent技能去除AI文本机器味 TimesFM:谷歌时序预测基础模型零样本上手 VoiceStudio:开源本地ElevenLabs替代 Portless:Vercel出品,告别localhost端口混乱 Codex+ChatGPT双AI协作编程方案 OpenClaw:388k星真正能做事的AI助手