发布日期:2026年8月12日 · 厂商:xAI (Elon Musk) · 评分:8.0/10
Grok 4.6是xAI在2026年8月12日发布的模型,是Grok 4.5的后训练升级版。它在同一1.5万亿参数基座上,通过后训练优化实现5分智能指数提升,从56分跳到61分,与GPT-5.6 Sol并列Artificial Analysis智能指数第三名,但价格仅为前者的三分之一。这是8月份最值得关注的新模型发布。
| 维度 | 评分 | 说明 |
|---|---|---|
| 推理能力 | 8.0/10 | 智能指数61分,与GPT-5.6 Sol并列第三,但略低于Claude Opus 5(63分) |
| 编程能力 | 8.5/10 | 编码性价比领先,$2/$6价格下编程能力超越多数同价位模型 |
| 长文本处理 | 9.0/10 | 50万token上下文窗口,是GPT-5.6的2倍以上 |
| Agent能力 | 8.5/10 | 长任务Agent表现突出,完成轮次约为Claude Opus 5的一半 |
| 性价比 | 9.5/10 | $2/$6每百万token,是Claude Opus 5($5/$25)的40%价格 |
| 创意写作 | 7.5/10 | 内容限制最少,原生X集成,适合创意和趋势类内容 |
| 多模态 | 7.0/10 | 文本为主,多模态能力暂未公开评测数据 |
| 生态集成 | 7.5/10 | 原生X平台集成,API开放,但第三方工具链不如OpenAI完善 |
Grok 4.6定价$2/$6每百万token,在同等智能水平下是最便宜的模型。对比:
| 模型 | 输入价格 | 输出价格 | 智能指数 |
|---|---|---|---|
| Grok 4.6 | $2 | $6 | 61 |
| Claude Opus 5 | $5 | $25 | 63 |
| GPT-5.6 Sol | $5 | $30 | 61 |
| Claude Fable 5 | $10 | $50 | 62 |
Grok 4.6在智能指数仅低2分的情况下,价格不到Claude Opus 5的十分之一(输出端)。
根据arena.ai的Agent排行榜,Grok 4.6在长周期任务中表现突出——完成同样的agentic任务,Grok 4.6大约只需要Claude Opus 5一半的轮次。这意味着更少的API调用、更低的总成本和更快的完成速度。
Grok系列一直以内容审查最少著称。Grok 4.6延续了这一特点,是前沿模型中guardrails最少的,适合需要创意自由度的场景。原生X(Twitter)集成也是独有优势。
61分虽然排名第三,但Claude Opus 5(63分)和Claude Fable 5(62分)仍领先。在需要最高推理精度的任务中,Grok 4.6可能不够。
Grok 4.6与Grok 4.5共享同一1.5T参数基座,提升完全来自后训练。这意味着基础能力天花板没有变化,提升空间有限。
相比Gemini 3系列的强多模态能力,Grok 4.6在图像、视频、音频处理方面暂无公开评测数据。
| 场景 | 推荐度 | 说明 |
|---|---|---|
| 高性价比编程 | ⭐⭐⭐⭐⭐ | $2/$6价格下编码能力极强 |
| 长周期Agent任务 | ⭐⭐⭐⭐⭐ | 轮次少、效率高 |
| 创意内容生成 | ⭐⭐⭐⭐ | 限制少、风格自由 |
| 高精度推理 | ⭐⭐⭐ | 不如Claude Opus 5 |
| 多模态任务 | ⭐⭐ | 暂无多模态评测数据 |
如果你正在寻找性价比最高的AI模型用于编程和Agent任务,Grok 4.6是目前的不二之选。更多AI模型对比请看我们的AI模型排行榜。也可以参考Grok Build CLI评测了解Grok生态的命令行工具。
| 维度 | Grok 4.6 | Claude Opus 5 | GPT-5.6 Sol |
|---|---|---|---|
| 智能指数 | 61 | 63 | 61 |
| 输入/输出价格 | $2/$6 | $5/$25 | $5/$30 |
| 上下文窗口 | 500K | 1M | 大 |
| Agent轮次效率 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐⭐ |
| 内容限制 | 最少 | 标准 | 标准 |
| 开源 | 否 | 否 | 否 |