评测日期:2026-08-13 | 评分:8.8/10 | 分类:AI模型评测
2026年8月13日凌晨,DeepSeek低调上线V4 Pro正式版(DeepSeek-V4-Pro-0813)。1.6万亿总参数、激活490亿,官方评测显示其在多项基准测试中接近Anthropic Fable 5水平,Terminal Bench 87.9分仅差Fable 5的88.0分1分,已压过Claude Opus 4.8。这是国产大模型首次在前沿推理能力上站到全球第一梯队。
| 维度 | 评分 | 说明 |
|---|---|---|
| Agent能力 | 9.5 | Terminal Bench 87.9,DeepSWE从54%→65.9%(V4 Pro正式版继续领先) |
| 编程 | 9.0 | 代码生成、调试、重构全面接近Fable 5 |
| 推理 | 9.0 | 复杂推理任务与Opus 4.8持平,部分场景超越 |
| 中文 | 9.5 | 中文理解与生成依旧是国产模型强项 |
| 性价比 | 9.0 | 输入3元/输出6元(缓存未命中),缓存命中仅0.025元,仍远低于Fable 5/Opus 4.8 |
| 上下文 | 9.0 | 1M token超长上下文 |
| 生态 | 8.0 | API兼容OpenAI格式,已接入Cursor/OpenClaw等主流工具 |
| 稳定性 | 8.5 | 正式版比预览版显著提升,API调用方式不变 |
综合评分:8.8/10 — 首次有国产模型在推理能力上与全球最顶尖模型站在同一梯队
| 基准 | V4 Pro 0813 | Fable 5 | Opus 4.8 | V4 Flash |
|---|---|---|---|---|
| Terminal Bench | 87.9 | 88.0 | 85.0 | 82.7 |
| DeepSWE v1.1 | 65.9% | ~66% | ~60% | 54.4% |
| APEX-Agents | 57.5% | ~58% | ~55% | ~47% |
| 价格(输出/1M) | ¥6 | ~¥45 | ~¥52 | ¥2 |
| 模型 | 定位 | 优势 | 劣势 |
|---|---|---|---|
| DeepSeek V4 Pro | 推理+Agent旗舰 | 性价比极高,中文最强 | 生态不如Claude成熟 |
| Claude Fable 5 | 全球最强推理 | Terminal Bench 88.0第一 | 价格昂贵 |
| Claude Opus 4.8 | 全能旗舰 | 生态完善 | 被V4 Pro超越 |
| Grok 4.6 | Agent+编程 | AII 61分并列GPT-5.6 | 新模型稳定性待验证 |
from openai import OpenAI
client = OpenAI(
api_key="your-deepseek-api-key",
base_url="https://api.deepseek.com/v1"
)
response = client.chat.completions.create(
model="deepseek-v4-pro", # 自动指向0813正式版
messages=[{"role": "user", "content": "帮我分析这段代码的性能瓶颈"}],
max_tokens=4096
)
DeepSeek V4 Pro正式版是国产大模型的重要里程碑——首次在Terminal Bench、DeepSWE等前沿推理基准上与Fable 5站在同一梯队,同时价格仅为其1/7。对于需要强推理能力但预算有限的开发者和企业,V4 Pro是当前最优选择。缓存命中时0.025元/1M的价格更是几乎免费。