2026-08-04 | AI Tools Hub
2026年8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8-Max,总参数量达2.4万亿,激活参数950亿,支持100万Token上下文。这是千问系列目前参数规模最大、性能最强的旗舰模型,在Arena榜单中文本能力与视觉理解均排名第二,编程能力第三,仅次于Anthropic的Claude系列。
Qwen3.8-Max基于Qwen3.5架构迭代,采用稀疏MoE(Mixture of Experts)架构与混合注意力机制的联合优化方案:
稀疏MoE的核心优势在于:虽然总参数量庞大,但每次推理只激活一小部分专家网络,从而实现接近小模型的推理速度,同时拥有大模型的知识容量。
根据阿里官方公布的基准测试数据:
| 评测项目 | Qwen3.8-Max得分 | 说明 |
|---|---|---|
| Arena 文本能力 | 第2名 | 仅次于Claude系列 |
| Arena 视觉理解 | 第2名 | 多模态能力全球第二 |
| Arena 编程能力 | 第3名 | 编程智能体大幅提升 |
| PaperBench | 93.0分 | 较上代提升28.2分,评测新高 |
| WideSearch | 81.9分 | 通用智能体评测前沿 |
| Agent's Last Exam | 52.4分 | 长程任务智能体评测 |
Qwen3.8-Max的API已上线千问AI平台,开发者可以直接调用。同时阿里推出了Token Plan计费方案,日间Credits低至1折,夜间更优惠。
# 安装SDK
pip install dashscope
# Python调用示例
import dashscope
from dashscope import Generation
dashscope.api_key = "your-api-key"
response = Generation.call(
model="qwen3.8-max",
messages=[
{"role": "user", "content": "用Python实现一个快速排序"}
],
result_format="message"
)
print(response.output.choices[0].message.content)
Qwen3.8-Max的API支持三档推理强度,开发者可根据场景灵活选择:
Qwen3.8-Max已适配Claude Code、OpenAI Codex等主流AI编程工具,开发者可以在这些工具中直接配置Qwen3.8-Max作为后端模型。API兼容OpenAI格式,迁移成本极低。
与Qwen3.8同步发布的还有阿里全新Agent产品"千问办公",这是一个基于Qwen3.8-Max构建的企业级AI办公助手,核心能力包括:
千问办公已接入Qwen3.8-Max的API,用户无需配置即可使用。了解更多AI办公工具,可以看我们的MarkItDown文档转换教程。
阿里宣布Qwen3.8-Max将于下周开源完整权重,同时还将开源Qwen3.8-27B小尺寸版本。这意味着开发者可以免费下载并在本地部署。
开源后,推荐使用以下方案本地部署:
对于Qwen3.8-27B小版本,单张24GB显存的GPU(如RTX 3090/4090)配合4-bit量化即可运行。完整版的2.4万亿参数模型则需要多卡集群。如果你对本地部署感兴趣,可以参考我们的vLLM本地部署完整教程。
| 模型 | 总参数 | 激活参数 | 上下文 | 开源 |
|---|---|---|---|---|
| Qwen3.8-Max | 2.4T | 95B | 1M | 下周开源 |
| Kimi K3 | 2.8T | 16B/896专家 | 1M | 已开源 |
| DeepSeek V4 Flash | 1.6T | 13B | 128K | API公测 |
| Claude (Anthropic) | 未公开 | 未公开 | 200K | 闭源 |
Qwen3.8-Max在参数规模上与Kimi K3相当,但在编程和办公场景的优化更为突出。API价格仅为Anthropic Opus5的24%,性价比优势明显。
Qwen3.8-Max的发布标志着中国大模型在万亿参数级别的又一次突破。2.4万亿参数+95B激活+1M上下文+下周开源的组合,对开发者来说极具吸引力。无论是通过API快速调用,还是等开源后本地部署,Qwen3.8-Max都值得尝试。
对于企业用户,千问办公Agent提供了开箱即用的AI办公解决方案。对于个人开发者,等下周权重开源后用Ollama或vLLM部署27B版本是最低成本的体验方式。
2026年8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8-Max,总参数量达2.4万亿,激活参数950亿,支持100万Token上下文。这是千问系列目前参数规模最大、性能最强的旗舰模型,在Arena榜单中文本能力与视觉理解均排名第二,编程能力第三,仅次于Anthropic的Claude系列。
vLLM:适合企业级部署,支持多卡推理,吞吐量高