G9v3模型教程:Artificial Analysis新评测AI模型分析与部署指南

2026-08-04 | AI Tools Hub

G9v3是8月3日刚登陆Artificial Analysis评测平台的新语言模型系列,包含G9v3-3B和G9v3-39A5B两个版本。G9v3-3B于7月22日发布,G9v3-39A5B于8月3日发布,两者均定位于轻量级高效模型。

模型架构

G9v3系列采用混合注意力机制,在有限参数量下最大化推理效率。G9v3-3B仅30亿参数,适合边缘设备和移动端部署。G9v3-39A5B采用稀疏激活设计,总参数39A但激活参数较少,平衡了能力和成本。两个版本均支持中英双语。

使用方式

G9v3系列提供开源权重和API两种使用方式:

pip install g9v3-sdk
g9v3 --model g9v3-3b --device cuda

G9v3-3B可在4GB显存GPU上运行,G9v3-39A5B需要16GB以上显存。两个版本均支持GGUF量化格式,可通过Ollama或llama.cpp本地运行。

性能评测

在Artificial Analysis Intelligence Index中,G9v3系列得分处于轻量级模型前列。G9v3-3B在同等参数量模型中推理速度领先,G9v3-39A5B在编程评测中表现出色。两个版本的开源特性使其成为学术研究和定制化部署的理想选择。

对轻量级模型感兴趣?看看Ollama本地部署指南,或了解Unsloth本地微调教程

📚 常见问题

G9v3模型是什么?

G9v3是8月3日刚登陆Artificial Analysis评测平台的新语言模型系列,包含G9v3-3B和G9v3-39A5B两个版本。G9v3-3B于7月22日发布,G9v3-39A5B于8月3日发布,两者均定位于轻量级高效模型。