概览
Google DeepMind 的开放权重模型系列,采用 Apache 2.0 许可,可自由商用。2026-03-31 首发 E2B、E4B、26B A4B、31B 四档,2026-04-02 在 Gemini API 上线 26B A4B 与 31B,2026-04-16 补上多 token 预测(MTP)权重,2026-06-03 再补齐 12B Unified 统一多模态档。E2B、E4B 面向手机与 IoT 端侧,12B 为无编码器的统一多模态模型,26B 为每 token 激活 4B 的 MoE,31B 为高性能稠密模型。官方对比数据里 31B(IT Thinking)取得 Arena AI 文本 1452 Elo、MMLU Multilingual 85.2%、AIME 2026 89.2%、LiveCodeBench v6 80.0%、GPQA Diamond 84.3%、MMMU Pro 76.9%。权重可从 Hugging Face、Kaggle 等渠道获取(含 GGUF、Compressed Tensors 等量化格式),Gemini API 亦提供免费调用。
- 模态
- 多模态
- 参数量
- E2B / E4B / 12B / 26B(A4B MoE,每 token 激活 4B)/ 31B
- 许可说明
- 开源 · Apache-2.0
能力
- 开放权重,Apache 2.0 许可,可自由商用
- 五档规格:E2B / E4B 端侧、12B 统一多模态、26B A4B MoE、31B 稠密
- 上下文:E2B/E4B 为 128K token,12B/26B/31B 为 256K token
- 全系支持文本与可变分辨率/宽高比的图像输入;E2B、E4B、12B 原生支持音频与视频
- 内置函数调用,可搭建自主智能体;支持可调节的思考模式
- 多 token 预测(Multi-Token Prediction)加速推测解码
基准测试
分数按各测试原始量表列示,不同测试之间不作百分比换算。
| 测试项目 | 得分 | 量表 |
|---|---|---|
| Arena AI(文本,Elo) | 1452 | 原始分数 |
| MMLU Multilingual | 85.2 | / 100 |
| AIME 2026 | 89.2 | / 100 |
| LiveCodeBench v6 | 80 | / 100 |
| GPQA Diamond | 84.3 | / 100 |
| MMMU Pro | 76.9 | / 100 |
版本历史
12B Unified
- 补齐 12B 统一多模态档
MTP 权重
- 为 E2B、E4B、31B、26B A4B 发布多 token 预测(MTP)权重
首发
- 发布 E2B、E4B、31B、26B A4B 四档开放权重
