Gemini 3.1 Pro

厂家 / 系列
GoogleGemini
上下文
1M
输入价
$2.00 / 百万 tokens
输出价
$12.00 / 百万 tokens
许可
闭源

快速对比

Gemini 3.1 Pro 固定为第一列,选择一个候选即可并列查看关键规格。

查看 Gemini 系列对比

COMPARE MATRIX · 横向比较

模型比较

并列查看 0模型的关键规格

当前不足 2 项,可关闭面板后继续选择。

已选模型规格比较矩阵
比较项
规格暂无可比较规格
提示:左右滚动可查看全部项目

概览

Google DeepMind 于 2026-02-19 上线的 Pro 档旗舰,官方定位是「应对复杂任务、把创意落地」,强项是代理执行、高阶编程、长上下文与多模态理解。输入 100 万 token、输出 64K token。官方公布的成绩包括 GPQA Diamond 94.3%、SWE-Bench Verified 80.6%、ARC-AGI-2 77.1%、MMMLU 92.6%、MRCR v2(128K 档)84.9%、LiveCodeBench Pro 2887 Elo。注意:截至 2026-08,它在 Gemini API 上仍以 gemini-3.1-pro-preview 预览形态提供、无免费额度;分档定价为 ≤200K token 时 $2.00 / $12.00,超过 200K 时 $4.00 / $18.00。官方标注「coming soon」的 Gemini 3.5 Pro 至今未发布。

模态
多模态

能力

  • 100 万 token 输入上下文,输出上限 64K token
  • 多模态输入:文本、图像、音频、视频、代码库
  • 复杂代理任务与高阶编程
  • 科学推理(GPQA Diamond 94.3%)
  • 长周期代理与浏览(BrowseComp 85.9%、τ2-bench 电信档 99.3%)

基准测试

分数按各测试原始量表列示,不同测试之间不作百分比换算。

测试项目得分量表
GPQA Diamond94.3/ 100
SWE-Bench Verified80.6/ 100
ARC-AGI-277.1/ 100
MMMLU92.6/ 100
Humanity's Last Exam(可用搜索与代码)51.4/ 100
MRCR v2 (128k)84.9/ 100
LiveCodeBench Pro (Elo)2887原始分数

使用该模型的工具

浏览全部工具