模型广场

Google: Gemini 3.1 Pro Preview

不用于训练

Gemini 3.1 Pro Preview 面向高级开发和 Agent 系统设计,提升了长程稳定性和工具编排能力,同时提高了 token 效率,并新增 medium 思考档以更好地平衡成本、速度与表现。该模型擅长 Agent 编码、结构化规划、多模态分析和流程自动化,适合自主 Agent、金融建模、表格自动化以及高上下文的企业级任务。作为 Google 的前沿推理模型,它在复杂工作流中带来更强的软件工程表现、更可靠的 Agent 执行和更高的 token 使用效率;依托 Gemini 3 系列的多模态底座,它能在文本、图像、视频、音频和代码之间做高精度推理,并具备 100 万 token 上下文窗口。

多模态能力
文本图片文件

灰色表示当前数据源未覆盖,不代表不支持。

输入 / 输出价格
$0.556 / $3.342.8 折
$2 / $12

per 1M tokens

上下文
1M
发布时间
2026年2月19日

供应商

同一个模型可由多条线路承载,各线路在时延、可用率与上下文上可能不同。 下方只列出本站实际接入的线路;未接入的线路不会出现,「—」表示该线路尚未产出该项实测数据。

供应商上下文输入价格输出价格缓存价格首字时延(TTFT)输出速度(TPS)可用率(SLA)数据安全
Google AI1M
$0.556
$2
$3.34
$12
$0.0556
$0.2
不用于训练
Google Vertex1M
$0.556
$2
$3.34
$12
$0.0556
$0.2
不用于训练
第三方供应商1M
$0.556
$2
$3.34
$12
$0.0556
$0.2
不用于训练

本模型在售状态与折后单价见 模型广场(当前输入 $0.514 / 输出 $3.08)

实时折扣

当前折扣2.8 折折后即结算价,让利 74%
Google 系列近 16 天折扣走势
2026-08-17 · 2.59折2026-09-14 · 2.4折

性能

首字时延(TTFT)
12749ms
从发出请求到收到第一个 token 的耗时
输出速度(TPS)
526 tok/s
生成阶段的平均输出速度

「—」表示该模型在当前统计窗口内还没有实测样本,不代表性能为 0。

可用率

近 24 小时聚合可用率
100.00%
100.0%

每一格代表一小时,鼠标停在格子上可看到该小时的数值;空格表示该小时尚未产出数据。 未产生调用记录的模型显示「—」,不代表可用率为 0。

数据安全

该模型供应商不使用用户数据用于模型训练(来源标记:不用于训练)。

数据处理与留存细则见 文档

快速接入

接口与 OpenAI 完全兼容:把 base_url 指向 https://caapi.top/v1、把 api_key 换成你在控制台创建的密钥, 其余业务代码不用改。把 model 填成 gemini-3.1-pro-preview 即可调用 Gemini 3.1 Pro Preview

from openai import OpenAI

client = OpenAI(
    base_url="https://caapi.top/v1",
    api_key="<CA_API_KEY>",
)

resp = client.chat.completions.create(
    model="gemini-3.1-pro-preview",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)

密钥在控制台创建,可随时吊销重建。完整参数与错误码见 API 文档