官方授权渠道
Gemini 3.1 Pro API 中转
Google 当前的旗舰推理档,100 万上下文,长短请求分档计价。
上下文
1M
最大输出
64K
推理精度
Vendor-managed
许可
Proprietary
Gemini 3.1 Pro 是 Google 当前面向旗舰级推理的一档,上下文 100 万 token,最大输出约 64K,支持文本与图像输入。它的计价按上下文长度分档:20 万 token 以内为每百万 token 输入 2 美元、输出 12 美元,超过后升至 4 美元 / 18 美元。我们通过官方商用授权渠道提供访问,不涉及账号池或逆向客户端协议。
闭源模型,通过厂商官方商用授权渠道提供。有合同、有发票、可审计——不是号池,也不是逆向的客户端协议。
规格
- 模型 ID
- gemini-3.1-pro
- 发布方
- 供给方式
- 官方授权渠道
- 许可
- Proprietary
- 上下文
- 1M
- 最大输出
- 64K
- 推理精度
- Vendor-managed
- 输入模态
- 文本 · 图像
- 发布时间
- 2026-02-19
- 价格
- 见定价页
它强在哪
- 短请求的价格很有竞争力
- 20 万 token 以内的档位是输入 2 美元、输出 12 美元每百万 token。绝大多数生产请求落在这一档,实际账单往往比按顶档估算的低不少。
- 百万窗口 + 图像输入
- 长文档与图像可以在同一个请求里处理,适合带图表、扫描件的资料分析。
- 生态另一极的对照
- 把 Gemini 放进来的价值之一是横向对照:同一把 Key 上和 Claude、GPT、开源旗舰跑同一批题,能力与成本的差异会直接暴露出来。
典型用法
- 带图表与扫描件的长资料分析
- 成本敏感、请求普遍在 20 万 token 以内的链路
- 多厂商横向对照与供应商冗余
- 需要 Google 生态一致性的场景
三步接入
改一行 base_url,再把 model 换成下面这个 ID,其余代码不动。
model: "gemini-3.1-pro"
curl https://api.nexaix.net/v1/chat/completions \
-H "Authorization: Bearer $NEXAIX_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-pro",
"stream": true,
"messages": [
{ "role": "user", "content": "Summarise this contract." }
]
}'import os
from openai import OpenAI
client = OpenAI(
# 只有这一行是新的
base_url="https://api.nexaix.net/v1",
api_key=os.environ["NEXAIX_API_KEY"],
)
# 下面全是你原来的代码
stream = client.chat.completions.create(
model="gemini-3.1-pro",
stream=True,
messages=[
{"role": "user", "content": "Summarise this contract."}
],
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="")import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.nexaix.net/v1", // 只有这一行是新的
apiKey: process.env.NEXAIX_API_KEY,
});
// 下面全是你原来的代码
const stream = await client.chat.completions.create({
model: "gemini-3.1-pro",
stream: true,
messages: [
{ role: "user", content: "Summarise this contract." }
],
});
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? "");
}关于这个模型
计价分档具体怎么算?
按请求的上下文长度分档:20 万 token 以内走低档,超过后整体升到高档。做成本估算时建议按你真实的输入长度分布来算,而不是取平均值。
为什么没有 Gemini 3.5 Pro?
因为它不存在。Google 这一代的 Pro 档是 3.1 Pro,3.5 / 3.6 是 Flash 系列(更快更便宜的速度档)。有人拿「Gemini 3.5 Pro」做宣传,基本可以判断信息来源不可靠。
你们这边会记录对话吗?
不会。我们这一侧不落盘、不留存,只保留请求 ID、token 计数、时间戳、状态码等计费与排障必需的元数据。上游厂商的数据处理策略以其官方条款为准。
