跳到主要内容

新用户注册即送测试额度,够跑完一整套 eval

官方授权渠道

Gemini 3.1 Pro API 中转

Google 当前的旗舰推理档,100 万上下文,长短请求分档计价。

  • 上下文

    1M

  • 最大输出

    64K

  • 推理精度

    Vendor-managed

  • 许可

    Proprietary

Gemini 3.1 Pro 是 Google 当前面向旗舰级推理的一档,上下文 100 万 token,最大输出约 64K,支持文本与图像输入。它的计价按上下文长度分档:20 万 token 以内为每百万 token 输入 2 美元、输出 12 美元,超过后升至 4 美元 / 18 美元。我们通过官方商用授权渠道提供访问,不涉及账号池或逆向客户端协议。

闭源模型,通过厂商官方商用授权渠道提供。有合同、有发票、可审计——不是号池,也不是逆向的客户端协议。

规格

模型 ID
gemini-3.1-pro
发布方
Google
供给方式
官方授权渠道
许可
Proprietary
上下文
1M
最大输出
64K
推理精度
Vendor-managed
输入模态
文本 · 图像
发布时间
2026-02-19

它强在哪

短请求的价格很有竞争力
20 万 token 以内的档位是输入 2 美元、输出 12 美元每百万 token。绝大多数生产请求落在这一档,实际账单往往比按顶档估算的低不少。
百万窗口 + 图像输入
长文档与图像可以在同一个请求里处理,适合带图表、扫描件的资料分析。
生态另一极的对照
把 Gemini 放进来的价值之一是横向对照:同一把 Key 上和 Claude、GPT、开源旗舰跑同一批题,能力与成本的差异会直接暴露出来。

典型用法

  • 带图表与扫描件的长资料分析
  • 成本敏感、请求普遍在 20 万 token 以内的链路
  • 多厂商横向对照与供应商冗余
  • 需要 Google 生态一致性的场景

三步接入

改一行 base_url,再把 model 换成下面这个 ID,其余代码不动。

model: "gemini-3.1-pro"

curl https://api.nexaix.net/v1/chat/completions \
  -H "Authorization: Bearer $NEXAIX_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.1-pro",
    "stream": true,
    "messages": [
      { "role": "user", "content": "Summarise this contract." }
    ]
  }'

关于这个模型

计价分档具体怎么算?

按请求的上下文长度分档:20 万 token 以内走低档,超过后整体升到高档。做成本估算时建议按你真实的输入长度分布来算,而不是取平均值。

为什么没有 Gemini 3.5 Pro?

因为它不存在。Google 这一代的 Pro 档是 3.1 Pro,3.5 / 3.6 是 Flash 系列(更快更便宜的速度档)。有人拿「Gemini 3.5 Pro」做宣传,基本可以判断信息来源不可靠。

你们这边会记录对话吗?

不会。我们这一侧不落盘、不留存,只保留请求 ID、token 计数、时间戳、状态码等计费与排障必需的元数据。上游厂商的数据处理策略以其官方条款为准。

也看看这些

用你自己的题目跑一遍

注册领测试额度,把你真实的 eval 在这个模型上跑一遍,再决定要不要交生产流量。