官方授权渠道
Grok 4.5 API 中转
xAI 口中的「Opus 级但更快更省」,官方定价确实低一档。
上下文
500K
最大输出
64K
推理精度
Vendor-managed
许可
Proprietary
Grok 4.5 于 2026 年 7 月 8 日面向开发者发布,上下文 50 万 token,支持文本与图像输入、工具调用、结构化输出、联网检索与扩展推理。Artificial Analysis 把它排在智能指数 168 个模型中的第 4(得分 54),而官方定价为每百万 token 输入 2 美元、输出 6 美元(缓存输入 0.5 美元),单任务成本明显低于同档竞品。需要注意它的窗口相比 Grok 4.3 的 100 万实际是缩小了的。
闭源模型,通过厂商官方商用授权渠道提供。有合同、有发票、可审计——不是号池,也不是逆向的客户端协议。
规格
- 模型 ID
- grok-4.5
- 发布方
- xAI
- 供给方式
- 官方授权渠道
- 许可
- Proprietary
- 上下文
- 500K
- 最大输出
- 64K
- 推理精度
- Vendor-managed
- 输入模态
- 文本 · 图像
- 发布时间
- 2026-07-08
- 价格
- 见定价页
它强在哪
- 接近前沿,价格低一档
- 智能指数排到第 4,而输入 2 美元、输出 6 美元的官方定价明显低于同档的闭源旗舰。追求「够强且划算」的链路,它是很难忽略的一个点。
- 缓存输入便宜到 0.25 倍
- 缓存命中的输入按 0.5 美元每百万 token 计。系统提示词长、重复前缀多的智能体链路,实际成本会比标价再低一截。
- 联网检索是内建能力
- 扩展推理与联网检索都是模型自带的,不需要你另外搭一套检索管线就能处理时效性问题。
典型用法
- 成本敏感但要求接近前沿能力的生产链路
- 系统提示词长、可大量命中缓存的智能体
- 需要时效性信息的问答与研究任务
- 与 Claude / GPT 旗舰做成本效果比的对照
三步接入
改一行 base_url,再把 model 换成下面这个 ID,其余代码不动。
model: "grok-4.5"
curl https://api.nexaix.net/v1/chat/completions \
-H "Authorization: Bearer $NEXAIX_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.5",
"stream": true,
"messages": [
{ "role": "user", "content": "Summarise this contract." }
]
}'import os
from openai import OpenAI
client = OpenAI(
# 只有这一行是新的
base_url="https://api.nexaix.net/v1",
api_key=os.environ["NEXAIX_API_KEY"],
)
# 下面全是你原来的代码
stream = client.chat.completions.create(
model="grok-4.5",
stream=True,
messages=[
{"role": "user", "content": "Summarise this contract."}
],
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="")import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.nexaix.net/v1", // 只有这一行是新的
apiKey: process.env.NEXAIX_API_KEY,
});
// 下面全是你原来的代码
const stream = await client.chat.completions.create({
model: "grok-4.5",
stream: true,
messages: [
{ role: "user", content: "Summarise this contract." }
],
});
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? "");
}关于这个模型
Grok 4.5 的上下文为什么比 4.3 还小?
确实如此:4.5 是 50 万 token,而 4.3 是 100 万。xAI 这一代的取舍是速度与 token 效率优先。需要百万级窗口的任务,我们线上还有 GLM-5.2、DeepSeek V4、Kimi K3、Claude Opus 5 和 GPT-5.6 系列。
超过 20 万 token 的请求会更贵吗?
会。官方对总 token 超过 20 万的请求采用更高一档的计价。做长上下文的成本估算时要把这个台阶算进去。
你们的 Grok 是官方渠道吗?
是。和我们提供的其他闭源模型一样,通过厂商官方商用授权渠道供给,有合同、有发票、可审计,不使用账号池,也不逆向客户端协议。
