跳到主要内容

新用户注册即送测试额度,够跑完一整套 eval

官方授权渠道

Grok 4.5 API 中转

xAI 口中的「Opus 级但更快更省」,官方定价确实低一档。

  • 上下文

    500K

  • 最大输出

    64K

  • 推理精度

    Vendor-managed

  • 许可

    Proprietary

Grok 4.5 于 2026 年 7 月 8 日面向开发者发布,上下文 50 万 token,支持文本与图像输入、工具调用、结构化输出、联网检索与扩展推理。Artificial Analysis 把它排在智能指数 168 个模型中的第 4(得分 54),而官方定价为每百万 token 输入 2 美元、输出 6 美元(缓存输入 0.5 美元),单任务成本明显低于同档竞品。需要注意它的窗口相比 Grok 4.3 的 100 万实际是缩小了的。

闭源模型,通过厂商官方商用授权渠道提供。有合同、有发票、可审计——不是号池,也不是逆向的客户端协议。

规格

模型 ID
grok-4.5
发布方
xAI
供给方式
官方授权渠道
许可
Proprietary
上下文
500K
最大输出
64K
推理精度
Vendor-managed
输入模态
文本 · 图像
发布时间
2026-07-08

它强在哪

接近前沿,价格低一档
智能指数排到第 4,而输入 2 美元、输出 6 美元的官方定价明显低于同档的闭源旗舰。追求「够强且划算」的链路,它是很难忽略的一个点。
缓存输入便宜到 0.25 倍
缓存命中的输入按 0.5 美元每百万 token 计。系统提示词长、重复前缀多的智能体链路,实际成本会比标价再低一截。
联网检索是内建能力
扩展推理与联网检索都是模型自带的,不需要你另外搭一套检索管线就能处理时效性问题。

典型用法

  • 成本敏感但要求接近前沿能力的生产链路
  • 系统提示词长、可大量命中缓存的智能体
  • 需要时效性信息的问答与研究任务
  • 与 Claude / GPT 旗舰做成本效果比的对照

三步接入

改一行 base_url,再把 model 换成下面这个 ID,其余代码不动。

model: "grok-4.5"

curl https://api.nexaix.net/v1/chat/completions \
  -H "Authorization: Bearer $NEXAIX_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.5",
    "stream": true,
    "messages": [
      { "role": "user", "content": "Summarise this contract." }
    ]
  }'

关于这个模型

Grok 4.5 的上下文为什么比 4.3 还小?

确实如此:4.5 是 50 万 token,而 4.3 是 100 万。xAI 这一代的取舍是速度与 token 效率优先。需要百万级窗口的任务,我们线上还有 GLM-5.2、DeepSeek V4、Kimi K3、Claude Opus 5 和 GPT-5.6 系列。

超过 20 万 token 的请求会更贵吗?

会。官方对总 token 超过 20 万的请求采用更高一档的计价。做长上下文的成本估算时要把这个台阶算进去。

你们的 Grok 是官方渠道吗?

是。和我们提供的其他闭源模型一样,通过厂商官方商用授权渠道供给,有合同、有发票、可审计,不使用账号池,也不逆向客户端协议。

也看看这些

用你自己的题目跑一遍

注册领测试额度,把你真实的 eval 在这个模型上跑一遍,再决定要不要交生产流量。