- 首页
- 模型
模型总览
我们线上跑的每一个模型
开源权重的部署在自有集群上,闭源的走官方商用授权渠道——两类分开列,不混着说。规格照实写,变更走更新日志。
自有算力部署
官方发布的开源权重,装在我们自己买的卡上。精度与权重版本公开,可复测。
| 模型 | 上下文 | 最大输出 | 精度 | 许可 | 查看详情 |
|---|---|---|---|---|---|
| Kimi K3kimi-k32.8T MoE、100 万 token 上下文,原生看得懂图和视频的旗舰模型。 | 1M | 1M | BF16 | Open weights | 查看详情 |
| GLM-5.2glm-5.2750B 稀疏 MoE、100 万上下文、MIT 许可,为软件工程调过的开源旗舰。 | 1M | 131K | BF16 / FP8 | MIT | 查看详情 |
| DeepSeek V4 Prodeepseek-v4-pro1.6 万亿参数混合专家,思考与非思考双模式,MIT 许可。 | 1M | 384K | BF16 | MIT | 查看详情 |
| DeepSeek V4 Flashdeepseek-v4-flash284B 总参数、每 token 只激活 13B,把单位成本压到最低的一档。 | 1M | 384K | BF16 | MIT | 查看详情 |
| MiniMax M3minimax-m3229.9B 混合专家,把前沿编码、百万上下文和原生多模态装进一个模型。 | 1M | 128K | BF16 | Open weights | 查看详情 |
| Qwen3.6-35B-A3Bqwen3.6-35b-a3bApache 2.0,每 token 只激活 3B,专门为智能体编码调过。 | 128K | 32K | BF16 | Apache-2.0 | 查看详情 |
| gpt-oss-120bgpt-oss-120bOpenAI 自己放出来的开源权重推理模型,Apache 2.0。 | 128K | 32K | BF16 / MXFP4 | Apache-2.0 | 查看详情 |
官方授权渠道
闭源模型无法自建,我们通过厂商的官方商用授权提供访问:有合同、有发票、可审计。不使用号池,不逆向客户端协议。
| 模型 | 上下文 | 最大输出 | 精度 | 许可 | 查看详情 |
|---|---|---|---|---|---|
| Claude Opus 5claude-opus-5100 万上下文全程不衰减,五档 effort 控制,且支持零数据保留。 | 1M | 128K | Vendor-managed | Proprietary | 查看详情 |
| Claude Fable 5claude-fable-5Anthropic 在 Opus 之上新开的 Mythos 级,能力上限优先的一档。 | 1M | 128K | Vendor-managed | Proprietary | 查看详情 |
| GPT-5.6 Solgpt-5.6-solGPT-5.6 家族的前沿旗舰,105 万上下文,面向复杂推理与长程智能体。 | 1.05M | 128K | Vendor-managed | Proprietary | 查看详情 |
| GPT-5.6 Terragpt-5.6-terraGPT-5.6 的日常档:窗口和 Sol 一样大,价格只有一半。 | 1.05M | 128K | Vendor-managed | Proprietary | 查看详情 |
| GPT-5.6 Lunagpt-5.6-lunaGPT-5.6 里最快最便宜的一档,窗口一点没缩。 | 1.05M | 128K | Vendor-managed | Proprietary | 查看详情 |
| Grok 4.5grok-4.5xAI 口中的「Opus 级但更快更省」,官方定价确实低一档。 | 500K | 64K | Vendor-managed | Proprietary | 查看详情 |
| Gemini 3.1 Progemini-3.1-proGoogle 当前的旗舰推理档,100 万上下文,长短请求分档计价。 | 1M | 64K | Vendor-managed | Proprietary | 查看详情 |
