只是一个默认分类

OpenAI SDK兼容多轮对话怎么传思考历史?工具调用核对表

OpenAI SDK兼容模式下多轮对话传思考历史:必须完整回传assistant消息的content、reasoning_content、tool_calls字段,且tool_call_id与tool_calls的id严格配对;保留思考历史是模型协议要求,丢弃会导致行为异常。

OpenAI base_url 怎么改?三种写法与报错对照

本文讲解 OpenAI base_url 在 Python、Node、curl 中的配置方法,明确 /v1 后缀与优先级,用报错对照表解决 404、401 等常见问题。

AI模型评测怎么做?自建业务对照集的6个步骤

开发者做AI模型评测,关键是自建业务对照集:把任务写成可判定条件,分层构造样本,锁定模型与参数,用同一套代码跨模型跑,建立回归基线。本文给出6个可执行步骤与判定标准,并说明黑盒路由和联网检索评测的陷阱。

AI API选型:自动路由还是锁定模型?6条判据

面对AI API选型,本文给出自动路由与显式锁定的明确分界:弱约束自由文本可放开自动路由,强Schema与多步工具调用必须锁定模型,并提供六条可执行判据与分流决策表。

AI API并发怎么定上限?四个判据加压测法

AI API并发上限不是常数,而是四个约束里最先撞墙的那个决定 AI API并发上限的,不是你想开多大,而是四个相互制约的判据:账户侧 RPM/TPM 配额、服务商推理侧的吞吐塌陷点、单请求输出长度占用的槽位时长、以及业务能接受的 p95 尾延迟。你的并发池只能取这四个约束的交集,而且这个交集会随模型架构、上下文长度和账户档位变化。2026-08-11...