厂商调用差异
认证与客户端 Base URL 见认证与 Base URL。本页记录 2026-09-22 的代表模型实测;结果限定于测试时的账户权限和渠道,不是对所有版本与参数组合的保证。
协议支持一览
| 协议 | 本次成功的代表模型 |
|---|---|
| Chat Completions | 当前公开目录中的 36 个文本模型;包括 GPT、Claude、Gemini、DeepSeek、GLM、Kimi、MiniMax 等 |
| Anthropic Messages | claude-haiku-4-5、claude-sonnet-5、deepseek-v4-flash、glm-5.3-flash、kimi-k2.6、MiniMax-M2.7 |
| Responses API | gpt-5.6-luna、gpt-5.5(Codex CLI) |
| Gemini 原生 | gemini-3.6-flash、gemini-3.7-flash、gemini-3.8-flash;gemini-3.1-flash-image 验证了图片生成 |
Chat Completions 成功不能证明 Responses 可用。本次 Claude Haiku 的 Responses 请求返回 500 / convert_request_failed / not implemented,DeepSeek Flash 返回 400 / MissingParameter。其他模型未在此接口逐一验证,不能将错误统一写成 not implemented。
角色与多轮上下文
developer 角色因模型和路由而异。 本次 DeepSeek Flash、GLM 5.3 Flash、MiniMax M2.7 接受带 developer 的请求并返回文本;Claude Haiku、Kimi K2.6 返回角色不受支持。通用入门示例可使用 system / user / assistant;请求被接受不等于所有模型的角色优先级语义相同。
Anthropic 的 system 放顶层。 使用 Messages 格式时,将系统提示放在顶层 system 字段。
保留工具调用需要的上下文。 OpenAI 兼容接口保留助手的 tool_calls,并使用对应 tool_call_id 回传 role: "tool" 的结果。Anthropic 接口保留 tool_use 与 tool_result 的关联。
不要统一丢弃 thinking。 本次 Claude Sonnet 5 在启用扩展思考时返回了 thinking 和 tool_use;原样回传包含签名的助手 content,再添加 tool_result,可得到最终回答。按Anthropic 协议保留需要的块,不自行修改或伪造签名。其他模型的 reasoning_content 应按其规范处理。
DeepSeek
本次 deepseek-v4-pro 与 deepseek-v4-flash 在发送 enable_thinking: true 后,都返回了非空 reasoning_content 与最终文本。不能概括为“只有 Pro 支持思考”。本轮没有验证 true/false 的开关效果,也未验证对应 Messages 思考参数的全部行为。
Kimi
kimi-k3 的最小请求在 temperature: 1 和 temperature: 0.3 时均成功,不能写成必须等于 1。请求成功只证明参数被接受,不证明上游一定按该数值改变采样分布。参数报错时,保留错误信息并退回最小请求排查。
MiniMax
模型名按目录原样复制,例如 MiniMax-M2.7、MiniMax-M3,不要自行改写大小写或连字符。模型授权和供应情况以当前账户为准。
智谱 GLM
推理可能消耗输出预算。本次 glm-5-turbo 在 max_tokens: 128 时返回 HTTP 200,但 finish_reason: "length" 且最终文本为空;提高到 1024 后返回文本。空输出时先检查结束原因与推理消耗,不要仅凭 HTTP 200 判断完整回答成功。
Anthropic
Messages 的 x-api-key 与 Bearer 鉴权均已验证成功。工具定义的数量不是唯一限制条件:同一 claude-sonnet-5 请求分别携带 1、13、32 个含嵌套对象、数组和枚举的工具定义均成功;32 个工具在自动选择模式下也成功。
这不代表任意复杂度的工具均可用,也不代表完整 Hermes 默认工具组合已通过。遇到 400 时记录工具数量、schema、请求体大小和错误详情,再逐步缩减工具集。配置示例见Hermes。
Google
Gemini 已出现在当前模型目录。三款文本模型的原生接口和一款图像模型已实测成功,具体型号见上表。实际可用范围仍取决于账户授权和渠道状态。
原生接口路径为 /v1beta/models/{model}:generateContent,请求体包含 contents,常用生成参数放在 generationConfig 中。
OpenAI
本次 GPT 代表模型的 Chat Completions、Responses 均成功;gpt-image-2 图片生成返回了可解码图像。图片编辑和所有高级参数组合没有在本轮覆盖,不能由生成成功推断编辑成功。图片响应解析见第一次调用。
遇到 400 怎么办
- 核对模型名称、授权与协议路径。
- 保留响应的
error.code/type/message和请求 ID。 - 使用对应协议的最小必填参数复现。
- 逐项恢复角色、采样参数与工具定义。
- 多轮调用检查工具 ID 和协议要求的完整上下文。
更多排查方法见常见问题。