跳到主要内容

厂商调用差异

认证与客户端 Base URL 见认证与 Base URL。本页记录 2026-09-22 的代表模型实测;结果限定于测试时的账户权限和渠道,不是对所有版本与参数组合的保证。

协议支持一览​

协议本次成功的代表模型
Chat Completions当前公开目录中的 36 个文本模型;包括 GPT、Claude、Gemini、DeepSeek、GLM、Kimi、MiniMax 等
Anthropic Messagesclaude-haiku-4-5、claude-sonnet-5、deepseek-v4-flash、glm-5.3-flash、kimi-k2.6、MiniMax-M2.7
Responses APIgpt-5.6-luna、gpt-5.5(Codex CLI)
Gemini 原生gemini-3.6-flash、gemini-3.7-flash、gemini-3.8-flash;gemini-3.1-flash-image 验证了图片生成
Responses 需要单独验证

Chat Completions 成功不能证明 Responses 可用。本次 Claude Haiku 的 Responses 请求返回 500 / convert_request_failed / not implemented,DeepSeek Flash 返回 400 / MissingParameter。其他模型未在此接口逐一验证,不能将错误统一写成 not implemented。

角色与多轮上下文​

developer 角色因模型和路由而异。 本次 DeepSeek Flash、GLM 5.3 Flash、MiniMax M2.7 接受带 developer 的请求并返回文本;Claude Haiku、Kimi K2.6 返回角色不受支持。通用入门示例可使用 system / user / assistant;请求被接受不等于所有模型的角色优先级语义相同。

Anthropic 的 system 放顶层。 使用 Messages 格式时,将系统提示放在顶层 system 字段。

保留工具调用需要的上下文。 OpenAI 兼容接口保留助手的 tool_calls,并使用对应 tool_call_id 回传 role: "tool" 的结果。Anthropic 接口保留 tool_use 与 tool_result 的关联。

不要统一丢弃 thinking。 本次 Claude Sonnet 5 在启用扩展思考时返回了 thinking 和 tool_use;原样回传包含签名的助手 content,再添加 tool_result,可得到最终回答。按Anthropic 协议保留需要的块,不自行修改或伪造签名。其他模型的 reasoning_content 应按其规范处理。

DeepSeek​

本次 deepseek-v4-pro 与 deepseek-v4-flash 在发送 enable_thinking: true 后,都返回了非空 reasoning_content 与最终文本。不能概括为“只有 Pro 支持思考”。本轮没有验证 true/false 的开关效果,也未验证对应 Messages 思考参数的全部行为。

Kimi​

kimi-k3 的最小请求在 temperature: 1 和 temperature: 0.3 时均成功,不能写成必须等于 1。请求成功只证明参数被接受,不证明上游一定按该数值改变采样分布。参数报错时,保留错误信息并退回最小请求排查。

MiniMax​

模型名按目录原样复制,例如 MiniMax-M2.7、MiniMax-M3,不要自行改写大小写或连字符。模型授权和供应情况以当前账户为准。

智谱 GLM​

推理可能消耗输出预算。本次 glm-5-turbo 在 max_tokens: 128 时返回 HTTP 200,但 finish_reason: "length" 且最终文本为空;提高到 1024 后返回文本。空输出时先检查结束原因与推理消耗,不要仅凭 HTTP 200 判断完整回答成功。

Anthropic​

Messages 的 x-api-key 与 Bearer 鉴权均已验证成功。工具定义的数量不是唯一限制条件:同一 claude-sonnet-5 请求分别携带 1、13、32 个含嵌套对象、数组和枚举的工具定义均成功;32 个工具在自动选择模式下也成功。

这不代表任意复杂度的工具均可用,也不代表完整 Hermes 默认工具组合已通过。遇到 400 时记录工具数量、schema、请求体大小和错误详情,再逐步缩减工具集。配置示例见Hermes。

Google​

Gemini 已出现在当前模型目录。三款文本模型的原生接口和一款图像模型已实测成功,具体型号见上表。实际可用范围仍取决于账户授权和渠道状态。

原生接口路径为 /v1beta/models/{model}:generateContent,请求体包含 contents,常用生成参数放在 generationConfig 中。

OpenAI​

本次 GPT 代表模型的 Chat Completions、Responses 均成功;gpt-image-2 图片生成返回了可解码图像。图片编辑和所有高级参数组合没有在本轮覆盖,不能由生成成功推断编辑成功。图片响应解析见第一次调用。

遇到 400 怎么办​

  1. 核对模型名称、授权与协议路径。
  2. 保留响应的 error.code/type/message 和请求 ID。
  3. 使用对应协议的最小必填参数复现。
  4. 逐项恢复角色、采样参数与工具定义。
  5. 多轮调用检查工具 ID 和协议要求的完整上下文。

更多排查方法见常见问题。