跳到主要内容

通用参数

不同协议的字段不完全相同,但大多数文本接口都会围绕模型、输入、生成控制和输出格式展开。

核心字段​

参数常见位置说明
model请求体要调用的模型 ID,例如 gpt-4o、claude-sonnet-4-6、gemini-2.5-flash
messages/v1/chat/completions多轮对话消息数组
input/v1/responsesResponses API 的输入内容
max_output_tokens/v1/responsesResponses API 控制最大输出长度;max_tokens 不适用于该接口
max_completion_tokens/v1/chat/completionsChat Completions 当前推荐的最大生成 Token 参数
max_tokens旧版 Chat Completions 或其他协议Chat Completions 中已弃用;优先改用 max_completion_tokens
stream请求体是否启用流式输出
temperature请求体控制随机性,值越低越稳定
top_p请求体核采样参数,通常不要和 temperature 同时大幅调整
tools请求体工具或函数调用定义
response_format / text请求体控制 JSON 或结构化输出

推荐调参顺序​

  1. 先只传必填字段,确认接口、Key 和模型可用。
  2. 再按接口协议调整输出上限:Responses API 使用 max_output_tokens,Chat Completions 使用 max_completion_tokens。
  3. 需要更稳定结果时降低 temperature,需要更多变化时提高 temperature。
  4. 需要工具调用或结构化输出时,再加入 tools、tool_choice、response_format 等高级字段。

模型选择​

模型列表和能力建议集中放在 模型与能力。API 参考页只展示接口字段,不再承载模型选型说明。

下一步​