调用问题

401、模型不存在、超时、429、回复被截断——现象与处理。

调用相关的高频问题。先按现象对号入座,再按给出的链接细查。

返回 401 Unauthorized?

  • 密钥不对:核对是否为创建时保存的完整值(打码列表里的不是完整密钥);
  • 密钥已删除或过期:到「API 密钥」页确认状态,必要时重建;
  • 请求头写错:OpenAI 兼容协议用 Authorization: Bearer <key>,不要漏 Bearer 前缀;
  • 详见鉴权方式

提示模型不存在?

  • 模型 ID 拼写错误——到模型广场复制准确的 ID,不要手写;
  • 平台不提供该模型或暂不可用——在模型广场确认模型卡片存在且可用。

请求超时或响应很慢?

  • 长上下文 / 长输出的请求天然更慢,检查 max_tokens 是否设置过大;
  • 给客户端设置合理超时与重试(指数退避);
  • 流式场景用 "stream": true,首字节更快、体感延迟低。

频繁收到 429?

请求频率超限。降低并发、加退避间隔;持续高压联系平台调整配额。见错误码说明

返回的内容是空的或被截断?

  • finish_reasonlength:回复被 max_tokens 截断,调大该参数;
  • 检查 messages 里是否误传了空 content
  • 个别模型对输入格式有要求(如图像模态的格式限制),参考模型卡片说明。

怎么确认调用真的成功了?

看两点:HTTP 状态码 200 且响应含 choices / usage;再到控制台日志页看到这笔请求的记录(有 Token 消耗与费用)。两边对上,链路就是通的。