调用问题
401、模型不存在、超时、429、回复被截断——现象与处理。
调用相关的高频问题。先按现象对号入座,再按给出的链接细查。
返回 401 Unauthorized?
- 密钥不对:核对是否为创建时保存的完整值(打码列表里的不是完整密钥);
- 密钥已删除或过期:到「API 密钥」页确认状态,必要时重建;
- 请求头写错:OpenAI 兼容协议用
Authorization: Bearer <key>,不要漏Bearer前缀; - 详见鉴权方式。
提示模型不存在?
- 模型 ID 拼写错误——到模型广场复制准确的 ID,不要手写;
- 平台不提供该模型或暂不可用——在模型广场确认模型卡片存在且可用。
请求超时或响应很慢?
- 长上下文 / 长输出的请求天然更慢,检查
max_tokens是否设置过大; - 给客户端设置合理超时与重试(指数退避);
- 流式场景用
"stream": true,首字节更快、体感延迟低。
频繁收到 429?
请求频率超限。降低并发、加退避间隔;持续高压联系平台调整配额。见错误码说明。
返回的内容是空的或被截断?
finish_reason为length:回复被max_tokens截断,调大该参数;- 检查
messages里是否误传了空content; - 个别模型对输入格式有要求(如图像模态的格式限制),参考模型卡片说明。
怎么确认调用真的成功了?
看两点:HTTP 状态码 200 且响应含 choices / usage;再到控制台日志页看到这笔请求的记录(有 Token 消耗与费用)。两边对上,链路就是通的。

