1. 帮助中心
无忧引擎 API
  • 无忧引擎 API
    • 引言
    • 发出请求
    • 在线调试说明
    • 模型
      • 获取可用模型列表
      • 获取指定模型信息
    • OpenAI 兼容接口(Chat Completions)
      • 创建聊天对话
    • OpenAI 兼容接口(Responses API)
      • 创建模型响应
      • 压缩 Responses 对话上下文
    • Claude 原生接口(Messages)
      • 创建 Claude Messages 对话
    • Gemini 原生接口
      • 创建 Gemini 原生响应
      • 创建 Gemini 原生流式响应
    • 帮助中心
      • HTTP 状态码及其含义
  1. 帮助中心

HTTP 状态码及其含义

无忧引擎尽量保持与上游及兼容协议一致的 HTTP 状态码。排查问题时,应同时查看响应体中的 error.message 或 message。

成功状态#

状态码含义处理建议
200请求成功正常解析响应
流式请求通常先返回 200,随后通过 SSE 持续传输数据。

客户端错误#

状态码含义常见原因处理建议
400请求参数错误JSON 格式错误、缺少必填字段、参数不受模型支持检查请求体和模型参数
401未通过身份验证API Key 缺失、错误、已删除或鉴权格式不正确检查 Authorization、x-api-key 或 x-goog-api-key
403无访问权限用户分组、令牌或渠道没有模型权限检查分组、模型授权和 API Key 限制
404资源不存在接口路径错误、模型名称错误或模型尚未启用查询 GET /v1/models 并核对路径
408请求超时请求处理时间超过限制缩短输入、降低输出上限或重试其他渠道
409请求冲突重复任务或当前状态不允许该操作根据响应信息调整请求
413请求体过大文本、图片或上下文超过网关限制压缩或拆分输入内容
422参数可以解析但无法处理参数组合不合法或模型不支持该能力删除不兼容参数后重试
429请求过多或额度受限RPM/TPM/并发限制、账户余额不足或上游限流降低并发、检查余额并进行退避重试

服务端及上游错误#

状态码含义常见原因处理建议
500网关内部错误内部处理异常保留请求时间和日志编号后联系管理员
502上游响应异常上游返回无效响应、连接中断或协议转换失败有限次数重试或切换渠道
503服务暂不可用没有可用渠道、渠道熔断或上游维护稍后重试并检查模型状态
504上游响应超时上游模型生成过慢或网络超时降低输出长度、使用流式请求或切换渠道

翻译业务的重试建议#

以下错误通常可以进行有限次数重试:
408, 429, 500, 502, 503, 504
建议:
1.
单次请求最多重试 1~2 次。
2.
使用指数退避,例如 0.5 秒、1 秒。
3.
不要自动重试 400、401、403、404 等确定性错误。
4.
流式请求已经输出部分内容后,不要直接拼接重试结果,应整次重新生成或交由业务层处理。
5.
保存请求时间、模型名称、状态码和响应错误,方便在无忧引擎使用日志中定位。
上一页
创建 Gemini 原生流式响应
Built with