LinkAGI

AI API 报错 · 504 网关超时

AI API 返回 504:上游没坏,也可能卡在首字节和代理超时

504 表示某一层网关没有在规定时间内拿到下游响应。上游控制台显示正常,并不能排除单请求首字节过慢、边缘代理超时、非流式长任务或客户端提前断开。

更新:2026-07-23 · 先用短请求验证,再迁移正式任务。

先把三个关键变量分开

同一个错误可能由不同层级触发。按地址、认证、模型或并发逐层验证,比同时修改所有配置更容易定位原因。

首字节时间

文本长推理、图片生成和大输入可能长时间没有任何响应字节。

代理超时

CDN、Nginx、应用网关与客户端各自都有读取或空闲超时。

流式边界

流式可以更早发送数据,但不能修复没有流式能力的端点或真正卡死的上游。

三步完成最小验证

保留一个可复现的短请求,每次只修改一个变量,并记录返回状态。

01

缩小请求

改用短提示、小图片或较小输出上限,判断是否与工作量相关。

02

比较流式与非流式

在端点支持的前提下分别测试,并记录首字节和总耗时。

03

沿链路核对时间

对比客户端报错时间、网关访问日志和上游请求记录,找到最先终止的一层。

文本端点的流式验证思路

curl -N https://api.linktoagi.com/v1/chat/completions \
  -H "Authorization: Bearer $LINKAGI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "从控制台复制当前模型名",
    "stream": true,
    "messages": [{"role":"user","content":"只回复 OK"}]
  }'

API Key 只放在环境变量或客户端密钥字段中,不要写进公开仓库、截图或前端代码。模型名与价格请从 LinkAGI 实时模型广场复制。

结果出现后,下一步看什么

不要把所有失败都归因到“中转站不稳定”。先判断请求停在路径、认证、模型、速率还是超时层。

短请求成功、长请求 504

重点检查首字节、输出上限、推理时长和代理读取超时。

关闭 CDN 后恢复

边缘层超时或缓冲可能是主要因素,应按长连接要求配置而非简单无限加时。

图片端点 504

确认该端点是否支持流式;图片任务通常要关注任务模式、轮询和生成耗时。

重试立即成功

可能是瞬时拥塞,但仍应保留失败样本,避免用高频重试掩盖稳定性问题。

LinkAGI 场景

使用 api.linktoagi.com 接入后,可以在控制台调用日志中核对模型、Token、状态和扣费;遇到持续异常可携带时间与请求信息联系支持,但不要发送完整 API Key。

常见问题

开启流式一定能解决 504 吗?

不能。流式只在端点支持并能较早产生数据时降低等待首字节的风险。

把所有超时都改成 10 分钟可以吗?

不建议一刀切。超时过长会占用连接和并发,应按端点类型、首字节和任务模式分别配置。

上游正常为什么还会 504?

上游整体正常不代表每个请求都及时响应;中间的 CDN、反代和应用网关也可能先到超时阈值。

先用短请求验证 LinkAGI

注册赠送 ¥0.2 试用额度;模型、号池和价格以实时页面为准。

注册并创建 API Key