首字节时间
文本长推理、图片生成和大输入可能长时间没有任何响应字节。
同一个错误可能由不同层级触发。按地址、认证、模型或并发逐层验证,比同时修改所有配置更容易定位原因。
文本长推理、图片生成和大输入可能长时间没有任何响应字节。
CDN、Nginx、应用网关与客户端各自都有读取或空闲超时。
流式可以更早发送数据,但不能修复没有流式能力的端点或真正卡死的上游。
保留一个可复现的短请求,每次只修改一个变量,并记录返回状态。
改用短提示、小图片或较小输出上限,判断是否与工作量相关。
在端点支持的前提下分别测试,并记录首字节和总耗时。
对比客户端报错时间、网关访问日志和上游请求记录,找到最先终止的一层。
curl -N https://api.linktoagi.com/v1/chat/completions \
-H "Authorization: Bearer $LINKAGI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "从控制台复制当前模型名",
"stream": true,
"messages": [{"role":"user","content":"只回复 OK"}]
}'API Key 只放在环境变量或客户端密钥字段中,不要写进公开仓库、截图或前端代码。模型名与价格请从 LinkAGI 实时模型广场复制。
不要把所有失败都归因到“中转站不稳定”。先判断请求停在路径、认证、模型、速率还是超时层。
重点检查首字节、输出上限、推理时长和代理读取超时。
边缘层超时或缓冲可能是主要因素,应按长连接要求配置而非简单无限加时。
确认该端点是否支持流式;图片任务通常要关注任务模式、轮询和生成耗时。
可能是瞬时拥塞,但仍应保留失败样本,避免用高频重试掩盖稳定性问题。
使用 api.linktoagi.com 接入后,可以在控制台调用日志中核对模型、Token、状态和扣费;遇到持续异常可携带时间与请求信息联系支持,但不要发送完整 API Key。
不能。流式只在端点支持并能较早产生数据时降低等待首字节的风险。
不建议一刀切。超时过长会占用连接和并发,应按端点类型、首字节和任务模式分别配置。
上游整体正常不代表每个请求都及时响应;中间的 CDN、反代和应用网关也可能先到超时阈值。
429 可能来自客户端令牌限额、账户余额、模型并发、当前号池或上游速率限制。相同状态码不等于相同原因,正确做法是保留请求时间与日志,再做有限退避。
Cherry Studio API 中转站Cherry Studio 的自定义提供方适合统一管理多个模型。配置时要把“提供方地址”和“最终接口路径”区分开:地址只填到 /v1,具体请求路径由客户端继续拼接。
Codex 404 Invalid URLCodex 会在 Base URL 后继续追加 /responses。根地址少一层 /v1 会得到错误路径;反过来,Claude Code 如果也照抄 /v1,则可能拼成 /v1/v1/messages。
注册赠送 ¥0.2 试用额度;模型、号池和价格以实时页面为准。