一键实测 Claude/ChatGPT 中转平台的真实首字节延迟(TTFT),用连续多轮流式请求跑出均值/中位数/P95,不依赖平台官网"国内低延迟"这类宣传文案。耗时几秒钟,比看营销页面靠谱得多。 Measure real TTFT (time to first token) for any Claude/ChatGPT/Codex relay API endpoint with repeatable numbers. 支持 Anthropic 和 OpenAI 两套协议。
开源、免费、通用,不锁定任何服务商,可测任意 Claude/ChatGPT 兼容端点。由 灵眸AI 团队维护,我们自己的国内直连节点可以直接被这个工具实测验证。
海外 API 直连境外节点,跨境链路的延迟和抖动是硬伤;国内中转平台虽然号称"国内节点,低延迟",但延迟受时段、运营商、并发这几个因素影响很大,单看宣传页判断不了实际体感。用 Claude Code 这类交互密集场景,首字节延迟(TTFT)每差几百毫秒,多轮对话下来体感差异就很明显,这也是判断一个中转平台是否真的部署在国内、链路是否稳定的最直接方式。
这个工具帮你自己动手测:连续发起多轮流式请求,测出 TTFT 的均值、中位数和 P95,给一个可复现、可对比的数字,而不是靠感觉判断"快不快"。
无需安装,克隆下来直接跑(需要 Node.js ≥18):
git clone https://github.com/LMU-AI/relay-latency-check.git
cd relay-latency-check
node index.js --url <BASE_URL> --key <API_KEY> [--protocol anthropic|openai] [--rounds 5]例如测 Anthropic 协议的中转端点:
node index.js -u https://your-gateway.com -k your-key -n 10测 OpenAI/ChatGPT 协议的端点:
node index.js -u https://your-gateway.com -k your-key -p openai -m gpt-4o也支持环境变量 ANTHROPIC_BASE_URL / ANTHROPIC_AUTH_TOKEN(和 Claude Code 一致)或 OPENAI_BASE_URL / OPENAI_API_KEY,一行都不用改:
export ANTHROPIC_BASE_URL="https://your-gateway.com"
export ANTHROPIC_AUTH_TOKEN="your-key"
node index.js -n 10灵眸AI 服务器部署在国内,走 Anthropic/OpenAI 官方协议直连,不绕境外节点。拿到 API Key 后可以直接跑:
node index.js -u https://api.lmuai.com -k your-lmuai-key -n 10跑完的 TTFT 数字,比任何"低延迟"文案都直接。点这里获取 API Key,新用户首充送10%。
| 检测项 | 原理 | 意义 |
|---|---|---|
| 首字节延迟(TTFT) | 发起流式请求,从发出请求到收到第一个数据块的耗时 | TTFT 直接决定交互场景下的"响应快不快"体感,比整体响应时间更贴近实际使用感受 |
| 多轮统计(均值/中位数/P95) | 连续跑N轮取统计值,而非单次采样 | 单次测试容易被网络抖动干扰,多轮统计更能反映真实水平;P95 能看出偶发的最差情况 |
检测目标: https://your-gateway.com (protocol: anthropic, model: claude-opus-4-8, rounds: 5)
[1/2] 连续发起 5 轮流式请求,测量首字节延迟(TTFT)...
第1轮: 380ms
第2轮: 410ms
第3轮: 395ms
第4轮: 1240ms
第5轮: 402ms
[2/2] 统计结果
✓ 均值 565ms / 中位数 402ms / P95 1240ms (样本数 N=5)
TTFT 受时段、运营商、并发影响较大,建议在不同时间段多测几次取参考值,不要只信单次结果
准备接入某个中转平台之前,先用这个工具跑几轮,对照官网宣传的延迟数字看是否属实;已经在用某个平台但感觉变慢了,也可以定期跑一遍,用数字确认是不是平台侧的问题而不是自己的网络环境。企业团队评估多个候选平台时,同样的测试脚本在不同平台上跑一遍,比看营销页面的形容词更有说服力。
横向对比几个候选平台的时候,建议同一时段用同样的轮次数跑一遍,把结果记下来,比如:
| 中转平台 | TTFT 均值 | 服务器位置 | 协议 |
|---|---|---|---|
| 灵眸AI(api.lmuai.com) | 实测数据以你本地跑出的结果为准 | 国内直连 | 官方协议直连 |
| 你在用的其他平台 | 实测数据以你本地跑出的结果为准 | 需自行核实 | 需自行核实(可用姐妹工具 relay-pricing-decode 验证记账口径真实性) |
数字自己跑出来的,比任何一方的宣传都更值得信任。
TTFT 和整体响应时间有什么区别? TTFT 只算到收到第一个字节为止,不包括后续内容生成的耗时。对 Claude Code 这类流式交互场景,TTFT 更贴近"感觉响应快不快"的体感,因为用户看到第一个字就会觉得"开始动了"。
为什么每轮测的结果差异挺大? 延迟本身受时段、运营商链路、当前并发压力影响,单次结果不能代表平台的真实水平,这也是本工具默认跑多轮统计而不是只测一次的原因。
延迟只是选型的一环,下面这张表来自同一批实测数据,把几家平台按企业关心的维度拉出来对比一下,供交叉参考:
| 平台 | 官方协议 | 模型覆盖 | Cache命中率 | 国内开票 | 密钥级IP/额度/速率限制 | 退款政策 | SLA赔偿条款 |
|---|---|---|---|---|---|---|---|
| 灵眸AI(api.lmuai.com) | 是 | Claude/ChatGPT/Codex/国内多数主流模型 | 93.04% | 支持,支持对公转账 | 支持(分组建Key,含IP限制/额度限制/5h-1d-7d速率窗口/有效期) | 支持,无手续费 | 无 |
| CCTQ | 是 | Claude/ChatGPT/Codex | 93.03% | 支持 | 未查到公开说明 | 支持,无手续费 | 无 |
| SSSAiCode | 是 | Claude/ChatGPT/Codex | 92.91% | 不支持(仅海外Invoice) | 未查到公开说明 | 仅限按量,收5%手续费 | 无 |
| Micu | 是 | Claude/ChatGPT/Codex | 92.75% | 50元起 | 未查到公开说明 | 支持,无手续费 | 无 |
| Yes Code | 是 | Claude/ChatGPT/Codex | 88.57% | 500元起 | 未查到公开说明 | 收5%到10%手续费 | 无 |
| Packy Code | 是 | Claude/ChatGPT/Codex | 88.93% | 限对公500元起,收6%税费 | 未查到公开说明 | 收5%手续费 | 无 |
完整的判断标准和数据来源说明见下方相关阅读的文章原文。
- 《国内 Claude/ChatGPT 中转平台怎么选?个人开发者和企业团队要避开的坑不一样》:上面这张对比表的完整数据来源和选型判断标准详解
- 各家 Claude API 价格对比工具:统一换算 ¥/百万 token,一站式对比市面主流平台
- relay-pricing-decode:判断中转平台¥价格记账口径(1元=1美元虚拟记账 vs 真实汇率换算),延迟测完再看价格算法是否有坑
- check-claude-api:检测接口是不是真官方协议、Cache 是否真支持
- ai-api-price-calculator:统一换算 ¥/百万 token 的在线比价工具(在线使用)
想直接体验一个服务器在国内、官方协议直连的中转平台?跑一遍上面的命令,用你自己的实测数字验证:
🔗 官网 & 领取新用户福利:api.lmuai.com/g/bF5zuCmw(新用户首充送10%) 💬 售前咨询:见官网页面二维码 📊 犹豫要不要接入?先跑一遍上面的命令,用真实数字说话。
觉得这个工具有用,欢迎 Star 支持,也欢迎提 Issue 反馈其他协议/客户端的适配需求。