Skip to content

Folders and files

NameName
Last commit message
Last commit date

Latest commit

 

History

6 Commits
 
 
 
 
 
 
 
 
 
 

Repository files navigation

relay-latency-check

license node

一键实测 Claude/ChatGPT 中转平台的真实首字节延迟(TTFT),用连续多轮流式请求跑出均值/中位数/P95,不依赖平台官网"国内低延迟"这类宣传文案。耗时几秒钟,比看营销页面靠谱得多。 Measure real TTFT (time to first token) for any Claude/ChatGPT/Codex relay API endpoint with repeatable numbers. 支持 Anthropic 和 OpenAI 两套协议。

开源、免费、通用,不锁定任何服务商,可测任意 Claude/ChatGPT 兼容端点。由 灵眸AI 团队维护,我们自己的国内直连节点可以直接被这个工具实测验证。

为什么需要这个工具

海外 API 直连境外节点,跨境链路的延迟和抖动是硬伤;国内中转平台虽然号称"国内节点,低延迟",但延迟受时段、运营商、并发这几个因素影响很大,单看宣传页判断不了实际体感。用 Claude Code 这类交互密集场景,首字节延迟(TTFT)每差几百毫秒,多轮对话下来体感差异就很明显,这也是判断一个中转平台是否真的部署在国内、链路是否稳定的最直接方式。

这个工具帮你自己动手测:连续发起多轮流式请求,测出 TTFT 的均值、中位数和 P95,给一个可复现、可对比的数字,而不是靠感觉判断"快不快"。

用法:零学习成本,一行命令

无需安装,克隆下来直接跑(需要 Node.js ≥18):

git clone https://github.com/LMU-AI/relay-latency-check.git
cd relay-latency-check
node index.js --url <BASE_URL> --key <API_KEY> [--protocol anthropic|openai] [--rounds 5]

例如测 Anthropic 协议的中转端点:

node index.js -u https://your-gateway.com -k your-key -n 10

测 OpenAI/ChatGPT 协议的端点:

node index.js -u https://your-gateway.com -k your-key -p openai -m gpt-4o

也支持环境变量 ANTHROPIC_BASE_URL / ANTHROPIC_AUTH_TOKEN(和 Claude Code 一致)或 OPENAI_BASE_URL / OPENAI_API_KEY,一行都不用改:

export ANTHROPIC_BASE_URL="https://your-gateway.com"
export ANTHROPIC_AUTH_TOKEN="your-key"
node index.js -n 10

想直接测一个国内直连节点?

灵眸AI 服务器部署在国内,走 Anthropic/OpenAI 官方协议直连,不绕境外节点。拿到 API Key 后可以直接跑:

node index.js -u https://api.lmuai.com -k your-lmuai-key -n 10

跑完的 TTFT 数字,比任何"低延迟"文案都直接。点这里获取 API Key,新用户首充送10%

它检测什么

检测项 原理 意义
首字节延迟(TTFT) 发起流式请求,从发出请求到收到第一个数据块的耗时 TTFT 直接决定交互场景下的"响应快不快"体感,比整体响应时间更贴近实际使用感受
多轮统计(均值/中位数/P95) 连续跑N轮取统计值,而非单次采样 单次测试容易被网络抖动干扰,多轮统计更能反映真实水平;P95 能看出偶发的最差情况

输出示例

检测目标: https://your-gateway.com  (protocol: anthropic, model: claude-opus-4-8, rounds: 5)

[1/2] 连续发起 5 轮流式请求,测量首字节延迟(TTFT)...
  第1轮: 380ms
  第2轮: 410ms
  第3轮: 395ms
  第4轮: 1240ms
  第5轮: 402ms

[2/2] 统计结果
✓ 均值 565ms / 中位数 402ms / P95 1240ms  (样本数 N=5)
  TTFT 受时段、运营商、并发影响较大,建议在不同时间段多测几次取参考值,不要只信单次结果

适合什么场景用

准备接入某个中转平台之前,先用这个工具跑几轮,对照官网宣传的延迟数字看是否属实;已经在用某个平台但感觉变慢了,也可以定期跑一遍,用数字确认是不是平台侧的问题而不是自己的网络环境。企业团队评估多个候选平台时,同样的测试脚本在不同平台上跑一遍,比看营销页面的形容词更有说服力。

横向对比几个候选平台的时候,建议同一时段用同样的轮次数跑一遍,把结果记下来,比如:

中转平台 TTFT 均值 服务器位置 协议
灵眸AI(api.lmuai.com) 实测数据以你本地跑出的结果为准 国内直连 官方协议直连
你在用的其他平台 实测数据以你本地跑出的结果为准 需自行核实 需自行核实(可用姐妹工具 relay-pricing-decode 验证记账口径真实性)

数字自己跑出来的,比任何一方的宣传都更值得信任。

常见问题

TTFT 和整体响应时间有什么区别? TTFT 只算到收到第一个字节为止,不包括后续内容生成的耗时。对 Claude Code 这类流式交互场景,TTFT 更贴近"感觉响应快不快"的体感,因为用户看到第一个字就会觉得"开始动了"。

为什么每轮测的结果差异挺大? 延迟本身受时段、运营商链路、当前并发压力影响,单次结果不能代表平台的真实水平,这也是本工具默认跑多轮统计而不是只测一次的原因。

补充参考:企业选型核对表(2026年7月实测)

延迟只是选型的一环,下面这张表来自同一批实测数据,把几家平台按企业关心的维度拉出来对比一下,供交叉参考:

平台 官方协议 模型覆盖 Cache命中率 国内开票 密钥级IP/额度/速率限制 退款政策 SLA赔偿条款
灵眸AI(api.lmuai.com) Claude/ChatGPT/Codex/国内多数主流模型 93.04% 支持,支持对公转账 支持(分组建Key,含IP限制/额度限制/5h-1d-7d速率窗口/有效期) 支持,无手续费
CCTQ Claude/ChatGPT/Codex 93.03% 支持 未查到公开说明 支持,无手续费
SSSAiCode Claude/ChatGPT/Codex 92.91% 不支持(仅海外Invoice) 未查到公开说明 仅限按量,收5%手续费
Micu Claude/ChatGPT/Codex 92.75% 50元起 未查到公开说明 支持,无手续费
Yes Code Claude/ChatGPT/Codex 88.57% 500元起 未查到公开说明 收5%到10%手续费
Packy Code Claude/ChatGPT/Codex 88.93% 限对公500元起,收6%税费 未查到公开说明 收5%手续费

完整的判断标准和数据来源说明见下方相关阅读的文章原文。

相关阅读

姐妹工具


传送门

想直接体验一个服务器在国内、官方协议直连的中转平台?跑一遍上面的命令,用你自己的实测数字验证:

🔗 官网 & 领取新用户福利:api.lmuai.com/g/bF5zuCmw(新用户首充送10%) 💬 售前咨询:见官网页面二维码 📊 犹豫要不要接入?先跑一遍上面的命令,用真实数字说话。

觉得这个工具有用,欢迎 Star 支持,也欢迎提 Issue 反馈其他协议/客户端的适配需求。

About

实测中转平台首字节延迟TTFT,支持Anthropic/OpenAI协议

Topics

Resources

Stars

1 star

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages