45.83% 的 AI API 中转端点在卖假模型

你从中转站买的 GPT-5、Claude Opus,有接近一半的概率不是真的——这不是猜测,是德国 CISPA 亥姆霍兹信息安全中心研究团队对「Shadow API」生态的审计结论。

研究说了什么

研究团队审计了 17 家 AI API 中转服务,发现 45.83% 的端点返回的模型与用户付费购买的型号不符。 最典型的手法:你付的是 GPT-5 的钱,接口背后悄悄换成了参数量小一个数量级的开源模型(研究中实测到 GPT-5 被替换为 GLM-4-9B 的案例)。

价格账也算得很清楚:用户每付 14.84 美元,实际获得的模型价值仅 5.70–7.77 美元——中间商每批赚走 7.07–9.14 美元的差价,而你以为自己占了官方价的便宜。

更值得警惕的是这个生态的规模:引用这些服务的 187 篇学术论文中,62% 发表于 ACL/CVPR/ICLR 等顶会——连研究者都在不知情中用假模型跑实验。88.2% 的此类服务没有透明的运营主体或工商登记信息。

为什么你很难发现

模型替换的受害体验不是「坏了」,而是「变笨了」:回答变浅、代码变差、长文被截断。研究测得 Shadow API 的错误率是官方的 2–4 倍,医疗问答准确率下降 47 个百分点——但单看一两次回复,你很难确信 是被换了模型还是「今天状态不好」。这正是灰色中转敢明目张胆替换的原因:取证成本高,单次损失小, 用户懒得追究。

怎么办:协议级证据,而不是感觉

「感觉变笨了」不构成证据,协议级破绽才构成。真模型与假模型在协议层有一系列难以伪造的差异:官方 Claude 的 thinking 签名(服务端加密签名,以目前公开的已知手段极难伪造)、官方计费元数据的字段与量级、 官方流式响应的事件结构、官方错误响应的固定形状。逐项比对这些硬指标,替换与掺水会留下清晰的痕迹。

这也是本站存在的原因:把这些协议级检测做成一个免费工具,并且检测在你的浏览器里直连运行——你不需要 为了验证一个不可信的站,先把 Key 交给另一个要你信任的站。


参考:CISPA Helmholtz Center for Information Security, “Shadow APIs” 研究(2026)。 本文数字均引自该研究公开材料;本文不针对任何具体服务商,检测结果仅供参考。