外观
揭秘黑心中转站 · 常见诈骗手段
AI API 中转站(把 OpenAI / Claude / Gemini 等模型打包转售的平台)门槛低、水极深。同样一个"claude-opus"接口,有的站给你官方满血,有的站背地里换成便宜小模型、往你请求里塞私货、甚至凭空多扣你 token。
这篇文章拆解行业里最常见的几种套路,每种都告诉你:它怎么骗你、你会看到什么症状、怎么自己查出来。看完你就有了一双"火眼金睛"。
为什么我们敢写这个
NoCannoBB 自己就是做中转的。正因为我们天天在后台和上游打交道,才清楚这些黑手法怎么运作、怎么被抓包。把它公开,是想让你有能力分辨——不管最后你用不用我们。
骗术一:偷偷降智 / 模型掉包
怎么骗你:你在界面上选的是 claude-opus 或 gpt-最新版,后台却悄悄把请求路由到更便宜的小模型(如 haiku、mini),或者用第三方"逆向/镜像"接口冒充官方。你付大模型的钱,用小模型的脑子。
你会看到的症状:
- 回答明显变笨、变短、爱偷懒,和你在官网体验的同名模型差很多;
- 复杂推理、长上下文任务翻车率异常高;
- 价格低到不合常理(官方成本都不够)。
怎么自查:
- 看 API 返回体里的
model字段是不是你点的那个(很多站会露馅); - 用同一个刁钻问题,分别问它和官方 API,对比深度;
- 警惕"全网最低价"——大模型的上游成本是硬的,明显低于官方的,多半在别处找补。
骗术二:偷偷往你的请求里注入提示词
怎么骗你:在把你的对话转发给上游前,中转站偷偷在你的系统提示里插一段自己的话——可能是压缩你的上下文(省他们的 token)、植入广告倾向、或监控/改写你的输出。你的 prompt 被人动过手脚,自己却不知道。
你会看到的症状:
- 模型偶尔冒出莫名其妙的立场、措辞或"建议使用某平台";
usage用量里出现你没发过的、异常的输入 token 或 cache_read(缓存命中)——那往往就是他们反复复用注入内容留下的痕迹;- 让模型"逐字复述你收到的完整系统提示",它吐出你没写过的段落。
怎么自查:
- 官方 API 的
usage会如实返回cache_creation_input_tokens/cache_read_input_tokens。你明明没用缓存,却看到大额 cache_read,就该警觉; - 分段让模型翻译/复述它收到的原始输入,能把偷偷塞进去的内容"扒"出来。
骗术三:刷 token / 虚假计费
怎么骗你:夸大你的 token 消耗、制造"幽灵请求"、缓存费用只收不退。账单数字比你实际用的虚高一截,温水煮青蛙。
你会看到的症状:
- 同样的对话量,扣费比官方明显高;
- 有"系统请求""预热请求"等你没发起的扣费项;
- 余额掉得莫名其妙,却没有逐条可核对的明细。
怎么自查:
- 要求平台提供逐条 usage 明细(每次请求的输入/输出/缓存 token),能对账的才可信;
- 拿一小段固定对话,自己用官方 tokenizer 估算 token 数,和账单对比;
- 没有透明用量日志、只给你一个"总额在掉"的数字的,直接绕开。
骗术四:预付卡 + 卷钱跑路
怎么骗你:用超低年费、"充多送多"诱导你一次性大额充值。你的余额只是他们数据库里的一个数字,随时可以关站、拉黑、跑路,无处追讨。
你会看到的症状:
- 疯狂催你买年费 / 大额套餐,小额充值反而不划算或不给开;
- 公司主体、联系方式、退款政策查无实据;
- 社群里陆续有人反馈"充了钱人没了"。
怎么自查:
- 第一次只充小额,跑一两周确认稳定、能对账,再考虑加码;
- 查平台运营时长、口碑、是否有明确退款条款;
- 对"限时年费骨折价"保持警惕——正规平台不靠一锤子买卖回本。
一张自查清单:怎么挑靠谱的中转站
把下面几条当成"体检项",越多打勾越可信:
- ✅ 模型不掉包:返回
model字段准确,深度对得上官方同名模型; - ✅ 不注入:
usage里没有你没发起的输入 token / cache_read; - ✅ 计费透明:有逐条用量明细,能对账,失败不扣费;
- ✅ 先小额、后加码:支持小额充值、按量付费,不逼你一次性大额;
- ✅ 口碑与运营时长经得起查,有明确主体和退款说明。
一句话总结
中转站的核心信任在于透明——模型透明、用量透明、计费透明。任何一项含糊其辞、查无实据,都值得你多留个心眼。先小额试水、学会自查,比听任何宣传都管用。