返回首页 TOP API DOCS 开 发 文 档
文档总览/了解我们/为什么我们是真的中转
了解我们

为什么我们是真的中转

不靠营销话术,用具体技术细节告诉你我们做了什么

AI 中转站这个赛道,劣币驱逐良币的现象很严重。本节用可验证的技术事实, 说清楚我们做了什么、不做什么,以及你如何自己核实。营销话术不能保真,代码细节可以。

1. 请求正文 · 永不入库

你打过来的 prompt、消息内容、上下文、上传的图片、tool call 参数,从不写入我们的数据库或日志。 管理后台能看到的只有:

  • User-Agent — 你用的客户端 (SDK 版本 / IDE)
  • token 计数 — input_tokens, output_tokens, cached_tokens
  • model — 调用的模型名
  • created_at — 调用时间戳
  • status_code — HTTP 状态码 (200/429/500 等)
  • upstream_account_id — 调度到哪个上游账号
  • latency_ms — 端到端耗时

请求体是流式直通到上游,中间不落盘、不缓存、不分析、不审计。响应体同理。

自证方法: 联系客服调阅你自己 24 小时内任意一笔调用的"全部存储字段"。 你会发现里面没有 messages 数组、没有 prompt 字符串、没有 image base64。这是设计层面承诺,不是运营自觉。

2. 上游账号 · 完整分类

每个上游账号在管理面板按 platform 字段分类,我们公开承认每种类型的稳定性差异:

类型稳定性说明
官方 API Key (Anthropic / OpenAI / Google)最高付费购买的官方 console key,签合规协议
官方 OAuth (Pro / Plus / Team / Enterprise)登录 OAuth 拿 access token,有 rate limit 但稳定
第三方 IDE 集成 (Cursor / Windsurf / Codex)逆向 IDE 内嵌的官方账号,会跟随 IDE 风控调整
Pro 订阅 (claude.ai / chat.openai.com)低-中个人账号订阅,有较严风控

我们把"IDE 集成"伪装成"官方 API"卖。如果你抽中的是 IDE 通道, 错误日志和上游账号 ID 会明确显示来源。

3. 计费可对账

计费完全按上游 usage 字段。我们透传 response_id / chat_id, 你拿到这个 ID 后,如果有官方账号可以去后台对账:

# Anthropic 响应 (透传)
{
  "id": "msg_01ABC...",         // ← 这个 ID 在 Anthropic 后台可查
  "type": "message",
  "model": "claude-sonnet-5",
  "usage": {
    "input_tokens": 1234,        // ← 计费按这个
    "output_tokens": 567,
    "cache_read_input_tokens": 800,
    "cache_creation_input_tokens": 0
  }
}

我们的扣费 = upstream usage × 该模型定价 × VIP 折扣系数。 公式公开,定价表见 模型与价格 页面。

4. 鉴别中转真伪 · 10 个测试项

你可以拿下面 10 项去衡量任何一家中转 (包括我们):

  1. 调用一个明确 400 的请求 (例: temperature=999),看返回的 error.type 是否原样 (真官方: invalid_request_error + 具体字段)
  2. 对比首 token 延迟 与官方 API 的差距 (官方一般 <1s,中转应 <1.5s)
  3. 测 prompt caching (Anthropic) — 第二次同 prefix 是否命中 cache,cache_read_input_tokens 是否>0
  4. 测 vision — 上传一张图 (base64),看是否真的能 OCR/描述
  5. 测 tool use — 复杂 JSON schema 的 tool calling 是否能正确执行
  6. 测 stream usage — 流式响应末尾的 message_delta.usage 是否完整
  7. 对比同 prompt 在多家中转的输出 (固定 temperature=0) — 应该几乎一致
  8. 查响应 header — 是否含 x-request-idanthropic-version 等官方头
  9. 测长 context (200k tokens) — 真 Opus / Sonnet 能吃下,小模型会截断
  10. 测复杂推理 — 数学竞赛题、代码 debug、长链条逻辑 — 这是 Opus 与 Haiku 最明显的差距

5. 行业常见掺水手法

列在这里供识别。我们不做这些,你可以拿去对照其他中转。

手法一 · IDE 逆向冒充官方 API

抓 KIRO、Cursor、Windsurf、Codex 等 IDE 的 Anthropic 集成 cookie, 把这个端点伪装成"Claude 官方 API"卖。稳定性极差: IDE 任何一次更新、Anthropic 改协议、对方账号被风控,你的"官方 API"立刻挂。 真官方 API 的 beta header、prompt caching、stream usage 末段统计往往不全。

手法二 · Cookie 中转

抓某个用户的 claude.ai / chat.openai.com 登录态 cookie 包装成 API 卖。 原账号被风控、改密码、cookie 过期,所有买家立刻断流。 而且明确违反服务条款,被发现可能反追溯。

手法三 · 模型欺诈

对外宣称 GPT-4 / Claude Opus,实际后端转发到 GPT-3.5 / Claude Haiku, 或用开源 Llama 微调套壳。固定一个高难度 prompt 多家对比就能识破。

手法四 · token 虚标

上游返回 usage 是 1000 token,中转改成 1500 多扣 50%。 对账方法: 拿透传的 response_id 去官方后台查实际 usage。 我们的扣费严格按上游 usage 字段,可对账。

手法五 · 假"流式"

非流式生成完后切片伪装流式 (首 token 延迟 5s+),或在流中段插入广告/统计。 我们的流是纯透传,首 token 延迟和官方差距只有网络往返。

手法六 · 错误码改写

把上游的 overloaded_error / insufficient_quota 等统一改写成 "服务繁忙"。掩盖了真实问题,客户端无法做精细化退避。 我们原样透传所有上游错误,你能定位到精确层。

6. 我们对自己的要求 (公开承诺)

  • 事故公开 — 任何超过 5 分钟的中断在公告里留痕,不删历史
  • 退款明文 — 支持申请退款;最终实际退款 = 充值金额 − 赠送金额 − 已消耗金额 (签到/盲盒/VIP 等赠送余额不退);申请退款即清空余额并默认放弃全部用户权益 (含移出群聊、账号封禁)
  • 价格不暗调 — 模型单价改动提前 7 天预告
  • 不卖渠道源 — 不会把你的 API key、IP、调用模式打包卖给第三方画像
  • 开源策略 — 平台主体代码对自部署用户开放,商业模式不靠技术黑盒
  • 日志保留 7 天 — 错误响应可能保留 7 天用于排障 (仅 status + 响应头,不含正文),之后自动删除