About

我们是谁,不做什么

API黄页是面向开发者的第三方大模型 API 服务商目录:收录服务商、做独立测评、给出可比较的实测数据。 我们只做信息展示与第三方测评,本身不提供 API 服务。

产品边界

以下几条是硬约束,不随业务需要调整。

  • 不自营 API 转发,不做任何形式的中转服务。
  • 不代收资金,不做支付、资金托管、代充代付。
  • 不托管用户 API Key。自助核验时用户提供的密钥仅在单次请求生命周期内使用,不落库、不写日志,证据文本中的密钥会被脱敏。
  • 测评排序不受商业合作影响,榜单位置与核验结论只依据实测数据。
  • 点评先审后发,只保存邮箱哈希,不保存明文邮箱。
  • 数据采集只使用合法搜索 API,不直接抓取搜索引擎结果页。
  • 只读取公开网页并遵守 robots.txt,不注册账号、不绕过登录、不调用第三方 API 的业务接口。
  • 只同步许可清楚的公开清单;含邀请参数的链接会先清洗再入库,授权不清的来源默认不启用。
  • 公开页面只展示 API 黄页团队确认收录的核心服务商,内部候选不对外展示。

核验方法

中转站声称提供某个模型,实际后端可能换成了更便宜的型号。 单看回答质量很难判断,因为回答本身会波动。我们看的是模型的概率习惯

让模型在受控条件下重复做同一件事,统计它每个位置上输出各个 token 的概率分布,得到一份「行为指纹」。不同模型的指纹差异稳定且难以伪造—— 中转站没法针对性地临时切换,因为这些探针看上去就是普通对话。 把实测指纹与基准库逐一比对,用 Jensen-Shannon 散度衡量差距。

我们还会把同一批采样随机对半分开,各自算一次指纹。如果两半自己跟自己 都对不上,说明后端在不同请求之间轮换了不同的模型。

两套核验,口径不同

平台深度核验用户自助检测
谁发起平台定时任务用户在模型验真页自己提交
可控性方法、样本、基准库全可控,结果可复现端点与密钥由用户提供,平台无法复核
对外表达给平台测评分与方法摘要,并附证据链、采样参数与申诉入口只给置信度与证据,不宣称真假
是否影响榜单否,不计入平台结论

核验结论描述的是某次采样窗口内的实测行为,不等同于对服务商的整体评价,也不构成法律意义上的认定。 服务商对结论有异议可以走申诉入口,我们会安排复测并公开复测结果。

排序中立性

商业合作不影响排序。榜单按实测延迟、价格、可用率、成功率与平台测评分加权计算, 权重公式对所有服务商一致,与是否有商业合作无关。 核验结论同样只依据实测证据。