/about/methodology
评分方法论
综合分由四维加权加总,再按扣分规则与并列决胜处理。口径与当前发布的规则版本 2026.08.1 一致。
评分公式
综合分 = 价格 × 权重 + 稳定性 × 权重 + 真实性 × 权重 + 透明度 × 权重,再叠加已启用的扣分项。
| 维度 | 权重 |
|---|---|
| 价格 | 35% |
| 稳定性 | 25% |
| 真实性 | 25% |
| 透明度 | 15% |
| 规则 | 指标 | 条件 | 阈值 | 扣分 | 处理 |
|---|---|---|---|---|---|
| 观察期不足 30 天 | listed_days | < | 30 | 0 | 不进榜 |
| 验真通过率<60% | verify_pass_rate | < | 0.6 | 0 | 判定未通过 |
| 连续掉线>24h | downtime_hours | > | 24 | 15 | 扣分并预警 |
| 域名 30 天内变更 | domain_changed_days | <= | 30 | 10 | 扣分并预警 |
| 静默下调限制未公告 | silent_limit | == | 是 | 6 | 扣分 |
| 退款投诉≥3 且未回应 | refund_complaints | >= | 3 | 8 | 扣分并预警 |
决胜规则:并列分先比近 30 天在线率,在线率也相同则比上线时长(更早上线者优先)
探针口径
单点探测(探针位于美国)。每 10 分钟对全部已收录站点发起一次轻量探测:优先 GET /v1/models,无响应时回退到站点根地址。连接超时 10 秒,读取超时 30 秒。HTTP 5xx 与超时计为失败;拿到非 5xx 状态码记为可达。DNS、连接与 TLS 错误同样记失败。在线率按近 30 天滚动窗口汇总,不按单次探测下结论。
验真原理
验真抽样比对两类信号。响应指纹:核对响应头是否齐全、正文关键字段类型、字段顺序、system_fingerprint 形态,以及错误响应的结构。Tokenizer:OpenAI 家族模型用 tiktoken 精确计数校验(o200k_base / cl100k_base),把返回的 usage.prompt_tokens 与离线期望值逐一比对;非 OpenAI 家族(含 Claude、Gemini 等)仅校验 usage 字段是否存在,不做精确计数验证。真实性按近 30 天滚动窗口的抽样通过率汇总。
探针记录与原始快照留存 90 天,验真抽样记录留存 180 天,用于复现与申诉核查。