质量检测
正在加载质量检测入口和历史记录。
正在加载数据
正在从服务器获取最新数据,请稍候...
正在加载质量检测入口和历史记录。
正在从服务器获取最新数据,请稍候...
检测模型身份、能力表现和协议完整性。结果与安全检测分开统计,不代表站点安全风险。
单次观测会立即归档;稳定身份结论需要跨时间窗口复测确认。原始模型响应不会公开保存。
基于当前全部筛选结果,不受分页影响。
平均值忽略空值,右侧标注有效样本数。
| 检测时间 | 站点 | 模型 | 协议 | 质量分 | 覆盖率 | 身份状态 | 结果来源 | 确认状态 | 摘要 | 操作 |
|---|---|---|---|---|---|---|---|---|---|---|
| 2026年8月22日 18:00 | Diegeai | gpt-5.6-sol | OpenAI-compatible | 身份不确定 | 服务器复测 | 检测不完整 | 跨厂 Judge 不可用,确定性结果已保留,但身份检测不完整。 辅助 baseline(不支持稳定身份结论) | 摘要 | ||
| 2026年8月22日 10:20 | booltoken | claude-haiku-4-5 | Claude 原生 | 身份不可用 | 服务器复测 | 检测不完整 | 检测进程异常结束,本次结果已按失败状态归档。 | 摘要 | ||
| 2026年8月22日 02:00 | Diegeai | gpt-5.6-sol | OpenAI-compatible | 身份不确定 | 服务器复测 | 检测不完整 | 跨厂 Judge 不可用,确定性结果已保留,但身份检测不完整。 辅助 baseline(不支持稳定身份结论) | 摘要 | ||
| 2026年8月21日 21:11 | Lingsuan | gpt-5.6 | OpenAI-compatible | 身份不确定 | 匿名单次观测 | 检测不完整 | 可信 baseline 不可用,本次结果不能形成稳定身份结论。 | 摘要 | ||
| 2026年8月21日 18:02 | booltoken | claude-haiku-4-5 | Claude 原生 | 身份不确定 | 服务器复测 | 检测不完整 | 跨厂 Judge 不可用,确定性结果已保留,但身份检测不完整。 辅助 baseline(不支持稳定身份结论) | 摘要 | ||
| 2026年8月21日 17:56 | A6api | claude-opus-5 | Claude 原生 | 身份不确定 | 匿名单次观测 | 检测不完整 | 可信 baseline 不可用,本次结果不能形成稳定身份结论。 | 摘要 | ||
| 2026年8月21日 17:51 | TokenmarketCheap | gpt-5.5 | OpenAI-compatible | 身份不确定 | 匿名单次观测 | 检测不完整 | 可信 baseline 不可用,本次结果不能形成稳定身份结论。 | 摘要 | ||
| 2026年8月21日 15:51 | quality-nan.meta-api.vip | gpt-5.6-luna | OpenAI-compatible | 身份不确定 | 匿名单次观测 | 检测不完整 | 可信 baseline 不可用,本次结果不能形成稳定身份结论。 | 摘要 | ||
| 2026年8月21日 12:17 | quality-aimgen.tech | gpt-5.6-sol | OpenAI-compatible | 身份不确定 | 匿名单次观测 | 检测不完整 | 可信 baseline 不可用,本次结果不能形成稳定身份结论。 | 摘要 | ||
| 2026年8月21日 10:00 | Diegeai | gpt-5.6-sol | OpenAI-compatible | 身份不确定 | 服务器复测 | 检测不完整 | 跨厂 Judge 不可用,确定性结果已保留,但身份检测不完整。 辅助 baseline(不支持稳定身份结论) | 摘要 |
从端点连接、协议识别到质量探针和模型身份检测,逐步生成可复核的公开摘要;任一关键条件不足都会保守降级。
先验证目标端点可达性,再识别 OpenAI-compatible 或 Claude 原生协议;无法确认协议时停止完整探针,避免产生误导结果。
运行能力表现、结构化输出、流式事件和 usage 等模型检测项目;不支持的探针明确标记为跳过并降低覆盖率。
将行为指纹、模型家族、子模型和 baseline 信号分开记录;只有真正完成且相互独立的信号才可参与身份判断。
匿名运行只形成单次观测。服务器复测满足次数、时间窗口、覆盖率、官方 baseline 和 Judge 门槛后,才可能形成稳定结论。
通过身份、能力和协议探针形成可复核的端点级观测;不使用“掺水概率”,也不会把单次运行表述为欺诈结论。
组合行为指纹、模型家族特征、子模型特征和可信 baseline,判断本次端点表现是否支持声明的模型身份。
通过质量探针观察推理、指令遵从、结构化输出与基础能力表现;质量分描述本次端点表现,不代表模型真伪概率。
检查 OpenAI-compatible 或 Claude 原生接口的流式事件、usage、tool use、thinking 等结构是否完整。
单次运行只形成观测记录;稳定身份结论要求跨时间窗口、多类独立信号和未过期 baseline 共同支持。
辅助 baseline 只用于质量与相似性观测,身份状态保持不确定且不能进入排名;只有官方 baseline 才能支撑稳定身份结论。
质量分、覆盖率、身份状态和确认状态含义不同,需要结合阅读,不能只依据单一数字判断模型身份。
历史列表展示乐观质量分,表示已完成探针下的端点能力表现;它不是官方模型跑分,也不是“掺水概率”。
表示计划探针中实际完成并可计入结果的比例。跳过、不支持、超时或依赖不可用都会降低覆盖率,不能按通过处理。
“身份匹配”表示现有证据支持声明模型;“家族匹配”只确认到模型家族;“不确定”表示证据不足,不能据此下负面结论。
“单次观测”与“待复核”都不是稳定结论;只有达到成功次数、时间窗口、独立信号和 baseline 门槛后,才会标记为“稳定结论”。
质量检测适合用于中转站选型、模型路由核验、协议兼容排查和版本回归观察,但不能替代厂商认证或安全检测。
在价格和可用性之外,比较同一声明模型在不同端点上的能力表现与协议完整性。
观察端点返回是否长期支持声明的模型家族或子模型,发现动态路由或信号漂移时保留待复核状态。
定位流式输出、tool use、thinking、usage 或 content block 缺失等 OpenAI-compatible 与 Claude 接入问题。
模型或中转配置调整后重复运行质量检测,对比覆盖率、质量分和身份信号是否发生明显变化。
质量检测属于黑盒观测工具,结论会受到上游路由、模型相似度、baseline 质量和检测覆盖率影响。
黑盒探针只能判断端点行为是否与对照特征一致。中转站可能按时间、请求或账户动态路由,因此任何单次结果都不能证明绝对真伪。
同系列模型可能共享训练数据、表达习惯和接口行为。缺少可信 baseline 或信号冲突时,系统会保持“不确定”,不会强行判定。
自定义模型没有可核验 baseline 时,只展示端点级能力与协议观测,不生成未经验证的稳定身份结论。
本模块不运行安全或 Jailbreak 探针,不输出安全风险等级。接口暴露、越权、提示词注入等风险应查看独立的“安全检测”。
说明模型身份、质量分、重复复测、密钥处理以及与综合排名的关系。
质量检测关注声明模型、能力表现和协议完整性;安全检测关注接口兼容性、风险信号与安全结论。两套结果、历史、评分和结论完全分开。
不等于。身份匹配表示当前证据支持声明模型,不是厂商认证,也不能排除动态路由、条件路由或高度相似的同家族模型。
质量表现与模型身份是两个独立维度。端点可以表现良好但缺少身份 baseline,也可能身份信号接近但部分能力探针失败。
中转端点的上游路由、负载和模型版本可能随时间变化。稳定身份结论至少需要 5 次成功运行、跨 2 个时间窗口,并由至少 2 类独立身份信号一致支持。
辅助 baseline 来自经批准的中转端点,只用于观察能力和相似性,不产生稳定身份结论或排名资格;官方 baseline 必须来自模型厂商官方端点。
不会。API Key 只用于本次请求和检测进程,不写入数据库、历史、URL、报告或缓存;公开摘要也不会保存完整原始模型回复。
不会。综合排名只把质量检测作为参考列展示,模型身份、质量分与覆盖率均不参与综合分计算和排序。