疑似降智
端点可用且已完成真实能力题,但本次未命中当前目标模型版本。综合连通、动态测试题和模型版本信号后,判定为疑似降智或降级。
本报告基于一次真实探针生成
结论由候选模型真实调用、动态测试题、返回模型、usage 字段、协议结构和目标模型版本共同计算;模型列表只用于候选排序,不作为最终真伪结论。报告不保存 API Key,只保留脱敏后的检测信号用于公开复核。
检测结果
核心结论优先展示,便于站长或用户快速复核。
关键指标
公开可读高到低候选排序
列表仅作排序依据claude-fable-5
逐项检查
PASS / WARN / FAILhttps://llmhub.ltd/v1beta/models 返回 HTTP 200,发现 Claude Opus 4.8 模型信号。
https://llmhub.ltd/v1/models 返回 HTTP 200,自动识别为 Claude Opus 4.8,解析到 9 个模型名。
本次将优先检测 claude-fable-5。
高到低模型试测:claude-fable-5:有效 2xx(HTTP 200,有效 JSON 响应)。最终采用 claude-fable-5。
模型 claude-fable-5 的原生 /messages 请求成功,并返回文本内容。
12 项动态校验全部命中:算术、上下文抽取、顺序记忆、矛盾判断、校验码、表格筛选和条件推理均正确。
响应 stop_reason 为 end_turn,未见明显截断。
返回包含 Anthropic 原生 input/output token usage。
请求模型 claude-fable-5,响应 model 字段为 claude-fable-5。
Claude Opus 最新目标 claude-opus-4.8;本次实际命中 claude-fable-5,未命中当前目标版本,存在疑似降智或降级风险。
保存与复核
公开报告报告保存哪些内容?
保存脱敏 Base URL、检测信号、候选排序、逐项检查和分数,不保存你提交的 API Key。
如何复核这份报告?
重点查看高到低模型试测、请求模型、返回模型、目标模型版本、动态测试题和 usage 字段;必要时使用新的临时 Key 重新检测。