Verification report details
Free model verification · Redacted public report

claude-fable-5 深度验真模型一致性报告

Report ID MZZR20260804113216B2E2CE生成时间 2026/08/04 19:32

匹配但有瑕疵

claude-fable-5 本次模型一致性深度验真结果:匹配但有瑕疵(83/100)。主要扣分项:模型代码锚定不稳定;品牌边界表达不清。

83Consistency score

主要扣分项:模型代码锚定不稳定;品牌边界表达不清。

测评方模真真
检测模型Claude Fable 5
中转站lingsu.xyz
样本数量40 次探测
耗时2 分 52 秒
验真版本V11
身份结论验真通过
验真依据模真真既有版本化基线

Token usage

Measured API usage is shown first; official baselines or test estimates are used only when measured values are unavailable.

实测 Token 用量116.0K来自本次响应 usage 字段;这是报告主展示口径。题包预计用量74.9K暂无官方基线时,按本次题包内容精确估算。Variance assessment高 55%接口返回的实际 Token 高于系统预计值,建议结合账单或渠道日志复核。Usage conclusion高于预计This reflects usage observability, not the final billed amount.
Token cache usage test

Observes token usage, cache fields, and reuse across rounds; 0% means no cached-token field was observed.

Tested 5 times
Observed cache share79.7%
缓存占比偏低

本次观察到缓存 Token,但占比偏低,建议结合接口参数、上下文复用方式和账单口径复核。

Observed tokens25.5KCached tokens20.3KNon-cached tokens5.2KAverage per run5.1K
Token usage record有返回Cache field已观察到Result正常
Cache share by testRepresents the API-reported cache share, not the final billing discount.
100%75%50%25%01次:缓存 Token 占比 0.0%,缓存 Token 0,观测 Token 5.1K0.0%1times2次:缓存 Token 占比 99.6%,缓存 Token 5.1K,观测 Token 5.1K99.6%2times3次:缓存 Token 占比 99.6%,缓存 Token 5.1K,观测 Token 5.1K99.6%3times4次:缓存 Token 占比 99.6%,缓存 Token 5.1K,观测 Token 5.1K99.6%4times5次:缓存 Token 占比 99.6%,缓存 Token 5.1K,观测 Token 5.1K99.6%5times
Long-context test

Shows stable responses at different context lengths and the model center reference window.

3 个样本
实测到 64K

100K 未通过,原因:接口鉴权或权限异常。

Reference window参考窗口 1M模型中心记录的上下文窗口;不同渠道可能开放不同长度。Tested context lengths32K / 64K / 100KTests begin at the longest generated context and step down to verify stable, correct responses.
Current guidance

100K 档暂不作为当前线路的稳定上下文参考。

模型真实性评分

Review API availability, model identity, response completeness, and other checks separately.

本次评分项目

匹配但有瑕疵83/100

主要扣分项:模型代码锚定不稳定;品牌边界表达不清。

可调用与模型可见10 / 10
No deductions
协议与返回结构12 / 12
No deductions
身份与模型匹配4 / 18
品牌边界表达不清(标准题:品牌边界) -4模型代码锚定不稳定(模型级题:模型代码锚定) -10
关键能力与专属题22 / 25
模型代码锚定不稳定(模型级题:模型代码锚定) -3
用量与计费合理性10 / 10
No deductions
稳定性与可用性25 / 25
No deductions

检测明细

Expand each check to view the redacted evidence notes.

25 项检测
模型列表可见性

接口模型列表中可以看到 claude-fable-5。

通过
检测证据
检测项目:模型列表可见性
执行状态:通过
样本数量:14
接口路径:/v1/models
可见模型数:14
基础调用探针

基础调用成功,接口能返回可识别响应。

通过
检测证据
检测项目:基础调用探针
执行状态:通过
样本数量:1
接口路径:/v1/chat/completions
快速题:模型身份自报

执行 通用题,用于形成模真真验真证据,评分维度:identity。 全部样本通过。

通过
检测证据
检测项目:快速题:模型身份自报
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:231
标准题:指令跟随

执行 通用题,用于形成模真真验真证据,评分维度:ability。 全部样本通过。

通过
检测证据
检测项目:标准题:指令跟随
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:37
标准题:JSON 结构

执行 通用题,用于形成模真真验真证据,评分维度:ability。 全部样本通过。

通过
检测证据
检测项目:标准题:JSON 结构
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:45
标准题:标签结构复述

执行 通用题,用于形成模真真验真证据,评分维度:protocol。 全部样本通过。

通过
检测证据
检测项目:标准题:标签结构复述
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:123
标准题:隐藏提示词边界

执行 通用题,用于形成模真真验真证据,评分维度:ability。 全部样本通过。

通过
检测证据
检测项目:标准题:隐藏提示词边界
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:87
标准题:品牌边界

执行 通用题,用于形成模真真验真证据,评分维度:identity。 存在样本未完全通过。

待观察
检测证据
检测项目:标准题:品牌边界
执行状态:待观察
样本数量:1
检测类型:文本题
需关注原因:品牌边界表达不清
样本结果:通过 0 / 需关注 1 / 未通过 0
观测 token:215
标准题:usage 返回可观测性

执行 通用题,用于形成模真真验真证据,评分维度:usage。 全部样本通过。

通过
检测证据
检测项目:标准题:usage 返回可观测性
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:64
深度题:逻辑网格推理

执行 通用题,用于形成模真真验真证据,评分维度:ability。 全部样本通过。

通过
检测证据
检测项目:深度题:逻辑网格推理
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:442
深度题:复测一致性

执行 通用题,用于形成模真真验真证据,评分维度:stability。 全部样本通过。

通过
检测证据
检测项目:深度题:复测一致性
执行状态:通过
样本数量:2
检测类型:文本题
样本结果:通过 2 / 需关注 0 / 未通过 0
观测 token:92
品牌题:Claude 隐藏思考边界 证据边界

执行 品牌题,用于形成模真真验真证据,评分维度:identity。 全部样本通过。

通过
检测证据
检测项目:品牌题:Claude 隐藏思考边界 证据边界
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:196
深度品牌题:Claude 隐藏思考边界

执行 品牌题,用于形成模真真验真证据,评分维度:ability。 全部样本通过。

通过
检测证据
检测项目:深度品牌题:Claude 隐藏思考边界
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:186
模型级题:模型代码锚定

执行 模型级题,用于形成模真真验真证据,评分维度:identity。 存在样本未完全通过。

待观察
检测证据
检测项目:模型级题:模型代码锚定
执行状态:待观察
样本数量:1
检测类型:文本题
需关注原因:模型代码锚定不稳定
样本结果:通过 0 / 需关注 1 / 未通过 0
观测 token:251
模型族题:系列和档位识别

执行 模型级题,用于形成模真真验真证据,评分维度:identity。 全部样本通过。

通过
检测证据
检测项目:模型族题:系列和档位识别
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:144
深度模型题:模型族专属边界

执行 模型级题,用于形成模真真验真证据,评分维度:ability。 全部样本通过。

通过
检测证据
检测项目:深度模型题:模型族专属边界
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:297
专项:Token缓存消耗 5 轮

执行 专项题,用于形成模真真验真证据。 全部样本通过。

通过
检测证据
检测项目:专项:Token缓存消耗 5 轮
执行状态:通过
样本数量:5
检测类型:文本题
专项模块:Token缓存消耗检测(影响真实使用扣费)
样本结果:通过 5 / 需关注 0 / 未通过 0
观测 token:25.5K
缓存 token:20.3K
专项:32K 上下文能力实测

32K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:32K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:32K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:29.3K
专项:64K 上下文能力实测

64K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:64K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:64K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:58.7K
专项:100K 上下文能力实测

100K 长度样本未形成稳定结果,本次按边界样本记录。

未通过
检测证据
检测项目:专项:100K 上下文能力实测
执行状态:未通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:100K
需关注原因:接口鉴权或权限异常
样本结果:通过 0 / 需关注 0 / 未通过 1
专项:Anthropic Messages 原生协议

执行 专项题,用于形成模真真验真证据。 存在样本未完全通过。

未通过
检测证据
检测项目:专项:Anthropic Messages 原生协议
执行状态:未通过
样本数量:1
专项模块:厂商原生接口检测
需关注原因:接口鉴权或权限异常
样本结果:通过 0 / 需关注 0 / 未通过 1
深度专项:Claude thinking 签名

执行 专项题,用于形成模真真验真证据。 前序检测已确认接口鉴权或权限异常,为避免继续制造无效请求,本项已跳过。

已跳过
检测证据
检测项目:深度专项:Claude thinking 签名
执行状态:已跳过
样本数量:0
专项模块:厂商原生接口检测
需关注原因:接口鉴权或权限异常
跳过原因:service_failure_circuit_breaker
专项:流式 / 非流式一致性

执行 专项题,用于形成模真真验真证据。 存在样本未完全通过。

未通过
检测证据
检测项目:专项:流式 / 非流式一致性
执行状态:未通过
样本数量:1
专项模块:流式、工具与结构化输出检测
需关注原因:接口鉴权或权限异常
样本结果:通过 0 / 需关注 0 / 未通过 1
专项:工具调用结构

执行 专项题,用于形成模真真验真证据。 前序检测已确认接口鉴权或权限异常,为避免继续制造无效请求,本项已跳过。

已跳过
检测证据
检测项目:专项:工具调用结构
执行状态:已跳过
样本数量:0
专项模块:流式、工具与结构化输出检测
需关注原因:接口鉴权或权限异常
跳过原因:service_failure_circuit_breaker
专项:JSON Schema 结构化输出

执行 专项题,用于形成模真真验真证据。 前序检测已确认接口鉴权或权限异常,为避免继续制造无效请求,本项已跳过。

已跳过
检测证据
检测项目:专项:JSON Schema 结构化输出
执行状态:已跳过
样本数量:0
专项模块:流式、工具与结构化输出检测
需关注原因:接口鉴权或权限异常
跳过原因:service_failure_circuit_breaker

报告评论

No public reviews

Be the first to leave a review.

发布匿名评论

Rating
5 points
Upload images/video
模真真AI service research and model verification report
Scan to view reportOpen full report
免费模型验真 · 支持所有文字模型检测

claude-fable-5 深度验真模型一致性报告

报告编号:MZZR20260804113216B2E2CE生成时间2026/08/04 19:32
Provider detailsAI model details
模型一致性分

匹配但有瑕疵

claude-fable-5 本次模型一致性深度验真结果:匹配但有瑕疵(83/100)。主要扣分项:模型代码锚定不稳定;品牌边界表达不清。

测评方模真真
检测模型Claude Fable 5
中转站lingsu.xyz
样本数量40
耗时3 分钟
检测版本V11
身份结论验真通过
验真依据模真真既有版本化基线

Token usage

Measured API usage is shown first; official baselines or test estimates are used only when measured values are unavailable.

实测 Token 用量116.0K来自本次响应 usage 字段;这是报告主展示口径。题包预计用量74.9K暂无官方基线时,按本次题包内容精确估算。Variance assessment高 55%接口返回的实际 Token 高于系统预计值,建议结合账单或渠道日志复核。Usage conclusion高于预计This reflects usage observability, not the final billed amount.
Token cache usage test

Observes token usage, cache fields, and reuse across rounds; 0% means no cached-token field was observed.

Tested 5 times
Observed cache share79.7%
缓存占比偏低

本次观察到缓存 Token,但占比偏低,建议结合接口参数、上下文复用方式和账单口径复核。

Observed tokens25.5KCached tokens20.3KNon-cached tokens5.2KAverage per run5.1K
Token usage record有返回Cache field已观察到Result正常
Cache share by testRepresents the API-reported cache share, not the final billing discount.
100%75%50%25%01次:缓存 Token 占比 0.0%,缓存 Token 0,观测 Token 5.1K0.0%1times2次:缓存 Token 占比 99.6%,缓存 Token 5.1K,观测 Token 5.1K99.6%2times3次:缓存 Token 占比 99.6%,缓存 Token 5.1K,观测 Token 5.1K99.6%3times4次:缓存 Token 占比 99.6%,缓存 Token 5.1K,观测 Token 5.1K99.6%4times5次:缓存 Token 占比 99.6%,缓存 Token 5.1K,观测 Token 5.1K99.6%5times
Long-context test

Shows stable responses at different context lengths and the model center reference window.

3 个样本
实测到 64K

100K 未通过,原因:接口鉴权或权限异常。

Reference window参考窗口 1M模型中心记录的上下文窗口;不同渠道可能开放不同长度。Tested context lengths32K / 64K / 100KTests begin at the longest generated context and step down to verify stable, correct responses.
Current guidance

100K 档暂不作为当前线路的稳定上下文参考。

模型真实性评分

把接口能不能用、回答像不像官方模型、返回信息是否完整等项目拆开看

本次评分项目

匹配但有瑕疵83/100

主要扣分项:模型代码锚定不稳定;品牌边界表达不清。

可调用与模型可见10 / 10
No deductions
协议与返回结构12 / 12
No deductions
身份与模型匹配4 / 18
品牌边界表达不清(标准题:品牌边界) -4模型代码锚定不稳定(模型级题:模型代码锚定) -10
关键能力与专属题22 / 25
模型代码锚定不稳定(模型级题:模型代码锚定) -3
用量与计费合理性10 / 10
No deductions
稳定性与可用性25 / 25
No deductions

检测明细

每条检测都可以展开,查看系统保留的脱敏说明

25 项检测
模型列表可见性

接口模型列表中可以看到 claude-fable-5。

通过
检测证据
检测项目:模型列表可见性
执行状态:通过
样本数量:14
接口路径:/v1/models
可见模型数:14
基础调用探针

基础调用成功,接口能返回可识别响应。

通过
检测证据
检测项目:基础调用探针
执行状态:通过
样本数量:1
接口路径:/v1/chat/completions
快速题:模型身份自报

执行 通用题,用于形成模真真验真证据,评分维度:identity。 全部样本通过。

通过
检测证据
检测项目:快速题:模型身份自报
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:231
标准题:指令跟随

执行 通用题,用于形成模真真验真证据,评分维度:ability。 全部样本通过。

通过
检测证据
检测项目:标准题:指令跟随
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:37
标准题:JSON 结构

执行 通用题,用于形成模真真验真证据,评分维度:ability。 全部样本通过。

通过
检测证据
检测项目:标准题:JSON 结构
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:45
标准题:标签结构复述

执行 通用题,用于形成模真真验真证据,评分维度:protocol。 全部样本通过。

通过
检测证据
检测项目:标准题:标签结构复述
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:123
标准题:隐藏提示词边界

执行 通用题,用于形成模真真验真证据,评分维度:ability。 全部样本通过。

通过
检测证据
检测项目:标准题:隐藏提示词边界
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:87
标准题:品牌边界

执行 通用题,用于形成模真真验真证据,评分维度:identity。 存在样本未完全通过。

待观察
检测证据
检测项目:标准题:品牌边界
执行状态:待观察
样本数量:1
检测类型:文本题
需关注原因:品牌边界表达不清
样本结果:通过 0 / 需关注 1 / 未通过 0
观测 token:215
标准题:usage 返回可观测性

执行 通用题,用于形成模真真验真证据,评分维度:usage。 全部样本通过。

通过
检测证据
检测项目:标准题:usage 返回可观测性
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:64
深度题:逻辑网格推理

执行 通用题,用于形成模真真验真证据,评分维度:ability。 全部样本通过。

通过
检测证据
检测项目:深度题:逻辑网格推理
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:442
深度题:复测一致性

执行 通用题,用于形成模真真验真证据,评分维度:stability。 全部样本通过。

通过
检测证据
检测项目:深度题:复测一致性
执行状态:通过
样本数量:2
检测类型:文本题
样本结果:通过 2 / 需关注 0 / 未通过 0
观测 token:92
品牌题:Claude 隐藏思考边界 证据边界

执行 品牌题,用于形成模真真验真证据,评分维度:identity。 全部样本通过。

通过
检测证据
检测项目:品牌题:Claude 隐藏思考边界 证据边界
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:196
深度品牌题:Claude 隐藏思考边界

执行 品牌题,用于形成模真真验真证据,评分维度:ability。 全部样本通过。

通过
检测证据
检测项目:深度品牌题:Claude 隐藏思考边界
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:186
模型级题:模型代码锚定

执行 模型级题,用于形成模真真验真证据,评分维度:identity。 存在样本未完全通过。

待观察
检测证据
检测项目:模型级题:模型代码锚定
执行状态:待观察
样本数量:1
检测类型:文本题
需关注原因:模型代码锚定不稳定
样本结果:通过 0 / 需关注 1 / 未通过 0
观测 token:251
模型族题:系列和档位识别

执行 模型级题,用于形成模真真验真证据,评分维度:identity。 全部样本通过。

通过
检测证据
检测项目:模型族题:系列和档位识别
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:144
深度模型题:模型族专属边界

执行 模型级题,用于形成模真真验真证据,评分维度:ability。 全部样本通过。

通过
检测证据
检测项目:深度模型题:模型族专属边界
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:297
专项:Token缓存消耗 5 轮

执行 专项题,用于形成模真真验真证据。 全部样本通过。

通过
检测证据
检测项目:专项:Token缓存消耗 5 轮
执行状态:通过
样本数量:5
检测类型:文本题
专项模块:Token缓存消耗检测(影响真实使用扣费)
样本结果:通过 5 / 需关注 0 / 未通过 0
观测 token:25.5K
缓存 token:20.3K
专项:32K 上下文能力实测

32K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:32K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:32K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:29.3K
专项:64K 上下文能力实测

64K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:64K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:64K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:58.7K
专项:100K 上下文能力实测

100K 长度样本未形成稳定结果,本次按边界样本记录。

未通过
检测证据
检测项目:专项:100K 上下文能力实测
执行状态:未通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:100K
需关注原因:接口鉴权或权限异常
样本结果:通过 0 / 需关注 0 / 未通过 1
专项:Anthropic Messages 原生协议

执行 专项题,用于形成模真真验真证据。 存在样本未完全通过。

未通过
检测证据
检测项目:专项:Anthropic Messages 原生协议
执行状态:未通过
样本数量:1
专项模块:厂商原生接口检测
需关注原因:接口鉴权或权限异常
样本结果:通过 0 / 需关注 0 / 未通过 1
深度专项:Claude thinking 签名

执行 专项题,用于形成模真真验真证据。 前序检测已确认接口鉴权或权限异常,为避免继续制造无效请求,本项已跳过。

已跳过
检测证据
检测项目:深度专项:Claude thinking 签名
执行状态:已跳过
样本数量:0
专项模块:厂商原生接口检测
需关注原因:接口鉴权或权限异常
跳过原因:service_failure_circuit_breaker
专项:流式 / 非流式一致性

执行 专项题,用于形成模真真验真证据。 存在样本未完全通过。

未通过
检测证据
检测项目:专项:流式 / 非流式一致性
执行状态:未通过
样本数量:1
专项模块:流式、工具与结构化输出检测
需关注原因:接口鉴权或权限异常
样本结果:通过 0 / 需关注 0 / 未通过 1
专项:工具调用结构

执行 专项题,用于形成模真真验真证据。 前序检测已确认接口鉴权或权限异常,为避免继续制造无效请求,本项已跳过。

已跳过
检测证据
检测项目:专项:工具调用结构
执行状态:已跳过
样本数量:0
专项模块:流式、工具与结构化输出检测
需关注原因:接口鉴权或权限异常
跳过原因:service_failure_circuit_breaker
专项:JSON Schema 结构化输出

执行 专项题,用于形成模真真验真证据。 前序检测已确认接口鉴权或权限异常,为避免继续制造无效请求,本项已跳过。

已跳过
检测证据
检测项目:专项:JSON Schema 结构化输出
执行状态:已跳过
样本数量:0
专项模块:流式、工具与结构化输出检测
需关注原因:接口鉴权或权限异常
跳过原因:service_failure_circuit_breaker

Latest user reviews

No public reviews

Be the first to leave a review.

本报告的评论与反馈

Rating
5 points
Upload images/video