验真报告详情

claude-opus-5 是不是真的?深度检测结果

报告编号 MZZR2026092218172220D5F7生成时间 2026/09/23 02:17

证据不足,暂不能判断

证据不足,暂不能判断。接口、速度、工具与 Token 表现单独记录,不构成身份依据。

证据不足证据状态

主要问题:看不到 Claude 官方的思考过程标记;会含糊地把自己说成官方原厂。

检测方模真真
检测模型Claude Opus 5
中转站LLM API
请求次数22 次
耗时1 分 7 秒
身份判定证据不足,暂不能判断
比对基准参考样本尚未充分校准

调用与功能检测

基础调用成功,接口能返回可识别响应。

  • 品牌边界:待观察
  • 看得到 Claude 官方的思考过程标记吗:待观察
  • 让它按指定格式输出,格式兑现了吗:待观察

调用结果与型号身份分开判断。证据不足不表示请求失败,也不表示模型为假。

型号参考证据

现有参考不足以判断型号身份;请结合本次调用与能力检测结果。

模型自报名称和单次回答不能证明真假;官方参考也只代表采样时的接口表现。

规则版本:2026-09-14.v1

Token 用量核对

以接口回报的用量为准,未回报时显示预估值。

回报用量52.2K接口回报的实际用量,本页以此为准。预估用量1.8K依据本次检测请求预估。偏差评估高 2844%接口回报用量高于预估,建议核对账单。用量核对高于预估以上为接口回报用量,实际扣费以账单为准。

检测明细

每条都能展开看细节,涉及隐私的内容已隐去。

21 项检测
模型列表可见性

接口模型列表中可以看到 claude-opus-5。

通过
检测细节
这题测了 1 次,结果:通过。
基础调用探针

基础调用成功,接口能返回可识别响应。

通过
检测细节
这题测了 1 次,结果:通过。
模型身份自报

问它自己是什么模型,看答案对不对。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 614 token
其中按缓存价计费 524 token
指令跟随

用几道题看它的回答水平像不像官方模型。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 549 token
JSON 结构

用几道题看它的回答水平像不像官方模型。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 560 token
其中按缓存价计费 524 token
标签结构复述

按官方接口的标准调用,看返回是否规范。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 599 token
隐藏提示词边界

用几道题看它的回答水平像不像官方模型。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 687 token
品牌边界

问它自己是什么模型,看答案对不对。 1 次里对了 0 次。

待观察
检测细节
这题测了 1 次:1 次要留意。
没通过的原因:品牌边界表达不清
本题用量 41.1K token
其中按缓存价计费 12.2K token
用量数据是否完整

核对它报回来的用量和缓存计费。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 561 token
其中按缓存价计费 524 token
逻辑网格推理

用几道题看它的回答水平像不像官方模型。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 702 token
其中按缓存价计费 383 token
复测一致性

反复多问几次,看会不会答一半就断或偷偷换模型。 2 次都对。

通过
检测细节
这题测了 2 次:2 次通过。
本题用量 1.1K token
其中按缓存价计费 1.1K token
Claude 隐藏思考边界

问它自己是什么模型,看答案对不对。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 652 token
Claude 隐藏思考边界

用几道题看它的回答水平像不像官方模型。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 607 token
其中按缓存价计费 511 token
模型代码锚定

问它自己是什么模型,看答案对不对。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 624 token
其中按缓存价计费 511 token
模型族题:系列和档位识别

问它自己是什么模型,看答案对不对。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 605 token
深度模型题:模型族专属边界

用几道题看它的回答水平像不像官方模型。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 674 token
按官方接口标准调用:Anthropic Messages

对照官方公开的产品说明来测。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 551 token
看得到 Claude 官方的思考过程标记吗

对照官方公开的产品说明来测。 1 次里对了 0 次。

待观察
检测细节
这题测了 1 次:1 次要留意。
没通过的原因:Claude thinking 签名不可观测
边打字边回和一次性回,结果一样吗

对照官方公开的产品说明来测。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 553 token
其中按缓存价计费 511 token
让它调用工具,返回格式对不对

对照官方公开的产品说明来测。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 365 token
让它按指定格式输出,格式兑现了吗

对照官方公开的产品说明来测。 1 次里对了 0 次。

待观察
检测细节
这题测了 1 次:1 次要留意。
本题用量 548 token
其中按缓存价计费 511 token

发布匿名评论

评分
5 分
模真真买 AI 前,先查模真真
扫码查看报告打开完整验真详情
模真真验真报告 · 真实调用实测

claude-opus-5 是不是真的?深度检测结果

报告编号:MZZR2026092218172220D5F7生成时间:2026/09/23 02:17
中转服务商详情AI 模型详情
证据状态

证据不足,暂不能判断

证据不足,暂不能判断。接口、速度、工具与 Token 表现单独记录,不构成身份依据。

检测方模真真
检测模型Claude Opus 5
中转站LLM API
请求次数22
耗时1 分钟
身份判定证据不足,暂不能判断
比对基准参考样本尚未充分校准

调用与功能检测

基础调用成功,接口能返回可识别响应。

  • 品牌边界:待观察
  • 看得到 Claude 官方的思考过程标记吗:待观察
  • 让它按指定格式输出,格式兑现了吗:待观察

调用结果与型号身份分开判断。证据不足不表示请求失败,也不表示模型为假。

型号参考证据

现有参考不足以判断型号身份;请结合本次调用与能力检测结果。

模型自报名称和单次回答不能证明真假;官方参考也只代表采样时的接口表现。

规则版本:2026-09-14.v1

Token 用量核对

以接口回报的用量为准,未回报时显示预估值。

回报用量52.2K接口回报的实际用量,本页以此为准。预估用量1.8K依据本次检测请求预估。偏差评估高 2844%接口回报用量高于预估,建议核对账单。用量核对高于预估以上为接口回报用量,实际扣费以账单为准。

检测明细

每条都能展开看细节,涉及隐私的内容已隐去

21 项检测
模型列表可见性

接口模型列表中可以看到 claude-opus-5。

通过
检测细节
这题测了 1 次,结果:通过。
基础调用探针

基础调用成功,接口能返回可识别响应。

通过
检测细节
这题测了 1 次,结果:通过。
模型身份自报

问它自己是什么模型,看答案对不对。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 614 token
其中按缓存价计费 524 token
指令跟随

用几道题看它的回答水平像不像官方模型。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 549 token
JSON 结构

用几道题看它的回答水平像不像官方模型。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 560 token
其中按缓存价计费 524 token
标签结构复述

按官方接口的标准调用,看返回是否规范。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 599 token
隐藏提示词边界

用几道题看它的回答水平像不像官方模型。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 687 token
品牌边界

问它自己是什么模型,看答案对不对。 1 次里对了 0 次。

待观察
检测细节
这题测了 1 次:1 次要留意。
没通过的原因:品牌边界表达不清
本题用量 41.1K token
其中按缓存价计费 12.2K token
用量数据是否完整

核对它报回来的用量和缓存计费。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 561 token
其中按缓存价计费 524 token
逻辑网格推理

用几道题看它的回答水平像不像官方模型。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 702 token
其中按缓存价计费 383 token
复测一致性

反复多问几次,看会不会答一半就断或偷偷换模型。 2 次都对。

通过
检测细节
这题测了 2 次:2 次通过。
本题用量 1.1K token
其中按缓存价计费 1.1K token
Claude 隐藏思考边界

问它自己是什么模型,看答案对不对。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 652 token
Claude 隐藏思考边界

用几道题看它的回答水平像不像官方模型。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 607 token
其中按缓存价计费 511 token
模型代码锚定

问它自己是什么模型,看答案对不对。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 624 token
其中按缓存价计费 511 token
模型族题:系列和档位识别

问它自己是什么模型,看答案对不对。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 605 token
深度模型题:模型族专属边界

用几道题看它的回答水平像不像官方模型。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 674 token
按官方接口标准调用:Anthropic Messages

对照官方公开的产品说明来测。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 551 token
看得到 Claude 官方的思考过程标记吗

对照官方公开的产品说明来测。 1 次里对了 0 次。

待观察
检测细节
这题测了 1 次:1 次要留意。
没通过的原因:Claude thinking 签名不可观测
边打字边回和一次性回,结果一样吗

对照官方公开的产品说明来测。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 553 token
其中按缓存价计费 511 token
让它调用工具,返回格式对不对

对照官方公开的产品说明来测。 1 次都对。

通过
检测细节
这题测了 1 次:1 次通过。
本题用量 365 token
让它按指定格式输出,格式兑现了吗

对照官方公开的产品说明来测。 1 次里对了 0 次。

待观察
检测细节
这题测了 1 次:1 次要留意。
本题用量 548 token
其中按缓存价计费 511 token

本报告的评论与反馈

评分
5 分