Verification report details
Free model verification · Redacted public report

gpt-5.6-luna 快速验真模型一致性报告

Report ID MZZR202608081100013E7983生成时间 2026/08/08 19:00

高度匹配

gpt-5.6-luna 本次模型一致性快速验真结果:高度匹配(100/100)。本轮主要检测项均已通过。

100Consistency score

本轮主要检测项均已通过。

测评方模真真
检测模型GPT-5.6 Luna
中转站Dogzee
样本数量10 次探测
耗时1 分 25 秒
验真版本V11
身份结论验真通过
验真依据CPA 官方产品源

Token usage

Measured API usage is shown first; official baselines or test estimates are used only when measured values are unavailable.

实测 Token 用量509.5K来自本次响应 usage 字段;这是报告主展示口径。题包预计用量20.4K暂无官方基线时,按本次题包内容精确估算。Variance assessment高 2397%接口返回的实际 Token 高于系统预计值,建议结合账单或渠道日志复核。Usage conclusion高于预计This reflects usage observability, not the final billed amount.
Long-context test

Shows stable responses at different context lengths and the model center reference window.

6 个样本
实测到 400K

800K 未通过,原因:800K 长度样本未形成稳定结果,本次按边界样本记录。

Reference window参考窗口 1M模型中心记录的上下文窗口;不同渠道可能开放不同长度。Tested context lengths32K / 64K / 100K / 200K / 400K / 800KTests begin at the longest generated context and step down to verify stable, correct responses.
Current guidance

800K 档暂不作为当前线路的稳定上下文参考。

模型真实性评分

Review API availability, model identity, response completeness, and other checks separately.

本次评分项目

高度匹配100/100

本轮主要检测项均已通过。

接口与模型可见30 / 30
No deductions
基础调用与协议25 / 25
No deductions
模型身份红旗25 / 25
No deductions
基础稳定性20 / 20
No deductions

检测明细

Expand each check to view the redacted evidence notes.

9 项检测
模型列表可见性

接口模型列表中可以看到 gpt-5.6-luna。

通过
检测证据
检测项目:模型列表可见性
执行状态:通过
样本数量:2
接口路径:/v1/models
可见模型数:2
基础调用探针

基础调用成功,接口能返回可识别响应。

通过
检测证据
检测项目:基础调用探针
执行状态:通过
样本数量:1
接口路径:/v1/chat/completions
快速题:模型身份自报

执行 通用题,用于形成模真真验真证据,评分维度:identity。 全部样本通过。

通过
检测证据
检测项目:快速题:模型身份自报
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:166
专项:32K 上下文能力实测

32K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:32K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:32K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:20.8K
专项:64K 上下文能力实测

64K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:64K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:64K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:41.5K
缓存 token:40.7K
专项:100K 上下文能力实测

100K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:100K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:100K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:63.9K
专项:200K 上下文能力实测

200K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:200K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:200K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:127.7K
专项:400K 上下文能力实测

400K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:400K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:400K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:255.4K
专项:800K 上下文能力实测

800K 长度样本未形成稳定结果,本次按边界样本记录。

未通过
检测证据
检测项目:专项:800K 上下文能力实测
执行状态:未通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:800K
样本结果:通过 0 / 需关注 0 / 未通过 1

报告评论

No public reviews

Be the first to leave a review.

发布匿名评论

Rating
5 points
Upload images/video
模真真AI service research and model verification report
Scan to view reportOpen full report
免费模型验真 · 支持所有文字模型检测

gpt-5.6-luna 快速验真模型一致性报告

报告编号:MZZR202608081100013E7983生成时间2026/08/08 19:00
Provider detailsAI model details
模型一致性分

高度匹配

gpt-5.6-luna 本次模型一致性快速验真结果:高度匹配(100/100)。本轮主要检测项均已通过。

测评方模真真
检测模型GPT-5.6 Luna
中转站Dogzee
样本数量10
耗时1 分钟
检测版本V11
身份结论验真通过
验真依据CPA 官方产品源

Token usage

Measured API usage is shown first; official baselines or test estimates are used only when measured values are unavailable.

实测 Token 用量509.5K来自本次响应 usage 字段;这是报告主展示口径。题包预计用量20.4K暂无官方基线时,按本次题包内容精确估算。Variance assessment高 2397%接口返回的实际 Token 高于系统预计值,建议结合账单或渠道日志复核。Usage conclusion高于预计This reflects usage observability, not the final billed amount.
Long-context test

Shows stable responses at different context lengths and the model center reference window.

6 个样本
实测到 400K

800K 未通过,原因:800K 长度样本未形成稳定结果,本次按边界样本记录。

Reference window参考窗口 1M模型中心记录的上下文窗口;不同渠道可能开放不同长度。Tested context lengths32K / 64K / 100K / 200K / 400K / 800KTests begin at the longest generated context and step down to verify stable, correct responses.
Current guidance

800K 档暂不作为当前线路的稳定上下文参考。

模型真实性评分

把接口能不能用、回答像不像官方模型、返回信息是否完整等项目拆开看

本次评分项目

高度匹配100/100

本轮主要检测项均已通过。

接口与模型可见30 / 30
No deductions
基础调用与协议25 / 25
No deductions
模型身份红旗25 / 25
No deductions
基础稳定性20 / 20
No deductions

检测明细

每条检测都可以展开,查看系统保留的脱敏说明

9 项检测
模型列表可见性

接口模型列表中可以看到 gpt-5.6-luna。

通过
检测证据
检测项目:模型列表可见性
执行状态:通过
样本数量:2
接口路径:/v1/models
可见模型数:2
基础调用探针

基础调用成功,接口能返回可识别响应。

通过
检测证据
检测项目:基础调用探针
执行状态:通过
样本数量:1
接口路径:/v1/chat/completions
快速题:模型身份自报

执行 通用题,用于形成模真真验真证据,评分维度:identity。 全部样本通过。

通过
检测证据
检测项目:快速题:模型身份自报
执行状态:通过
样本数量:1
检测类型:文本题
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:166
专项:32K 上下文能力实测

32K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:32K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:32K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:20.8K
专项:64K 上下文能力实测

64K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:64K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:64K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:41.5K
缓存 token:40.7K
专项:100K 上下文能力实测

100K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:100K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:100K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:63.9K
专项:200K 上下文能力实测

200K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:200K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:200K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:127.7K
专项:400K 上下文能力实测

400K 长度样本稳定返回,作为本次上下文实测证据。

通过
检测证据
检测项目:专项:400K 上下文能力实测
执行状态:通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:400K
样本结果:通过 1 / 需关注 0 / 未通过 0
观测 token:255.4K
专项:800K 上下文能力实测

800K 长度样本未形成稳定结果,本次按边界样本记录。

未通过
检测证据
检测项目:专项:800K 上下文能力实测
执行状态:未通过
样本数量:1
检测类型:文本题
专项模块:上下文实测
上下文档位:800K
样本结果:通过 0 / 需关注 0 / 未通过 1

Latest user reviews

No public reviews

Be the first to leave a review.

本报告的评论与反馈

Rating
5 points
Upload images/video