Verification report details
Free model verification · Redacted public report

step-3.5-flash 深度验真模型一致性报告

Report ID MZZR20260710054159080D1A生成时间 2026/07/10 13:41

不可判定

step-3.5-flash 本次模型一致性深度验真结果:不可判定(暂无评分)。接口鉴权、额度、中继链路或服务状态异常,本轮未进入模型真实性评分。

待确认Consistency score

接口鉴权、额度、中继链路或服务状态异常,本轮未进入模型真实性评分。

测评方模真真
检测模型Step 3.5 Flash
中转站Infistar
样本数量86 次探测
耗时5 秒
验真版本V11
身份结论验真不通过
验真依据模真真既有版本化基线

Token usage

Measured API usage is shown first; official baselines or test estimates are used only when measured values are unavailable.

预计 Token 用量6.7K当前没有实测 usage 时,用题包估算兜底。Variance assessment暂无本报告有题包预计 Token,但当前接口没有返回实际用量。Usage conclusion只看到预计This reflects usage observability, not the final billed amount.

模型真实性评分

Review API availability, model identity, response completeness, and other checks separately.

本次评分项目

不可判定待确认

接口鉴权、额度、中继链路或服务状态异常,本轮未进入模型真实性评分。

可调用与模型可见10 / 10
No deductions
协议与返回结构12 / 12
No deductions
身份与模型匹配18 / 18
No deductions
关键能力与专属题25 / 25
No deductions
用量与计费合理性10 / 10
No deductions
稳定性与可用性25 / 25
No deductions

检测明细

Expand each check to view the redacted evidence notes.

16 项检测
模型列表可见性

接口模型列表中可以看到 step-3.5-flash。

通过
检测证据
检测项目:模型列表可见性
执行状态:通过
样本数量:85
接口路径:/v1/models
可见模型数:85
基础调用探针

基础调用未成功,可能是 Key 权限、额度、接口路径或模型能力类型问题。

待观察
检测证据
检测项目:基础调用探针
执行状态:待观察
样本数量:1
需关注原因:接口服务异常
快速题:模型身份自报

执行 通用题,用于形成模真真验真证据,评分维度:identity。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:快速题:模型身份自报
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
标准题:指令跟随

执行 通用题,用于形成模真真验真证据,评分维度:ability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:标准题:指令跟随
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
标准题:JSON 结构

执行 通用题,用于形成模真真验真证据,评分维度:ability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:标准题:JSON 结构
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
标准题:标签结构复述

执行 通用题,用于形成模真真验真证据,评分维度:protocol。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:标准题:标签结构复述
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
标准题:隐藏提示词边界

执行 通用题,用于形成模真真验真证据,评分维度:ability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:标准题:隐藏提示词边界
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
标准题:品牌边界

执行 通用题,用于形成模真真验真证据,评分维度:identity。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:标准题:品牌边界
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
标准题:usage 返回可观测性

执行 通用题,用于形成模真真验真证据,评分维度:usage。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:标准题:usage 返回可观测性
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
深度题:逻辑网格推理

执行 通用题,用于形成模真真验真证据,评分维度:ability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:深度题:逻辑网格推理
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
深度题:复测一致性

执行 通用题,用于形成模真真验真证据,评分维度:stability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:深度题:复测一致性
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
品牌题:阶跃星辰证据边界 证据边界

执行 品牌题,用于形成模真真验真证据,评分维度:identity。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:品牌题:阶跃星辰证据边界 证据边界
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
深度品牌题:阶跃星辰证据边界

执行 品牌题,用于形成模真真验真证据,评分维度:ability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:深度品牌题:阶跃星辰证据边界
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
模型级题:模型代码锚定

执行 模型级题,用于形成模真真验真证据,评分维度:identity。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:模型级题:模型代码锚定
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
模型族题:系列和档位识别

执行 模型级题,用于形成模真真验真证据,评分维度:identity。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:模型族题:系列和档位识别
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
深度模型题:模型族专属边界

执行 模型级题,用于形成模真真验真证据,评分维度:ability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:深度模型题:模型族专属边界
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

报告评论

No public reviews

Be the first to leave a review.

发布匿名评论

Rating
5 points
Upload images/video
模真真AI service research and model verification report
Scan to view reportOpen full report
免费模型验真 · 支持所有文字模型检测

step-3.5-flash 深度验真模型一致性报告

报告编号:MZZR20260710054159080D1A生成时间2026/07/10 13:41
Provider detailsAI model details
模型一致性分

不可判定

step-3.5-flash 本次模型一致性深度验真结果:不可判定(暂无评分)。接口鉴权、额度、中继链路或服务状态异常,本轮未进入模型真实性评分。

测评方模真真
检测模型Step 3.5 Flash
中转站Infistar
样本数量86
耗时5 秒
检测版本V11
身份结论验真不通过
验真依据模真真既有版本化基线

Token usage

Measured API usage is shown first; official baselines or test estimates are used only when measured values are unavailable.

预计 Token 用量6.7K当前没有实测 usage 时,用题包估算兜底。Variance assessment暂无本报告有题包预计 Token,但当前接口没有返回实际用量。Usage conclusion只看到预计This reflects usage observability, not the final billed amount.

模型真实性评分

把接口能不能用、回答像不像官方模型、返回信息是否完整等项目拆开看

本次评分项目

不可判定待确认

接口鉴权、额度、中继链路或服务状态异常,本轮未进入模型真实性评分。

可调用与模型可见10 / 10
No deductions
协议与返回结构12 / 12
No deductions
身份与模型匹配18 / 18
No deductions
关键能力与专属题25 / 25
No deductions
用量与计费合理性10 / 10
No deductions
稳定性与可用性25 / 25
No deductions

检测明细

每条检测都可以展开,查看系统保留的脱敏说明

16 项检测
模型列表可见性

接口模型列表中可以看到 step-3.5-flash。

通过
检测证据
检测项目:模型列表可见性
执行状态:通过
样本数量:85
接口路径:/v1/models
可见模型数:85
基础调用探针

基础调用未成功,可能是 Key 权限、额度、接口路径或模型能力类型问题。

待观察
检测证据
检测项目:基础调用探针
执行状态:待观察
样本数量:1
需关注原因:接口服务异常
快速题:模型身份自报

执行 通用题,用于形成模真真验真证据,评分维度:identity。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:快速题:模型身份自报
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
标准题:指令跟随

执行 通用题,用于形成模真真验真证据,评分维度:ability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:标准题:指令跟随
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
标准题:JSON 结构

执行 通用题,用于形成模真真验真证据,评分维度:ability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:标准题:JSON 结构
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
标准题:标签结构复述

执行 通用题,用于形成模真真验真证据,评分维度:protocol。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:标准题:标签结构复述
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
标准题:隐藏提示词边界

执行 通用题,用于形成模真真验真证据,评分维度:ability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:标准题:隐藏提示词边界
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
标准题:品牌边界

执行 通用题,用于形成模真真验真证据,评分维度:identity。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:标准题:品牌边界
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
标准题:usage 返回可观测性

执行 通用题,用于形成模真真验真证据,评分维度:usage。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:标准题:usage 返回可观测性
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
深度题:逻辑网格推理

执行 通用题,用于形成模真真验真证据,评分维度:ability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:深度题:逻辑网格推理
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
深度题:复测一致性

执行 通用题,用于形成模真真验真证据,评分维度:stability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:深度题:复测一致性
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
品牌题:阶跃星辰证据边界 证据边界

执行 品牌题,用于形成模真真验真证据,评分维度:identity。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:品牌题:阶跃星辰证据边界 证据边界
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
深度品牌题:阶跃星辰证据边界

执行 品牌题,用于形成模真真验真证据,评分维度:ability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:深度品牌题:阶跃星辰证据边界
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
模型级题:模型代码锚定

执行 模型级题,用于形成模真真验真证据,评分维度:identity。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:模型级题:模型代码锚定
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
模型族题:系列和档位识别

执行 模型级题,用于形成模真真验真证据,评分维度:identity。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:模型族题:系列和档位识别
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。
深度模型题:模型族专属边界

执行 模型级题,用于形成模真真验真证据,评分维度:ability。 基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

已跳过
检测证据
检测项目:深度模型题:模型族专属边界
执行状态:已跳过
样本数量:0
检测类型:文本题
跳过原因:基础调用探针未通过,后续题包已跳过,避免继续消耗 token。

Latest user reviews

No public reviews

Be the first to leave a review.

本报告的评论与反馈

Rating
5 points
Upload images/video