验真报告 · 公开证据

公开验真报告库

只展示已公开、已脱敏的模型一致性验真报告,按检测发布时间排序

公开报告73
通过报告73
高异常0
当前筛选匹配 / 深度验真 / 低异常共 73 份报告

报告列表

发起验真
深度验真deepseek-v4-flash 深度验真模型一致性报告deepseek-v4-flash 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:额度或频率限制;存在未通过证据项。sensenova.cn · DeepSeek V4 Flash · 样本 13 · 07/31 18:39匹配86/100深度验真minimax-m3 深度验真模型一致性报告minimax-m3 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。xinlicloud.top · MiniMax-M3 · 样本 25 · 07/22 17:35匹配86/100深度验真claude-opus-4-6 深度验真模型一致性报告claude-opus-4-6 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。无限星河AI · Claude Opus 4.6 · 样本 23 · 07/21 16:35匹配86/100深度验真claude-sonnet-5 深度验真模型一致性报告claude-sonnet-5 本次模型一致性深度验真结果:匹配(87/100)。主要扣分项:模型代码锚定不稳定。无限星河AI · Claude Sonnet 5 · 样本 33 · 07/18 10:45匹配87/100深度验真claude-sonnet-5 深度验真模型一致性报告claude-sonnet-5 本次模型一致性深度验真结果:匹配(93/100)。主要扣分项:模型族识别不稳定。无限星河AI · Claude Sonnet 5 · 样本 27 · 07/17 10:44匹配93/100深度验真claude-opus-4-8 深度验真模型一致性报告claude-opus-4-8 本次模型一致性深度验真结果:匹配(87/100)。主要扣分项:模型代码锚定不稳定。无限星河AI · Claude Opus 4.8 · 样本 33 · 07/17 10:42匹配87/100深度验真gpt-5.6-sol 深度验真模型一致性报告gpt-5.6-sol 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:额度或频率限制;存在未通过证据项。小破站 · GPT-5.6 Sol · 样本 25 · 07/16 19:42匹配86/100深度验真gpt-5.6-sol 深度验真模型一致性报告gpt-5.6-sol 本次模型一致性深度验真结果:匹配(94/100)。主要扣分项:品牌边界表达不清;验真信号待复核。llm-api · GPT-5.6 Sol · 样本 432 · 07/16 19:01匹配94/100深度验真claude-opus-4-8 深度验真模型一致性报告claude-opus-4-8 本次模型一致性深度验真结果:匹配(87/100)。主要扣分项:模型代码锚定不稳定。无限星河AI · Claude Opus 4.8 · 样本 33 · 07/16 10:42匹配87/100深度验真glm-5.2 深度验真模型一致性报告glm-5.2 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:额度或频率限制;存在未通过证据项。sensenova.cn · GLM-5.2 · 样本 13 · 07/15 14:38匹配86/100深度验真gpt-5.4-codex 深度验真模型一致性报告gpt-5.4-codex 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。无限星河AI · GPT-5.4 Codex · 样本 34 · 07/15 13:50匹配86/100深度验真deepseek-v4-flash 深度验真模型一致性报告deepseek-v4-flash 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。无限星河AI · DeepSeek V4 Flash · 样本 23 · 07/15 11:57匹配86/100深度验真deepseek-v4-flash 深度验真模型一致性报告deepseek-v4-flash 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。无限星河AI · DeepSeek V4 Flash · 样本 106 · 07/10 17:40匹配86/100深度验真baichuan-m3 深度验真模型一致性报告baichuan-m3 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:逻辑网格推理不稳定。无限星河AI · Baichuan-M3 · 样本 101 · 07/10 16:53匹配86/100深度验真glm-5.2 深度验真模型一致性报告glm-5.2 本次模型一致性深度验真结果:匹配(85/100)。主要扣分项:接口服务异常;多个关键证据项需要复核。无限星河AI · GLM-5.2 · 样本 101 · 07/10 13:36匹配85/100深度验真glm-5.2 深度验真模型一致性报告glm-5.2 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:接口服务异常;多个关键证据项需要复核。无限星河AI · GLM-5.2 · 样本 101 · 07/10 13:34匹配86/100深度验真360zhinao-turbo-doubao-seed-1-8 深度验真模型一致性报告360zhinao-turbo-doubao-seed-1-8 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:逻辑网格推理不稳定。无限星河AI · 360 智脑 Turbo · 样本 101 · 07/10 13:29匹配86/100深度验真360zhinao-turbo-doubao-seed-1-8-thinking-minimal 深度验真模型一致性报告360zhinao-turbo-doubao-seed-1-8-thinking-minimal 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:逻辑网格推理不稳定。无限星河AI · 360 智脑 Turbo Thinking Minimal · 样本 101 · 07/10 13:29匹配86/100深度验真baichuan-m2 深度验真模型一致性报告baichuan-m2 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:逻辑网格推理不稳定。无限星河AI · Baichuan-M2 · 样本 101 · 07/10 13:28匹配86/100深度验真baichuan-m3 深度验真模型一致性报告baichuan-m3 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:逻辑网格推理不稳定。无限星河AI · Baichuan-M3 · 样本 101 · 07/10 13:27匹配86/100
每页显示
第 1-20 份 / 共 73 份报告