验真报告 · 公开证据

公开验真报告库

只展示已公开、已脱敏的模型一致性验真报告,按检测发布时间排序

公开报告157
通过报告157
高异常0
当前筛选深度验真 / 低异常共 157 份报告

报告列表

发起验真
深度验真deepseek-v4-flash 深度验真模型一致性报告deepseek-v4-flash 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:额度或频率限制;存在未通过证据项。sensenova.cn · DeepSeek V4 Flash · 样本 13 · 07/31 18:39匹配86/100深度验真gpt-5.6-sol 深度验真模型一致性报告gpt-5.6-sol 本次模型一致性深度验真结果:高度匹配(100/100)。本轮主要检测项均已通过。xfcxb.com · GPT-5.6 Sol · 样本 32 · 07/27 12:11高度匹配100/100深度验真gpt-5.6-sol 深度验真模型一致性报告gpt-5.6-sol 本次模型一致性深度验真结果:高度匹配(100/100)。本轮主要检测项均已通过。xfcxb.com · GPT-5.6 Sol · 样本 22 · 07/27 09:45高度匹配100/100深度验真minimax-m3 深度验真模型一致性报告minimax-m3 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。xinlicloud.top · MiniMax-M3 · 样本 25 · 07/22 17:35匹配86/100深度验真kimi-k2.7-code 深度验真模型一致性报告kimi-k2.7-code 本次模型一致性深度验真结果:匹配但有瑕疵(75/100)。主要扣分项:模型代码锚定不稳定;模型族识别不稳定;模型专属边界表达不清。xinlicloud.top · Kimi K2.7 Code · 样本 34 · 07/22 17:27匹配但有瑕疵75/100深度验真claude-opus-4-6 深度验真模型一致性报告claude-opus-4-6 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。无限星河AI · Claude Opus 4.6 · 样本 23 · 07/21 16:35匹配86/100深度验真claude-sonnet-5 深度验真模型一致性报告claude-sonnet-5 本次模型一致性深度验真结果:匹配但有瑕疵(76/100)。主要扣分项:模型代码锚定不稳定;模型专属边界表达不清;品牌边界表达不清。无限星河AI · Claude Sonnet 5 · 样本 29 · 07/21 16:29匹配但有瑕疵76/100深度验真claude-opus-4-8 深度验真模型一致性报告claude-opus-4-8 本次模型一致性深度验真结果:匹配但有瑕疵(80/100)。主要扣分项:模型代码锚定不稳定;模型族识别不稳定。无限星河AI · Claude Opus 4.8 · 样本 26 · 07/21 16:24匹配但有瑕疵80/100深度验真deepseek-ai/deepseek-v4-pro 深度验真模型一致性报告deepseek-ai/deepseek-v4-pro 本次模型一致性深度验真结果:高度匹配(100/100)。本轮主要检测项均已通过。ltzy.top · DeepSeek V4 Pro · 样本 80 · 07/19 19:54高度匹配100/100深度验真claude-opus-4-6 深度验真模型一致性报告claude-opus-4-6 本次模型一致性深度验真结果:高度匹配(100/100)。本轮主要检测项均已通过。无限星河AI · Claude Opus 4.6 · 样本 33 · 07/18 10:48高度匹配100/100深度验真claude-sonnet-5 深度验真模型一致性报告claude-sonnet-5 本次模型一致性深度验真结果:匹配(87/100)。主要扣分项:模型代码锚定不稳定。无限星河AI · Claude Sonnet 5 · 样本 33 · 07/18 10:45匹配87/100深度验真claude-opus-4-8 深度验真模型一致性报告claude-opus-4-8 本次模型一致性深度验真结果:匹配但有瑕疵(80/100)。主要扣分项:模型代码锚定不稳定;模型族识别不稳定。无限星河AI · Claude Opus 4.8 · 样本 33 · 07/18 10:42匹配但有瑕疵80/100深度验真claude-opus-4-6 深度验真模型一致性报告claude-opus-4-6 本次模型一致性深度验真结果:高度匹配(100/100)。本轮主要检测项均已通过。无限星河AI · Claude Opus 4.6 · 样本 33 · 07/17 10:48高度匹配100/100深度验真claude-sonnet-5 深度验真模型一致性报告claude-sonnet-5 本次模型一致性深度验真结果:匹配(93/100)。主要扣分项:模型族识别不稳定。无限星河AI · Claude Sonnet 5 · 样本 27 · 07/17 10:44匹配93/100深度验真claude-opus-4-8 深度验真模型一致性报告claude-opus-4-8 本次模型一致性深度验真结果:匹配(87/100)。主要扣分项:模型代码锚定不稳定。无限星河AI · Claude Opus 4.8 · 样本 33 · 07/17 10:42匹配87/100深度验真step-3.5-flash 深度验真模型一致性报告step-3.5-flash 本次模型一致性深度验真结果:匹配但有瑕疵(82/100)。主要扣分项:逻辑网格推理不稳定;品牌边界表达不清。阶跃星辰 API 型号池 · Step 3.5 Flash · 样本 25 · 07/16 20:52匹配但有瑕疵82/100深度验真gpt-5.6-sol 深度验真模型一致性报告gpt-5.6-sol 本次模型一致性深度验真结果:高度匹配(100/100)。本轮主要检测项均已通过。小破站 · GPT-5.6 Sol · 样本 35 · 07/16 20:04高度匹配100/100深度验真gpt-5.6-sol 深度验真模型一致性报告gpt-5.6-sol 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:额度或频率限制;存在未通过证据项。小破站 · GPT-5.6 Sol · 样本 25 · 07/16 19:42匹配86/100深度验真gpt-5.6-sol 深度验真模型一致性报告gpt-5.6-sol 本次模型一致性深度验真结果:匹配(94/100)。主要扣分项:品牌边界表达不清;验真信号待复核。llm-api · GPT-5.6 Sol · 样本 432 · 07/16 19:01匹配94/100深度验真gpt-5.5 深度验真模型一致性报告gpt-5.5 本次模型一致性深度验真结果:高度匹配(100/100)。本轮主要检测项均已通过。More Code 联盟 · GPT-5.5 · 样本 83 · 07/16 18:28高度匹配100/100
每页显示
...
第 1-20 份 / 共 157 份报告