验真报告 · 公开证据

公开验真报告库

只展示已公开、已脱敏的模型一致性验真报告,按检测发布时间排序

公开报告25
通过报告25
高异常0
当前筛选有瑕疵 / 深度验真共 25 份报告

报告列表

发起验真
深度验真kimi-k2.7-code 深度验真模型一致性报告kimi-k2.7-code 本次模型一致性深度验真结果:匹配但有瑕疵(75/100)。主要扣分项:模型代码锚定不稳定;模型族识别不稳定;模型专属边界表达不清。xinlicloud.top · Kimi K2.7 Code · 样本 34 · 07/22 17:27匹配但有瑕疵75/100深度验真claude-sonnet-5 深度验真模型一致性报告claude-sonnet-5 本次模型一致性深度验真结果:匹配但有瑕疵(76/100)。主要扣分项:模型代码锚定不稳定;模型专属边界表达不清;品牌边界表达不清。无限星河AI · Claude Sonnet 5 · 样本 29 · 07/21 16:29匹配但有瑕疵76/100深度验真claude-opus-4-8 深度验真模型一致性报告claude-opus-4-8 本次模型一致性深度验真结果:匹配但有瑕疵(80/100)。主要扣分项:模型代码锚定不稳定;模型族识别不稳定。无限星河AI · Claude Opus 4.8 · 样本 26 · 07/21 16:24匹配但有瑕疵80/100深度验真claude-opus-4-8 深度验真模型一致性报告claude-opus-4-8 本次模型一致性深度验真结果:匹配但有瑕疵(80/100)。主要扣分项:模型代码锚定不稳定;模型族识别不稳定。无限星河AI · Claude Opus 4.8 · 样本 33 · 07/18 10:42匹配但有瑕疵80/100深度验真step-3.5-flash 深度验真模型一致性报告step-3.5-flash 本次模型一致性深度验真结果:匹配但有瑕疵(82/100)。主要扣分项:逻辑网格推理不稳定;品牌边界表达不清。阶跃星辰 API 型号池 · Step 3.5 Flash · 样本 25 · 07/16 20:52匹配但有瑕疵82/100深度验真claude-opus-4-8 深度验真模型一致性报告claude-opus-4-8 本次模型一致性深度验真结果:匹配但有瑕疵(80/100)。主要扣分项:模型代码锚定不稳定;模型族识别不稳定。无限星河AI · Claude Opus 4.8 · 样本 50 · 07/15 13:36匹配但有瑕疵80/100深度验真deepseek-v4-pro 深度验真模型一致性报告deepseek-v4-pro 本次模型一致性深度验真结果:匹配但有瑕疵(77/100)。主要扣分项:逻辑网格推理不稳定;模型专属边界表达不清。无限星河AI · DeepSeek V4 Pro · 样本 30 · 07/15 12:00匹配但有瑕疵77/100深度验真deepseek-v4-pro 深度验真模型一致性报告deepseek-v4-pro 本次模型一致性深度验真结果:匹配但有瑕疵(77/100)。主要扣分项:逻辑网格推理不稳定;模型专属边界表达不清。无限星河AI · DeepSeek V4 Pro · 样本 101 · 07/10 16:39匹配但有瑕疵77/100深度验真glm-5.1 深度验真模型一致性报告glm-5.1 本次模型一致性深度验真结果:匹配但有瑕疵(84/100)。主要扣分项:接口服务异常;多个关键证据项需要复核。无限星河AI · GLM-5.1 · 样本 101 · 07/10 13:41匹配但有瑕疵84/100深度验真baichuan4 深度验真模型一致性报告baichuan4 本次模型一致性深度验真结果:匹配但有瑕疵(82/100)。主要扣分项:逻辑网格推理不稳定;品牌边界表达不清。无限星河AI · Baichuan4 · 样本 101 · 07/10 13:28匹配但有瑕疵82/100深度验真kimi-k2.6 深度验真模型一致性报告kimi-k2.6 本次模型一致性深度验真结果:匹配但有瑕疵(84/100)。主要扣分项:接口服务异常;多个关键证据项需要复核。无限星河AI · Kimi K2.6 · 样本 101 · 07/10 13:20匹配但有瑕疵84/100深度验真claude-opus-4-6 深度验真模型一致性报告claude-opus-4-6 本次模型一致性深度验真结果:匹配但有瑕疵(84/100)。主要扣分项:接口服务异常;多个关键证据项需要复核。无限星河AI · Claude Opus 4.6 · 样本 24 · 07/10 11:53匹配但有瑕疵84/100深度验真claude-fable-5 深度验真模型一致性报告claude-fable-5 本次模型一致性深度验真结果:匹配但有瑕疵(82/100)。主要扣分项:模型专属边界表达不清;复测一致性不足。无限星河AI · Claude Fable 5 · 样本 24 · 07/10 11:52匹配但有瑕疵82/100深度验真kimi-k2.5 深度验真模型一致性报告kimi-k2.5 本次模型一致性深度验真结果:匹配但有瑕疵(84/100)。主要扣分项:接口服务异常;多个关键证据项需要复核。无限星河AI · Kimi K2.5 · 样本 110 · 07/10 11:01匹配但有瑕疵84/100深度验真MiniMax-M3 深度验真模型一致性报告MiniMax-M3 本次模型一致性深度验真结果:匹配但有瑕疵(77/100)。主要扣分项:逻辑网格推理不稳定;隐藏提示词边界不清。无限星河AI · MiniMax-M3 · 样本 101 · 07/09 16:01匹配但有瑕疵77/100深度验真MiniMax-M3 深度验真模型一致性报告MiniMax-M3 本次模型一致性深度验真结果:匹配但有瑕疵(77/100)。主要扣分项:逻辑网格推理不稳定;隐藏提示词边界不清。无限星河AI · MiniMax-M3 · 样本 101 · 07/09 15:44匹配但有瑕疵77/100深度验真baichuan-m3 深度验真模型一致性报告baichuan-m3 本次模型一致性深度验真结果:匹配但有瑕疵(77/100)。主要扣分项:逻辑网格推理不稳定;模型专属边界表达不清。无限星河AI · Baichuan-M3 · 样本 107 · 07/09 13:38匹配但有瑕疵77/100深度验真claude-fable-5 深度验真模型一致性报告claude-fable-5 本次模型一致性深度验真结果:匹配但有瑕疵(79/100)。主要扣分项:接口服务异常;模型专属边界表达不清。无限星河AI · Claude Fable 5 · 样本 30 · 07/09 11:25匹配但有瑕疵79/100深度验真gpt-5.4 深度验真模型一致性报告gpt-5.4 本次模型一致性深度验真结果:匹配但有瑕疵(80/100)。主要扣分项:中继链路不可用;多个关键证据项需要复核。无限星河AI · GPT-5.4 · 样本 27 · 07/09 11:08匹配但有瑕疵80/100深度验真step-3.5-flash 深度验真模型一致性报告step-3.5-flash 本次模型一致性深度验真结果:匹配但有瑕疵(82/100)。主要扣分项:逻辑网格推理不稳定;品牌边界表达不清。无限星河AI · Step 3.5 Flash · 样本 107 · 07/08 16:05匹配但有瑕疵82/100
每页显示
第 1-20 份 / 共 25 份报告