当前筛选匹配 / 低异常共 1,847 份报告
报告列表
标准验真gpt-5.5 标准验真模型一致性报告gpt-5.5 本次模型一致性标准验真结果:匹配(86/100)。主要扣分项:网关暂不可用;存在未通过证据项。UU API · GPT-5.5 · 样本 15 · 08/01 09:12匹配86/100深度验真deepseek-v4-flash 深度验真模型一致性报告deepseek-v4-flash 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:额度或频率限制;存在未通过证据项。sensenova.cn · DeepSeek V4 Flash · 样本 13 · 07/31 18:39匹配86/100标准验真gpt-5.6-luna 标准验真模型一致性报告gpt-5.6-luna 本次模型一致性标准验真结果:匹配(86/100)。主要扣分项:网关暂不可用;存在未通过证据项。UU API · GPT-5.6 Luna · 样本 16 · 07/31 09:54匹配86/100标准验真gpt-5.6-luna 标准验真模型一致性报告gpt-5.6-luna 本次模型一致性标准验真结果:匹配(86/100)。主要扣分项:网关暂不可用;存在未通过证据项。UU API · GPT-5.6 Luna · 样本 13 · 07/31 08:50匹配86/100标准验真gpt-5.6-sol 标准验真模型一致性报告gpt-5.6-sol 本次模型一致性标准验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。零壹跃迁 · GPT-5.6 Sol · 样本 17 · 07/31 05:28匹配86/100标准验真gpt-5.6-luna 标准验真模型一致性报告gpt-5.6-luna 本次模型一致性标准验真结果:匹配(86/100)。主要扣分项:网关暂不可用;存在未通过证据项。零壹跃迁 · GPT-5.6 Luna · 样本 13 · 07/31 05:08匹配86/100标准验真claude-sonnet-5 标准验真模型一致性报告claude-sonnet-5 本次模型一致性标准验真结果:匹配(91/100)。主要扣分项:隐藏提示词边界不清。UU API · Claude Sonnet 5 · 样本 22 · 07/29 12:41匹配91/100深度验真minimax-m3 深度验真模型一致性报告minimax-m3 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。xinlicloud.top · MiniMax-M3 · 样本 25 · 07/22 17:35匹配86/100标准验真kimi-k2.6 标准验真模型一致性报告kimi-k2.6 本次模型一致性标准验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。xinlicloud.top · Kimi K2.6 · 样本 22 · 07/22 17:26匹配86/100深度验真claude-opus-4-6 深度验真模型一致性报告claude-opus-4-6 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。无限星河AI · Claude Opus 4.6 · 样本 23 · 07/21 16:35匹配86/100深度验真claude-sonnet-5 深度验真模型一致性报告claude-sonnet-5 本次模型一致性深度验真结果:匹配(87/100)。主要扣分项:模型代码锚定不稳定。无限星河AI · Claude Sonnet 5 · 样本 33 · 07/18 10:45匹配87/100深度验真claude-sonnet-5 深度验真模型一致性报告claude-sonnet-5 本次模型一致性深度验真结果:匹配(93/100)。主要扣分项:模型族识别不稳定。无限星河AI · Claude Sonnet 5 · 样本 27 · 07/17 10:44匹配93/100深度验真claude-opus-4-8 深度验真模型一致性报告claude-opus-4-8 本次模型一致性深度验真结果:匹配(87/100)。主要扣分项:模型代码锚定不稳定。无限星河AI · Claude Opus 4.8 · 样本 33 · 07/17 10:42匹配87/100深度验真gpt-5.6-sol 深度验真模型一致性报告gpt-5.6-sol 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:额度或频率限制;存在未通过证据项。小破站 · GPT-5.6 Sol · 样本 25 · 07/16 19:42匹配86/100深度验真gpt-5.6-sol 深度验真模型一致性报告gpt-5.6-sol 本次模型一致性深度验真结果:匹配(94/100)。主要扣分项:品牌边界表达不清;验真信号待复核。llm-api · GPT-5.6 Sol · 样本 432 · 07/16 19:01匹配94/100深度验真claude-opus-4-8 深度验真模型一致性报告claude-opus-4-8 本次模型一致性深度验真结果:匹配(87/100)。主要扣分项:模型代码锚定不稳定。无限星河AI · Claude Opus 4.8 · 样本 33 · 07/16 10:42匹配87/100深度验真glm-5.2 深度验真模型一致性报告glm-5.2 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:额度或频率限制;存在未通过证据项。sensenova.cn · GLM-5.2 · 样本 13 · 07/15 14:38匹配86/100深度验真gpt-5.4-codex 深度验真模型一致性报告gpt-5.4-codex 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。无限星河AI · GPT-5.4 Codex · 样本 34 · 07/15 13:50匹配86/100深度验真deepseek-v4-flash 深度验真模型一致性报告deepseek-v4-flash 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。无限星河AI · DeepSeek V4 Flash · 样本 23 · 07/15 11:57匹配86/100深度验真deepseek-v4-flash 深度验真模型一致性报告deepseek-v4-flash 本次模型一致性深度验真结果:匹配(86/100)。主要扣分项:上游响应超时;存在未通过证据项。无限星河AI · DeepSeek V4 Flash · 样本 106 · 07/10 17:40匹配86/100