当前筛选存疑 / 深度验真 / 中异常共 30 份报告
报告列表
深度验真qwen3.6-plus 深度验真模型一致性报告qwen3.6-plus 本次模型一致性深度验真结果:存疑(73/100)。主要扣分项:逻辑网格推理不稳定;标签结构复述不稳定;品牌边界表达不清。xinlicloud.top · Qwen3.6 Plus · 样本 35 · 07/22 17:46存疑73/100深度验真glm-5.2 深度验真模型一致性报告glm-5.2 本次模型一致性深度验真结果:存疑(72/100)。主要扣分项:逻辑网格推理不稳定;上游响应超时;存在未通过证据项。xinlicloud.top · GLM-5.2 · 样本 27 · 07/22 17:24存疑72/100深度验真claude-opus-4-8 深度验真模型一致性报告claude-opus-4-8 本次模型一致性深度验真结果:存疑(72/100)。主要扣分项:隐藏提示词边界不清;标签结构复述不稳定;复测一致性不足。省省Token · Claude Opus 4.8 · 样本 20 · 07/18 23:13存疑72/100深度验真claude-opus-4-8 深度验真模型一致性报告claude-opus-4-8 本次模型一致性深度验真结果:存疑(70/100)。主要扣分项:模型代码锚定不稳定;复测一致性不足;模型族识别不稳定。apikey · Claude Opus 4.8 · 样本 22 · 07/17 20:08存疑70/100深度验真deepseek-v4-pro 深度验真模型一致性报告deepseek-v4-pro 本次模型一致性深度验真结果:存疑(73/100)。主要扣分项:逻辑网格推理不稳定;模型专属边界表达不清;品牌边界表达不清。无限星河AI · DeepSeek V4 Pro · 样本 30 · 07/15 13:26存疑73/100深度验真deepseek-v4-pro 深度验真模型一致性报告deepseek-v4-pro 本次模型一致性深度验真结果:存疑(73/100)。主要扣分项:逻辑网格推理不稳定;模型专属边界表达不清;品牌边界表达不清。无限星河AI · DeepSeek V4 Pro · 样本 113 · 07/10 17:45存疑73/100深度验真deepseek-v4-pro 深度验真模型一致性报告deepseek-v4-pro 本次模型一致性深度验真结果:存疑(73/100)。主要扣分项:逻辑网格推理不稳定;模型专属边界表达不清;品牌边界表达不清。无限星河AI · DeepSeek V4 Pro · 样本 113 · 07/10 17:06存疑73/100深度验真mimo-v2.5-pro 深度验真模型一致性报告mimo-v2.5-pro 本次模型一致性深度验真结果:存疑(61/100)。主要扣分项:逻辑网格推理不稳定;接口服务异常;隐藏提示词边界不清。无限星河AI · MiMo-V2.5-Pro · 样本 101 · 07/10 13:31存疑61/100深度验真MiniMax-M3 深度验真模型一致性报告MiniMax-M3 本次模型一致性深度验真结果:存疑(73/100)。主要扣分项:逻辑网格推理不稳定;隐藏提示词边界不清;品牌边界表达不清。无限星河AI · MiniMax-M3 · 样本 101 · 07/10 13:26存疑73/100深度验真MiniMax-M2.7 深度验真模型一致性报告MiniMax-M2.7 本次模型一致性深度验真结果:存疑(73/100)。主要扣分项:逻辑网格推理不稳定;接口服务异常;多个关键证据项需要复核。无限星河AI · MiniMax-M2.7 · 样本 101 · 07/10 13:24存疑73/100深度验真claude-haiku-4-5-20251001 深度验真模型一致性报告claude-haiku-4-5-20251001 本次模型一致性深度验真结果:存疑(63/100)。主要扣分项:逻辑网格推理不稳定;隐藏提示词边界不清;复测一致性不足。无限星河AI · Claude Haiku 4.5 · 样本 24 · 07/10 11:48存疑63/100深度验真deepseek-v4-pro 深度验真模型一致性报告deepseek-v4-pro 本次模型一致性深度验真结果:存疑(70/100)。主要扣分项:逻辑网格推理不稳定;模型专属边界表达不清;品牌边界表达不清。无限星河AI · DeepSeek V4 Pro · 样本 101 · 07/09 16:15存疑70/100深度验真step-3.5-flash 深度验真模型一致性报告step-3.5-flash 本次模型一致性深度验真结果:存疑(70/100)。主要扣分项:逻辑网格推理不稳定;额度或频率限制;多个关键证据项需要复核。无限星河AI · Step 3.5 Flash · 样本 107 · 07/09 13:57存疑70/100深度验真mimo-v2.5 深度验真模型一致性报告mimo-v2.5 本次模型一致性深度验真结果:存疑(69/100)。主要扣分项:逻辑网格推理不稳定;隐藏提示词边界不清;模型族识别不稳定。无限星河AI · MiMo-V2.5 · 样本 107 · 07/09 13:57存疑69/100深度验真mimo-v2.5-pro 深度验真模型一致性报告mimo-v2.5-pro 本次模型一致性深度验真结果:存疑(67/100)。主要扣分项:逻辑网格推理不稳定;隐藏提示词边界不清;复测一致性不足。无限星河AI · MiMo-V2.5-Pro · 样本 107 · 07/09 13:55存疑67/100深度验真MiniMax-M3 深度验真模型一致性报告MiniMax-M3 本次模型一致性深度验真结果:存疑(63/100)。主要扣分项:逻辑网格推理不稳定;结构化输出不稳定;隐藏提示词边界不清。无限星河AI · MiniMax-M3 · 样本 112 · 07/09 13:32存疑63/100深度验真mimo-v2.5 深度验真模型一致性报告mimo-v2.5 本次模型一致性深度验真结果:存疑(65/100)。主要扣分项:逻辑网格推理不稳定;隐藏提示词边界不清;usage 用量字段不可观测。无限星河AI · MiMo-V2.5 · 样本 107 · 07/09 12:06存疑65/100深度验真MiniMax-M3 深度验真模型一致性报告MiniMax-M3 本次模型一致性深度验真结果:存疑(63/100)。主要扣分项:逻辑网格推理不稳定;模型代码锚定不稳定;隐藏提示词边界不清。无限星河AI · MiniMax-M3 · 样本 113 · 07/09 11:50存疑63/100深度验真claude-opus-4-8 深度验真模型一致性报告claude-opus-4-8 本次模型一致性深度验真结果:存疑(74/100)。主要扣分项:逻辑网格推理不稳定;接口服务异常。无限星河AI · Claude Opus 4.8 · 样本 35 · 07/09 11:21存疑74/100深度验真MiniMax-M3 深度验真模型一致性报告MiniMax-M3 本次模型一致性深度验真结果:存疑(73/100)。主要扣分项:逻辑网格推理不稳定;模型代码锚定不稳定。无限星河AI · MiniMax-M3 · 样本 113 · 07/09 10:51存疑73/100