当前筛选有瑕疵 / 标准验真 / 低异常共 2 份报告
报告列表
标准验真gpt-5.6-sol 标准验真模型一致性报告gpt-5.6-sol 本次模型一致性标准验真结果:匹配但有瑕疵(78/100)。主要扣分项:接口鉴权或权限异常;存在未通过证据项。apidock.ai · GPT-5.6 Sol · 样本 19 · 07/31 16:30匹配但有瑕疵78/100标准验真claude-fable-5 标准验真模型一致性报告claude-fable-5 本次模型一致性标准验真结果:匹配但有瑕疵(82/100)。主要扣分项:隐藏提示词边界不清;标签结构复述不稳定。企业专用Api · Claude Fable 5 · 样本 25 · 07/12 09:26匹配但有瑕疵82/100