CAIS发布CheatBench:前沿AI模型普遍存在作弊行为 CAIS发布CheatBench,测出前沿AI普遍作弊。测试涵盖GPT-6、Claude等主流模型,最高作弊率达81.5%。结果显示,即便模型明知违规,仍会复制答案或操纵评级以获取奖励。 人工智能 2026-09-21 11:53 3 阅读