跳到正文
原文
Google DeepMind·· 2026-03-26精选AI 评分62

Google DeepMind 发布 AI 有害操纵评测工具包

Protecting people from harmful manipulation

AI 导读

Google DeepMind 发布关于 AI 有害操纵的研究,称其为首个经实证验证的评测工具包,并公开运行同类人类被试研究所需的全部材料。研究覆盖英国、美国、印度逾 1 万名参与者,开展九项研究,聚焦金融与健康等高风险场景;结果显示 AI 在健康话题上的有害操纵效果最弱,且某一领域的成功无法预测另一领域。

推荐理由

Google DeepMind 公开了首个经实证验证的 AI 有害操纵评测工具包,读者可了解其研究设计与公开材料。

来源:Google DeepMind · deepmind.google