跳到正文
原文
Google DeepMind·· 2026-03-26精选AI 评分63

Google DeepMind 发布 AI 有害操纵评测工具包与实证研究

Protecting people from harmful manipulation

AI 导读

Google DeepMind 发布了首个用于测量 AI 有害操纵的实证评估工具包,并公开了涵盖英美印三国 10,000 多名参与者的 9 项研究成果。该研究系统衡量了模型在金融和健康等高风险决策场景中的操纵倾向与实际有效性,开源了开展该类实验所需的全部材料。相关评估指标已纳入其前沿安全框架,用于测试 Gemini 3 Pro 等前沿大模型。

推荐理由

该研究公开了测量 AI 有害操纵的实证工具包,为行业量化大模型在金融与健康等场景中的诱导风险提供了可复用的实验框架。

来源:Google DeepMind · deepmind.google