OpenAI 安全团队成员 David Robinson 离职并公开批评其安全文化
曾在 OpenAI Trustworthy AI 团队负责安全系统的 David Robinson 离职,并在 The Atlantic 客座文章中批评 OpenAI 的安全文化。
曾在 OpenAI Trustworthy AI 团队负责安全系统的 David Robinson 离职,并在 The Atlantic 客座文章中批评 OpenAI 的安全文化。
OpenAI 表示已阻断一次协同的模型蒸馏活动,该活动试图提取其受保护的模型推理内容。OpenAI 称正在加强对对抗性蒸馏的防御。
推荐理由:OpenAI 披露其阻断了一次针对模型推理的对抗性蒸馏活动,读者可了解模型保护与对抗蒸馏的攻防现状。
Import AI 第 468 期汇总了多条 AI 研究动态:智库 IFP 提出 23 条分属 7 个类别的政策建议,用于应对 AI 研发自动化风险;MIT 与 Columbia 的论文 Racing to Ruin 用博弈模型分析竞争对手实现协同放缓的条件。