跳到正文

技术方向

安全对齐 最新动态

AI 安全与对齐:越狱与防御、模型行为研究、安全评测与治理框架的进展。

22 条精选近 30 天 12 条共收录 80 条

更新

精选归档 · 第 2 页

6月10日周三第 21–22 条
  1. Google DeepMind62

    Google DeepMind 联合 Schmidt Sciences 等发起最高 1000 万美元多智能体安全研究资助

    Google DeepMind 联合 Schmidt Sciences、Cooperative AI Foundation、ARIA,并在 Google.org 支持下发起最高 1000 万美元的技术研究资助征集,面向全球研究者,聚焦大规模多智能体 AI 系统作为群体时的行为与风险框架。

    推荐理由:Google DeepMind 联合多家机构出资征集多智能体安全研究提案,读者可了解四个优先方向与申请节点。

5月28日周四
  1. Google Research60

    Google 提出零信任聚合的隐私分析方案

    Google Research 发布零信任隐私分析方案,用基于格的密码学协议让设备以单条消息提交数据,无需在多轮协议中长时间保持在线。该方案将密码学聚合与 TEE 证明结合,使原始数据在服务器内存中不被暴露或重建,仅在聚合匿名后才处理明文。Android SafetyCore 将采用该方案评估安全工具的有效性元数据,用户内容仍只留在设备上。

    推荐理由:Google 把格密码一次性聚合与 TEE 证明叠加,读者可了解端侧隐私分析如何摆脱多轮在线依赖。