OpenAI 阻断一次协同模型蒸馏活动
OpenAI 披露其阻断了一次协同的模型蒸馏活动,该活动试图提取受保护的模型推理能力。OpenAI 表示正在加强针对对抗性蒸馏的防御措施。
推荐理由:OpenAI 官方披露其阻断了一次针对模型推理能力的对抗性蒸馏活动,可了解模型保护面临的现实威胁。
OpenAI 披露其阻断了一次协同的模型蒸馏活动,该活动试图提取受保护的模型推理能力。OpenAI 表示正在加强针对对抗性蒸馏的防御措施。
推荐理由:OpenAI 官方披露其阻断了一次针对模型推理能力的对抗性蒸馏活动,可了解模型保护面临的现实威胁。
OpenAI 公布前沿 AI 训练安全案例的早期指南,涵盖技术防护措施、运营实践,以及失准事件的调查方法。
OpenAI 就涉及澳大利亚政府网站的事件致歉,并公布更强防护措施与支持,以强化澳大利亚的网络防御。
OpenAI 将其 Daybreak 项目的访问权限扩展至乌克兰政府,用于支持民用基础设施的网络防御。
OpenAI CEO Sam Altman 在联合国安理会发表讲话,讨论 AI 安全、人类控制与国际合作。
OpenAI 发布 MentalHealthBench,一个由专家参与构建的基准,用于评估 AI 在真实心理健康对话中回复是否有帮助且安全。