[EN] GPT-Red:OpenAI 用自我对抗解锁 AI 鲁棒性自增强
OpenAI 发布了 GPT-Red,一个基于自博弈的自动化红队系统,旨在通过自我对抗训练提升 AI 的安全性、对齐度和对提示注入攻击的鲁棒性。
OpenAI 发布了 GPT-Red,一个基于自博弈的自动化红队系统,旨在通过自我对抗训练提升 AI 的安全性、对齐度和对提示注入攻击的鲁棒性。
OpenAI 发布了自动红队系统 GPT-Red,该系统通过自对弈机制不断提升 AI 安全性、对齐能力和对提示注入攻击的鲁棒性,标志着 AI 安全领域的一次重要自主进化。
OpenAI 宣布推出针对 GPT-5.5 的生物安全漏洞赏金计划,旨在通过外部研究人员发现并修复模型在生物学领域的潜在滥用风险,提升 AI 安全治理。