[EN] GPT-Red:OpenAI 用自我博弈解锁AI鲁棒性自动红队测试
OpenAI 发布 GPT-Red,一种利用自我博弈机制自动执行红队测试的系统,旨在提升 AI 模型的安全性、对齐性和对提示注入攻击的鲁棒性,标志着 AI 安全自动化评估的重大进展。
OpenAI 发布 GPT-Red,一种利用自我博弈机制自动执行红队测试的系统,旨在提升 AI 模型的安全性、对齐性和对提示注入攻击的鲁棒性,标志着 AI 安全自动化评估的重大进展。
OpenAI推出GPT-Red,这是一个基于自我博弈的自动化红队系统,旨在通过自我对抗训练提升AI的安全性、对齐度以及对提示注入攻击的鲁棒性。
OpenAI推出GPT-Red自动化红队系统,通过自我对抗训练提升AI安全性、对齐能力和提示注入鲁棒性,标志着AI安全从人工审计向自主进化的重要转变。