[EN] GPT-Red:OpenAI 用自我对抗解锁 AI 鲁棒性自增强OpenAI 发布了 GPT-Red,一个基于自博弈的自动化红队系统,旨在通过自我对抗训练提升 AI 的安全性、对齐度和对提示注入攻击的鲁棒性。 OpenAI Blog 23:11 AI 辅助 AI 安全 大模型对齐 自动化红队
[EN] OpenAI推GPT-Red:自博弈自动红队系统,解锁AI安全自我进化新路径OpenAI推出GPT-Red,一个基于自我对弈的自动化红队系统,旨在通过持续自改进提升AI模型的安全对齐能力与提示注入鲁棒性。 OpenAI Blog 23:01 AI 辅助 AI安全 大语言模型 自动化测试