OpenAI推出GPT-5.5生物漏洞赏金计划,强化AI安全防御
OpenAI宣布启动GPT-5.5生物漏洞赏金计划,邀请全球安全研究人员与生物技术专家共同测试该模型在生物相关应用中的潜在风险,以预防其被误用于制造生物威胁。
OpenAI宣布启动GPT-5.5生物漏洞赏金计划,邀请全球安全研究人员与生物技术专家共同测试该模型在生物相关应用中的潜在风险,以预防其被误用于制造生物威胁。
OpenAI分享了部署长时间运行AI模型的经验,揭示了新的安全风险、已观察到的失败案例,并通过迭代部署改进了防护措施,强调长周期模型带来的独特安全与对齐挑战。
OpenAI 启动了针对 GPT-5.5 的生物漏洞悬赏计划,旨在识别和修复模型在生物安全领域的潜在风险。该计划鼓励研究人员和安全专家发现并报告可能被滥用于生物威胁的漏洞。
OpenAI推出GPT-Red自动化红队系统,通过自我对抗训练提升AI安全性、对齐能力和提示注入鲁棒性,标志着AI安全从人工审计向自主进化的重要转变。
OpenAI 宣布启动针对其新一代模型GPT-5.5的生物安全漏洞赏金计划(Bio Bounty),旨在通过外部安全研究团队主动发现并修复模型在生物风险方面的潜在漏洞,最高奖金可达百万美元级别。
OpenAI 推出 GPT-Red 自动化红队系统,通过自我博弈机制持续改进 AI 安全、对齐性及提示注入鲁棒性,标志着 AI 安全评估从人工模式向自动化闭环的范式转变。
OpenAI宣布启动GPT-5.5生物漏洞悬赏计划,旨在邀请全球安全研究人员发现并报告模型在生物安全领域的潜在风险。
OpenAI推出自动化红队系统GPT-Red,通过自博弈(self-play)方式让AI模型自行生成对抗性攻击,从而显著提升AI在安全性、对齐性及提示注入攻击鲁棒性方面的表现。
OpenAI正在为ChatGPT引入针对青少年的年龄适宜保护措施、学习工具、家长控制功能以及与专家的合作,以确保青少年安全、负责任地使用AI技术。
OpenAI推出GPT-Red,一个基于自我对弈的自动化红队系统,旨在通过持续自改进提升AI模型的安全对齐能力与提示注入鲁棒性。