[EN] GPT-Red:OpenAI用自我博弈解锁AI鲁棒性自改进
OpenAI推出GPT-Red自动化红队系统,通过自我对抗训练提升AI安全性、对齐能力和提示注入鲁棒性,标志着AI安全从人工审计向自主进化的重要转变。
OpenAI推出GPT-Red自动化红队系统,通过自我对抗训练提升AI安全性、对齐能力和提示注入鲁棒性,标志着AI安全从人工审计向自主进化的重要转变。
OpenAI正在推出针对青少年的安全版ChatGPT,包含年龄适配的内容保护、教育学习工具、家长控制功能以及专家合作机制,旨在让年轻用户更安全地使用AI技术。
OpenAI 公布了其与政府及国家安全机构合作的核心原则,包括负责任AI使用、民主问责制和公共安全,旨在平衡技术发展与社会伦理要求。
OpenAI 宣布启动针对其新一代模型GPT-5.5的生物安全漏洞赏金计划(Bio Bounty),旨在通过外部安全研究团队主动发现并修复模型在生物风险方面的潜在漏洞,最高奖金可达百万美元级别。
OpenAI 推出 GPT-Red 自动化红队系统,通过自我博弈机制持续改进 AI 安全、对齐性及提示注入鲁棒性,标志着 AI 安全评估从人工模式向自动化闭环的范式转变。
OpenAI宣布推出一系列针对青少年用户的ChatGPT安全保护措施,包括年龄适配内容过滤、学习工具和家长控制功能,旨在让青少年在安全环境下使用AI工具,同时借助专家合作确保技术伦理与教育价值。
OpenAI正式发布其与政府及国家安全机构合作的方法论,强调以负责任AI使用、民主问责和公共安全为三大核心原则,旨在平衡技术创新与国家安全需求。
OpenAI推出ChatGPT Work,一款能够跨应用和文件执行操作、持续跟进项目数小时、将目标转化为完成工作的智能体。这标志着ChatGPT从对话工具向主动工作伙伴的转型。
OpenAI宣布启动GPT-5.5生物漏洞悬赏计划,旨在邀请全球安全研究人员发现并报告模型在生物安全领域的潜在风险。
微软宣布 GPT-5.6 现已作为 Microsoft 365 Copilot 的默认模型,为 Word、Excel、PowerPoint、Chat 及 Cowork 等应用提供更强大的 AI 能力,旨在提升办公效率与工作质量。