[EN]GPT-Red:OpenAI用AI自我对抗锻造安全防线
OpenAI推出自动化红队系统GPT-Red,通过自博弈(self-play)方式让AI模型自行生成对抗性攻击,从而显著提升AI在安全性、对齐性及提示注入攻击鲁棒性方面的表现。
OpenAI推出自动化红队系统GPT-Red,通过自博弈(self-play)方式让AI模型自行生成对抗性攻击,从而显著提升AI在安全性、对齐性及提示注入攻击鲁棒性方面的表现。
OpenAI提出“反向联邦主义”AI治理策略,主张通过各州立法实践逐步构建全国性的、确保安全与民主的AI监管框架。
OpenAI正在为ChatGPT引入针对青少年的年龄适宜保护措施、学习工具、家长控制功能以及与专家的合作,以确保青少年安全、负责任地使用AI技术。
OpenAI发布ChatGPT Work,一个能够跨应用和文件执行操作、持续数小时跟进项目,并将目标转化为完整成果的AI代理,标志着AI从对话助手向主动工作伙伴的跃迁。
OpenAI推出GPT-Red,一个基于自我对弈的自动化红队系统,旨在通过持续自改进提升AI模型的安全对齐能力与提示注入鲁棒性。
OpenAI推出GPT-5.5生物漏洞悬赏计划,邀请安全研究人员检测模型在生物技术领域的潜在风险,以提前规避恶意使用。
OpenAI提出“反向联邦制”AI治理策略,主张各州立法先行,逐步构建全国性安全、民主的AI监管框架。
印度二手车平台Cars24利用OpenAI驱动的语音与聊天代理,每月处理超100万分钟对话,成功挽回12%的流失潜在客户,并将智能工作流推广至全公司团队。
OpenAI正通过引入年龄适宜保护措施、学习工具、家长控制功能及专家合作,使ChatGPT对青少年更为安全。这一举措旨在平衡技术创新与青少年隐私、教育及安全需求。
OpenAI公布了其与政府和国家安全机构合作的最新方针,确立了负责任AI使用、民主问责和公共安全等核心原则,旨在平衡技术创新与国家安全需求。