[EN] OpenAI发布长时运行AI模型安全对齐经验:新风险与迭代防护
OpenAI分享了部署长时运行AI模型的经验,揭示了新型安全风险、观察到的故障模式,并通过迭代部署改进了防护措施。
OpenAI分享了部署长时运行AI模型的经验,揭示了新型安全风险、观察到的故障模式,并通过迭代部署改进了防护措施。
OpenAI发布了关于长时运行AI模型(即长期视野模型)的安全对齐经验总结,揭示了此类模型在持续运行中暴露的新安全风险、实际故障案例,以及通过迭代部署策略改进防护措施的方法。
OpenAI分享了部署长期运行AI模型的经验,指出了新的安全风险、已观察到的失败案例,并通过迭代部署改进了防护措施。
OpenAI 推出 GPT-Red 自动化红队系统,通过自我博弈机制持续改进 AI 安全、对齐性及提示注入鲁棒性,标志着 AI 安全评估从人工模式向自动化闭环的范式转变。
智谱创始人唐杰在2026年7月11日发布的内部信中,回顾了公司通过押注Coding实现市值暴涨的历程,并宣布未来将战略投入长程任务、自治智能体系统、自我进化及极致安全治理四大领域,以推动AGI发展。
OpenAI 展示了其下一代模型 GPT-5.6 Sol,该模型在编程、科学和网络安全方面性能更强大,并配备了迄今为止最先进的安全栈。