<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>AI对齐 on AI 早报</title><link>https://ai-news.example.com/tags/ai%E5%AF%B9%E9%BD%90/</link><description>Recent content in AI对齐 on AI 早报</description><generator>Hugo</generator><language>zh-CN</language><lastBuildDate>Wed, 29 Jul 2026 23:10:11 +0800</lastBuildDate><atom:link href="https://ai-news.example.com/tags/ai%E5%AF%B9%E9%BD%90/feed.xml" rel="self" type="application/rss+xml"/><item><title>[EN] OpenAI发布长周期AI模型安全部署经验：新风险与迭代防护并行</title><link>https://ai-news.example.com/articles/en-openaiai/</link><pubDate>Wed, 29 Jul 2026 23:10:11 +0800</pubDate><guid>https://ai-news.example.com/articles/en-openaiai/</guid><description>OpenAI分享了部署长运行时间AI模型的经验，揭示了新的安全风险与观察到的失败案例，并通过迭代部署改进了防护措施。</description></item><item><title>[EN] OpenAI分享长时运行AI模型的安全部署经验：新风险与迭代防护</title><link>https://ai-news.example.com/articles/en-openaiai/</link><pubDate>Sun, 26 Jul 2026 23:10:18 +0800</pubDate><guid>https://ai-news.example.com/articles/en-openaiai/</guid><description>OpenAI发布了关于长时运行AI模型（即长期视野模型）的安全对齐经验总结，揭示了此类模型在持续运行中暴露的新安全风险、实际故障案例，以及通过迭代部署策略改进防护措施的方法。</description></item><item><title>[EN]OpenAI 发布长周期AI模型部署经验：安全风险与防护升级</title><link>https://ai-news.example.com/articles/enopenai-ai/</link><pubDate>Thu, 23 Jul 2026 23:09:36 +0800</pubDate><guid>https://ai-news.example.com/articles/enopenai-ai/</guid><description>OpenAI分享了在部署长周期AI模型过程中的安全教训，指出随着模型运行时间的延长，出现了新的安全风险和失效模式，并通过迭代部署改进了防护措施。</description></item><item><title>[EN] GPT-Red：OpenAI用自我博弈解锁AI鲁棒性自改进</title><link>https://ai-news.example.com/articles/en-gpt-redopenaiai/</link><pubDate>Tue, 21 Jul 2026 23:08:57 +0800</pubDate><guid>https://ai-news.example.com/articles/en-gpt-redopenaiai/</guid><description>OpenAI推出GPT-Red，这是一个基于自我博弈的自动化红队系统，旨在通过自我对抗训练提升AI的安全性、对齐度以及对提示注入攻击的鲁棒性。</description></item><item><title>[EN] GPT-Red：OpenAI 用自我对抗解锁 AI 鲁棒性自增强</title><link>https://ai-news.example.com/articles/en-gpt-redopenai-ai/</link><pubDate>Mon, 20 Jul 2026 23:11:39 +0800</pubDate><guid>https://ai-news.example.com/articles/en-gpt-redopenai-ai/</guid><description>OpenAI 发布了 GPT-Red，一个基于自博弈的自动化红队系统，旨在通过自我对抗训练提升 AI 的安全性、对齐度和对提示注入攻击的鲁棒性。</description></item><item><title>[EN]GPT-Red：OpenAI用AI自我对抗锻造安全防线</title><link>https://ai-news.example.com/articles/engpt-redopenaiai/</link><pubDate>Sat, 18 Jul 2026 02:30:17 +0800</pubDate><guid>https://ai-news.example.com/articles/engpt-redopenaiai/</guid><description>OpenAI推出自动化红队系统GPT-Red，通过自博弈(self-play)方式让AI模型自行生成对抗性攻击，从而显著提升AI在安全性、对齐性及提示注入攻击鲁棒性方面的表现。</description></item><item><title>[EN] OpenAI推GPT-Red：自博弈自动红队系统，解锁AI安全自我进化新路径</title><link>https://ai-news.example.com/articles/en-openaigpt-redai/</link><pubDate>Fri, 17 Jul 2026 23:01:32 +0800</pubDate><guid>https://ai-news.example.com/articles/en-openaigpt-redai/</guid><description>OpenAI推出GPT-Red，一个基于自我对弈的自动化红队系统，旨在通过持续自改进提升AI模型的安全对齐能力与提示注入鲁棒性。</description></item></channel></rss>