<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>模型对齐 on AI 早报</title><link>https://ai-news.example.com/categories/%E6%A8%A1%E5%9E%8B%E5%AF%B9%E9%BD%90/</link><description>Recent content in 模型对齐 on AI 早报</description><generator>Hugo</generator><language>zh-CN</language><lastBuildDate>Wed, 22 Jul 2026 23:15:18 +0800</lastBuildDate><atom:link href="https://ai-news.example.com/categories/%E6%A8%A1%E5%9E%8B%E5%AF%B9%E9%BD%90/feed.xml" rel="self" type="application/rss+xml"/><item><title>[EN] GPT-Red：OpenAI 用自我博弈解锁AI鲁棒性自动红队测试</title><link>https://ai-news.example.com/articles/en-gpt-redopenai-ai/</link><pubDate>Wed, 22 Jul 2026 23:15:18 +0800</pubDate><guid>https://ai-news.example.com/articles/en-gpt-redopenai-ai/</guid><description>OpenAI 发布 GPT-Red，一种利用自我博弈机制自动执行红队测试的系统，旨在提升 AI 模型的安全性、对齐性和对提示注入攻击的鲁棒性，标志着 AI 安全自动化评估的重大进展。</description></item><item><title>[EN] OpenAI发布长周期AI模型安全部署经验：风险与防护同步升级</title><link>https://ai-news.example.com/articles/en-openaiai/</link><pubDate>Mon, 20 Jul 2026 23:11:31 +0800</pubDate><guid>https://ai-news.example.com/articles/en-openaiai/</guid><description>OpenAI分享了部署长时间运行AI模型的经验，揭示了新的安全风险、已观察到的失败案例，并通过迭代部署改进了防护措施，强调长周期模型带来的独特安全与对齐挑战。</description></item><item><title>[EN] OpenAI自演红队系统GPT-Red：通过自我博弈提升AI安全性与鲁棒性</title><link>https://ai-news.example.com/articles/en-openaigpt-redai/</link><pubDate>Thu, 16 Jul 2026 23:07:02 +0800</pubDate><guid>https://ai-news.example.com/articles/en-openaigpt-redai/</guid><description>OpenAI推出名为GPT-Red的自动化红队系统，利用自我博弈机制不断测试和改进AI模型的安全性、对齐性及对抗提示注入能力。</description></item><item><title>[EN] OpenAI 推出 GPT-Red：通过自对弈实现 AI 鲁棒性自我提升</title><link>https://ai-news.example.com/articles/en-openai-gpt-red-ai/</link><pubDate>Wed, 15 Jul 2026 23:07:00 +0800</pubDate><guid>https://ai-news.example.com/articles/en-openai-gpt-red-ai/</guid><description>OpenAI 发布了自动红队系统 GPT-Red，该系统通过自对弈机制不断提升 AI 安全性、对齐能力和对提示注入攻击的鲁棒性，标志着 AI 安全领域的一次重要自主进化。</description></item></channel></rss>