[EN] OpenAI发布长周期AI模型安全部署经验:新风险与迭代防护并行
OpenAI分享了部署长运行时间AI模型的经验,揭示了新的安全风险与观察到的失败案例,并通过迭代部署改进了防护措施。
OpenAI分享了部署长运行时间AI模型的经验,揭示了新的安全风险与观察到的失败案例,并通过迭代部署改进了防护措施。
OpenAI与Hugging Face联合发布初步调查结果,涉及一起在AI模型评估过程中发生的安全事件,突出展示了高级网络攻击能力,并为防御者提供了关键教训。
OpenAI正式推出企业AI代理平台Presence,旨在帮助组织部署可信赖的语音和聊天代理,用于客户服务和内部工作流程。
OpenAI 推出的 GPT-5.6 在模型架构、推理过程和智能体工作流三个层面提升了 AI 效率,旨在实现每单位算力成本下更高的智能产出,推动大模型从“能力竞赛”向“效率竞赛”转型。
通过启用保留推理路径和启用压缩两个API设置,GPT-5.6在ARC-AGI-3基准测试中的性能得分提升了三倍,同时效率也得到显著改善。
中国自主研发的AI安全智能体在最新国际评测中超越OpenAI和Anthropic,排名全球第四、国内第一,标志着国产AI安全技术取得重大突破。
AI领域知名学者吴恩达团队推出了一款完全开源的个人桌面Agent,允许用户本地运行并自由定制AI助手,标志着AI工具从黑箱走向透明开放的重要一步。
全球首个Agentic扩散模型问世,具备128K上下文能力,追平自回归模型,并能在执行任务过程中实时纠错,标志着AI模型从被动生成向主动推理与行动交互迈出关键一步。
OpenAI正在通过年龄适宜的保护措施、学习工具、家长控制功能及专家合作,使ChatGPT对青少年更安全,旨在平衡AI的赋能潜力与未成年人的风险防护。
OpenAI分享了部署长周期AI模型的经验,指出其带来了新的安全风险,并观察到特定失败模式,通过迭代部署改进了防护措施。