AI 资讯

AI 模型发布 · 行业动态 · 应用案例 — 每日精选,中文呈现。

246 篇 · 每 6 小时自动更新 · 第 11 / 11 页

O

OpenAI 强化 ChatGPT Atlas 浏览器代理防御提示词注入攻击

OpenAI 近期发布针对 ChatGPT Atlas 浏览器代理(Browser Agent)的安全更新,应对新型提示词注入(Prompt Injection)攻击。通过内部自动化红队测试发现新攻击类别后,团队部署了对抗训练模型和增强防护措施。文章详细披露了 OpenAI 如何利用强化学习训练自动化攻击者,通过端到端模拟和高计算量测试,在攻击出现在野外之前提前发现漏洞并快速修复。

行业动态OpenAI
O

OpenAI 发布思维链可监控性评估框架:推理越长越透明

OpenAI 推出包含 13 项评估(24 个环境)的系统性框架,用于衡量 AI 推理模型的思维链可监控性。研究发现,监控思维链(CoT)比仅监控输出有效得多,推理时间越长的模型越易监控,但小模型高推理与大模型低推理存在"可监控性税"权衡。研究呼吁业界共同保持思维链可监控性,使其成为未来 AI 系统的关键控制层。

研究与论文OpenAI
O

OpenAI 与美国能源部签署合作备忘录 推进 Genesis Mission 科学计划

OpenAI 与美国能源部(DOE)签署谅解备忘录,将在 AI 与先进计算领域展开深度合作,支持 Genesis Mission 科学加速计划。双方已在 DOE 国家实验室部署前沿模型,并组织超千名科学家参与 AI 测试。合作重点包括核聚变能源等领域,OpenAI 还向白宫提交了 2026"科学年"政策建议。

行业动态OpenAI
O

OpenAI 发布青少年与家长 AI 素养指南

OpenAI 推出两份面向家庭的 ChatGPT 使用指南,涵盖 AI 模型训练原理、信息验证、提示词技巧等基础知识,并为家长提供与青少年讨论 AI 能力边界、培养批判性思维的对话建议。资源由 OpenAI 专家委员会与 ConnectSafely 等机构联合开发,未来将扩展至更多年龄段。

应用与案例OpenAI
O

OpenAI 发布未成年人保护原则,ChatGPT 将强化 13-17 岁用户安全防护

OpenAI 更新其 Model Spec(模型规范)文件,新增 Under-18 Principles(未成年人原则),明确 ChatGPT 如何为 13-17 岁青少年提供年龄适配的安全体验。新原则基于发展心理学,强调预防、透明和早期干预,并在自残、成人内容、危险行为等高风险领域设置更严格防护栏。美国心理学会参与审阅并背书该原则。

政策与安全OpenAI
O

OpenAI 联合美国新闻机构推出记者 AI 学习平台 Academy

OpenAI 宣布推出面向新闻机构的 AI 学习中心 OpenAI Academy for News Organizations,提供实操培训、案例手册和开源资源,帮助记者团队在调查报道、数据分析、多语言翻译等场景应用 AI。该项目由 OpenAI 与美国新闻项目组织(AJP)、Lenfest 研究所合作开发,已与全球超过 20 种语言的新闻机构建立内容合作。

应用与案例OpenAI