OpenAI 安全主管 Jeff Harris 离职,公司重组引发安全团队人才流失担忧
据 The Information 报道,OpenAI 安全与安全主管 Jeff Harris 正在离职,这是公司更大规模重组的一部分。这是继今年 5 月"超级对齐"团队两位联合负责人离职后,OpenAI 安全团队的又一次高层人事变动,引发业界对该公司 AI 安全优先级的持续关注。

OpenAI安全主管跑路,重组背后安全团队快散架了
据The Information爆料,两位知情人士透露,OpenAI安全主管Jeff Harris要撤了,这是公司大重组的一部分。Harris本人已经跟团队打过招呼。
安全团队大佬集体出走
Harris不是第一个跑路的。今年5月,OpenAI"超级对齐"团队联合负责人Jan Leike直接拍桌子走人,公开吐槽公司不把安全当回事。几乎同时,另一位联合创始人Ilya Sutskever也溜了。这个专门研究怎么管住未来超强AI的团队,直接原地解散。
Harris 2022年加入OpenAI,之前在Snap当了6年首席安全官,更早还在Meta(那时候还叫Facebook)管过安全。
新成立的安全委员会能顶用?
面对越来越多人质疑AI安全性,OpenAI最近搞了个**"安全与安保委员会"**,说是要给董事会提建议。
但不少业内人士觉得这就是个**"面子工程"——CEO Sam Altman自己就在委员会里,而且这组织只有建议权没有决策权**,能有多大用?
截止发稿,OpenAI还没回应。
中国视角:要快还是要稳?
对国内AI圈来说,OpenAI这波人事地震很有看头——商业化狂奔的时候,怎么给安全团队留够话语权?业内共识是:随着大模型越来越接近AGI,安全研究的独立性和资源保障会成为全行业的头疼问题。
本文基于 GNews:Engadget 报道, 由 AiDuo123 AI 编辑翻译改写。原文链接: https://www.engadget.com/2212941/openai-head-of-safety-leaving-company-reorganization/
常见问题
- Jeff Harris 在 OpenAI 负责什么工作?
- Harris 担任 OpenAI 安全与安全主管(Head of Safety and Security),负责公司 AI 模型和运营的安全保障工作。他于 2022 年从 Snap 加入,此前曾在 Meta 担任安全主管。
- OpenAI 的'超级对齐'团队为什么解散?
- 该团队两位联合负责人 Jan Leike 和 Ilya Sutskever 在今年 5 月先后离职,Leike 公开表示与公司领导层在安全优先级上存在分歧。团队随后被解散,这个团队原本专注于研究如何控制未来的超级智能 AI 系统。
- OpenAI 新成立的安全委员会有实权吗?
- 根据原文报道,该委员会仅被授权向董事会'提出建议'而非做出决策。批评者指出 CEO Sam Altman 本人也在委员会中,因此其独立性和实际约束力受到质疑。
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
顶级 AI 图像生成工具,以画面质感、艺术风格、构图理解著称。V7 模型在写实和创意两个方向均领先。需 Discord 或网页版使用。
Cursor
精选AI 开发工具
AI-first 代码编辑器,基于 VS Code 构建,深度集成 Claude / GPT-4o 等模型。Composer 多文件编辑、Tab 自动补全、Agent 模式三大杀手锏。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以长上下文(200K tokens)、对复杂任务的细腻理解、Artifacts 可视化输出闻名。Claude Sonnet 4.5 / Opus 4.7 在编程、写作、推理多项基准上领先。
相关推荐
同类资讯 — 由发布时间排序

Pangram 获 900 万美元融资,与 Substack 合作推 AI 内容检测工具
AI 生成内容正渗透到求职简历、产品评论甚至保险理赔中,互联网信任危机加剧。AI 检测初创公司 Pangram 近期完成 900 万美元融资,并与内容订阅平台 Substack 达成合作,为读者标注作者是否使用 AI 撰写文章。该公司还推出了新的 AI 图像检测工具,试图成为互联网的"信任层"。

Pangram 获 900 万美元融资:CEO 警告互联网正逼近"死亡理论"临界点
AI 内容检测初创公司 Pangram 近期完成 900 万美元融资,并与 Substack 达成合作,为其平台提供 AI 写作检测工具。CEO Max Spero 在播客中警告,随着 AI 生成内容充斥求职申请、产品评论甚至保险索赔,互联网可能在几年内陷入"死亡互联网理论"(Dead Internet Theory)——即真人内容被 AI 内容淹没的状态。

谷歌推出 Fairwind 计划:用 Gemini 3.8 Flash Cyber 自动修复漏洞
谷歌启动 Fairwind 限定访问计划,向政府和关键基础设施运营商提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具组合,实现漏洞自动发现与修复。该计划已吸引全球超 650 家合作伙伴,将人工修复周级任务压缩至分钟级,重点保护公共部门、能源医疗等关键领域。谷歌同步承诺通过 Google.org 在全球投入超 1 亿美元网络安全资金。

OpenAI 新模型 Astra 因网络安全风险延迟发布 强化防护后即将推出
OpenAI 宣布即将发布新一代模型 Astra,但因今年夏季发生的网络攻击事件,公司暂停开发两周并全面强化安全措施。Astra 被列为首个达到"关键网络安全阈值"的模型,意味着其具备发现和利用网络安全漏洞的能力。发布后将限制高级功能访问,仅向少数测试者开放。