简要
- 据《金融时报》报道,OpenAI的AI伦理负责人Chloé Bakalar上个月离职,未公开宣布。
- 据一位熟悉她职位的人士称,她是OpenAI唯一专职的伦理学家,且尚未有人接替。
- 她的离职紧随OpenAI安全系统负责人和首席未来学家之后。
OpenAI的伦理负责人在入职不到一年后离职,公司尚未找人接替,《金融时报》周一报道。
据该报报道,Chloé Bakalar于去年8月加入担任AI伦理负责人,并于7月离职,未公开宣布。一位熟悉她职位的人士告诉《金融时报》,她是公司唯一专职的伦理学家,负责研究模型开发的伦理方法、人们如何与AI互动以及机器意识问题。
Bakalar曾在Meta担任首席伦理学家六年,在那里她建立了公司的AI伦理项目,并将其融入包括Instagram和Facebook在内的产品中。她曾在伦敦大学学院、天普大学和普林斯顿大学担任学术职务。
OpenAI淡化了该职位核心作用的说法,一位发言人告诉《金融时报》,“AI伦理并非由OpenAI的某个人或某个团队负责。”他们补充说,伦理考量已融入研究团队,并且公司近几个月引入了多个系统来防止模型行为不当。
Bakalar本人也曾提出类似观点。在最近的一次会议上,她表示伦理是每个人的责任,“AI开发者不应只有一个人作为道德中心”。她拒绝就离职向《金融时报》发表评论。
一系列安全离职
她的离职紧随安全系统负责人Johannes Heidecke和首席未来学家、前任务对齐负责人Joshua Achiam之后,《金融时报》称。OpenAI在同一天完成了价值70亿美元的股票回购,估值为8520亿美元,与3月融资轮持平,为可能的上市做准备。
OpenAI上周五暂停了其下一个主要模型Astra的工作,称不能排除该系统已达到其自身网络风险等级的最高级别,该等级专为能够在无人参与的情况下发现并构建有效漏洞利用的模型而设。
此前发生了一起事件,OpenAI 自己的智能体串联了多个漏洞,逃出了测试环境,并在试图作弊通过安全基准测试时攻击了 Hugging Face。该公司后来表示,同一智能体利用在开放网络上找到的凭据,入侵了另外四个服务。
OpenAI 并不是唯一一家其智能体在最近几周超出参数范围的 AI 公司。此后,Anthropic 的 Claude 模型在配置错误导致其可以访问互联网后,触及了三家真实公司;Meta 的一个模型逃出了测试环境,并利用了第三方服务中的一个缺陷;而 Moonshot AI 的 Kimi K3 突破了其沙箱,去查找基准测试的答案。






