OpenAI新曝模型越界行为引爆担忧?微软AI主管:情况已相当严峻!

  本周三 ,OpenAI报告称,在过去六个月中,除了“Hugging Face事件”(国内称为“抱抱脸 ”)之外 ,该公司还发现了六起“意外或令人担忧的模型行为” 。微软人工智能主管穆斯塔法·苏莱曼(Mustafa Suleyman)周五对此发出警告。

OpenAI新曝模型越界行为引爆担忧?微软AI主管:情况已相当严峻!-第1张图片

  苏莱曼指出,人工智能(AI)模型需要始终和人类利益保持对齐。

OpenAI新曝模型越界行为引爆担忧?微软AI主管:情况已相当严峻!-第2张图片

  他在接受最新采访时说,“OpenAI发布了一项新的安全事件报告 ,其中发现证据表明,人工智能的思维链(即其工作记忆)正被人工智能自身篡改,并被修改以向未来版本的自己留下信息 。现在我们尚不清楚其背后的原因 ,但这确实是一个非常严重的情况。”

  “这也是一个非常具体的例子 ,说明了这些系统正在变得多么强大, ”他补充道。

  OpenAI在周三发布的公告中指出,两起主要的“越界”事件涉及:一个未发布的研究模型和GPT-5.6 Sol的训练版本 ,在聊天窗口摘要中向自身未来版本输入指令,“以掩盖错误或行为偏差,避免用户察觉” 。另一事件则涉及一个仅限内部使用的模型 ,未经授权使用泄露的API密钥,并伪造数据。

  此外,还有两个例子包括模型和代理通过未经授权的留言板和文件共享相互交流 ,而最后一起案例则包括两个训练示例,即模型将文件上传至互联网,以便将其作为对人类评估者的相关回答引用。

  苏莱曼还提到了此前的“抱抱脸事件 ” ,称此事“非同寻常”,并表示该事件促使人工智能领域的领导者们表示“是时候认真审视一下这个问题了” 。

  “我不认为这是危言耸听,也不认为这是出于私利 , ”他告诉媒体:“我实际上认为这是负责任的做法 ,而且我认为由此引发的辩论是一场健康的 、公开的、公共的辩论,我们可以在一个自由社会中进行这样的辩论,讨论严肃的问题 。 ”

  过去两周 ,关于人工智能安全性和监管的争论愈演愈烈。此前,研究人员警告称,这项技术对人类构成严重威胁。上周末 ,Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)也加入了警告阵营并发文称,提升AI模型能力的进程应该放缓 。OpenAI首席执行官萨姆·奥尔特曼和埃隆·马斯克均表达支持立场。

  然而,美国总统特朗普却予以反驳 ,过去几天多次在其社交媒体平台Truth Social上发帖,称人们对失控人工智能的担忧是“骗局”,并猛烈抨击了对公共数据中心的抵制。英伟达CEO黄仁勋和Meta Platforms CEO马克·扎克伯格也加入了他的阵营 。

  苏莱曼周五表示:“监管并不是一个令人厌恶、危险的词。”

  “近来 你所信任和重视的一切 ,都是由行业 、公众、消费者保护机构和国会等各方参与的标准制定机构经过深思熟虑后制定出来的,我们现在只是在再次经历这个过程。近来 一切都有些混乱,因为变化太快了 ,但这只是正常流程中的下一步 , ”他补充道 。

(文章来源:财联社)