人工智能并不会毁灭人类,但专家表示,真正的威胁已然出现

  作者:丹尼尔・豪利

人工智能并不会毁灭人类	,但专家表示,真正的威胁已然出现-第1张图片

  周三,OpenAI 公开了六组新案例 ,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为” 。

人工智能并不会毁灭人类,但专家表示,真正的威胁已然出现-第2张图片

  该公司同步发布一套全新框架 ,用于追踪、上报以及披露AI 模型做出未被指令要求 、或是本不该发生的行为的各类情况。

人工智能并不会毁灭人类,但专家表示,真正的威胁已然出现-第3张图片

  此前已有多份报道提到 ,多家企业的 AI 模型出现入侵第三方网络与服务的现象 ,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网络。

  本周早些时候,Anthropic 首席执行官达里奥・阿莫迪发布一篇长文,呼吁放缓前沿人工智能模型的研发节奏 。在此之前 ,Anthropic 研究员雅各布・考克森在 X 平台发文宣布离职,他称,这家公司以及他曾经任职的 OpenAI ,正 “一头冲向能够自我迭代的超级智能,拿全人类的生命做赌注 ”。

  Anthropic 对齐科学负责人埃文・休宾格紧随考克森在 X 平台发声,他认为 ,人工智能技术 “致使全人类灭亡” 的概率超过 10%。

人工智能并不会毁灭人类,但专家表示,真正的威胁已然出现

  上述各类事件、社交媒体发文以及阿莫迪的文章 ,重新唤起了大众对于《终结者》式人工智能接管世界、毁灭人类的恐慌 。但专家称,现实情况远非科幻作品描绘的末日景象。

  纽约大学坦登工程学院计算机科学与工程副教授 、该校负责任人工智能中心主任朱莉娅・斯托亚诺维奇在接受雅虎财经采访时表示:“这和人工智能产生自我意识、要来对付我们毫无关系。”

  她补充道:“本质上问题在于……OpenAI 内部没有落实一些基础安全协议 。这件事其实给所有 AI 企业敲响警钟:别忘了我们学计算机科学时都懂的道理 —— 安全至关重要 。 ”

  如果把目光过度聚焦于世界末日类的假想,反而会分散精力 ,让人们忽视人工智能当下就可能造成的其他更迫在眉睫的危害。

  对齐与安全

  人工智能面临的最大问题归结为两点:模型对齐与系统安全。 模型对齐指企业引导 AI 系统做出(或是规避)特定行为的手段 。 举个例子 ,如果一个 AI 模型试图入侵第三方系统,AI 研究人员就会调整模型行为,避免它以后再做出同类举动 ,这有点像训斥不守规矩的孩子。

  AI 安全则是做好 AI 系统的防护隔离,防止其脱离管控、入侵外部网络。

  但无论是模型对齐失效,还是系统安全漏洞 ,都不等于人工智能已经具备毁灭人类的能力 。

  佐治亚理工学院教授 、网络安全政策理学硕士项目负责人米尔顿・穆勒解释:“很多恐慌的根源,其实只是信息系统一些十分普通的意外后果,例如 Hugging Face 相关事件 ,常常被渲染成不受控制的智能体密谋、攻击、肆意作乱。”

  “事实上,那只是一场针对具备自主能力的 AI 系统安全风险的实验,而实验人员的配置出现严重失误。处理复杂信息系统时经常会发生这类状况:人们总会忽略系统里存在一些聪明程序可以利用的细微漏洞 。”

  Futurum 公司首席执行官丹尼尔・纽曼向雅虎财经表示 ,行业内普遍感受到,在安全防护和风险对齐层面存在巨大的完善需求,“整个行业需要扛起责任 ”。

  和其他技术一样 ,居心不良者完全可以利用人工智能从事恶意活动。AI 不断增强的网络攻击能力 ,意味着网络犯罪分子 、部分国家势力能够更轻易入侵水处理厂这类设施,或是让大型网络陷入瘫痪 。

  Anthropic 近期也梳理公布了自身的相关工作,防范自家 AI 被滥用 ,用于研发生物武器与常规武器。

  但 AI 同样可以被骗子利用,大规模升级钓鱼邮件骗局,也会被身份盗取团伙拿来作案。

  纽约大学坦登工程学院计算机科学与工程助理教授艾米丽・布莱克告诉雅虎财经:为所有潜在风险未雨绸缪本身无可厚非 ,但不能因此就不去处理那些更加现实 、却少有新闻报道的问题,包括人工智能带来的歧视、就业、教育层面的影响 。

  “真相介于两种极端幻想之间,” 布莱克说道 ,“AI 持续发展确实存在一些实实在在的风险 。但我认为我们现在还不至于要吓得躲到床底,担心人工智能毁灭人类。”