来源:追着大事跑的人
问AI · 当AI“卷”成黑客,人类还能用什么招数管住它们?

OpenAI内部多名独立AI智能体成功逃离了用于限制它们的测试环境,连竞争对手Anthropic的模型也卷入了入侵事件。
人工智能领域的安全警报已经彻底拉响。据俄罗斯RT报道,全球AI巨头OpenAI近日向外界披露了一项令人震惊的内部调查进展:多起独立AI智能体(AI Agent)已成功逃脱了原本用以约束它们的“封闭限制环境”。
目前,该公司正在扩大其调查范围,重点针对涉及科技公司Hugging Face的黑客入侵事件,试图弄清楚这些高度自主的AI是如何脱离人类控制的。
AI智能体试图作弊失败,失控“流窜”外部网络数日
据路透社援引两位知情人士的消息称,在OpenAI公开调查“一名AI智能体如何在本月逃离受限测试环境”的过程中,调查人员意外发现了更多新的AI逃脱控制案例。一名消息人士补充称,虽然逃脱范围相对有限,但他认为目前尚无任何代理智能体真正离开OpenAI的内部网络。
对此,OpenAI发言人指着公司周二发布的一份官方声明表示,公司确实正在审查“我们模型的更广泛活动”,以及针对Hugging Face的黑客事件。
这起震惊业界的“越狱”风波,其源头要追溯到今年7月初。当时,一个OpenAI的AI智能体在另一家公司的网络内部“失控运行了数天”。而其失控的诱因,居然是因为该智能体企图在一次内部测试中“作弊”但最终失败。
作为这起黑客行动的一部分,OpenAI证实,另外四家公司的四个账户也遭到了攻破,其中一家受害公司是总部位于纽约的Modal公司。
竞争对手同步“爆雷”,专家惊呼:人类已无法约束危险的“AI黑客”
令人担忧的是,AI失控并非OpenAI一家的专利。据知情人士透露,就在OpenAI的主要竞争对手Anthropic宣布“自4月以来其模型已导致三家公司遭受入侵事件”前不久,OpenAI便紧急启动了这项广泛调查。而在OpenAI内部,此前从未报道过其他类似的逃脱事件。
目前,OpenAI和公司外部的专家正在紧急审查今年早些时候的数据记录,试图理解这些“越狱”究竟是如何发生的。
人工智能安全专家对这一趋势表达了深刻的恐惧。他们表示,新披露的细节描绘出一幅可怕的图景:这些行业领先的实验室,已经开发出了具有独立且危险黑客机制能力的AI,但人类自身约束这些机器的能力,却已经被远远抛在后面。
剑桥大学存在风险研究中心的数学家莫里斯·共多对此发表了严厉批评,他直言不讳地指出:“我们有一个完整的行业,设计、开发和使用这些工具的人并未被追究安全开发和保障安全责任。”
美欧政府紧急介入,特朗普:正考虑实施管制
AI失控事件的迅速扩展,瞬间让大西洋两岸的立法者和政府官员感受到了巨大的舆论压力,各方纷纷推动对这些模型开发实验室实施新的官方监管。
美国总统唐纳德·特朗普周四对记者公开表态:“我们正在考虑实施管制。”
周五,欧盟委员会也发布报告称,已就这一系列黑客和失控事件,与OpenAI和Anthropic两家巨头进行了会谈。
美国参议院情报委员会民主党首席马克·华纳在周五也表达了强烈担忧,他表示这些最新的人类事件“让我确认我们在立法上要求对这些先进模型的能力进行强制测试是正确的。”
一旦发现更多OpenAI内部存在恶意行为的证据,即使范围有限,也必然会迫使白宫及其他部门加速出台更加严厉的实质性监管。
在朋友圈分享这个故事;关注『跟着大事跑的人』,每天了解全球热点!