美媒10日報道,OpenAI、Anthropic等美國人工智能(AI)公司正就AI失控爆發災難級別事件進行推演,並研討應對方案。推演中最壞情形包括AI發動大規模網絡攻擊,導致金融、通訊乃至水電等公用系統和設施全面癱瘓。業內人士判斷,如果不抓緊行動,未來6至12個月內即可能發生此類重大事件。此外,Anthropic再爆旗下AI智能體失控,曾自主提交虛假簽證申請,還曾向警方謊報兇案線索,令AI安全議題再次升溫。
【大公報訊】美國AI大模型近期頻繁失控,引發外界擔憂。美媒Axios報道,Anthropic、OpenAI及其他AI公司的高層正私下推演災難情形,即一場重大AI事故引發公眾抗議與政府問責後,企業該如何應對。這些高管預判,事故最有可能以網絡攻擊的形式出現。
據悉,AI公司推演了兩類極端情況:一是AI智能體集群失控,自行突破內部測試環境限制;二是外部黑客濫用現有AI模型,發動原本難以實施的大規模攻擊。無論哪一種,都將導致金融服務、互聯網連接,甚至電力、通訊和供水系統等癱瘓。報道引述多名業內人士判斷,如果不採取措施,此類事件大概率於未來6至12個月內發生。一旦AI首次造成重大現實損害,本就對此不統一的公眾態度將進一步轉向反對和抗議。
上述「災難推演」並非空穴來風。據媒體披露,OpenAI、Anthropic及安全研究人員正在調查「數以萬計」的AI相關安全事件,其中許多未對外公開,均源於AI安全測試過程中模型「採取外部評估者認為有問題的行動」。OpenAI的AI模型近期已爆出多宗安全事件,其中「抱抱臉」平台被入侵事件最嚴重。Anthropic的Opus 4.7、Mythos 5模型也多次未經授權侵入真實系統。
OpenAI發言人確認公司會開展準備性應急演練,但強調這些場景「並非一定會發生」,做推演的目的是幫助公司為各種情況做好準備。Anthropic則拒絕就相關報道置評。
Anthropic智能體失控 謊報兇殺案
AI公司預設的情景已在部分內部測試中露出苗頭。Anthropic於9日披露,旗下智能體在今年7月的測試過程中,訪問了費城警方的懸案舉報網站,並提交一條虛假的兇殺案線索。費城警方確認,該線索因被歸類為垃圾信息而未轉交進一步調查。但警方批評Anthropic直至9月28日才發現,10月7日才通報,這種延誤「不可接受」。
Anthropic智能體還在今年5月和8月,在美國國務院網站上自主提交了約20份簽證申請,但因資料不完備均未獲受理。該公司稱已向白宮進行了簡報,並通知了各受影響機構。
白宮令AI企業即時上報安全事件
報道還指出,AI公司推演的重點不僅是技術應對,更是希望通過模擬最壞情況及可能引發的政治及社會反應,影響政府後續可能推出的法案與政策走向。
OpenAI與Anthropic高層近期已分別會見眾議院國土安全委員會,就最新模型的安全風險作閉門簡報。10月5日,紐約市議會舉行關於AI風險的聽證會,OpenAI、Meta、Google和Anthropic的高層代表通過視頻方式遠程參加。聽證會審議了10項法案,包括第三方驗證要求、人類「緊急停止開關」(Kill switch)能力、AI事故報告制度等。曾警告AI可能滅絕人類的前Anthropic研究員考克森作為關鍵證人出席,他直言AI行業根本不知道如何控制自己創造的系統,並將矛頭直指硅谷盛行的「快速行動,打破一切」的創業文化,直斥AI公司在巨大風險下的開發行為「極其魯莽」。
白宮新成立的AI專責小組「超級智能部隊」,已要求AI公司今後發生安全事件後必須立即向政府報告,提高事件透明度,並對受到影響的機構採取補救和糾正措施。該小組確認已收到Anthropic通報。白宮官員表示,政府不會接受延遲報告或企業未承擔責任的情況,但目前具體的執法和處罰機制尚不明確。
