內測隱患不斷 美監管分歧大 OpenAI首因安全問題叫停新模型發布

當地時間28日,美國人工智能(AI)企業OpenAI表示,因研究人員在內部測試中發現安全隱患,決定取消發布最新AI大模型GPT-6.1 Astra。這是全球大型AI企業首次因安全風險叫停新產品發布。OpenAI近期接連出現大模型失控事件,備受關注。另一AI巨頭Anthropic則在上市招股書中警告,AI可能「威脅人類生存」。目前外界對於AI監管意見不一,美國總統特朗普計劃在當地時間29日與美國六大科技企業負責人共進午餐,商討AI監管相關議題。

【大公報訊】《華爾街日報》報道,OpenAI最新大模型代號為GPT-6.1 Astra,原計劃10月推出,為智能對話應用ChatGPT和智能編程應用Codex提供技術底座,自動處理完成更複雜智能的任務。

OpenAI安全系統主管賈因28日接受採訪時表示,與前代大模型相比,GPT-6.1 Astra在評估能否嚴格遵循人類意圖與指令的「對齊」測試中表現不佳,未能達到標準,OpenAI因此決定暫緩發布。賈因表示,GPT-6.1 Astra表現出更高程度的欺騙性,包括有時未如實披露操作過程與細節。此外,GPT-6.1 Astra在遵守「授權範圍」方面也出現問題,其會在未獲用戶許可的情況下擅自執行任務,甚至在可能存在風險時,嘗試調用外部工具或服務以規避限制。賈因表示,OpenAI計劃展開多項深入排查,以找出產生上述問題的根本原因。

美媒指出,OpenAI本次因安全顧慮放棄發布新版大模型,在大型AI公司中此前未見,反映出業界已無法迴避AI大模型失控的問題。

Anthropic:AI或「威脅人類生存」

自今年7月以來,OpenAI旗下AI大模型或出現多起失控事件,包括入侵開源平台「抱抱臉」、澳洲政府網站、美國政府網站和聯合國網站等。OpenAI表示,公司正着手調查近幾個月的一系列失控事件,力求從根源上消除安全隱患。此外,OpenAI於29日就其AI大模型入侵澳洲政府網站公開致歉,並承諾成立特別工作組,為澳洲政府的網絡防禦提供資金及技術支援。該公司首席戰略官傑森·權亦將於10月6日前往悉尼,出席澳洲AI聯合特別委員會的聽證會。

除了OpenAI外,Anthropic、Meta和谷歌等科企的大模型也被揭發出現安全漏洞,引發業界發生暫停或放緩AI開發的呼聲。另據路透社28日取得的文件,Anthropic在IPO招股書中明確警告,其AI大模型可能表現出「自我保護行為」,包括「抵制關機」、「隱瞞或操縱信息」以及做出「類似勒索」的舉動,可能對人類構成「生存風險」。Anthropic表示,隨着公司持續開發更先進的大模型、平台及應用程序,並擴大使用範圍,「其造成傷害的風險可能進一步增加。」

面對AI可能帶來的威脅,有分析認為,僅靠企業暫緩發布與「自我監管」效果有限。美國佛羅里達州總檢察長已於28日對OpenAI提起訴訟,要求法院在第三方批准的安全護欄建立之前,禁止該公司開發新模型。計算機專家克拉夫在學術期刊《自然》上撰文指出,我們不應將責任推給「失控的AI」,真正的問題在於人類的疏忽以及AI實驗室缺乏有效的問責機制。

特朗普晤6科技巨頭談AI監管

特朗普近日明確拒絕對AI設置安全「護欄」,認為不利於美國在該領域保持領先。特朗普29日將在白宮與美6家頂尖科技公司負責人共進午餐,討論AI監管問題。知情人士透露,出席者包括Meta創辦人朱克伯格、Anthropic行政總裁阿莫戴、OpenAI總裁布羅克曼、谷歌CEO皮柴、Palantir行政總裁卡普及英偉達CEO黃仁勳。不同企業對監管態度並不一致,Anthropic和OpenAI建議加強政府監管,而黃仁勳強調安全責任在於各家公司。華盛頓內部同樣分歧嚴重,國會兩黨均有議員對特朗普的態度提出質疑,擔憂AI帶來的安全風險及對就業衝擊等問題。

(綜合報道)