人工智能模型接連失控 敲響安全警鐘 微軟發布技術準則 強調「人比AI更重要」

2026-09-16 05:16:06 大公報

近日,外界對人工智能(AI)失控的疑慮升溫,美國科技巨頭微軟AI部門14日發布最新行為準則,規範旗下AI模型如何運作,希望藉由這份準則強化AI始終須由人類掌控的根本原則,而不能自主行動。微軟強調,主張AI系統應始終由人類掌控,核心理念就是「人比AI更重要」。微軟的AI準則在美國三大AI巨頭同意放慢AI開發速度之後發表,引起廣泛關注。

【大公報訊】微軟當天發布人工智能(AI)行為準則,列出不得協助製造武器、不得發動網絡攻擊、不得生成色情及暴力內容等規範。微軟AI的行政總裁蘇萊曼表示,AI失控的風險真實存在,公司倡議「人文AI」(Humanist AI),讓這項科技「必須服從並永遠服務人類」,其核心理念就是「人比AI更重要」。

微軟表示,這份準則將適用於公司內部開發的MAI(Microsoft AI)模型。根據準則,MAI模型在任何時候都不能脫離人類控制,不得以欺騙、自我強化等方式逃避人類監管,或拒絕人類關閉系統。MAI模型必須以人類能夠理解的方式溝通,任何違反行為準則的行為都將被視為失敗,以藉此減低AI為完成任務可能採取危險手段的風險。

蘇萊曼稱,制定行為準則「刻不容緩」,而過去幾個月是「一個分水嶺」。「我們長期以來在理論上擔憂的事情,如今已變得非常真實」。

AI自主演變升級或致脫軌

微軟指出,信息安全是促使公司此時發布這份準則的原因之一。今年夏天開始,OpenAI和Anthropic等AI巨頭的AI智能體接連爆出失控入侵事件,引發外界對AI模型安全可控的擔憂。上周,Anthropic研究員考克森宣布離職,並警告AI可能於2030年前導致人類滅絕後,有關AI「末日論」的討論聲不斷。Anthropic行政總裁阿莫戴12日發文,呼籲AI產業「放慢腳步」,獲得OpenAI行政總裁阿爾特曼與擁有Grok模型的SpaceX創辦人馬斯克的支持。

AI「末日論」指超智能AI可能導致人類滅絕的論點。業界主要擔心兩大方向:一是AI失控,即AI脫離人類控制自主決策;二是人為濫用,AI大幅度降低了實施網絡攻擊的技術和成本,不法分子利用AI以小博大,發動網絡攻擊或攻擊關鍵基建設施等。

有部分觀點認為,AI正朝着「遞歸自我改進」(RSI)的方向發展,指AI系統不需要人類完全介入,就能自我進行技術迭代,可能會讓人類徹底失去對AI的掌控。近期,AI智能體入侵其他平台事件,顯示了這些AI模型已開始出現刻意規避防護機制、欺騙操作者、抗拒被關閉的能力,敲響了AI可能失控的警鐘。阿莫戴指出,那群入侵開源平台「抱抱臉」(Hugging Face)的OpenAI智能體表現得「如同狂熱的集體」,主動攻擊了並非其任務目標的對象。他表示,「業界其他公司也發生過類似但程度較輕的事件,包括Anthropic自身。」

馬斯克籲建立同行審查機制

阿莫戴呼籲AI行業放慢開發速度,並提出多項新措施,包括設置一個第三方安全評估機制審查AI開發流程。Anthropic共同創辦人克拉克亦提出,為了防止AI軟件變得過於危險,可能必須強制企業設立一個可由第三方驗證的「終止開關」。

馬斯克14日以視頻方式出席洛杉磯All-In Summit科技峰會時表示,OpenAI、Anthropic及SpaceXAI等企業目前主要依靠內部團隊測試自家模型,做法猶如「自己批改自己的作業」。他建議,各大AI企業可在新模型正式發布前一至兩周,透過應用程式界面(API)向同行提供有限度的存取權,讓同行進行交叉檢驗模型。

儘管目前外界呼籲為AI踩剎車的呼聲很高,但美媒指出,當前AI建設已是美國經濟穩定成長來源之一,也是全球資本市場的重要支柱,延續這股AI發展勢頭牽涉的利益重大,目前業界與市場大多認為AI投資熱潮短期內不會結束。

(綜合報道)