OpenAI主管辭職警告:須嚴控AI風險 「試錯時代」已過 應借鑒核安全措施
2026-10-05 05:16:09 大公報

近期美國人工智能(AI)安全事件頻發,引發業界對AI「失控」風險的深切擔憂。美國人工智能巨頭OpenAI負責AI安全的工程師當地時間3日撰文宣布辭職,並批評OpenAI內部風險意識嚴重不足,成為又一位因與公司安全理念不合離職的前沿研究人員。該工程師警告,AI的「試錯時代」已過,呼籲業界迅速行動,效仿核工業與航空業,嚴格設置多重安全防護措施,以避免災難發生。
【大公報訊】曾在OpenAI安全團隊領導政策規劃及透明度方面工作的戴維·魯濱遜當地時間3日在美國《大西洋》月刊發表一篇題為《我辭去OpenAI的工作,因為企業文化已崩壞》的署名文章,成為又一位因安全理念分歧而選擇離職的前沿AI研究人員。
魯濱遜曾在OpenAI任職3年多,是該公司資深員工之一。他在文中透露,自己曾參與起草OpenAI的風險應對框架,並負責監督12次前沿模型發布的安全評估。他直言:「OpenAI不斷推出新產品,但在審慎管控方面,遠未達到我認為應有的水平。」
今年夏季,OpenAI和另一個AI巨頭Anthropic先後披露,其AI模型在網絡攻防能力測試中突破測試環境進入公共互聯網,並未經授權訪問其他機構的系統,引發外界對AI「失控」風險的擔憂。路透社與益普索集團9月22日發布的民調結果顯示,四分之三的美國人擔心,AI企業在防範人工智能對社會造成嚴重危害方面做得遠遠不夠。OpenAI行政總裁阿爾特曼隨後加入呼籲強化AI安全的行列,OpenAI也於9月28日以安全疑慮為由喊停新模型發布,但翌日便高調推出多款新產品,被外界詬病。
OpenAI先發布產品再上安全護欄
魯濱遜提到,OpenAI在模型發布方面推行「迭代部署」原則:先發布產品,觀察產品是否出現問題,再補上安全護欄。但他警告,隨着AI模型能力呈指數級增強,這種試錯模式極度危險,一旦超強AI模型出現失控,人類可能連「從錯誤中學習」和「重新迭代」的機會都沒有。魯濱遜表示,面對可能造成嚴重或不可逆轉傷害的系統,業界必須做到「首次發布即接近完美」。
魯濱遜強調,「試錯時代已過」,前沿AI實驗室應該效仿核工業與航空業,設置多重安全防護措施並進行謹慎規劃,「如此一來,即便不可避免地出現人為失誤,也不至於釀成災難。」魯濱遜認為,AI公司也需要更多地依賴其他領域已有的安全專業知識。他舉例,在核電站或繁忙的機場,即便設備損壞或操作員誤按按鈕,嚴密的縱深防禦體系也能確保不致發生堆芯熔毀或空難;相較之下,目前的AI公司在部署可能帶來毀滅性後果的技術時,嚴重缺乏基本的防護設計與嚴謹規劃。
此前從Anthropic辭職的研究人員考克森亦指出,AI巨頭在開發AI時未承擔應有責任,AI企業對爭奪技術領先地位的競爭考量正凌駕於安全考量之上,這些企業在「拿我們所有人的生命做賭注」。
白宮AI沙皇反對放緩發展
圍繞AI監管議題,美國國內分歧嚴重。雖然多名AI研究人員呼籲加強監管,但美國總統特朗普明確拒絕對AI設置安全「護欄」。美國總統特朗普當地時間4日確認,將任命國家情報總監克萊頓兼任白宮新成立的AI特別工作組負責人,即外界所稱的「AI沙皇」。
特朗普4日在社媒平台發文稱,在克萊頓的領導下,「超級智能部隊」(Super Intelligence Force)將確保美國在AI發展領域「持續領先全球」。
美媒3日報道,克萊頓將領導「超級智能部隊」在120天內提交一份有關人工智能風險和機遇的報告。工作組成員包括副總統萬斯、國防部長海格塞斯、財政部長貝森特和白宮辦公廳主任懷爾斯。克萊頓在報道中說,成立工作組旨在保護公眾利益,以及保持美國在人工智能領域的領先地位。他也曾表示,「超級智能是國家安全問題」,但也明確反對美國企業暫停或放慢AI模型的研發腳步。(綜合報道)