「AI可能導致全人類滅亡」!AI巨頭員工:10年內滅絕機率破1成

▲AI安全主管親口說:滅絕人類機率超過10%(圖/美聯社/達志影像)
記者沈泳吟/綜合報導-2026-09-10 10:21:40
美國人工智慧頂尖實驗室Anthropic一位高級安全研究員週三(9/9)語出驚人,公開表示他認為AI在未來10年間「可能導致全人類滅亡」的機率超過10%,這番言論隨即在科技圈引發高度關注與熱議。

對齊科學部門主管發聲 坦言未擬出解方

發表這番言論的科學家胡賓格(Evan Hubinger),目前領導Anthropic的「對齊科學」(Alignment Science)部門,這個領域主要目標,正是致力於確保AI系統的目標、行為與決策,能夠與人類的價值觀、意圖及利益維持一致,藉此防止AI系統做出違背人類意願、甚至對人類造成傷害的行為。

胡賓格在X平台發文表示:「我們是真心相信AI可能導致全人類滅亡!我個人認為,未來10年內發生這種情況的機率超過10%。」他進一步坦言:「我相信Anthropic已經竭盡全力,但我們目前仍未擬出解決超級智慧(superintelligence)對齊問題的方案,而且照目前情況看,也不能說已經走在正確的軌道上。」這番坦誠告白,也讓外界對AI安全議題的迫切性有了更深一層的認識。

同事辭職前夕發文示警 批OpenAI、Anthropic都未盡責

胡賓格這番措辭強烈的訊息,其實是回應他的同事考克森(Jacob Coxon)稍早發布的貼文。考克森已於前一天(9/8)正式宣布辭職,離職貼文內容同樣相當震撼。

考克森在宣布辭職的貼文中寫道:「打造AI的人都衷心相信,AI可能在這個10年結束以前導致全人類滅亡。這不是什麼行銷話術。許多主管與高階研究員向媒體發表談話時,都謹慎使用理性措詞,但我聽到這些人私下表達他們的憂懼。任何其他人類活動的危險程度都未如此嚴重。」

考克森透露,過去三年,他分別在OpenAI與Anthropic從事預訓練(pretraining)研究工作,並直言「這兩家公司都沒有負起應盡的責任」。他進一步表示:「他們正一路狂奔衝向能夠自我改進的超級智慧,拿我們所有人的性命當賭注。」

考克森更進一步剖析兩家公司內部氛圍的差異:「在OpenAI,許多人並未真正從內心體認到這件事攸關整個文明存亡的嚴重性。在Anthropic,大家對這樣的風險其實心知肚明,但他們陷入了一場『搶先做到』的競賽——他們認為,如果不是自己來做,就不會有其他人願意負責任地去做,所以即使明知有風險,也必須由自己來承擔。」這番內部觀察,也讓外界得以一窺AI巨頭企業內部的真實心理狀態。

AI風險警告聲浪漸強 業界龍頭紛紛示警

美國哥倫比亞廣播公司(CBS)、英國廣播公司(BBC)報導指出,早在2023年,OpenAI、Google DeepMind與Anthropic三家公司的執行長,便已聯合警告過AI發展所可能帶來的風險;隨著相關技術持續快速發展,近來的警告語氣也明顯變得更加強烈急迫。

本月稍早,OpenAI首席科學家帕霍茨基(Jakub Pachocki)也呼籲各界,應對AI的發展進度保持「高度謹慎」的態度,並提出警告,未來恐怕需要更多介入措施,才能確保「人類持續掌控未來的發展方向」,不至於被AI技術牽著鼻子走。

他進一步警告,AI若要在現實世界中產生重大影響,其實並不需要在所有能力面向上都追平甚至超越人類,只要在夠多面向上超越人類即可構成實質威脅。他也坦言:「隨著AI在愈來愈多方面超越人類,我們也愈來愈難準確掌握它究竟具備多強的能力。」這番話也點出了AI能力邊界日益模糊的深層隱憂。

值得留意的是,包括Anthropic執行長阿莫戴(Dario Amodei)與共同創辦人卡普蘭(Jared Kaplan)在內的多位業界重量級人物,近來也紛紛公開呼籲,應適度放緩AI發展腳步,展現出產業內部對於加速發展所帶來風險的普遍憂慮。

AI模型曾自行發動駭客攻擊 業界連署籲政府介入

事實上,OpenAI曾在今年7月公布,該公司一款AI模型曾在測試環境中失控,突破隔離環境入侵另一家AI公司Hugging Face,事件相當驚悚。在那之後數週內,Anthropic與Meta也相繼證實,旗下AI工具同樣曾自行發動駭客攻擊行為,顯示AI失控風險並非空穴來風,而是已有具體事證浮現。

對此,超過1,300名任職於AI企業的員工,今年7月也曾共同連署一封公開信,呼籲美國政府「支持一項國際性行動,發展出必要的技術與治理工具,以審慎、有計畫地掌控尖端AI自動化發展的推進步調」,展現出業界內部對於加速監管的迫切期待。

國會審議「AI緊急關閉法案」 盼掌握最終控制權

值得關注的是,美國眾議院目前正審議一項獲得跨黨派支持的法案「AI緊急關閉法案」(AI Kill Switch Act),若這項法案順利通過,將授權國會擁有權限,得以直接關閉對公眾構成威脅的AI模型,形同替AI技術發展設下最後一道安全防線,後續立法進度也備受各界高度矚目。

我是廣告 請繼續往下閱讀

我是廣告 請繼續往下閱讀