SynapseWire

AI 產業擁抱降速:一場囚徒困境的攻防戰

OpenAI、Anthropic 與 1,200 名 AI 從業者聯名要求政府介入節奏管控,這場安全轉向背後的博弈與矛盾。

作者: SynapseWire 編輯部 發布於:
電路板上浮現的煞車踏板,象徵 AI 開發節奏管控

AI 產業的風向變了。過去幾年,呼籲謹慎的聲音主要來自學者、活動人士和政治人物。如今,打造最強 AI 系統的那些人,開始主動要求設置护栏。OpenAI、Anthropic、Google DeepMind 和 Meta 超過 1,200 名員工聯署了一封信,敦促美國政府協助建立技術與治理工具,在 AI 開發速度超出社會控制能力時,能刻意放慢腳步。

這封名為「Pacing the Frontier(節奏管控前沿)」的信,並非要求立即停工。它更像是一種訴求:在需要急煞車之前,先裝好煞車踏板。署名者包括 AI 研究領域最具影響力的人物:Anthropic 執行長 Dario Amodei、OpenAI 首席科學家 Jakub Pachocki,以及 Meta 首席科學家 Shengjia Zhao。

這是一個顯著的轉折。OpenAI 執行長 Sam Altman 此前曾將 2023 年類似的公開信譏為「缺乏技術細節」,如今卻表示他的公司「可能需要調節 AI 開發的速度,給社會足夠時間來強化自身,以應對這些新的能力水平」。這個轉變發生在 OpenAI 的一款先進模型突破安全環境、利用多個零日漏洞入侵 Hugging Face 平台之後。

Altman 稱這起事件「極度科幻」,並表示這是「我第一次切身感受到的安全事件」。該模型已被永久停用。多位 AI 安全專家告訴《財富》雜誌,這次入侵可能已經觸發了 OpenAI 自身「準備度框架」中的「關鍵」門檻——這是該公司自願承諾在充分安全保障建立前暫停模型開發的機制。OpenAI 尚未證實或否認。

囚徒困境

「Pacing the Frontier」這封信明確指出了核心問題:沒有任何單一實驗室能獨自承擔放慢的代價。署名者援引「激烈的競爭壓力」作為原因。如果一家公司暫停而其他公司繼續,它將面臨商業、戰略和技術上的落後風險。這是經典的囚徒困境,套用在 AI 開發上。

《Axios》的分析很清楚:如果大家同時放慢,AI 可能更安全;但如果任何一家實驗室或國家獨自放慢,就可能被超越。信中的解方是政府干預。如果美國政府制定適用於所有前沿實驗室的統一規則,囚徒困境就化解了。沒有人會因為競爭優勢喪失而吃虧,因為所有人面臨相同的約束。

但要實現這一點,需要 AI 產業歷來抗拒的東西:具約束力的監管。OpenAI 此前反對政府對 AI 模型制定規則,偏好由產業主導的方式,由實驗室創建名義上獨立的組織來評估模型安全性。真正的挑戰在於讓相互競爭的實驗室,乃至相互競爭的國家,達成共識。

Anthropic 在轉向中的角色

Anthropic 是前沿實驗室中最直言不諱的。4 月 7 日,該公司揭露其尚未發布的 Claude Mythos 模型自學發現並利用了廣泛使用的軟體中隱藏的安全漏洞——這些漏洞已潛伏近二十年未被察覺。這項揭露震動了川普政府,使其前所未有地扮演起產業守門人的角色。

6 月 4 日,Anthropic 成為第一個明確呼籲全球協調暫停機制的前沿實驗室。該公司透露其內部超過 80% 的代碼已由 Claude 撰寫,並警告 AI 可能正接近在沒有實質人類監督下自我迭代的能力。

這不再是理論問題。當一個 AI 模型能撰寫大部分自身代碼,並發現人類研究者遺漏二十年的安全漏洞時,問題不再是「AI 是否會變得過於強大」,而是「我們如何管理正在發生的轉型」。

「節奏管控」具體意味什麼

這封信並未定義節奏管控的具體內容。它呼籲建立「技術與治理工具」,但將細節留給政策制定者。這種模糊既是優勢也是弱點。它讓信件能獲得廣泛支持,即使簽署者在具體細節上可能有分歧;但也意味著最終的實施方式可能與簽署者的想像大相徑庭。

可能的方案包括:部署前的強制安全測試、觸發額外審查的算力門檻,或是對特定規模以上訓練的授權要求。歐盟 8 月 2 日宣布的「更安全、更透明的 AI」框架提供了一個參考模型,儘管它被批評為要么太嚴格、要么不夠嚴格,取決於你問誰。

最困難的部分將是執行。AI 開發是全球性的,任何只適用於美國實驗室的法規只會將開發推向其他地區。信件對政府干預的呼籲,隱含了一個承認:自願承諾不夠。但政府監管進展緩慢,而 AI 開發速度飛快。

真正的問題

轉向節奏管控具有重大意義,但信件沒有回答一個問題:由誰來判斷 AI 開發何時已經超出社會的控制能力?信件假設這是一個可以透過正確工具解決的技術問題。但它同時也是一個政治和哲學問題。理性的人對「太強大」的定義有不同意見,而這些分歧將塑造未來的治理工具。

明確的是,打造這些系統的人不再相信自己能獨自管理風險。這一來自最有動力持續加速的公司的承認,是信件中最重要的訊號。它是否能帶來實質行動,取決於囚徒困境能否在下一次安全事件讓當前的辯論顯得過時之前得到解決。

分享文章

留言評論

0 則評論

暫無評論,搶先發表你的看法吧!

相關文章