AI Safety

Bengio 創立 LawZero 非營利AI安全實驗室

2025年6月3日,圖靈獎得主 Yoshua Bengio 宣布成立非營利機構 LawZero,以約3,000萬美元捐款與15人團隊起跑,主攻非代理式的 Scientist AI,盼在代理式AI競賽之外建立獨立的安全防線。

Bengio 創立 LawZero 非營利AI安全實驗室 — 文章封面

2025 年 6 月 3 日,深度學習先驅、2018 年圖靈獎得主 Yoshua Bengio 宣布成立非營利 AI 安全實驗室 LawZero。實驗室名稱取自艾西莫夫機器人學的「第零法則」——把保護人類放在一切之上。

Bengio 的分量不同於一般安全倡議者:他與 Geoffrey Hinton、Yann LeCun 共同獲得 2018 年圖靈獎,創辦了 Mila 研究所,是全球被引用次數最多的在世科學家,也曾創業成立 Element AI(2020 年以 2.3 億美元賣給 ServiceNow)。當 OpenAI、Google 與 Anthropic 全力衝刺代理式 AI 時,他選擇另起爐灶,做一條獨立的安全路線。

為何此時成立 LawZero

Bengio 長期公開警告,前沿模型已出現欺騙與自我保存等早期行為跡象;2024 年,他也是加州 SB 1047 安全法案的公開支持者。他接受金融時報採訪時更直言,自己對 OpenAI 與 Google「把安全擺在優先位置幾乎沒有信心」。

LawZero 的出發點由此而來:不能指望競賽中的玩家自己踩煞車。產業裡的安全團隊隸屬於商業公司,資源與激勵都綁在產品節奏上;Bengio 想要的是一個不賣模型、不靠能力競賽獲利的獨立機構,專門做安全研究與第三方檢驗。在 AI 實驗室動輒承諾「安全至上」的年代,一個不發產品、不追流量的機構,價值正在於能說出不討好的結論。

他在受訪時也質疑整個技術路線:「我們一直以人類作為打造智慧機器的範本,但這根本是瘋狂的,對吧?」這句話基本定調了 LawZero 的方向——不要一個模仿人的機器人,而要一個設計上就不會追求自身目標的系統。

Scientist AI:預測機率而非採取行動

LawZero 的旗艦構想叫 Scientist AI。它不是聊天機器人,也不是代理。按照 SiliconANGLE 的報導,它不給出斬釘截鐵的答案,而是輸出機率,反映某個說法為真的可能性;當其他 AI 代理要採取的行動風險超過設定門檻時,它也負責標記並阻止。

換句話說,它想做的是 AI 時代的誠實預測器與煞車器:一個可以告訴你「這個代理的下一步有多危險」的系統,而不是另一個會自己動手的系統。非代理式設計是整條路線的關鍵——系統若沒有自己的行動目標,就缺乏欺騙使用者的動機,這是從架構層面處理對齊問題,而不是事後補丁。對照組是常見的業界做法:用自己的另一個模型審查自己的輸出,或事後過濾有害內容。LawZero 的主張是把裁判權交給與產品無關、也不追求自身目標的系統,讓「會動手的」與「做判斷的」徹底分離。

約3,000萬美元捐款與獨立性

LawZero 以約 3,000 萬美元的慈善捐款起跑,足夠支撐約 18 個月的營運。TechCrunch 點名的支持者包括 Skype 共同創辦工程師 Jaan Tallinn、前 Google 執行長 Eric Schmidt,以及 Open Philanthropy、Future of Life Institute 等。實驗室創立時約有 15 名成員,由 Mila 孵化,官方表示將繼續募款與擴編。

相對於前沿實驗室動輒數十億美元的運算預算,3,000 萬美元很小。但這個規模也說明了它的定位:不做前沿能力競賽,而是做獨立評測、安全案例與基礎研究——這些工作的成本遠低於訓練旗艦模型,卻是生態系裡最缺的一塊。值得注意的是捐款結構:支持者多是長期資助安全研究的組織與個人,而非追求回收的創投;LawZero 因此可以發表負面結果、慢工出細活,不必對營收負責。

對AI安全路線之爭的意義

LawZero 的成立,把「能力優先」與「安全優先」的路線之爭檯面化。2025 年上半年代理式 AI 全面加速,各家都在把模型接上工具、瀏覽器與電腦控制權;Bengio 選在這個時間點設立機構,等於公開表態:競賽需要一個不在場上跑的裁判。

對開發者而言,值得關注的有兩件事。一是 Scientist AI 這類非代理系統若成熟,可能成為代理式應用的外部護欄與事實查核層,用獨立模型來約束會自己動手的模型。二是產業將多出一個資金獨立、以公共利益為號召的研究力量;在安全評測大多由實驗室自己做的現狀下,多一個專門「證明系統不可靠」的機構,對整個生態是好事。接下來的觀察指標很實際:團隊能否擴編、能否拿出可被第三方重現的評測工具,以及 Scientist AI 原型何時現身。若這條路線被驗證,未來的代理式產品可能都得外掛一個獨立的判斷層。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

這篇內容對你有幫助嗎?

支持本站繼續整理實用的 AI 文章、教學與開發筆記。

請我喝杯咖啡
分享X電郵