AI News字數 2576閱讀時長7 分鐘

Paul Christiano 加入 OpenAI 基金會董事會及安全與保安委員會

OpenAI 委任 Paul Christiano 加入其基金會董事會及安全與保安委員會,並在 OpenAI Group PBC 擔任觀察員。

文章目錄 · 11
  1. 一、Christiano 出任三個相連的管治職位
  2. 二、安全委員會可介入模型發布
  3. 三、他的背景結合對齊研究與政府評估工作
  4. 四、Christiano 表示任命並非認可
  5. 常見問題
  6. Paul Christiano 是以僱員身分加入 OpenAI 嗎?
  7. Christiano 可以親自停止 OpenAI 模型發布嗎?
  8. 他在 OpenAI Group PBC 董事會有投票權嗎?
  9. 他會繼續與美國政府合作嗎?
  10. 這項任命會改變 OpenAI 的產品或安全規則嗎?
  11. 參考來源

OpenAI 於 2026 年 9 月 9 日委任對齊研究員 Paul Christiano 加入 OpenAI 基金會董事會,讓他進入控制該公司商業公益公司的非牟利機構。他亦會加入基金會的安全與保安委員會;該委員會正式獲授權要求採取緩解措施,並可暫停發布 OpenAI 模型或 AI 系統。

Christiano 不會成為 OpenAI Group PBC 的有投票權董事。相反,他會以無投票權觀察員身分出席其董事會。這項區別相當重要,因為它讓他可參與商業公司的董事會層級討論,同時將其投票權置於具控制權的非牟利機構內。

這項任命讓一名前 OpenAI 對齊研究主管及美國政府前沿模型評估人員,進入公司其中一個最具影響力的監督職位。它本身不會改變任何 OpenAI 模型、產品、發布時間表或安全門檻。

一、Christiano 出任三個相連的管治職位

Christiano 將以董事身分加入 OpenAI 基金會董事會、以成員身分加入基金會董事會的安全與保安委員會,並以無投票權觀察員身分加入 OpenAI Group PBC 董事會。

基金會不只是 OpenAI 的慈善部門。根據於 2025 年 10 月完成的架構,基金會透過特別投票權及管治權控制 OpenAI Group PBC。基金會委任 Group 董事會的每一位董事,並可隨時更換這些董事。

OpenAI 現時的管治頁面列出 11 名基金會董事:公司形容其中十名為獨立董事,包括 Christiano,以及行政總裁 Sam Altman。Bret Taylor 同時擔任基金會及 Group 董事會主席。

大多數基金會董事亦曾擔任 OpenAI Group 的董事。安全與保安委員會主席 Zico Kolter 起初是例外:他只擔任基金會董事,並以無投票權觀察員身分出席 Group 董事會會議。Christiano 的任命再增添一個這類分拆職位。

這個架構讓 Christiano 可在具控制權的非牟利董事會投票,但以商業公司觀察員身分時沒有投票權。觀察員可參與董事會層級的資訊流通及審議,但任命公告沒有賦予 Christiano 對 Group 決定的個人否決權。

相比一般顧問職位,他的委員會成員身分更具影響力,因為安全與保安委員會行使的是透過 OpenAI 公司管治安排所授予的權力。Christiano 將與 Kolter 共事,後者由 OpenAI 於 2024 年委任為該委員會主席。

二、安全委員會可介入模型發布

OpenAI 於 2024 年成立安全與保安委員會,最初委託其審視安全及保安流程。經過 90 日審查後,公司將其轉為獨立的董事會監督委員會,負責模型開發及部署各環節的安全與保安事宜。

OpenAI 表示,該委員會將會聽取主要模型發布的評估簡報、審閱技術評估及發布後監察,並與全體董事會一同參與發布監督。公司亦表示,委員會及董事會可延遲發布,直至已識別的安全疑慮獲得處理。

這些權力其後在 OpenAI 於 2025 年進行資本重組時被更明確地記錄下來。由 OpenAI 與加州總檢察長簽署的一份備忘錄指出,該委員會仍屬於非牟利機構而非 PBC,並對涉及安全及保安的 Group 行動擁有實質批准權。

備忘錄指出,即使 OpenAI 適用的風險門檻原本容許發布,委員會仍可要求採取「包括但不限於暫停發布模型或 AI 系統」的緩解措施。OpenAI 必須就該權力的任何重大變更,預先通知加州總檢察長。

該協議亦要求 PBC 董事會在處理企業安全及保安事宜時,只考慮 OpenAI 的使命,而非股東的財務利益或其他利益。基金會對 Group 董事會任命的控制權,為非牟利監督提供了委員會以外的額外途徑。

因此,Christiano 加入了一個已獲記錄、可要求保障措施及停止發布的機構。然而,這些權力是否及如何被行使,仍是另一個問題:OpenAI 和 Christiano 均沒有隨任命公布任何即將介入的行動、修訂後的安全政策,或針對特定模型的審查。

三、他的背景結合對齊研究與政府評估工作

Christiano 於 2017 年至 2021 年在 OpenAI 工作,期間領導對齊研究,並為人類回饋強化學習的基礎工作作出貢獻。RLHF 利用人類判斷訓練獎勵模型,然後將 AI 系統最佳化,使其行為更符合評估者偏好;這種方法的不同變體後來成為訓練對話式 AI 系統的核心。

離開 OpenAI 後,他創立了非牟利機構 Alignment Research Center。他亦發起一項針對前沿模型進行獨立評估的倡議,後來成為 Model Evaluation and Threat Research,即 METR。

美國商務部於 2024 年 4 月委任 Christiano 為美國 AI 安全研究所的 AI 安全主管。該研究所設於國家標準與技術研究院內,委託他設計及進行前沿模型評估,尤其是測試具有國家安全影響的能力,並協助制定相關風險緩解措施。

該研究所其後由 NIST 的 Center for AI Standards and Innovation 接替。OpenAI 將 Christiano 列為 CAISI 的高級技術顧問,並表示他的政府經驗橫跨兩屆總統政府。

他持續擔任政府職務,明顯需要處理利益衝突。OpenAI 的公告表示,Christiano 在擔任高級技術顧問期間,將就所有與 OpenAI 有關的政府事項及所有模型評估迴避。披露的限制範圍廣泛:並不限於評估 OpenAI 模型。

公告沒有表示他會離開 ARC 或其政府顧問職位,亦沒有披露薪酬、其基金會任期,或其他針對委員會職務的迴避安排。

四、Christiano 表示任命並非認可

Christiano 在同日發表的個人聲明中,形容先進 AI 帶來的失控風險相當迫切。他認為,自動化 AI 研究可能形成回饋循環,讓獲改善的 AI 系統加速開發能力更強的系統。

他給出主觀且綜合所有因素的風險估計:未來一年發生災難性且不可逆轉的失控風險為 4%,未來三年則為 15%。Christiano 強調,這些數字反映他的個人不確定性,而非由精確或穩定的預測模型產生的結果。

他亦表示,包括 OpenAI 在內的 AI 業界,目前並未朝著將風險降至可接受水平的方向前進。這項說法比 OpenAI 的公告更進一步;後者較概括地形容他為願意挑戰假設,以及質疑業界保障措施是否足夠的人。

Christiano 明確提醒,不應把他決定加入視為對 OpenAI 現有安全做法的認可或批評。他表示,開發者應按可由外界核實的行為及結果來評價,並列出更強的緩解措施、關於風險及保障措施的透明證據,以及共同安全標準等實際措施。

這項任命的即時影響屬於制度層面,而非技術層面。OpenAI 已將 Christiano 的判斷加入控制 Group 的董事會,以及獲授權審視評估、要求緩解措施和阻止發布的委員會。影響的證據將取決於其後可觀察到的行動,例如已公布保障措施、評估披露、發布決定的變更,或委員會行使其介入權力。

常見問題

Paul Christiano 是以僱員身分加入 OpenAI 嗎?

不是。OpenAI 宣布他出任基金會董事、安全與保安委員會成員,以及 Group 董事會的無投票權觀察員。公告沒有宣布他擔任營運或研究職位。

Christiano 可以親自停止 OpenAI 模型發布嗎?

OpenAI 沒有授予他個人否決權。安全與保安委員會整體則具備已記錄的權力,可要求緩解措施,包括暫停發布。

他在 OpenAI Group PBC 董事會有投票權嗎?

沒有。Christiano 是 Group 董事會的無投票權觀察員。他是具控制權的 OpenAI 基金會的有投票權董事。

他會繼續與美國政府合作嗎?

OpenAI 表示他仍是 NIST CAISI 的高級技術顧問。他必須就所有與 OpenAI 有關的政府事項及所有模型評估迴避。

這項任命會改變 OpenAI 的產品或安全規則嗎?

沒有公布產品或政策變更。這項任命改變了 OpenAI 管治基金會董事會及其安全與保安委員會的成員組成。

參考來源

Share

分享這篇文章