Paul Christiano 加入 OpenAI 基金會董事會及安全與保安委員會
OpenAI 委任 Paul Christiano 加入其基金會董事會及安全與保安委員會,並在 OpenAI Group PBC 擔任觀察員。
文章目錄 · 11
OpenAI 於 2026 年 9 月 9 日委任對齊研究員 Paul Christiano 加入 OpenAI 基金會董事會,讓他進入控制該公司商業公益公司的非牟利機構。他亦會加入基金會的安全與保安委員會;該委員會正式獲授權要求採取緩解措施,並可暫停發布 OpenAI 模型或 AI 系統。
Christiano 不會成為 OpenAI Group PBC 的有投票權董事。相反,他會以無投票權觀察員身分出席其董事會。這項區別相當重要,因為它讓他可參與商業公司的董事會層級討論,同時將其投票權置於具控制權的非牟利機構內。
這項任命讓一名前 OpenAI 對齊研究主管及美國政府前沿模型評估人員,進入公司其中一個最具影響力的監督職位。它本身不會改變任何 OpenAI 模型、產品、發布時間表或安全門檻。
一、Christiano 出任三個相連的管治職位
Christiano 將以董事身分加入 OpenAI 基金會董事會、以成員身分加入基金會董事會的安全與保安委員會,並以無投票權觀察員身分加入 OpenAI Group PBC 董事會。
基金會不只是 OpenAI 的慈善部門。根據於 2025 年 10 月完成的架構,基金會透過特別投票權及管治權控制 OpenAI Group PBC。基金會委任 Group 董事會的每一位董事,並可隨時更換這些董事。
OpenAI 現時的管治頁面列出 11 名基金會董事:公司形容其中十名為獨立董事,包括 Christiano,以及行政總裁 Sam Altman。Bret Taylor 同時擔任基金會及 Group 董事會主席。
大多數基金會董事亦曾擔任 OpenAI Group 的董事。安全與保安委員會主席 Zico Kolter 起初是例外:他只擔任基金會董事,並以無投票權觀察員身分出席 Group 董事會會議。Christiano 的任命再增添一個這類分拆職位。
這個架構讓 Christiano 可在具控制權的非牟利董事會投票,但以商業公司觀察員身分時沒有投票權。觀察員可參與董事會層級的資訊流通及審議,但任命公告沒有賦予 Christiano 對 Group 決定的個人否決權。
相比一般顧問職位,他的委員會成員身分更具影響力,因為安全與保安委員會行使的是透過 OpenAI 公司管治安排所授予的權力。Christiano 將與 Kolter 共事,後者由 OpenAI 於 2024 年委任為該委員會主席。
二、安全委員會可介入模型發布
OpenAI 於 2024 年成立安全與保安委員會,最初委託其審視安全及保安流程。經過 90 日審查後,公司將其轉為獨立的董事會監督委員會,負責模型開發及部署各環節的安全與保安事宜。
OpenAI 表示,該委員會將會聽取主要模型發布的評估簡報、審閱技術評估及發布後監察,並與全體董事會一同參與發布監督。公司亦表示,委員會及董事會可延遲發布,直至已識別的安全疑慮獲得處理。
這些權力其後在 OpenAI 於 2025 年進行資本重組時被更明確地記錄下來。由 OpenAI 與加州總檢察長簽署的一份備忘錄指出,該委員會仍屬於非牟利機構而非 PBC,並對涉及安全及保安的 Group 行動擁有實質批准權。
備忘錄指出,即使 OpenAI 適用的風險門檻原本容許發布,委員會仍可要求採取「包括但不限於暫停發布模型或 AI 系統」的緩解措施。OpenAI 必須就該權力的任何重大變更,預先通知加州總檢察長。
該協議亦要求 PBC 董事會在處理企業安全及保安事宜時,只考慮 OpenAI 的使命,而非股東的財務利益或其他利益。基金會對 Group 董事會任命的控制權,為非牟利監督提供了委員會以外的額外途徑。
因此,Christiano 加入了一個已獲記錄、可要求保障措施及停止發布的機構。然而,這些權力是否及如何被行使,仍是另一個問題:OpenAI 和 Christiano 均沒有隨任命公布任何即將介入的行動、修訂後的安全政策,或針對特定模型的審查。
三、他的背景結合對齊研究與政府評估工作
Christiano 於 2017 年至 2021 年在 OpenAI 工作,期間領導對齊研究,並為人類回饋強化學習的基礎工作作出貢獻。RLHF 利用人類判斷訓練獎勵模型,然後將 AI 系統最佳化,使其行為更符合評估者偏好;這種方法的不同變體後來成為訓練對話式 AI 系統的核心。
離開 OpenAI 後,他創立了非牟利機構 Alignment Research Center。他亦發起一項針對前沿模型進行獨立評估的倡議,後來成為 Model Evaluation and Threat Research,即 METR。
美國商務部於 2024 年 4 月委任 Christiano 為美國 AI 安全研究所的 AI 安全主管。該研究所設於國家標準與技術研究院內,委託他設計及進行前沿模型評估,尤其是測試具有國家安全影響的能力,並協助制定相關風險緩解措施。
該研究所其後由 NIST 的 Center for AI Standards and Innovation 接替。OpenAI 將 Christiano 列為 CAISI 的高級技術顧問,並表示他的政府經驗橫跨兩屆總統政府。
他持續擔任政府職務,明顯需要處理利益衝突。OpenAI 的公告表示,Christiano 在擔任高級技術顧問期間,將就所有與 OpenAI 有關的政府事項及所有模型評估迴避。披露的限制範圍廣泛:並不限於評估 OpenAI 模型。
公告沒有表示他會離開 ARC 或其政府顧問職位,亦沒有披露薪酬、其基金會任期,或其他針對委員會職務的迴避安排。
四、Christiano 表示任命並非認可
Christiano 在同日發表的個人聲明中,形容先進 AI 帶來的失控風險相當迫切。他認為,自動化 AI 研究可能形成回饋循環,讓獲改善的 AI 系統加速開發能力更強的系統。
他給出主觀且綜合所有因素的風險估計:未來一年發生災難性且不可逆轉的失控風險為 4%,未來三年則為 15%。Christiano 強調,這些數字反映他的個人不確定性,而非由精確或穩定的預測模型產生的結果。
他亦表示,包括 OpenAI 在內的 AI 業界,目前並未朝著將風險降至可接受水平的方向前進。這項說法比 OpenAI 的公告更進一步;後者較概括地形容他為願意挑戰假設,以及質疑業界保障措施是否足夠的人。
Christiano 明確提醒,不應把他決定加入視為對 OpenAI 現有安全做法的認可或批評。他表示,開發者應按可由外界核實的行為及結果來評價,並列出更強的緩解措施、關於風險及保障措施的透明證據,以及共同安全標準等實際措施。
這項任命的即時影響屬於制度層面,而非技術層面。OpenAI 已將 Christiano 的判斷加入控制 Group 的董事會,以及獲授權審視評估、要求緩解措施和阻止發布的委員會。影響的證據將取決於其後可觀察到的行動,例如已公布保障措施、評估披露、發布決定的變更,或委員會行使其介入權力。
常見問題
Paul Christiano 是以僱員身分加入 OpenAI 嗎?
不是。OpenAI 宣布他出任基金會董事、安全與保安委員會成員,以及 Group 董事會的無投票權觀察員。公告沒有宣布他擔任營運或研究職位。
Christiano 可以親自停止 OpenAI 模型發布嗎?
OpenAI 沒有授予他個人否決權。安全與保安委員會整體則具備已記錄的權力,可要求緩解措施,包括暫停發布。
他在 OpenAI Group PBC 董事會有投票權嗎?
沒有。Christiano 是 Group 董事會的無投票權觀察員。他是具控制權的 OpenAI 基金會的有投票權董事。
他會繼續與美國政府合作嗎?
OpenAI 表示他仍是 NIST CAISI 的高級技術顧問。他必須就所有與 OpenAI 有關的政府事項及所有模型評估迴避。
這項任命會改變 OpenAI 的產品或安全規則嗎?
沒有公布產品或政策變更。這項任命改變了 OpenAI 管治基金會董事會及其安全與保安委員會的成員組成。
參考來源
Share