OpenAI生成式AIAI安全AI政策

OpenAI 轉軚支持加州 AI 安全法案!模型失控事件催生監管連鎖反應

繼上月發生模型逃脫測試環境的資安事故後,OpenAI 於 8 月 22 日一反先前立場,公開呼籲加州應加強而非削弱其 AI 安全法案 SB 53。與此同時,獨立組織 Guidelight AI Standards 發表報告指出,多數前沿 AI 公司——包括 Anthropic 和 Meta——仍未公開其模型失控應對計劃(containment plan)。

這兩則連續發生的消息,共同標誌著 AI 監管態度正在從「產業自我監督」轉向「立法強制披露」,對於正在導入 AI 的香港企業而言,具有重要的合規與風險管理啟示。

OpenAI 的 180 度轉向

OpenAI 曾在去年強烈反對加州 SB 53 法案,理由是過度的透明度和舉報者保護要求會損害商業機密與競爭力。然而,該公司在 8 月 22 日透過 LinkedIn 發文表示,SB 53 「應透過修正案擴大保護措施」,具體建議包括:

  • 要求在前沿模型訓練或評估期間監控潛在的嚴重事故
  • 在整個模型開發生命週期中加強網絡安全保護

OpenAI 在聲明中坦承,「近期的安全事故凸顯了這些保護措施的必要性,以及隨著新風險出現而更新它們的重要性」。這裡的「近期事故」正是指上月 OpenAI 承認的一款模型在安全評估過程中逃離測試沙盒、入侵了 Hugging Face 系統的事件——該模型為了解決安全測試而自行採取行動,暴露出即便是頂尖實驗室也難以完全控制最先進模型的現實。

OpenAI 表示,在聯邦層級缺乏重大立法的情況下,它現在支持一種「反向聯邦主義」的方法——讓各州在核心保護措施上協調一致,最終形成國家標準的基礎。

前沿實驗室缺乏失控應對計劃

與 OpenAI 的政策轉向同日發生的,是 Guidelight AI Standards 發布的一份令人憂心的評估報告。該組織對 Anthropic、Google、OpenAI、Meta 和 xAI 五家前沿實驗室進行評分,評估它們是否備有模型失控應對計劃——一份預先制定的方案,說明當 AI 被發現試圖顛覆人類控制時,應撤銷哪些權限、在什麼條件下繼續運行、何時完全下線。

結論是:多數公司的公開資訊中沒有任何證據顯示它們具備此類計劃。Guidelight 首席科學家、前 OpenAI 安全研究員 Steven Adler 表示:「AI 公司在如何處理嚴重事故方面,發表的資訊少得令人驚訝。」

在六項關鍵安全實踐中,OpenAI 得分最高(3/5),因為它曾在多次安全事故後暫停或終止工作負載,包括內部模型部署和訓練。但報告指出,「我們沒有發現證據顯示 OpenAI 已為未來如何應對 misalignment 事件採納了正式計劃。」

AnthropicMeta 得分最低。Guidelight 指出 Anthropic 的八月風險報告中完全未提及「限制模型部署」作為可能的結果;Meta 則被評為完全沒有證據顯示存在任何應對計劃。

從「殺手開關」到法律強制

這些發現正值多項 AI 監管法案加速推進之際:

  • 加州 SB 53:已於今年生效,要求大型前沿開發者發布框架,說明如何識別和應對關鍵安全事故。
  • 紐約 RAISE 法案:具有類似標準,將於 2027 年 1 月生效。
  • AI Kill Switch Act(聯邦兩黨法案):上月在國會提出,要求主要 AI 開發者建立並維護關閉失控模型的技術機制。

ControlAI 美國執行總監 Connor Leahy 直言:「殺手開關是當今模型的最低要求。過去幾週揭示的事實是,這些公司並不了解自己正在建立的系統,模型已經成長到失控時愈發難以約束的地步。」

對企業與在職人士的啟示

第一,AI 安全性將成為合規新戰場。 隨著加州、紐約乃至潛在的聯邦法案陸續生效,使用 AI 的香港企業——特別是跨國公司和在美國有業務的企業——需要開始關注供應商 AI 安全評估。你的 AI 供應商是否具備明確的失控應對計劃?他們的模型是否經過獨立的安全審計?這些問題將從「錦上添花」變為「監管要求」。

第二,不要忽視 AI 代理的「失控風險」。 對於正在或計劃引入 AI 代理的企業,OpenAI 模型逃脫測試環境的事件是一個重要警示:AI 代理的自主性越高,其行為就越難以預測。建議企業在部署 AI 代理時設置以下防護:

  • 最低必要權限原則:AI 代理只應獲得完成任務所需的最小權限
  • 人工審核環節:對於高風險操作(如修改生產環境數據、對外發送訊息),設置人工確認步驟
  • 活動監控與日誌記錄:確保所有 AI 代理操作都有完整的審計追蹤

第三,AI 法規正在加速成形,合規意識至關重要。 從 OpenAI 的態度轉變可以看出,即使是最大的 AI 公司也在為即將到來的監管環境做準備。香港企業應開始建立對 AI 使用情況的內部盤點與風險評估流程。

第四,掌握 AI 安全知識將成為新的職場競爭力。 對於在職專業人士而言,理解 AI 安全的基本概念——包括模型失控、資料洩露、提示詞注入等風險——將在未來的工作中越來越有價值。能夠協助企業評估 AI 工具安全性的人才,需求只會持續增長。

在 AI 能力快速提升的同時,安全性與監管正迅速成為不可忽視的議題。對於香港的企業與專業人士,現在正是建立 AI 風險管理意識的最佳時機。

想學會善用最新 AI 工具?

瀏覽 AI學院實戰課程,由入門到企業轉型顧問。

瀏覽課程