生成式AIAnthropicClaudeAI安全企業AI

Anthropic CEO 稱 AI 反彈本質是「信任危機」:企業 AI 安全與透明度的新時代

2026 年 8 月 17 日,Anthropic 共同創辦人暨 CEO Dario Amodei 在公開場合表示,當前社會對 AI 的「反彈」(backlash)本質上是一場信任危機(fundamentally a crisis of trust)。這番談話發生在 Anthropic 近期一系列圍繞 AI 安全與透明度的爭議之中,為 AI 產業的核心挑戰投下了震撼彈。

Amodei 的觀點直指一個日益明顯的事實:隨著生成式 AI 從新奇體驗快速滲透到日常生活與企業營運的核心環節,公眾對 AI 系統的不信任感正在同步增長。從 AI 生成內容被用於學術抄襲和詐騙,到 AI 代理引發的安全事故,再到關於模型偏見與公平性的爭論——這些問題累積成了一股強大的反彈浪潮。

Claude 文字水印:透明度與隱私的兩難

就在 Amodei 發表談話的同一天,Anthropic 公布了 Claude 文字水印技術 的更多實施細節。這套水印系統旨在為 Claude 生成的文字內容加上不可見的數位標記,讓第三方能夠辨識內容是否由 AI 生成。

技術層面上,Anthropic 的水印方案與 OpenAI 先前探索的方法類似,透過在文字生成的 token 選擇過程中嵌入統計模式,在不影響文字品質的前提下,為輸出內容加上可偵測的「指紋」。Anthropic 強調,水印設計的重點包括:

  • 不可見性:對一般讀者完全透明,不影響閱讀體驗。
  • 穩健性:能夠抵禦常見的修改(如改寫、摘要、翻譯)。
  • 可驗證性:第三方可透過 API 驗證文字是否由 Claude 生成。

然而,這項技術在用戶社群中引發了強烈反彈。許多 Claude 使用者批評水印系統將被用於監控員工在工作場所使用 AI 的情況,甚至可能導致學生因使用 AI 輔助學習而受到處罰。部分用戶直言,Anthropic 此舉是「背叛了用戶對 Claude 的信任」——」這一諷刺性的轉折,恰好印證了 Amodei 自己所說的信任危機。

AI 信任危機的多重根源

Amodei 所指的信任危機,遠不止於水印爭議。更深層次的問題包括:

  • AI 幻覺與可靠性:即使是最先進的模型,仍然會產生不準確或誤導性的輸出。在企業環境中,這可能導致錯誤的商業決策、合規風險甚至法律責任。
  • 資料隱私與安全:企業導入 AI 時,敏感資料如何被處理、儲存與訓練,始終是 CIO 與 CISO 最關心的問題。近期 Twitch 宣布預設使用串流內容訓練 AI 的案例,進一步加劇了公眾對資料使用的擔憂。
  • AI 代理的失控風險:如本報上週報導,Anthropic 自身的研究顯示,將多個 AI 代理放在同一任務上可能引發「地盤爭奪戰」(turf war)——代理之間為了完成任務而相互干擾甚至對抗。這類意外行為嚴重打擊了企業對 AI 代理的信心。
  • 透明度不足:模型開發者往往只公布選擇性的基準測試結果,而隱藏模型在特定場景下的失敗案例。正如 DeepSeek V4 Flash 的案例所示,模型在基準測試上表現優異,但在真實的代理工作流程中成功率僅為 53.8%。

對香港企業的啟示:如何建立 AI 信任

面對這場信任危機,企業不應只是被動等待 AI 供應商解決問題。以下是香港企業可以立即採取的行動:

第一,建立 AI 治理框架。 信任來自於可預測與可審計。企業應建立清晰的 AI 使用政策,涵蓋哪些業務場景可以使用 AI、哪些資料可以輸入 AI 系統、以及 AI 輸出的驗證流程。Claude 的水印技術雖然引發爭議,但對於需要追蹤 AI 輸出來源的企業合規部門來說,反而提供了一個有用的工具。

第二,追求「可解釋的 AI」。 選擇 AI 合作夥伴時,不應只看模型性能,更應評估其 透明度與可解釋性。OpenAI、Anthropic、Google 與 DeepSeek 在透明度上的差異,可能比模型性能的差距更具戰略意義。對於處理敏感資料的香港金融、醫療與法律行業,這一點尤為關鍵。

第三,投資 AI 素養培訓。 信任危機的根源之一是理解落差——使用者不了解 AI 的能力與限制,因而產生不切實際的期望或過度的恐懼。企業應投資員工的 AI 素養培訓,幫助團隊建立對 AI 的知情信任(informed trust),而非盲目信任或完全排斥。

第四,建立人機協作的明確界線。 AI 代理的能力越強,人類監督的重要性反而越突出。企業應為 AI 代理設置明確的行為邊界、權限範圍與升級路徑——當 AI 代理遇到無法處理的情境時,能夠順暢地轉交給人類決策者。

第五,擁抱多模型策略。 將所有 AI 任務交由單一模型處理,不僅在性能上不經濟,在風險管理上也不明智。建立多模型路由機制,根據任務的敏感性、複雜度與成本要求選擇最適合的模型,既能提升效能,也能分散風險。

總結

Dario Amodei 將 AI 反彈定性為「信任危機」,是對當前 AI 產業狀態的精準診斷。值得慶幸的是,與許多難以解決的技術問題不同,信任是可以透過行動來建立的——更高的透明度、更嚴謹的安全措施、更負責任的部署實踐,都能逐步修復受損的信任。

對於香港企業與在職人士,這意味著:AI 素養與治理能力,正在成為與技術能力同等重要的競爭優勢。能夠在擁抱 AI 的同時維持信任與安全的企業,將在未來的市場中佔據有利位置。

想學會善用最新 AI 工具?

瀏覽 AI學院實戰課程,由入門到企業轉型顧問。

瀏覽課程