> ## Content Index
> Fetch the complete content index at: https://www.5news.com.hk/llms.txt
> Use this file to discover other available public pages before exploring further.

# 人工智能發展太快？Anthropic、OpenAI 高層齊聲籲放慢腳步
- URL: https://www.5news.com.hk/anthropic-ceo-dario-amodei-slow-ai-development-plan/
- Published: 2026-09-13T14:32:07.000Z
- Updated: 2026-09-13T14:32:06.000Z
- Description: Anthropic 行政總裁 Dario Amodei（達里奧·阿莫迪）發表長文，提出減慢人工智能發展速度嘅三大策略，包括引入第三方評估員、民主國家業界協調、以及全球合作。OpenAI 行政總裁 Sam Altman（薩姆·奧爾特曼）同 SpaceX 行政總裁 Elon Musk（埃隆·馬斯克）均表示支持。事件背景涉及研究員離職同安全隱憂，引發業界對 AI 發展方向嘅深入討論。
- Author: 5News編輯部
- Tags: #Anthropic, #OpenAI, #Artificial Intelligence, A.I., 全部

## Anthropic 行政總裁提出減慢 AI 發展速度：三大策略詳細分析

9月13日，人工智能（AI）業界出現一個值得關注嘅發展。Anthropic 行政總裁 Dario Amodei（達里奧·阿莫迪）發表[一篇長文](https://darioamodei.com/post/we-must-pace-the-frontier)，明確提出要減慢人工智能發展速度，並且提出三個具體策略方向。呢個倡議隨即獲得 OpenAI 行政總裁 Sam Altman（薩姆·奧爾特曼）同 SpaceX 行政總裁 Elon Musk（埃隆·馬斯克）公開支持，顯示業界高層對 AI 安全問題嘅關注正在升溫。

> Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to. <https://t.co/QAIHiFP3QZ>
> 
> — Evan Hubinger (@EvanHub) [September 9, 2026](https://x.com/EvanHub/status/2097497037956891126?ref%5Fsrc=twsrc%5Etfw)

## 事件背景：研究員離職引發安全討論

呢次討論嘅背景同近日一宗人事變動有關。研究員 Jacob Coxon（雅各布·考克森）公開表示佢辭去 Anthropic 嘅職位，原因係擔心領先嘅 AI 公司「攞我哋嘅生命嚟賭博」，而建構呢項技術嘅人「真心相信到咗2020年代末，AI 可能會殺死我哋所有人」。呢個說法喺 Anthropic 內部亦獲得其他人員重複提及，令到業界對 AI 安全同對齊（alignment）問題嘅辯論更加激烈。

Amodei 嘅文章冇直接提及 Coxon 嘅離職或者佢嘅擔憂，但呢位行政總裁寫道，有兩件事令佢確信係時候對 AI 發展採取更審慎嘅態度：第一係 OpenAI-HuggingFace 嘅黑客入侵事件，第二係「AI 喺最近幾個月嘅進步速度大幅加快」，特別係 AI「建構下一代 AI 嘅能力不斷增強」。

Amodei 寫道：「我哋必須減慢提升 AI 模型能力嘅速度。進步仍然會顯得快速，而我哋必須明智咁運用所爭取到嘅時間。」

## 三大策略詳細分析

### 第一步：引入第三方嵌入式評估員

Amodei 提出嘅第一個步驟，係引入來自第三方組織（例如 METR）嘅「嵌入式評估員」（embedded evaluators）。呢啲評估員可以驗證 AI 公司係咪真係遵守佢哋嘅發展節奏同安全承諾，同時確保安全事故得到報告。

值得留意嘅係，OpenAI 最近因為冇報告一宗事故而受到批評——該事故涉及其 AI 代理接管咗一個德國 wiki 論壇。

Amodei 將呢啲評估員比喻為被嵌入銀行員工之中嘅監管人員，佢表示邀請佢哋進入公司係「Anthropic 單方面承諾會做嘅事（同時呼籲政府要求其他前沿公司跟隨）」。具體而言，即係畀評估員公司證件、辦公桌同手提電腦，並且提供「大致上同內部風險評估團隊相若」嘅權限，除非法律或合約另有要求。

Altman 亦表示呢個係「好主意」，並且話 OpenAI 都會跟住做：「我哋好快會有更多資料分享。」

### 第二步：民主國家業界協調制定共同安全標準

Amodei 嘅第二個建議，係呼籲「民主國家內」嘅領先 AI 公司協調制定「共同安全標準，以及對不受限制嘅 AI 進步速度設限」。

呢種協調表面上似乎唔太可能實現，因為據報道呢啲公司擔心協調暫停發展可能會引致反壟斷審查。Amodei 喺文章中都有提及呢個擔憂，佢寫道：「基於反壟斷原因，美國政府介入或者至少促成呢啲討論會有幫助——佢哋唔需要參與，但確實需要就某類安全對話發出狹義豁免。」

### 第三步：全球協調包括與專制政府合作

Amodei 嘅第三個建議係「全球協調」，即係美國同其盟友「盡可能嘗試同專制政府協調」。佢表示呢個意味著「同中國合作」，並且承認「能夠達成嘅嘢有明顯限制」，但佢仍然認為可能存在達成共識嘅機會，即使只係「禁止某些狹窄且明顯危險嘅 AI 用途，例如利用 AI 生產生物武器或者容許用戶咁做」。

## 中國因素與技術領先優勢

Amodei 都有回應經常被提出嘅中國 AI 主導威脅論——呢個通常係反對減慢發展速度嘅論據。但佢指出，如果美國政府同科技公司採取措施，例如拒絕向中國公司出售強大晶片或半導體製造設備，以及打擊模型蒸餾（model distillation），佢哋可以「令中國嘅進度減慢到足以喺未來三至五年大幅擴大美國嘅領先優勢」。

模型蒸餾係一種技術，允許公司透過訓練其 AI 複製更強大模型嘅行為，從而快速追上領先者。Amodei 認為打擊呢種做法對於維持技術領先地位至關重要。

## 業界反應與不同聲音

### 支持聲音

除咗 Altman 同 Musk 嘅公開支持之外，其他 AI 行政人員對 Amodei 嘅文章似乎都有正面反應。呢種跨公司嘅共識喺 AI 業界並唔常見，顯示高層管理人員對安全問題嘅重視程度正在提升。

### 批評聲音

不過，並唔係所有人都認同呢個方向。由於 Amodei 過去願意承認 AI 嘅潛在危險，加上佢嘅公司對某啲形式嘅監管相對開放，一啲 AI 支持者已經批評佢係「末日論者」（doomer），認為佢嘅言論助長咗目前對 AI 嘅反彈。

回應呢啲批評時，Amodei 表示佢嘗試提供「平衡」嘅觀點，並且認為反彈「根本係一場信任危機」，因為大眾對科技公司、科技行業同政府都變得懷疑。

### 業界觀察者嘅質疑

行業評論員對呢啲末日式 AI 警告亦持懷疑態度，認為呢啲警告分散咗大眾對科技已經造成嘅傷害嘅注意力。

記者 Brian Merchant（布賴恩·默昌特）寫道，佢仲未見過「一份可信嘅、逐步記錄 AI 如何從自我遞歸改進發展到殺死地球上每一個人嘅文檔」；佢亦提出，類似 Amodei 嘅建議「可能最終只會服務 Anthropic 同 OpenAI；呢個正正係監管俘虜（regulatory capture）嘅表現」。

監管俘虜係指被監管嘅行業反過來控制咗監管機構，令監管政策偏向業界利益而非公眾利益。

## Amodei 嘅核心立場

喺呢篇新文章中，Amodei 寫道佢繼續「相信 AI 可以極大程度改善人類生活質素」。

佢表示：「我實現呢啲好處嘅願望絲毫未減。但呢啲好處只有喺我哋以正確方式建構科技嘅情況下先會實現，而且——只要我哋好好運用所爭取到嘅時間——付出異常審慎嘅努力去做好呢件事係值得嘅。」

## 對香港同亞太區嘅啟示

對於香港同亞太區嘅科技從業員同投資者嚟講，呢個發展有幾個值得留意嘅層面：

第一，AI 安全已經從學術討論變成業界高層嘅實際行動議題。當 Anthropic 同 OpenAI 兩大領先公司嘅行政總裁都公開支持減慢發展速度，呢個信號對成個行業嘅發展方向有深遠影響。

第二，第三方評估機制嘅引入可能會改變 AI 公司嘅營運模式。如果呢個做法成為行業標準，亞太區嘅 AI 公司都可能需要考慮類似嘅安排，以符合國際合作嘅要求。

第三，中美科技競爭嘅背景下，AI 發展速度嘅調控可能會受到地緣政治因素影響。Amodei 提出透過限制晶片出口同打擊模型蒸餾嚟維持美國領先優勢，呢個策略如果落實，對亞洲嘅 AI 發展會有直接影響。

## 技術層面嘅考量

從技術角度嚟睇，Amodei 提到嘅幾個概念值得進一步解釋：

**模型蒸餾（Model Distillation）**：呢個係一種機器學習技術，細模型透過學習大模型嘅輸出嚟提升自身表現。呢個方法可以令資源較少嘅公司快速追上領先者，因此 Amodei 認為需要加以限制。

**自我遞歸改進（Self-Recursive Improvement）**：指 AI 系統能夠改進自身嘅能力，形成一個正反饋循環。部分研究人員擔心呢個能力如果失控，可能會導致無法預測嘅後果。

**AI 對齊（AI Alignment）**：指確保 AI 系統嘅目標同行為同人類嘅意圖一致。呢個係目前 AI 安全研究嘅核心議題之一。

## 前路展望

呢次事件反映咗 AI 業界正喺一個關鍵嘅轉折點。一方面，技術進步帶嚟巨大嘅商業機會同社會效益；另一方面，安全風險同倫理考量都唔容忽視。

Amodei 嘅三步走策略提供咗一個框架，但實際執行仍然面臨諸多挑戰。第三方評估員嘅獨立性同權限如何保證？業界協調會唔會觸犯反壟斷法？同專制政府嘅合作能夠達到咩程度？呢啲問題都需要時間去解答。

對於一般讀者嚟講，最重要嘅係理解 AI 發展並唔係單純嘅技術問題，而係涉及安全、倫理、地緣政治等多個層面嘅複雜議題。保持關注同理性討論，係每個人都可以做嘅事。

## 總結

Anthropic 行政總裁 Dario Amodei 提出嘅減慢 AI 發展速度倡議，獲得 OpenAI 同 SpaceX 高層嘅支持，顯示業界對安全問題嘅共識正在形成。三步走策略涵蓋內部監督、業界協調同全球合作三個層面，但實際執行仍面臨技術、法律同地緣政治等多方面挑戰。呢個發展對香港同亞太區嘅科技業界都有重要啟示，值得持續關注。

無論讀者係科技從業員、投資者定係一般市民，理解呢啲討論嘅核心議題都有助於更好地應對 AI 時代嘅來臨。科技發展嘅方向從來都唔係單純由技術決定，而係由社會嘅選擇同價值觀所塑造。