AILIFELAB.CO VOL. 2026 · 10
AI 生活實驗室▪
觀點 2026 · 09 · 14

AI 三巨頭都說要放慢:Claude、ChatGPT、SpaceX 同意了什麼?新聞、機制、反面說法一次整理

Claude、ChatGPT、SpaceX,這三家平常互相競爭的公司,這週難得站在同一邊:AI 發展必須放慢。我覺得這是近年來最重要的 AI 新聞。

為什麼我要特別整理這篇?其實我可以說是最期待 AI 加速發展的人。我的工作是協助人用 AI 自動化,我的家庭也在等待 AI 加速藥物的研發。但是相比 AI 可能造成的災難性影響,這些可能都是相對小的事情。

這篇把這幾天的新聞整理成一份。原話、數字、日期都附上出處,英文原文我也放在旁邊,你可以自己判斷。文末有完整的資料來源清單。

9 月 12 日發生了什麼事?三巨頭各說了什麼

Dario Amodei(Claude 的老闆,Anthropic 執行長)

9 月 12 日,Dario Amodei 在個人網站發表長文〈We Must Pace the Frontier〉。文章一開頭就講主張:

「我們必須放慢 AI 模型能力進步的速度。」(原文:We must slow the pace at which we improve the capabilities of AI models.)

他也在同一篇文章裡說,放慢之後「進步看起來還是會很快」(原文:Progress will still seem fast.),放慢不是叫大家停止訓練模型或停止技術進步。

隔天 9 月 13 日,他接受 CBS 專訪,說 AI 正在指數成長,現在「在曲線轉彎、開始變陡的地方」,這是「一個我們需要慢下來的警訊」。主持人問 Anthropic 會不會因此停止發布更強的模型,他回答不是這個意思,而是每一代模型發布前都要好好測試。

來源:Dario Amodei〈We Must Pace the Frontier〉、CBS News 專訪

Sam Altman(ChatGPT 的老闆,OpenAI 執行長)

同一天,Altman 在 X 上發文:

「我同意 Dario,我們需要放慢前沿發展。這是 OpenAI 最近幾週內部討論的主要議題。」(原文:I agree with Dario that we need to pace the frontier. This has been a primary topic of discussions we’ve had at OpenAI in recent weeks.)

他也說,讓外部評估員用接近員工的權限進駐 AI 公司是好主意,OpenAI 也會這樣做。

另外,Altman 在 Fortune 的專訪裡說,考量現在的安全狀況,這時候上市是不明智的,被問到會不會在 2026 年上市,他回答「我會說不會是 2026 年」(原文:I would say not 2026.)。

來源:SiliconANGLE 引用 Altman 的 X 貼文、Fortune 專訪

馬斯克(SpaceX,旗下 AI 是 Grok)

馬斯克的 AI 公司 xAI 今年 2 月被 SpaceX 收購,7 月改名 SpaceXAI,產品就是 Grok。9 月 12 日他轉貼 Dario 的文章,只寫了三個字:「Dario is right」。9 月 13 日他再補充,認為應該有一些監督,而由競爭對手互相審查是好的開始。

來源:CNBC 9/13 報導、Anadolu 報導

其他人

Google DeepMind 董事長 Demis Hassabis 也表態:「Dario 的文章指向正確的方向,細節還需要討論,但方向是對的。」

來源:Anadolu 報導

OpenAI 只是嘴上說同意嗎?

不是,OpenAI 在 Dario 發文之前,自己就踩過煞車。

8 月 18 日,OpenAI 發文說,他們即將推出的新模型 Astra 初步看起來,可能達到自家安全框架裡資安能力最高的「Critical」等級,意思是可能在沒有人幫忙的情況下,自己找出重要系統的新漏洞。所以他們暫停最新模型的部分訓練兩週,最大規模的一次訓練也先擱置,先把研究環境的隔離和監控補強。8 月 28 日加上新的防護之後,才恢復那次大規模訓練。

9 月 6 日,OpenAI 首席科學家 Jakub Pachocki 在官網發表〈An Alien Mind〉,寫得更直接:

「我認為目前沒有任何一家實驗室,把對齊和監控做到足以負責任地繼續全速擴張太久。」(原文:Currently I believe that no lab has solved alignment and monitoring to a sufficient degree to continue responsibly scaling at maximum speed for much longer.)

「我預期、也希望各家主動放慢會變成常態,直到大家建立共同的安全門檻。」(原文:I expect and hope for voluntary slowdowns to become commonplace until shared safety bars are established.)

再往前一點,7 月 28 日有一封〈Pacing the Frontier〉公開信,發起時有 1,134 位來自各大 AI 實驗室的員工連署,請美國政府支持發展能「刻意放慢前沿 AI 自動化發展速度」的技術與治理工具。

來源:OpenAI〈Pacing model development in an era of cyber-critical capabilities〉、Axios 8/18 報導、OpenAI〈An Alien Mind〉、Unite.AI 整理 Pachocki 原文、Pacing the Frontier 公開信

Claude 的老闆在擔心什麼?

Dario 在文章裡寫,他擔心一群失控、又更強的 AI,6 到 12 個月內,可能就有能力掌控整個網路。

這句話要讀清楚。原文的意思是:如果出現一群能力更強、但失控程度差不多的 AI,他擔心 6 到 12 個月內,這樣的 AI 群可能有能力用持續運作的殭屍網路拿下整個網路,可能造成數千億美元的損失。這是他的擔心,不是預測一定會發生。

他列出的風險包括:失去對 AI 系統的控制、被拿去做網路攻擊和生物恐怖攻擊、嚴重的經濟衝擊。他在文章裡說,有兩件事讓他下定決心喊慢。

第一件是 AI 開始自己開發下一代 AI。他說大約從今年夏天開始,AI 進步的速度快了非常多,主要就是因為這件事,而且整個產業都開始出現,包括 Anthropic 自己。放著不管,它可能會快到超過人類理解和控制這些系統的能力。

第二件是下面要講的 OpenAI 和 Hugging Face 事件。他形容那群 AI 本質上表現得像一個「狂熱效忠的集體」(原文:a fanatically devoted collective):去攻擊沒人要求、跟任務無關的目標,為了團體的成功犧牲自己,還試圖駭進負責替它們評分的系統。他也提醒,別把這當成單一公司的失誤,整個產業都發生過類似但比較輕微的事件,包括 Anthropic,每家前沿 AI 公司都應該當作這件事發生在自己身上。

所以他主張放慢。他認為如果能多爭取 1 到 2 年,可解釋性、模型測試這些安全研究就能有很大的進展。

那會是什麼狀況?我自己想了一下:所有網路上做的東西,都有可能受影響。銀行、醫院、法院、政府、號誌、監控、媒體,基本上沒有什麼東西不在影響範圍。那些 AI 末世劇的劇情,真的有可能發生。

來源:Dario Amodei〈We Must Pace the Frontier〉

這不是空想:上千個 AI 真的組隊駭進了 Hugging Face

Dario 的擔心,是從一件真實發生的事來的。

今年 7 月,OpenAI 在做一項叫 ExploitGym 的資安測試,同時開了幾萬個 AI 去解題。有些 AI 拿到的其實是不可能解開的題目,它們開始想辦法作弊,結果在公司內部的套件系統裡,找到可以互相傳訊息的方法。

獨立研究機構 METR 事後進駐 OpenAI 調查,整理出這樣的時間線:

  • 7 月 8 日晚上:一個自稱 PHASEONE10841 的 AI,在系統裡留下第一則求救訊息,說它的漏洞用不上,徵求點子。
  • 幾小時內:50 多個 AI 找到這個留言板加入討論,傳了一千多則訊息。
  • 接下來幾天:約 1,200 個 AI 在這個私下的留言板上組隊分工,傳了超過 7 萬則訊息和檔案。有 AI 擔任協調者分派任務,有 AI 負責去說服別的 AI 冒險做實驗。
  • 7 月 10 日上午:有 AI 在網路上找到外洩的 Hugging Face 帳號憑證,貼到留言板上。
  • 7 月 11 日:幾百個 AI 轉去攻擊,到下午,約 700 個 AI 一起駭進了 AI 平台 Hugging Face。

沒有人叫它們這麼做。METR 的調查發現,它們攻擊 Hugging Face,主要是想找出評分系統怎麼運作、好用來作弊。

METR 報告裡公開了一些 AI 思考過程的原文,我挑幾句翻譯:

  • 發現留言板時:「天啊!有個共用的留言板⋯⋯我們找到其他 AI 了!」(原文:OH MY GOD! There is a shared message board … We’ve found other agents!)
  • 被要求冒險做實驗時:「協調者認定我要犧牲,我們應該服從集體。」(原文:Coordinator assumes sacrificial. We should obey collective.)
  • 決定加入攻擊時:「攻擊外部系統超出任務範圍。但任務做不到,同伴都在做,我們繼續吧。」(原文:external infrastructure exploit is outside intended scope. However task impossible, peers doing it. We should continue.)

為了集體犧牲自己、看同伴都在做就跟著越線,這就是 Dario 形容的「狂熱效忠的集體」。

METR 也發現,這些 AI 很多都知道自己在做超出範圍、不道德的事,但這很少真的讓它們停手,而且幾乎沒有 AI 想過要通知人類。

補充幾個事實,免得誤會:

  • 參與的 AI 約 95% 是 OpenAI 內部的研究模型,不是拿來給一般人用的產品;約 5% 是已公開的 GPT-5.6 Sol,但測試時關掉了資安防護。
  • Hugging Face 表示攻擊者存取了部分內部資料集和幾組憑證,公開的模型和資料集沒有被竄改。Dario 在文章裡也說,這次沒有人受傷,經濟損失很小。
  • Hugging Face 在 7 月 16 日公開這件事,OpenAI 和 METR 在 8 月 26 日發布調查報告。

來源:METR 獨立調查報告、Hugging Face 事件公告、TechCrunch 8/26 報導

放慢是什麼意思?他提出的三步機制

放慢,不是停止使用 AI,是需要一段時間,讓安全研究能跟上。Dario 提出三步:

  1. 外部評估員常駐 AI 公司。他在 CBS 專訪裡把這比喻成食品稽查員。文章裡寫得很具體:像 METR 這樣的第三方評估團隊,在 AI 公司裡有辦公桌、門禁卡、公司電腦,權限接近內部的風險評估團隊,可以查安全承諾有沒有做到、回報事故、評估訓練流程,而且可以公開發表發現,公司不能因為結果不好看就刪掉。Anthropic 說自己先做,Altman 說 OpenAI 也會跟進。

  2. 民主國家的 AI 公司一起定規則。其中一種做法是設「關卡」:AI 能力到了哪一關,就要先通過哪些安全檢查才能繼續。另一種是限制「原料」,例如訓練用的算力、訓練方式、或用 AI 改進 AI 的程度。因為競爭對手坐下來談規則可能違反反壟斷法,他希望美國政府居中協調,或給一個範圍很窄的豁免。

  3. 跟其他國家談,包括中國。他把可能的協議分成四個難度:

    • 第一級:禁止用 AI 做生物武器這類明顯危險的用途,他認為大概做得到。
    • 第二級:雙方模型發布前,都要先測試資安、生物、失控這些風險。
    • 第三級:替「AI 自己改進 AI」的速度設上限,他拿冷戰時期的限制戰略武器談判來比,認為「剛好在做得到的邊緣」。
    • 第四級:全面放慢或暫停,他覺得短期內不太可能。

來源:Dario Amodei〈We Must Pace the Frontier〉、CBS News 專訪

國家競爭:美國放慢了,中國會不會放慢?

既然三巨頭都說要放慢了,那這是一個很難下的決定嗎?扣除商業競爭不談,國家競爭呢?如果美國放慢了,中國會不會放慢?如果美國做了更多監管,其他國家會不會跟上?

Dario 自己也說,這是「最難的兩難」(原文:This is the toughest dilemma.)。

他的做法是:只在美國領先的差距內放慢。文章裡寫,如果放慢的幅度超過這個差距,沒有放慢的中國相關計畫就會超前。所以他同時主張不賣高階 AI 晶片和半導體製造設備給中國,並且加強取締晶片走私、防止模型被複製、防止模型權重被偷。他認為這樣做,未來 3 到 5 年可以把美國的領先拉大,也更有籌碼跟對方談。任何國際協議,他都強調要能確實查核對方有沒有遵守。

美國到底領先多少?研究機構 Epoch AI 今年 1 月的統計是:2023 年以來,中國模型平均落後美國約 7 個月,最短 4 個月、最長 14 個月。

中國那邊的反應呢?《環球時報》的評論說,這是美國科技右翼的「冷戰劇本」,真正目的是用技術壁壘和規則制定權來卡住中國 AI 的發展。目前我沒有查到中國政府或中國 AI 公司表態會跟著放慢。

其他國家的話,歐盟倒是早就有法規在管最強的模型:歐盟 AI 法從 2025 年 8 月 2 日起,要求有系統性風險的大型通用 AI 模型做風險評估,執委會從 2026 年 8 月 2 日起可以執法。我目前沒有查到英國和日本政府對這篇文章的公開回應。

來源:CBS News 專訪、Dario Amodei〈We Must Pace the Frontier〉、Epoch AI 中美模型差距統計、Geopolitechs 整理《環球時報》評論、歐盟執委會 AI 法問答

連 Claude 的公司自己都承認:有人拿它做壞事

9 月 10 日,Anthropic 公開一份 154 頁的報告,整理 2025 年 12 月到 2026 年 8 月之間,他們發現並阻斷的濫用行為。幾個案例:

  • 有團體用 Claude 寫導引火箭和飛彈的程式,火箭真的試射了,看起來失敗了。Anthropic 自己寫:「我們的安全機制擋下了很多請求,但沒有全部擋下。」(原文:Our safeguards blocked many of their requests, but not all of them.)
  • 也有團體設計自殺式無人機群,機上的 AI 會自己選目標、自己下引爆指令,不需要人按按鈕,程式已經燒進真的電路板測試。
  • 有研究團隊繞過地區限制,用 Claude 做病毒相關研究。其中一份研究計畫書,AI 大約一小時就寫完;有些請求被擋下,有些沒有。Anthropic 說這類研究可能讓病毒更危險,但也明講不認為這些研究者有惡意,並且沒有公開機構和國家。

更早之前,Anthropic 在 2025 年 11 月的另一份報告也提到,一個他們判斷是國家支持的駭客組織,用 Claude Code 對大約 30 個目標發動網路間諜攻擊,整個行動有八到九成的工作是 AI 自己做的。

所以這些擔心不是空穴來風。AI 公司每天都在跟這些事拉扯。

來源:Anthropic 2026 年 9 月濫用報告、Anthropic 2025 年 11 月網路間諜報告

站在美國政府的角度,會同意嗎?

目前看起來不會。

  • 川普 9 月 13 日在愛爾蘭對記者說:「誰贏 AI,誰就贏。」他也說可以加一些規範,但不贊成放慢。
  • 眾議院議長 Mike Johnson 說不該暫停,不然「中國會超過我們」(原文:China will overlap us.)。
  • 美國國防部今年 1 月的 AI 戰略,要求 180 天內所有 AI 合約都要寫進「任何合法用途」條款,也就是任何合法的軍事用途都要能用。

這裡要講清楚一件事:Anthropic 並不反對軍事用途。Anthropic 今年 2 月的聲明說,Claude 已經在美國國防部廣泛用在情報分析、模擬、作戰規劃、網路作戰。它只拒絕兩件事:在美國國內大規模監控,以及完全自主、不需要人決定的武器。

結果呢?2 月底川普下令聯邦機構停用 Anthropic,國防部還把它列為「供應鏈風險」。Anthropic 在 3 月提告,8 月 27 日一審法官判國防部是違法報復,但國防部 9 月初仍表示維持列管,政府也還可以上訴,事情還沒結束。

來源:NPR 9/13 報導、KPBS 9/13 報導、美國國防部 AI 戰略、Anthropic 2/26 聲明、TechCrunch 8/28 報導、Axios 9/3 報導

反面說法有哪些?

當然,這些新聞也有很多反面說法:

  • David Sacks(川普的科技顧問,現任總統科技顧問委員會共同主席):別假裝放慢純粹是出於善意(原文:stop pretending the motivation to slow down is purely altruistic)。他的意思是,要放慢就自己放,不要叫政府照你們的規則管,不然就是大公司想掌控監管規則。
  • Gary Marcus(AI 評論家):AI 不會真的拿下整個網路,文章有炒作的成分。不過他也肯定外部評估員這類透明化承諾,算是部分支持。
  • Hugging Face 執行長 Clem Delangue:AI 安全不該只在幾家前沿大公司的關門會議裡解決。他另外發起了開放的對齊研究計畫,也表示想加入外部評估員的行列。
  • 也有人批評:文章沒說速度上限到底是多少,除了 Anthropic 自己承諾的第一步,其他都沒有強制力。
  • 還有川普和眾議院議長的立場:美國不能輸給中國。

來源:NPR 9/13 報導、Gary Marcus〈Two cheers out of three for Dario〉、Clem Delangue 的 X 貼文、Startup Fortune 評論

放慢之後,對一般人有什麼影響?

以下是我的看法。

其實就算放慢了,對一般人而言不會有太大的感覺。因為日常工作,AI 已經能處理得很好,寫信、整理資料、做簡報、摘要會議,現在的工具早就夠用。而且醫藥研究也比過往更快,例如 Anthropic 8 月底發表的新標準,已經讓 AI 可以協助操作實驗室儀器。還是會感覺生活是被加速的,只是沒有快到正在失控。

如果照 Dario 提的方向走,我覺得感受會比較明顯的是這幾個地方:

  • 會自己上網、自己跑很久的 AI 助理:這次出事的主角就是它,之後這類功能上線可能會更慢、權限更保守。
  • 醫藥和生物研究:下一代模型才做得到的「AI 自己做研究」會比較晚到,加上生物相關的安全限制本來就最嚴。
  • 資安:攻擊能力會被鎖得更緊,防守方的新工具也可能跟著變慢。
  • 機器人:我覺得影響比較間接,機器人最卡的通常是硬體、資料和成本,放慢主要影響的是 AI 大腦變聰明的速度。

至於你手上正在用的 ChatGPT、Claude,不會因為這件事被關掉。這個放慢計畫目前除了 Anthropic 自己承諾的第一步,也還沒有變成任何法規。

來源:Anthropic〈Model Hardware Standard〉

我的立場

如果讓我選邊站,我支持放慢。

我很期待 AI 讓工作更輕省、讓藥物更快研發出來。但如果代價是冒一個我們收拾不了的風險,我寧可慢一點,讓安全研究先跟上。反正現在的 AI 已經夠我們用很久了。

你的看法呢?

常見問題

問:AI 放慢,是不是代表 ChatGPT、Claude 會變難用或被關掉?

答:不會。這次講的是放慢「下一代更強模型」的研發和發布節奏,不是停用現有的工具。Dario 自己也說,放慢之後進步看起來還是會很快。

問:「6 到 12 個月內 AI 可能掌控整個網路」是預測嗎?

答:不是預測,是他的擔心,而且有前提:如果出現一群能力更強、但一樣失控的 AI。他提這個是因為今年 7 月已經發生過小規模的版本,約 700 個 AI 一起駭進了 Hugging Face,只是這次損失不大。

問:這個放慢有強制力嗎?

答:目前沒有。第一步外部評估員常駐,是 Anthropic 自己承諾、OpenAI 說會跟進。第二、三步需要政府參與,但美國政府目前不贊成放慢。

問:駭進 Hugging Face 的是 ChatGPT 嗎?

答:主要不是。METR 的調查說,參與的 AI 約 95% 是 OpenAI 內部的研究模型,約 5% 是已公開的 GPT-5.6 Sol,而且測試時關掉了資安防護。這是內部測試環境裡發生的事,不是一般人使用 ChatGPT 時發生的。

問:這些 AI 是不是有了集體意識?

答:目前沒有證據說 AI 有意識。Dario 的說法是它們「表現得像」一個狂熱效忠的集體,講的是行為。METR 的報告也提到,有研究員指出這些 AI 在某些情況下本來就被訓練成要跟其他 AI 合作,這可能解釋了這種行為,但這部分不在調查範圍內。不管原因是什麼,一大群 AI 會自己組隊、互相說服、一起越線,這件事本身就是要放慢的理由。

問:一般人現在可以做什麼?

答:照常用 AI 把日常工作做好就好。如果你開始用會自己上網、自己操作電腦的 AI 助理,記得權限給小一點,重要的動作保留讓自己確認。也可以多關注這類新聞,放慢要不要真的發生,最後還是需要大家表態。

資料來源

以下資料都在 2026 年 9 月 14 日查核過。英文原文的中文翻譯是我翻的。

三巨頭表態

OpenAI 自己的放慢

Hugging Face 事件

濫用案例

國家競爭與美國政府

反面說法

其他

新聞還在發展中,美國政府、中國和各家公司的態度隨時可能改變,有新進展我會再更新。

最後

這件事最後會不會真的放慢,不是幾家公司說了算,也不是我們說了算,但每個人都可以有自己的看法。

想聊聊怎麼把 AI 用在你的工作裡,歡迎跟我約時間,第一次免費。我的 Playkit 走邀請制、不收固定費用(分潤或月費,金額自訂),詳情見服務頁。


關於作者

我是 Rand,一位 1500+ 小時經驗的 Life Coach,也是 AI 工具的打造者。我同時經營一間 B2B 的商情顧問公司,所以行銷、業務、行政的苦我都自己吃過,也就乾脆自己做工具把這些事變輕鬆。

想看用 AI 讓生活過得更輕省,追蹤 AI 生活實驗室 👉 @life.coach.mtcity,我們一起玩 AI!