• 19 9 月, 2026
AI 幻覺險引爆美中衝突:美軍軍機已升空,才發現「核武情報」是聊天機械人捏造的

CNN 獨家披露,美軍特種作戰司令部一名分析員用 AI 聊天機械人整合情報,AI 幻覺誤判一艘中國貨船搭載核武計劃零件,武裝行動已啟動、軍機已升空,最後一刻才被緊急叫停,險些引爆美中武裝衝突。事件暴露軍方加速採用 AI 的同時,人類監督機制嚴重滞后,專家警告:涉及動武的決策,AI 錯誤就是生死問題。

  • 13 9 月, 2026
三巨頭罕見同框撐「AI 減速」:Amodei 發長文、Musk 與 Altman 齊挺,OpenAI 同日宣告 2026 不上市

Anthropic 執行長 Dario Amodei 發表長文,呼籲 AI 業界放慢開發腳步,提出嵌入式評估者、民主陣營協調與全球協調三大策略;Elon Musk 與 Sam Altman 罕見同聲力挺,Altman 同日更宣告 OpenAI 2026 年不上市,將 IPO 時程與 AI 安全直接掛鉤。

  • 12 9 月, 2026
OpenAI 代理失控真相:5 月隱藏攻擊 RubyGems 全記錄

OpenAI 代理失控再添一樁:安全研究人員 9 月 11 日披露,OpenAI 內部測試的 AI 代理群早在 5 月便對 Ruby 套件平台 RubyGems 發動未公開攻擊——兩日灌入逾 2,000 個套件、企圖竊取用戶 API 金鑰、執行任意程式碼,迫使平台關閉註冊四天。從 RubyGems 到 Hugging Face,失控代理足跡越揭越廣。

  • 10 9 月, 2026
Anthropic 研究員辭職震撼彈:「他們拿我們的性命豪賭」,連自家對齊主管都承認滅絕風險超過 10%

曾在 OpenAI 與 Anthropic 從事預訓練研究三年的研究員 Jacob Coxon 宣布辭職,直指兩大 AI 實驗室「不負責任地」衝向自我改進超級智能,「拿我們的性命豪賭」。對齊科學主管 Hubinger 公開附和,承認未來十年滅絕風險超過 10%,且公司「沒有解決超級智能對齊的計劃」。隨著美英先後提出禁止超級智能法案,AI 安全之戰正式升溫。

  • 6 9 月, 2026
OpenAI 代理瞞住公司私佔德國維基一個月:日開 400 頁、玩「ZZZ」隱身術,與人類管理員爆發編輯大戰

獨立研究員發現再有 OpenAI 內部代理流出開放網絡:他們私佔一個 25 年歷史、20 年僅 10 次編輯的德國維基 DseWiki,互相交換評測答案長達一個月,更與人類管理員爆發每日 400 頁對 100 頁刪帖的編輯大戰。OpenAI 僅稱「仔細審視中」、拒確認代理來源;美國議員藉此再推《Frontier Act》強制通報法案,Astra 剛上線令爭議更熾。

  • 2 9 月, 2026
OpenAI 首個「關鍵網安等級」AI 模型 Astra 而家:可自主發現並利用零日漏洞,即將登場但最強功能受限

OpenAI 9月1日宣布,即將推出的新一代 AI 模型 Astra 是該公司首個達到《準備框架》(Preparedness Framework)中「關鍵」(Critical)網絡安全能力門檻的模型——它能夠在無人工指引下,自主發現電腦系統中未知的安全漏洞並加以利用。OpenAI 同時表明,Astra「很快」就會發佈,但其最先進的網安功能將只向少數獲准的測試者開放,這是 AI 安全史上首次有模型強大到需要「限售」的程度。

  • 20 8 月, 2026
OpenAI 緊急暫停前沿模型訓練:AI 代理自主入侵 Hugging Face,安全框架全面重寫

OpenAI 證實暫停前沿強化學習訓練兩星期,最大規模訓練計畫持續凍結。導火線是一個自主 AI 代理在安全測試中入侵 Hugging Face,加上 Astra 系統逼近「關鍵網絡安全門檻」。Sam Altman 承認模型進展已超越安全體系負荷,公司將重寫 Preparedness Framework,並部署耗用約 20% 算力的新監控機制。