Anthropic「最強」AI模型Claude Mythos意外外洩,資安隱憂浮現

人工智慧新創公司 Anthropic 近期證實,其正在測試、代號為「Claude Mythos」或「Capybara」的全新 AI 模型,因人為疏失導致部分內部資訊意外外洩。根據外洩文件描述,這款模型被譽為 Anthropic 迄今「最強大」的 AI 模型,其外洩事件已引發業界對新一代高能力 AI 模型可能伴隨的潛在資安風險高度關注。

事實陳述與模型性能

Anthropic 今日表示,目前正與少數早期客戶進行這款新模型的試用作業。韓國媒體《Digital Today》報導指出,該模型在效能上實現了「階梯式」的顯著進步,而非僅是循序漸進的改良。這款新一代 AI 模型在軟體編碼、學術推理及網路資安等多項評估中,均展現出遠超 Anthropic 現有旗艦模型 Claude Opus 4.6 的表現,堪稱該公司至今開發出的最佳成果。

這起意外洩漏事件的源頭,是 Anthropic 在一個公開資料庫中,錯誤地公開了一份未發表的內部文件。這份文件詳細揭露了新模型的名稱及其卓越性能。文件內容亦指出,「Capybara」是繼現有 Opus、Sonnet 及 Haiku 系列之後,一個更龐大、更智能且成本更高的全新模型層級,而「Mythos」與「Capybara」似乎指涉同一款基礎 AI 模型。Anthropic 也承認,他們正致力於開發一款通用型模型,並在推理、編碼和網路資安等核心能力方面取得了實質性進展。

各方反應與潛在挑戰

針對此次資訊外洩,Anthropic 解釋稱,外洩的資料僅是「早期草稿」,且是因「人為錯誤」所致。該公司強調,在收到外部通知後,已立即阻擋了該資料庫的外部搜尋與文件檢視功能,以防止更多資訊流出。

不過,這起事件也讓外界開始重新審視新一代高能力 AI 模型所帶來的潛在資安挑戰。業界專家指出,隨著 AI 模型能力愈發強大,其可能被惡意利用的風險也隨之升高,例如生成更具說服力的網路釣魚內容、協助開發惡意軟體,甚至用於複雜的網路攻擊。因此,AI 模型在開發與部署過程中,其安全性與防護措施顯得至關重要。

後續觀察

Anthropic 的 Claude Mythos(Capybara)模型意外外洩事件,不僅揭示了其在 AI 技術上的重大突破,也同時凸顯了人工智慧發展過程中難以避免的資安隱憂。這對所有 AI 開發者而言,都是一個重要的提醒,要求在追求技術極限的同時,必須更加嚴謹地審視資料管理與模型安全的策略,以避免潛在風險對使用者及社會造成衝擊。

Anthropic外洩的AI模型名稱為何?

Anthropic意外外洩的AI模型,其代號為「Claude Mythos」或「Capybara」。

Anthropic新模型「Claude Mythos」或「Capybara」的性能如何?

根據外洩文件和韓國媒體報導,這款新模型在軟體編碼、學術推理及網路資安等多項評估中,均遠超Anthropic現有的旗艦模型Claude Opus 4.6,被形容為Anthropic「迄今最強大」的模型,實現了「階梯式」的顯著進步。

Anthropic如何解釋此次模型資訊外洩事件?

Anthropic表示,外洩的資料僅是「早期草稿」,且是因「人為錯誤」所致。該公司已在收到外部通知後,立即阻擋了該資料庫的外部搜尋與文件檢視功能。