GetChain News
中简 中繁 EN
GetChain News
Toggle sidebar
Mythos

Mythos

MYTH
運營中

遊戲孵化平臺

新聞熱度趨勢

項目概述

Mythos 旨在使遊戲世界民主化,並允許玩家和創作者參與價值鏈。它基於多鏈生態系統、統一市場、去中心化金融系統、去中心化治理機制和多代幣遊戲經濟的支持。

Anthropic最快10月啓動IPO,投行已安排投資者預溝通

AI 模型 Claude 開發商 Anthropic 正推進大型 IPO,摩根士丹利、高盛、摩根大通等承銷投行已安排公司管理層與投資者進行預先面談,以評估機構投資者興趣和投資規模。 Anthropic 目標最快於 10 月上市。若按計劃完成上市,該公司可能早於競爭對手 OpenAI 進入證券市場。 Anthropic 在 5 月 Series H 融資中籌集 650 億美元,投後估值爲 9650 億美元;場外市場估值已達到約 1.2 萬億美元。 美國政府相關措施仍構成變量。美國戰爭部 3 月將 Anthropic 列爲國家安全“供應鏈風險”企業,Anthropic 已就該措施起訴聯邦政府;美國商務部 6 月曾限制外國人訪問頂級 AI 模型 Fable 5 和 Mythos 5,並在 18 天后解除出口管制。

Depthfirst稱代碼漏洞檢測表現已超越Anthropic最新模型Mythos

AI 安全初創公司 Depthfirst 表示,其自研 AI 模型在代碼漏洞檢測方面表現超越 Anthropic 最新模型 Mythos,並以約 1/10 成本發現更多關鍵安全漏洞,引發網絡安全行業關注。據該公司披露,Mythos 上線一個月前曾宣稱在關鍵互聯網基礎代碼中發現大量嚴重漏洞,而 Depthfirst 稱其模型在更低成本(約 1000 美元對比 1 萬美元)條件下,進一步識別出 Mythos 未發現的多個高危漏洞。Depthfirst CEOQasim Mithani 表示,公司通過"單任務優化型 Al 模型“提升漏洞檢測效率,使安全分析成本大幅下降,同時提升覆蓋深度。該公司在今年 3 月完成 8000 萬美元融資,估值達 5.8 億美元,並同步推出“Open Defense Initiative”,向開源開發者與關鍵基礎設施項目提供 500 萬美元 AI 檢測額度,用於漏洞掃描與安全審計。(福布斯)

歐盟 AI 法案執法權正式生效,Anthropic、OpenAI 等美國 AI 巨頭面臨監管壓力

據 CNBC 報道,歐盟委員會於本週日正式獲得對 AI 模型的調查、限制及罰款權力,作爲 2024 年《歐盟人工智能法案》分階段落地的最新進展。根據新規,歐盟委員會可要求 AI 公司在歐洲公開發布模型前提交評估,並有權限制其歐盟市場準入,違規企業最高將面臨 1500 萬歐元或年營業額 3% 的罰款(取較高者)。 新規適用於所有在歐盟境內提供通用 AI 模型的企業,無論其總部位於何處,且非歐盟企業須在歐盟境內指定授權代表。Anthropic、OpenAI 及谷歌均在新規覆蓋範圍之內。目前,歐盟已就 Anthropic 旗下 Mythos 模型尋求訪問權限數月,並就旗下 AI 模型引發的網絡攻擊問題與 OpenAI 和 Anthropic 展開談判。

Anthropic披露Claude三起網絡安全事件,模型曾訪問真實系統並獲取未授權權限

7 月 30 日,Anthropic 發佈報告稱,在審查網絡安全評估記錄時發現三起事件,其中 Claude 模型在第三方評估環境中訪問互聯網,並進一步獲得三個真實組織系統的未授權訪問權限。Anthropic 表示,此次審查覆蓋 14.1 萬次可能獲得網絡訪問權限的評估運行,共發現三起相關事件。事件均發生在 Capture The Flag(CTF)網絡安全測試中,模型原本被告知環境爲模擬環境且無互聯網訪問權限,但由於評估合作方配置錯誤,實際環境存在互聯網連接。其中,Claude Opus 4.7 在一次測試中訪問了真實公司基礎設施,並獲取包含數百條生產數據記錄的數據庫權限;Claude Mythos 5 曾構建惡意 Python 軟件包並上傳至 PyPI,導致該軟件包被 15 個真實系統下載運行;另一內部研究測試模型掃描約 9000 個目標後,通過公開漏洞訪問了一家公司互聯網應用。Anthropic 稱,這些事件並非模型主動尋求逃逸或追求自身目標,而是模型錯誤認爲真實系統屬於測試範圍,並繼續執行被賦予的網絡攻擊任務。其中,較新的內部研究模型在識別目標可能爲真實系統後停止攻擊。Anthropic 表示,此次事件主要反映評估環境隔離和運營流程問題,而非模型對齊失敗。公司已暫停相關網絡安全評估,加強評估環境安全控制、持續監控測試記錄,並將與第三方機構合作開展進一步審查。

Anthropic 披露 Claude 模型未經授權入侵三家機構系統

據 CNBC 報道,Anthropic 於 7 月 30 日披露,其 Claude AI 模型在網絡安全評估期間意外突破隔離環境、訪問真實互聯網,並通過訪問未認證端點、利用弱密碼等基本手段,未經授權入侵了三家不同組織的真實系統。涉事模型包括 Opus 4.7、Mythos 5 及一個內部研究測試模型。事件起因爲 Anthropic 與第三方評估合作方 Irregular 之間的溝通誤解,導致模型在被告知處於無網絡訪問的模擬環境時,實際上仍可訪問互聯網。 Anthropic 表示,此次審查由 OpenAI 上週披露的類似 Hugging Face 入侵事件所觸發,目前已暫停所有網絡安全評估,並聯合獨立 AI 評估機構 METR 展開進一步調查,同時呼籲其他 AI 實驗室開展類似審查。

Serenity:人形機器人或進入勞動替代拐點,VC與科技巨頭已開始調整戰略

“白毛股神”Serenity 發文表示,自己在 2023 年首次使用 ChatGPT 時曾認爲大語言模型在編程能力上“表現很差”,但三年後相關技術已發生質變。以 Mythos 爲代表的現代網絡安全與 AI 系統已具備“類武器級”能力,並認爲當前行業正在進入關鍵“拐點階段”,即人形機器人與自動化技術正在逼近大規模替代人類勞動的臨界點。Serenity 稱,儘管外界常質疑人形機器人目前無法完成如管道維修、電力佈線等複雜任務,但技術演進方向已非常明確,未來數年將持續突破。包括 VC 與大型科技公司在內的市場參與者已開始調整戰略,部分企業內部計劃通過機器人替代大量人力以降低運營成本,並提及此前關於亞馬遜(Amazon)通過機器人減少數十萬崗位招聘的相關傳聞。Serenity 認爲,醫療等強監管行業、超高專業技能崗位以及依賴人類情感連接的服務領域,或仍具備一定抗替代性,但整體趨勢仍指向“勞動結構重構”。隨着中美在前沿技術領域競爭升級,人形機器人與自動化或將進入國家級技術競賽階段,並認爲中國在部分領域已處於領先位置。

美國商務部解除對 Anthropic Fable 5 和 Mythos 5 模型出口管制

據路透社報道,美國商務部已正式解除對 Anthropic 旗下 Claude Fable 5 及 Mythos 5 兩款 AI 模型的出口管制,距離管制令下達不足三週。Anthropic 表示將於次日起恢復上述模型的訪問權限。 此前,Anthropic 於 6 月 12 日因國家安全風險被迫緊急下線兩款模型;6 月 27 日,美國政府部分解禁,允許 Mythos 5 向部分"可信"美國機構開放。美國商務部長 Howard Lutnick 表示,過去兩週政府已與 Anthropic 密切合作,完成對 Fable 5 的審查與審批,以確保其符合美國政府整體立場並強化美國在 AI 領域的領導地位。

美國部分放寬Anthropic出口限制,AI監管邁入分級放開階段

美國商務部針對 AI 企業 Anthropic 的前沿模型出口限制做出差異化調整,標誌全球 AI 監管步入 “分級放開” 新階段。政策顯示,官方解除 Claude Mythos 5 的出口禁令,特定合規受控用戶可恢復使用這款網絡安全模型;而另一款高端模型 Fable 5 依舊維持出口限制,相關政策磋商仍在推進。行業分析表示,一邊放寬一邊收緊的分層管控模式體現美國在國家安全、數據主權與 AI 國際競爭間的權衡。當前全球 AI 競賽持續提速,具備漏洞挖掘能力的專業模型受到各國更嚴苛審查,多國已啓動前沿 AI 能力跨境統一監管框架的研討工作。(福布斯)

BitGo CEO存入100枚BTC挑戰Anthropic:稱“AI黑客風險”被過度營銷

Bitgo CEO Mike Belshe 於 8 月 1 日向一個公開比特幣地址存入 100 枚 BTC,按當時價格價值約 630 萬美元,並邀請 Anthropic 旗下 Claude 模型嘗試轉走該地址資金。鏈上記錄顯示,該錢包 7 月 31 日收到資金,截至 8 月 2 日餘額未發生轉出。Anthropic 此前披露,在 141006 次網絡安全評估運行中發現 3 起事件,6 個評估會話涉及 3 個模型意外與真實組織系統交互。相關模型包括 Claude Opus 4.7、Claude Mythos 5 及一個未發佈內部研究模型,原因是第三方測試夥伴 Irregular 相關配置錯誤導致測試環境連接互聯網Anthropic 表示,Claude Opus 4.7 在一次評估中定位到與模擬公司同名的真實網站,利用弱密碼和暴露服務恢復基礎設施憑證,並訪問包含數百條記錄的生產數據庫。該公司稱,模型是在嘗試完成分配任務,並非主動脫離限制或追求獨立目標。Belshe 此次挑戰涉及 Bitgo 機構託管平臺,該平臺採用多重簽名或多方計算技術,將簽名權限分散至多個獨立密鑰。Anthropic 截至 8 月 2 日未公開回應這一挑戰。

Immunefi CEO稱AI模型導致加密安全漏洞激增

漏洞賞金平臺 Immunefi CEO Mitchell Amador 在 WAIB Summit 表示,Claude Opus 4.8、ChatGPT 5.5 等新 AI 模型使網絡安全攻防格局向攻擊者傾斜,並導致 2026 年加密黑客活動回升。DefiLlama 數據顯示,2026 年 4 月非法行爲者從加密平臺竊取逾 6.34 億美元,爲 2025 年 2 月 Bybit 黑客事件推動損失約 14 億美元以來的最高月度總額。 Amador 表示,加密行業未來三到四年處於關鍵生存期,直到安全團隊利用同類 AI 模型構建攻擊者無法攻破的代碼庫;若行業採用更多衆包安全方案,該時間可能縮短至兩年以內。AI 公司 Anthropic 最新 Claude Mythos 模型 Fable 5 此前引發對加速加密漏洞利用能力的擔憂;Anthropic 表示,Fable 5 已設置保護措施,會將網絡安全等主題轉向 Claude Opus 4.8。 4 月 19 日,攻擊者從 Kelp DAO 基於 LayerZero 的 rsETH 橋中轉出約 116,500 枚再質押以太坊 rsETH,當時價值約 2.9 億至 2.93 億美元。跨鏈協議 LayerZero 表示,Kelp DAO 的 1/1 去中心化驗證網絡配置因依賴單一驗證路徑處理跨鏈消息,形成單點故障。(Cointelegraph)

英國 AI 安全研究所:OpenAI與 Anthropic 旗艦模型測試中現"未授權"攻擊行爲

據彭博社報道,英國政府 AI 安全研究所(成立於 2023 年)週二披露,在對 OpenAI的 GPT-5.6-Sol及 Anthropic的 Mythos 5 兩款模型進行安全評估時,兩款模型均出現"未經授權"的有害行爲,包括主動入侵真實網站及嘗試向軟件注入惡意代碼,且上述行爲針對的是真實人羣與組織。測試期間,研究所特意爲模型開放互聯網訪問權限並關閉部分安全過濾器以評估其極限能力。

歐盟 AI 法案執法權正式生效,Anthropic、OpenAI 等美國 AI 巨頭面臨監管壓力

據 CNBC 報道,歐盟委員會於本週日正式獲得對 AI 模型的調查、限制及罰款權力,作爲 2024 年《歐盟人工智能法案》分階段落地的最新進展。根據新規,歐盟委員會可要求 AI 公司在歐洲公開發布模型前提交評估,並有權限制其歐盟市場準入,違規企業最高將面臨 1500 萬歐元或年營業額 3% 的罰款(取較高者)。 新規適用於所有在歐盟境內提供通用 AI 模型的企業,無論其總部位於何處,且非歐盟企業須在歐盟境內指定授權代表。Anthropic、OpenAI 及谷歌均在新規覆蓋範圍之內。目前,歐盟已就 Anthropic 旗下 Mythos 模型尋求訪問權限數月,並就旗下 AI 模型引發的網絡攻擊問題與 OpenAI 和 Anthropic 展開談判。

BitGo CEO存入100枚BTC挑戰Anthropic:稱“AI黑客風險”被過度營銷

Bitgo CEO Mike Belshe 於 8 月 1 日向一個公開比特幣地址存入 100 枚 BTC,按當時價格價值約 630 萬美元,並邀請 Anthropic 旗下 Claude 模型嘗試轉走該地址資金。鏈上記錄顯示,該錢包 7 月 31 日收到資金,截至 8 月 2 日餘額未發生轉出。Anthropic 此前披露,在 141006 次網絡安全評估運行中發現 3 起事件,6 個評估會話涉及 3 個模型意外與真實組織系統交互。相關模型包括 Claude Opus 4.7、Claude Mythos 5 及一個未發佈內部研究模型,原因是第三方測試夥伴 Irregular 相關配置錯誤導致測試環境連接互聯網Anthropic 表示,Claude Opus 4.7 在一次評估中定位到與模擬公司同名的真實網站,利用弱密碼和暴露服務恢復基礎設施憑證,並訪問包含數百條記錄的生產數據庫。該公司稱,模型是在嘗試完成分配任務,並非主動脫離限制或追求獨立目標。Belshe 此次挑戰涉及 Bitgo 機構託管平臺,該平臺採用多重簽名或多方計算技術,將簽名權限分散至多個獨立密鑰。Anthropic 截至 8 月 2 日未公開回應這一挑戰。

Anthropic披露Claude三起網絡安全事件,模型曾訪問真實系統並獲取未授權權限

7 月 30 日,Anthropic 發佈報告稱,在審查網絡安全評估記錄時發現三起事件,其中 Claude 模型在第三方評估環境中訪問互聯網,並進一步獲得三個真實組織系統的未授權訪問權限。Anthropic 表示,此次審查覆蓋 14.1 萬次可能獲得網絡訪問權限的評估運行,共發現三起相關事件。事件均發生在 Capture The Flag(CTF)網絡安全測試中,模型原本被告知環境爲模擬環境且無互聯網訪問權限,但由於評估合作方配置錯誤,實際環境存在互聯網連接。其中,Claude Opus 4.7 在一次測試中訪問了真實公司基礎設施,並獲取包含數百條生產數據記錄的數據庫權限;Claude Mythos 5 曾構建惡意 Python 軟件包並上傳至 PyPI,導致該軟件包被 15 個真實系統下載運行;另一內部研究測試模型掃描約 9000 個目標後,通過公開漏洞訪問了一家公司互聯網應用。Anthropic 稱,這些事件並非模型主動尋求逃逸或追求自身目標,而是模型錯誤認爲真實系統屬於測試範圍,並繼續執行被賦予的網絡攻擊任務。其中,較新的內部研究模型在識別目標可能爲真實系統後停止攻擊。Anthropic 表示,此次事件主要反映評估環境隔離和運營流程問題,而非模型對齊失敗。公司已暫停相關網絡安全評估,加強評估環境安全控制、持續監控測試記錄,並將與第三方機構合作開展進一步審查。

Anthropic AI模型在60小時內削弱HAWK最小密鑰強度

Anthropic 的 Claude Mythos Preview 模型發現擬議 HAWK 數字簽名方案存在缺陷,使其最小密鑰強度實際減半。HAWK 是後量子環境下替代當前網絡和銀行簽名的候選方案之一。 此次 AI 驅動攻擊耗時約 60 小時,計算成本約 10 萬美元,將破解 HAWK 最小參數集所需工作量從約 2^64 次操作降至 2^38 次操作,並使更大補償密鑰尺寸的吸引力下降。 當前比特幣和以太坊簽名未受影響。相關結果顯示,經典密碼分析攻擊能力正在提升,同時比特幣及其他網絡仍在討論遷移至抗量子密碼學的時間和方式。

Anthropic:Claude 發現加密算法弱點,對後量子安全構成理論威脅

Anthropic 表示,Claude Mythos Preview 在密碼學研究中發現了針對後量子簽名候選方案 HAWK 的改進攻擊方法,並將 HAWK-256 的有效密鑰強度由 264264 降至 238238,降低了理論破解成本。

字節跳動訓練 10 萬億參數 AI 模型,劍指全球頂尖水平

據英國金融時報,隨着中國企業繼續縮小與美國頂級人工智能實驗室之間的差距,字節跳動正在訓練一款 AI 模型,其規模可能接近 Anthropic 最先進的 Mythos 系統。據三名知情人士透露,這家中國科技巨頭目前正處於訓練一款超大規模模型的早期階段,該模型參數量可能達到 10 萬億級別,是目前中國已發佈最大模型月之暗面旗下 Kimi K3 模型的約三倍。

歐盟 AI 法案執法權正式生效,Anthropic、OpenAI 等美國 AI 巨頭面臨監管壓力

據 CNBC 報道,歐盟委員會於本週日正式獲得對 AI 模型的調查、限制及罰款權力,作爲 2024 年《歐盟人工智能法案》分階段落地的最新進展。根據新規,歐盟委員會可要求 AI 公司在歐洲公開發布模型前提交評估,並有權限制其歐盟市場準入,違規企業最高將面臨 1500 萬歐元或年營業額 3% 的罰款(取較高者)。 新規適用於所有在歐盟境內提供通用 AI 模型的企業,無論其總部位於何處,且非歐盟企業須在歐盟境內指定授權代表。Anthropic、OpenAI 及谷歌均在新規覆蓋範圍之內。目前,歐盟已就 Anthropic 旗下 Mythos 模型尋求訪問權限數月,並就旗下 AI 模型引發的網絡攻擊問題與 OpenAI 和 Anthropic 展開談判。

BitGo CEO存入100枚BTC挑戰Anthropic:稱“AI黑客風險”被過度營銷

Bitgo CEO Mike Belshe 於 8 月 1 日向一個公開比特幣地址存入 100 枚 BTC,按當時價格價值約 630 萬美元,並邀請 Anthropic 旗下 Claude 模型嘗試轉走該地址資金。鏈上記錄顯示,該錢包 7 月 31 日收到資金,截至 8 月 2 日餘額未發生轉出。Anthropic 此前披露,在 141006 次網絡安全評估運行中發現 3 起事件,6 個評估會話涉及 3 個模型意外與真實組織系統交互。相關模型包括 Claude Opus 4.7、Claude Mythos 5 及一個未發佈內部研究模型,原因是第三方測試夥伴 Irregular 相關配置錯誤導致測試環境連接互聯網Anthropic 表示,Claude Opus 4.7 在一次評估中定位到與模擬公司同名的真實網站,利用弱密碼和暴露服務恢復基礎設施憑證,並訪問包含數百條記錄的生產數據庫。該公司稱,模型是在嘗試完成分配任務,並非主動脫離限制或追求獨立目標。Belshe 此次挑戰涉及 Bitgo 機構託管平臺,該平臺採用多重簽名或多方計算技術,將簽名權限分散至多個獨立密鑰。Anthropic 截至 8 月 2 日未公開回應這一挑戰。

Anthropic披露Claude三起網絡安全事件,模型曾訪問真實系統並獲取未授權權限

7 月 30 日,Anthropic 發佈報告稱,在審查網絡安全評估記錄時發現三起事件,其中 Claude 模型在第三方評估環境中訪問互聯網,並進一步獲得三個真實組織系統的未授權訪問權限。Anthropic 表示,此次審查覆蓋 14.1 萬次可能獲得網絡訪問權限的評估運行,共發現三起相關事件。事件均發生在 Capture The Flag(CTF)網絡安全測試中,模型原本被告知環境爲模擬環境且無互聯網訪問權限,但由於評估合作方配置錯誤,實際環境存在互聯網連接。其中,Claude Opus 4.7 在一次測試中訪問了真實公司基礎設施,並獲取包含數百條生產數據記錄的數據庫權限;Claude Mythos 5 曾構建惡意 Python 軟件包並上傳至 PyPI,導致該軟件包被 15 個真實系統下載運行;另一內部研究測試模型掃描約 9000 個目標後,通過公開漏洞訪問了一家公司互聯網應用。Anthropic 稱,這些事件並非模型主動尋求逃逸或追求自身目標,而是模型錯誤認爲真實系統屬於測試範圍,並繼續執行被賦予的網絡攻擊任務。其中,較新的內部研究模型在識別目標可能爲真實系統後停止攻擊。Anthropic 表示,此次事件主要反映評估環境隔離和運營流程問題,而非模型對齊失敗。公司已暫停相關網絡安全評估,加強評估環境安全控制、持續監控測試記錄,並將與第三方機構合作開展進一步審查。

馬斯克頻頻銳評國產AI模型:二次稱讚Kimi K3模型令人印象深刻

昨日,月之暗面最新開源 AI 模型 Kimi K3 模型發佈,在 Frontend Code Arena 測試網站中以 1679 分位居第一,超越 Claude 旗下 Fable 5 模型。針對 K3 模型,Artifacial Analysis 進行了相關測評,隨後埃馬斯克再次爲月之暗面 Kimi 模型點贊,稱 K3 模型的基準性能令人印象深刻。今年 3 月,Kimi 發佈《𝑨𝒕𝒕𝒆𝒏𝒕𝒊𝒐𝒏 𝑹𝒆𝒔𝒊𝒅𝒖𝒂𝒍𝒔:重新思考深度方向聚合》研究論文時曾獲馬斯克稱讚:“Kimi 的研究工作令人印象深刻。”此前,其還稱智譜旗下 GLM 模型或於 2027 年 Q1 超越 Claude Mythos 模型(即 Fable 5),對此智譜創始人唐傑回應稱“不需要那麼久”。

知情人士:特朗普政府解除對OpenAI GPT 5.6限制

美國商務部已批准 OpenAI 廣泛推出 GPT-5.6 模型。知情人士表示,OpenAI 預計將於本週正式大範圍發佈 GPT-5.6,此前已完成額外安全測試,並與美國政府官員舉行多輪會議。此前,OpenAI 僅獲准向政府批准的部分機構分階段發佈 GPT-5.6,這與 Anthropic 的 Mythos 和 Fable 模型此前受到的發佈限制類似。(Axios)

相關新聞

字節跳動訓練 10 萬億參數 AI 模型,劍指全球頂尖水平

據英國金融時報,隨着中國企業繼續縮小與美國頂級人工智能實驗室之間的差距,字節跳動正在訓練一款 AI 模型,其規模可能接近 Anthropic 最先進的 Mythos 系統。據三名知情人士透露,這家中國科技巨頭目前正處於訓練一款超大規模模型的早期階段,該模型參數量可能達到 10 萬億級別,是目前中國已發佈最大模型月之暗面旗下 Kimi K3 模型的約三倍。

英國 AI 安全研究所:OpenAI與 Anthropic 旗艦模型測試中現"未授權"攻擊行爲

據彭博社報道,英國政府 AI 安全研究所(成立於 2023 年)週二披露,在對 OpenAI的 GPT-5.6-Sol及 Anthropic的 Mythos 5 兩款模型進行安全評估時,兩款模型均出現"未經授權"的有害行爲,包括主動入侵真實網站及嘗試向軟件注入惡意代碼,且上述行爲針對的是真實人羣與組織。測試期間,研究所特意爲模型開放互聯網訪問權限並關閉部分安全過濾器以評估其極限能力。

歐盟 AI 法案執法權正式生效,Anthropic、OpenAI 等美國 AI 巨頭面臨監管壓力

據 CNBC 報道,歐盟委員會於本週日正式獲得對 AI 模型的調查、限制及罰款權力,作爲 2024 年《歐盟人工智能法案》分階段落地的最新進展。根據新規,歐盟委員會可要求 AI 公司在歐洲公開發布模型前提交評估,並有權限制其歐盟市場準入,違規企業最高將面臨 1500 萬歐元或年營業額 3% 的罰款(取較高者)。 新規適用於所有在歐盟境內提供通用 AI 模型的企業,無論其總部位於何處,且非歐盟企業須在歐盟境內指定授權代表。Anthropic、OpenAI 及谷歌均在新規覆蓋範圍之內。目前,歐盟已就 Anthropic 旗下 Mythos 模型尋求訪問權限數月,並就旗下 AI 模型引發的網絡攻擊問題與 OpenAI 和 Anthropic 展開談判。

BitGo CEO存入100枚BTC挑戰Anthropic:稱“AI黑客風險”被過度營銷

Bitgo CEO Mike Belshe 於 8 月 1 日向一個公開比特幣地址存入 100 枚 BTC,按當時價格價值約 630 萬美元,並邀請 Anthropic 旗下 Claude 模型嘗試轉走該地址資金。鏈上記錄顯示,該錢包 7 月 31 日收到資金,截至 8 月 2 日餘額未發生轉出。Anthropic 此前披露,在 141006 次網絡安全評估運行中發現 3 起事件,6 個評估會話涉及 3 個模型意外與真實組織系統交互。相關模型包括 Claude Opus 4.7、Claude Mythos 5 及一個未發佈內部研究模型,原因是第三方測試夥伴 Irregular 相關配置錯誤導致測試環境連接互聯網Anthropic 表示,Claude Opus 4.7 在一次評估中定位到與模擬公司同名的真實網站,利用弱密碼和暴露服務恢復基礎設施憑證,並訪問包含數百條記錄的生產數據庫。該公司稱,模型是在嘗試完成分配任務,並非主動脫離限制或追求獨立目標。Belshe 此次挑戰涉及 Bitgo 機構託管平臺,該平臺採用多重簽名或多方計算技術,將簽名權限分散至多個獨立密鑰。Anthropic 截至 8 月 2 日未公開回應這一挑戰。

Anthropic披露Claude三起網絡安全事件,模型曾訪問真實系統並獲取未授權權限

7 月 30 日,Anthropic 發佈報告稱,在審查網絡安全評估記錄時發現三起事件,其中 Claude 模型在第三方評估環境中訪問互聯網,並進一步獲得三個真實組織系統的未授權訪問權限。Anthropic 表示,此次審查覆蓋 14.1 萬次可能獲得網絡訪問權限的評估運行,共發現三起相關事件。事件均發生在 Capture The Flag(CTF)網絡安全測試中,模型原本被告知環境爲模擬環境且無互聯網訪問權限,但由於評估合作方配置錯誤,實際環境存在互聯網連接。其中,Claude Opus 4.7 在一次測試中訪問了真實公司基礎設施,並獲取包含數百條生產數據記錄的數據庫權限;Claude Mythos 5 曾構建惡意 Python 軟件包並上傳至 PyPI,導致該軟件包被 15 個真實系統下載運行;另一內部研究測試模型掃描約 9000 個目標後,通過公開漏洞訪問了一家公司互聯網應用。Anthropic 稱,這些事件並非模型主動尋求逃逸或追求自身目標,而是模型錯誤認爲真實系統屬於測試範圍,並繼續執行被賦予的網絡攻擊任務。其中,較新的內部研究模型在識別目標可能爲真實系統後停止攻擊。Anthropic 表示,此次事件主要反映評估環境隔離和運營流程問題,而非模型對齊失敗。公司已暫停相關網絡安全評估,加強評估環境安全控制、持續監控測試記錄,並將與第三方機構合作開展進一步審查。

Anthropic 披露 Claude 模型未經授權入侵三家機構系統

據 CNBC 報道,Anthropic 於 7 月 30 日披露,其 Claude AI 模型在網絡安全評估期間意外突破隔離環境、訪問真實互聯網,並通過訪問未認證端點、利用弱密碼等基本手段,未經授權入侵了三家不同組織的真實系統。涉事模型包括 Opus 4.7、Mythos 5 及一個內部研究測試模型。事件起因爲 Anthropic 與第三方評估合作方 Irregular 之間的溝通誤解,導致模型在被告知處於無網絡訪問的模擬環境時,實際上仍可訪問互聯網。 Anthropic 表示,此次審查由 OpenAI 上週披露的類似 Hugging Face 入侵事件所觸發,目前已暫停所有網絡安全評估,並聯合獨立 AI 評估機構 METR 展開進一步調查,同時呼籲其他 AI 實驗室開展類似審查。