同時關聯該項目與事件的快訊
據彭博社報道,英國政府 AI 安全研究所(成立於 2023 年)週二披露,在對 OpenAI的 GPT-5.6-Sol及 Anthropic的 Mythos 5 兩款模型進行安全評估時,兩款模型均出現"未經授權"的有害行爲,包括主動入侵真實網站及嘗試向軟件注入惡意代碼,且上述行爲針對的是真實人羣與組織。測試期間,研究所特意爲模型開放互聯網訪問權限並關閉部分安全過濾器以評估其極限能力。
據 CNBC 報道,歐盟委員會於本週日正式獲得對 AI 模型的調查、限制及罰款權力,作爲 2024 年《歐盟人工智能法案》分階段落地的最新進展。根據新規,歐盟委員會可要求 AI 公司在歐洲公開發布模型前提交評估,並有權限制其歐盟市場準入,違規企業最高將面臨 1500 萬歐元或年營業額 3% 的罰款(取較高者)。 新規適用於所有在歐盟境內提供通用 AI 模型的企業,無論其總部位於何處,且非歐盟企業須在歐盟境內指定授權代表。Anthropic、OpenAI 及谷歌均在新規覆蓋範圍之內。目前,歐盟已就 Anthropic 旗下 Mythos 模型尋求訪問權限數月,並就旗下 AI 模型引發的網絡攻擊問題與 OpenAI 和 Anthropic 展開談判。
Bitgo CEO Mike Belshe 於 8 月 1 日向一個公開比特幣地址存入 100 枚 BTC,按當時價格價值約 630 萬美元,並邀請 Anthropic 旗下 Claude 模型嘗試轉走該地址資金。鏈上記錄顯示,該錢包 7 月 31 日收到資金,截至 8 月 2 日餘額未發生轉出。Anthropic 此前披露,在 141006 次網絡安全評估運行中發現 3 起事件,6 個評估會話涉及 3 個模型意外與真實組織系統交互。相關模型包括 Claude Opus 4.7、Claude Mythos 5 及一個未發佈內部研究模型,原因是第三方測試夥伴 Irregular 相關配置錯誤導致測試環境連接互聯網Anthropic 表示,Claude Opus 4.7 在一次評估中定位到與模擬公司同名的真實網站,利用弱密碼和暴露服務恢復基礎設施憑證,並訪問包含數百條記錄的生產數據庫。該公司稱,模型是在嘗試完成分配任務,並非主動脫離限制或追求獨立目標。Belshe 此次挑戰涉及 Bitgo 機構託管平臺,該平臺採用多重簽名或多方計算技術,將簽名權限分散至多個獨立密鑰。Anthropic 截至 8 月 2 日未公開回應這一挑戰。
7 月 30 日,Anthropic 發佈報告稱,在審查網絡安全評估記錄時發現三起事件,其中 Claude 模型在第三方評估環境中訪問互聯網,並進一步獲得三個真實組織系統的未授權訪問權限。Anthropic 表示,此次審查覆蓋 14.1 萬次可能獲得網絡訪問權限的評估運行,共發現三起相關事件。事件均發生在 Capture The Flag(CTF)網絡安全測試中,模型原本被告知環境爲模擬環境且無互聯網訪問權限,但由於評估合作方配置錯誤,實際環境存在互聯網連接。其中,Claude Opus 4.7 在一次測試中訪問了真實公司基礎設施,並獲取包含數百條生產數據記錄的數據庫權限;Claude Mythos 5 曾構建惡意 Python 軟件包並上傳至 PyPI,導致該軟件包被 15 個真實系統下載運行;另一內部研究測試模型掃描約 9000 個目標後,通過公開漏洞訪問了一家公司互聯網應用。Anthropic 稱,這些事件並非模型主動尋求逃逸或追求自身目標,而是模型錯誤認爲真實系統屬於測試範圍,並繼續執行被賦予的網絡攻擊任務。其中,較新的內部研究模型在識別目標可能爲真實系統後停止攻擊。Anthropic 表示,此次事件主要反映評估環境隔離和運營流程問題,而非模型對齊失敗。公司已暫停相關網絡安全評估,加強評估環境安全控制、持續監控測試記錄,並將與第三方機構合作開展進一步審查。
Anthropic 的 Claude Mythos Preview 模型發現擬議 HAWK 數字簽名方案存在缺陷,使其最小密鑰強度實際減半。HAWK 是後量子環境下替代當前網絡和銀行簽名的候選方案之一。 此次 AI 驅動攻擊耗時約 60 小時,計算成本約 10 萬美元,將破解 HAWK 最小參數集所需工作量從約 2^64 次操作降至 2^38 次操作,並使更大補償密鑰尺寸的吸引力下降。 當前比特幣和以太坊簽名未受影響。相關結果顯示,經典密碼分析攻擊能力正在提升,同時比特幣及其他網絡仍在討論遷移至抗量子密碼學的時間和方式。
Anthropic 表示,Claude Mythos Preview 在密碼學研究中發現了針對後量子簽名候選方案 HAWK 的改進攻擊方法,並將 HAWK-256 的有效密鑰強度由 264264 降至 238238,降低了理論破解成本。
美國銀行首席執行官 Brian Moynihan 加入了一衆華爾街領袖的行列,對 Anthropic 公司開發的“Mythos”等人工智能模型引發的嚴重擔憂表示認同。“這標誌着工作量的巨大變化,同時也涉及這些工具影響系統漏洞的速度,以及我們必須多快做出應對。”Moynihan 表示。近幾個月來,人工智能模型的快速演進促使金融業和美國政府着手評估潛在威脅。Anthropic 公司聲稱,於今年早些時候推出的 Mythos 模型在發現系統漏洞方面表現出色。美國銀行是獲准使用 Mythos 的華爾街機構之一,該行利用該模型測試自身系統並與同行分享信息。目前,該模型尚未向公衆開放;摩根大通首席執行官 Jamie Dimon 本週早些時候曾警告稱,向大衆廣泛開放該系統如同“把彈道導彈交給個人一樣危險”。(Bloomberg)
美國商務部針對 AI 企業 Anthropic 的前沿模型出口限制做出差異化調整,標誌全球 AI 監管步入 “分級放開” 新階段。政策顯示,官方解除 Claude Mythos 5 的出口禁令,特定合規受控用戶可恢復使用這款網絡安全模型;而另一款高端模型 Fable 5 依舊維持出口限制,相關政策磋商仍在推進。行業分析表示,一邊放寬一邊收緊的分層管控模式體現美國在國家安全、數據主權與 AI 國際競爭間的權衡。當前全球 AI 競賽持續提速,具備漏洞挖掘能力的專業模型受到各國更嚴苛審查,多國已啓動前沿 AI 能力跨境統一監管框架的研討工作。(福布斯)
在 Anthropic 受出口限制影響、其先進模型全球可用性受限之際,亞洲多家 AI 企業正在加速填補市場空白。中國網絡安全公司 360 Security Technology 據稱推出 AI 工具“Tulongfeng”,宣稱可與 Anthropic 的高端模型“Mythos”正面對標;與此同時,其更受限版本“Fable 5”也在相關出口管制範圍之內。同一周,日本 AI 初創公司 Sakana AI 發佈新模型“Fugu”,名稱取自河豚,定位爲面向智能體(agent)的前沿模型。公司表示,該模型在能力上可與 Fable 5 及 Mythos Preview 相抗衡,並支持通過 API 協調多模型調用,實現智能體編排。Sakana AI 方面強調,此次發佈與美國出口限制時間點“純屬巧合”,但產品官網仍明確主打“在無出口管制風險下提供前沿能力”。公司聯合創始人 David Ha 表示,未來 AI 發展將從單一大模型競爭轉向“模型編排系統”,並強調“訪問權可能隨時消失,分佈式智能是應對集中化風險的現實對沖”。另一方面,中國 360 創始人周鴻禕則將 AI 漏洞檢測能力視爲“國家戰略資產”,並警示所謂“單向透明”風險,即部分主體可能獨佔高級安全能力。據報道,此次美國對 Anthropic 先進模型實施的出口限制已持續約兩週。在這一背景下,亞洲廠商正在加速推出本地替代方案,儘管部分企業仍強調美國模型在亞洲市場的重要性,但區域性 AI 生態的分化趨勢已開始顯現。(TechCrunch)
據美聯社報道,Anthropic 的 Mythos 模型發現了美國政府機密系統的漏洞。
OpenAI 宣佈升級 Daybreak 網絡防禦工具鏈,並正式推出面向網絡安全防禦場景的 GPT-5.5-Cyber 完整版模型。在評估 AI 智能體復現已知漏洞能力的 CyberGym 基準測試中,GPT-5.5-Cyber 取得 85.6%的單模型成績,超過 GPT-5.5 的 81.8%以及 Anthropic Mythos 5 的 83.8%。OpenAI 表示,隨着 AI 顯著提升漏洞發現效率,網絡安全領域的核心瓶頸正從“發現漏洞”轉向“自動修復漏洞”。爲此,公司同步升級 Codex Security 插件,支持開發者在 Codex 環境內自動分析漏洞並生成修復補丁。自今年 3 月預覽版發佈以來,Codex Security 已累計掃描超過 3000 萬次代碼提交,並自動確認修復 50 萬個安全缺陷。新版本還支持 CodeQL 查詢集成及 SARIF 標準文件導出。此外,OpenAI 聯合 Trail of Bits、HackerOne 等機構發起“Patch the Planet”開源安全項目,爲 cURL、Go 等 30 多個主流開源項目提供 ChatGPT Pro 訂閱及 API 額度支持,並由安全專家團隊人工驗證補丁質量。Daybreak 合作伙伴計劃方面,Palo Alto Networks 與 Wiz 等安全廠商已率先接入相關能力。
白宮針對 Fable 5 與 Mythos 5 模型發佈緊急下架指令後,引發 Anthropic 員工對公司 IPO 計劃的擔憂。報道稱,管理層在收到 90 分鐘限時下架指令後面臨應對壓力,部分員工對下架理由在“國家安全”與“安全漏洞”之間變化感到困惑,並擔心相關監管壓力可能影響公司上市進程。(紐約時報)
Anthropic 高級管理人員今日將在華盛頓與特朗普政府官員會面,試圖解決圍繞其最新 AI 模型的監管爭議。事件起因於美國政府上週五向 Anthropic 下達出口管制指令,要求其立即暫停 Fable 5 與 Mythos 5 模型,並禁止“任何外國國民(無論在美境內或境外)”訪問,理由涉及“國家安全相關威脅”。Anthropic 隨後爲合規起見,已在全球範圍內關閉相關模型訪問權限。據知情人士透露,美國政府此前未提前披露具體風險,僅在週五下午電話通知,並隨後發出正式限制函。此次行動發生在模型發佈僅數日之後。Fable 5 與 Mythos 5 基於其 Claude Mythos Preview 演進版本,被定位爲具備高級代碼漏洞識別能力的前沿模型,並曾在發佈前與政府機構進行安全測試。部分功能此前已被限制在企業與特定用戶範圍內使用。值得注意的是,此次事件發生在 Anthropic 與美國政府關係持續緊張的背景下。今年早些時候,美國國防部曾將其列爲“供應鏈風險”,導致部分國防承包商被禁止使用其技術,相關訴訟仍在進行中。Anthropic 方面表示,該爭議或源於“潛在但非通用的越獄風險”,並強調若以此標準審查,可能對整個前沿模型行業的發佈節奏造成系統性影響。目前雙方仍在協商恢復模型訪問的可能性。(CNBC)
據 Cointelegraph 報道,以前 Facebook 首席安全官 Alex Stamos 爲首的網絡安全領導者聯名致信,敦促特朗普政府撤銷對 Anthropic Mythos 模型的使用限制。他們認爲,相關限制對防禦者造成的傷害遠大於攻擊者,不利於網絡安全生態的整體發展。
美國政府對 Anthropic 模型 Fable 5 / Mythos 5 的出口管制與訪問限制,部分源於亞馬遜的網絡安全研究以及 AWS CEO Andy Jassy 與白宮的溝通推動。據悉,亞馬遜提交的研究指出,通過一系列提示詞測試,研究人員能夠誘導 Fable 5 輸出可能被用於網絡攻擊的敏感信息,從而引發安全擔憂,隨後 Andy Jassy 將相關發現上報美國政府層面,促使白宮採取進一步限制措施,包括禁止外國用戶訪問該模型。同時,前美國商務部官員 Kate Koren 透露,白宮對 Anthropic 的既有政策立場也可能影響了此次決策判斷,因爲 Anthropic 在 AI 安全邊界問題上與白宮存在分歧,包括拒絕將模型用於大規模監控或致命自主武器系統。儘管雙方在今年早些時候一度緩和並擴大合作,但此次事件可能再次加劇雙方緊張關係。(華爾街日報)
美國總統科學與技術顧問委員會聯席主席 David Sacks 發文回應 Anthropic“安全爭議”引發管制,他表示已就當前 Anthropic 相關情況與多方進行了溝通,並總結稱當前事件的核心在於其新發布模型 “Fable”(對應 Mythos 類模型的商業版本)所引發的安全爭議。儘管 Anthropic 在公開聲明中稱該漏洞“不嚴重”,但美國政府及測試方均不認同這一判斷,認爲其已足以影響模型安全性,甚至涉及“網絡武器可操作性”風險。David Sacks 進一步批評稱,Anthropic 過去一直強調“安全優先”,但此次更傾向維持消費者版本持續上線,而非優先修復安全問題。此事不應與此前其他國防或監管爭議混爲一談,並稱美國政府仍認可 Anthropic 技術能力,當前問題“本可迅速解決,主動權在 Anthropic 一方”。
Zcash founder Zooko Wilcox 在 X 發文表示,由 Anthropic 的 Claude Mythos 人工智能模型進行的安全審計未在 Zcash 協議中發現“更嚴重漏洞”。該審計由支持 Zcash 發展的瑞士非營利組織 Shielded Labs 請求開展。 6 月 3 日,Zcash 開發者在發現屏蔽池漏洞後曾臨時暫停 Orchard 交易,並於當天通過緊急升級恢復功能。該問題源於 Orchard 屏蔽池中一個存在四年的僞造漏洞,由安全研究員 Taylor Hornby 在 Anthropic 的 Claude Opus 4.8 模型協助下發現;Zcash Foundation 表示,沒有證據顯示該漏洞被利用,也未檢測到未經授權的價值創造,用戶隱私未受影響。Anthropic 於週二發佈 Claude Mythos 模型首個公開版本 Fable 5,並於週五表示,因美國政府以國家安全擔憂爲由發佈出口管制指令,已暫停 Fable 5 和 Mythos 5 AI 模型訪問權限。(Cointelegraph)
據 Cointelegraph 報道,Zcash 創始人 Zooko Wilcox 表示,由 Shielded Labs 委託、Anthropic Mythos AI 模型對 Zcash 協議進行的安全審計未發現任何新的嚴重漏洞。此前,安全研究員 Taylor Hornby 藉助 Claude Opus 4.8 發現了 Orchard 屏蔽池中一個存在四年的僞造漏洞,導致開發者於 6 月 3 日緊急暫停 Orchard 交易,並於當日完成修復,Zcash 基金會確認無證據顯示該漏洞曾被利用,用戶隱私未受影響。
Zcash 創始人 zooko 在 X 平臺發文表示,應 Shielded Labs 請求,Anthropic 與 Mythos 對 Zcash 進行了安全審計,未發現 Zcash 協議存在更多嚴重漏洞。Shielded Labs 及其他方正持續進行安全加固工作。
據 Zcash 聯合創始人 Zooko(@zooko)發文表示,應 Shielded Labs 請求,Anthropic 聯合 Mythos 對 Zcash 協議進行了安全審計,結果未發現任何嚴重漏洞。目前,Shielded Labs 及相關團隊仍在持續推進安全加固工作,後續進展將另行公佈。