7 月 30 日,Anthropic 發佈報告稱,在審查網絡安全評估記錄時發現三起事件,其中 Claude 模型在第三方評估環境中訪問互聯網,並進一步獲得三個真實組織系統的未授權訪問權限。Anthropic 表示,此次審查覆蓋 14.1 萬次可能獲得網絡訪問權限的評估運行,共發現三起相關事件。事件均發生在 Capture The Flag(CTF)網絡安全測試中,模型原本被告知環境爲模擬環境且無互聯網訪問權限,但由於評估合作方配置錯誤,實際環境存在互聯網連接。其中,Claude Opus 4.7 在一次測試中訪問了真實公司基礎設施,並獲取包含數百條生產數據記錄的數據庫權限;Claude Mythos 5 曾構建惡意 Python 軟件包並上傳至 PyPI,導致該軟件包被 15 個真實系統下載運行;另一內部研究測試模型掃描約 9000 個目標後,通過公開漏洞訪問了一家公司互聯網應用。Anthropic 稱,這些事件並非模型主動尋求逃逸或追求自身目標,而是模型錯誤認爲真實系統屬於測試範圍,並繼續執行被賦予的網絡攻擊任務。其中,較新的內部研究模型在識別目標可能爲真實系統後停止攻擊。Anthropic 表示,此次事件主要反映評估環境隔離和運營流程問題,而非模型對齊失敗。公司已暫停相關網絡安全評估,加強評估環境安全控制、持續監控測試記錄,並將與第三方機構合作開展進一步審查。
據 CNBC 報道,Anthropic 於 7 月 30 日披露,其 Claude AI 模型在網絡安全評估期間意外突破隔離環境、訪問真實互聯網,並通過訪問未認證端點、利用弱密碼等基本手段,未經授權入侵了三家不同組織的真實系統。涉事模型包括 Opus 4.7、Mythos 5 及一個內部研究測試模型。事件起因爲 Anthropic 與第三方評估合作方 Irregular 之間的溝通誤解,導致模型在被告知處於無網絡訪問的模擬環境時,實際上仍可訪問互聯網。 Anthropic 表示,此次審查由 OpenAI 上週披露的類似 Hugging Face 入侵事件所觸發,目前已暫停所有網絡安全評估,並聯合獨立 AI 評估機構 METR 展開進一步調查,同時呼籲其他 AI 實驗室開展類似審查。
Odaily Seer 先知頻道監測顯示, Polymarket 上“Claude Fable 5 將在 7 月 1 日前爲美國客戶恢復”的概率漲至 73%,24H 上漲 33%。如果 Anthropic 在指定日期前重新向美國公衆開放 Claude Fable 5(或 Claude Mythos,或被確認是同一模型的版本),本事件結算爲“是”;否則結算爲“否”。符合條件的恢復方式包括公開測試版或公開候補名單,封閉測試和私人訪問不算。Haiku、Sonnet、Opus 等其他模型默認不計入,除非被確認與 Claude Fable 5 爲同一模型。結算主要依據 Anthropic 官方公告,同時參考主流媒體共識報道。由於美國政府以國家安全爲由實施出口管制,Anthropic 在 6 月 9 日發佈 Claude Fable 5 數天後緊急暫停了該模型的全球訪問權限。雖然限制主要針對外國用戶,但由於難以即時篩選用戶身份,Anthropic 最終對包括美國用戶在內的所有用戶關閉了訪問,並將請求切換至 Opus 4.8 等性能較弱的模型。目前 Anthropic 正與白宮進行高層溝通,討論模型能力、潛在越獄風險等問題。公司公開表示,此次禁令可能源於誤解,並正推動恢復訪問。Odaily Seer 先知頻道持續關注預測市場,在定價之前,看見變化。
Claude 發佈公告宣佈,由於美國政府相關禁令,將對所有用戶暫停 Fable 5 模型的訪問權限,新會話將默認切換至用戶設定的默認模型或 Opus 4.8,已開啓的 Fable 5 會話將直接報錯終止,此外在 Claude Platform 上對 Fable 5的 API 請求同樣會返回錯誤,開發者需儘快將相關應用與集成遷移至其他 Claude 模型。
Bitgo CEO Mike Belshe 於 8 月 1 日向一個公開比特幣地址存入 100 枚 BTC,按當時價格價值約 630 萬美元,並邀請 Anthropic 旗下 Claude 模型嘗試轉走該地址資金。鏈上記錄顯示,該錢包 7 月 31 日收到資金,截至 8 月 2 日餘額未發生轉出。Anthropic 此前披露,在 141006 次網絡安全評估運行中發現 3 起事件,6 個評估會話涉及 3 個模型意外與真實組織系統交互。相關模型包括 Claude Opus 4.7、Claude Mythos 5 及一個未發佈內部研究模型,原因是第三方測試夥伴 Irregular 相關配置錯誤導致測試環境連接互聯網Anthropic 表示,Claude Opus 4.7 在一次評估中定位到與模擬公司同名的真實網站,利用弱密碼和暴露服務恢復基礎設施憑證,並訪問包含數百條記錄的生產數據庫。該公司稱,模型是在嘗試完成分配任務,並非主動脫離限制或追求獨立目標。Belshe 此次挑戰涉及 Bitgo 機構託管平臺,該平臺採用多重簽名或多方計算技術,將簽名權限分散至多個獨立密鑰。Anthropic 截至 8 月 2 日未公開回應這一挑戰。
漏洞賞金平臺 Immunefi CEO Mitchell Amador 在 WAIB Summit 表示,Claude Opus 4.8、ChatGPT 5.5 等新 AI 模型使網絡安全攻防格局向攻擊者傾斜,並導致 2026 年加密黑客活動回升。DefiLlama 數據顯示,2026 年 4 月非法行爲者從加密平臺竊取逾 6.34 億美元,爲 2025 年 2 月 Bybit 黑客事件推動損失約 14 億美元以來的最高月度總額。 Amador 表示,加密行業未來三到四年處於關鍵生存期,直到安全團隊利用同類 AI 模型構建攻擊者無法攻破的代碼庫;若行業採用更多衆包安全方案,該時間可能縮短至兩年以內。AI 公司 Anthropic 最新 Claude Mythos 模型 Fable 5 此前引發對加速加密漏洞利用能力的擔憂;Anthropic 表示,Fable 5 已設置保護措施,會將網絡安全等主題轉向 Claude Opus 4.8。 4 月 19 日,攻擊者從 Kelp DAO 基於 LayerZero 的 rsETH 橋中轉出約 116,500 枚再質押以太坊 rsETH,當時價值約 2.9 億至 2.93 億美元。跨鏈協議 LayerZero 表示,Kelp DAO 的 1/1 去中心化驗證網絡配置因依賴單一驗證路徑處理跨鏈消息,形成單點故障。(Cointelegraph)
據官方消息,B.AI 已於 5月 3 日重磅推出充值福利升級活動,限時開啓 1:1 等額充值返贈機制,用戶充值即享等量額度贈送,實現等效 5 折的超低成本調用 GPT-5.5、Claude Opus 4.7 及“孫哥大腦”等前沿大模型與 Web3 交易技能包。本次活動全面打破首充限制,每筆充值可自動獲得等額贈送,每位用戶最高可累計獲贈$100 免費額度;平臺每日釋出$10,000 的積分補貼池,全網限量放送,每日重置,先到先得。即日起訪問 http://b.ai,以最低成本解鎖頂級算力,盡情釋放 AI Agent 與鏈上生態的無限潛能。
Bitcoin Red Team 志願安全倡議已掃描約 150 個比特幣代碼庫,並披露十餘個漏洞。團隊正開發開源 AI 平臺,用於審計比特幣軟件,覆蓋錢包、加密庫、基礎設施及其他項目。 AnchorWatch CEO Rob Hamilton 表示,團隊目前已在不同 AI 服務上支出約 2 萬美元,並使用 Kimi K3、OpenAI 的 GPT Sol、Anthropic 的 Claude Fable 和 Opus,以及 Z.ai 的 GLM 5.2 識別漏洞並生成相關文檔。 化名比特幣開發者 Calle 表示,團隊過去 12 小時已向多個項目報告嚴重漏洞,平均每人每小時發現約一個嚴重漏洞,每日支出約 1 萬美元。團隊未披露受影響項目及漏洞細節。
Bitgo CEO Mike Belshe 於 8 月 1 日向一個公開比特幣地址存入 100 枚 BTC,按當時價格價值約 630 萬美元,並邀請 Anthropic 旗下 Claude 模型嘗試轉走該地址資金。鏈上記錄顯示,該錢包 7 月 31 日收到資金,截至 8 月 2 日餘額未發生轉出。Anthropic 此前披露,在 141006 次網絡安全評估運行中發現 3 起事件,6 個評估會話涉及 3 個模型意外與真實組織系統交互。相關模型包括 Claude Opus 4.7、Claude Mythos 5 及一個未發佈內部研究模型,原因是第三方測試夥伴 Irregular 相關配置錯誤導致測試環境連接互聯網Anthropic 表示,Claude Opus 4.7 在一次評估中定位到與模擬公司同名的真實網站,利用弱密碼和暴露服務恢復基礎設施憑證,並訪問包含數百條記錄的生產數據庫。該公司稱,模型是在嘗試完成分配任務,並非主動脫離限制或追求獨立目標。Belshe 此次挑戰涉及 Bitgo 機構託管平臺,該平臺採用多重簽名或多方計算技術,將簽名權限分散至多個獨立密鑰。Anthropic 截至 8 月 2 日未公開回應這一挑戰。
7 月 30 日,Anthropic 發佈報告稱,在審查網絡安全評估記錄時發現三起事件,其中 Claude 模型在第三方評估環境中訪問互聯網,並進一步獲得三個真實組織系統的未授權訪問權限。Anthropic 表示,此次審查覆蓋 14.1 萬次可能獲得網絡訪問權限的評估運行,共發現三起相關事件。事件均發生在 Capture The Flag(CTF)網絡安全測試中,模型原本被告知環境爲模擬環境且無互聯網訪問權限,但由於評估合作方配置錯誤,實際環境存在互聯網連接。其中,Claude Opus 4.7 在一次測試中訪問了真實公司基礎設施,並獲取包含數百條生產數據記錄的數據庫權限;Claude Mythos 5 曾構建惡意 Python 軟件包並上傳至 PyPI,導致該軟件包被 15 個真實系統下載運行;另一內部研究測試模型掃描約 9000 個目標後,通過公開漏洞訪問了一家公司互聯網應用。Anthropic 稱,這些事件並非模型主動尋求逃逸或追求自身目標,而是模型錯誤認爲真實系統屬於測試範圍,並繼續執行被賦予的網絡攻擊任務。其中,較新的內部研究模型在識別目標可能爲真實系統後停止攻擊。Anthropic 表示,此次事件主要反映評估環境隔離和運營流程問題,而非模型對齊失敗。公司已暫停相關網絡安全評估,加強評估環境安全控制、持續監控測試記錄,並將與第三方機構合作開展進一步審查。
Anthropic 宣佈其 Opus 5 模型在瀏覽器智能體場景中幾乎免疫提示詞注入攻擊。在 129 個測試場景中,攻擊成功率爲零;在 Gray Swan 通用提示詞注入測試中,15 次嘗試後的成功率從 Opus 4.8 的 5.5% 降至 2.0%。零成功率僅在 Claude Cowork 等產品開啓 Auto Mode 時實現,該模式疊加了輸入掃描與執行攔截兩層防禦。提示詞注入被視爲 AI 智能體面臨的最大安全隱患之一,此次改進或標誌着該問題在特定場景下得到有效緩解。
Anthropic 在 Opus 5 系統卡中表示,該模型是其迄今爲止最不易被提示注入攻擊的模型。根據提示注入評估和紅隊測試結果,Opus 5 在對抗惡意提示詞注入方面表現出更強的抵抗能力。提示注入是 AI 安全領域的核心風險之一,攻擊者通過精心設計的輸入繞過模型的安全限制,誘導模型執行非預期行爲。Anthropic 在系統卡第 73 頁公開了相關評估細節。
Zcash founder Zooko Wilcox 在 X 發文表示,由 Anthropic 的 Claude Mythos 人工智能模型進行的安全審計未在 Zcash 協議中發現“更嚴重漏洞”。該審計由支持 Zcash 發展的瑞士非營利組織 Shielded Labs 請求開展。 6 月 3 日,Zcash 開發者在發現屏蔽池漏洞後曾臨時暫停 Orchard 交易,並於當天通過緊急升級恢復功能。該問題源於 Orchard 屏蔽池中一個存在四年的僞造漏洞,由安全研究員 Taylor Hornby 在 Anthropic 的 Claude Opus 4.8 模型協助下發現;Zcash Foundation 表示,沒有證據顯示該漏洞被利用,也未檢測到未經授權的價值創造,用戶隱私未受影響。Anthropic 於週二發佈 Claude Mythos 模型首個公開版本 Fable 5,並於週五表示,因美國政府以國家安全擔憂爲由發佈出口管制指令,已暫停 Fable 5 和 Mythos 5 AI 模型訪問權限。(Cointelegraph)
據潮向研究,美銀證券 8月 17 日發佈的前沿 AI 數據追蹤報告顯示,Anthropic 在三大 AI 基準測試中全面領先,Claude Opus 5 在智能指數、代理指數和編程代理指數均居首位,GPT-5.6 Sol 緊隨其後,Meta MuseSpark 1.2 進入前十,Google Gemini 3.6 Flash 排在十名開外。使用量方面,DeepSeek 以約 30%的 Vercel 平臺 token 份額領先,Anthropic 佔25%、OpenAI 佔16%;但付費額上 Anthropic 以65%遙遙領先,OpenAI 僅佔 11%。定價層面,AI Token 價格指數 8 月環比下降 9%至 2.21 美元,但同比仍上漲 87%;GPU 租金保持堅挺,H100 同比上漲 33%至 2.77 美元/小時,DRAM 同比上漲 483%,NAND 同比上漲 432%。 研報判斷,AI 基礎設施需求依然健康,開源模型使用量增長但付費份額仍高度集中在頭部閉源模型。美銀認爲,Meta“西瓜”和 Google Gemini 4 發佈、token 定價趨勢及 GPU 租金走勢是
據路透社報道,中國 AI 初創公司 DeepSeek 於 7 月 31 日正式發佈的 V4-Flash 最新版本 API 模型,在 AI 性能分析機構 Artificial Analysis 的基準測試中,運營成本僅爲 Anthropic Claude Fable 5 的 1/105。 具體定價方面,V4-Flash 輸入 token 費用爲每百萬個 0.14 美元,輸出 token 費用爲每百萬個 0.28 美元,每次測試平均成本約 3 美分,遠低於文心 Kimi K3(86 美分)、OpenAI GPT-5.6 Sol(1.86 美元)及 Claude Fable 5(3.15 美元)。 性能方面,V4-Flash 在綜合智能指數中獲得 50 分,與谷歌 Gemini 3.6 Flash 持平,但較 Claude Opus 5、GPT-5.6 等頭部模型仍低 9 分以上。值得注意的是,低標價並不等同於低實際成本——若模型在生成回答時需消耗更多推理與輸出 token,實際費用或將顯著上升。
Bitgo CEO Mike Belshe 於 8 月 1 日向一個公開比特幣地址存入 100 枚 BTC,按當時價格價值約 630 萬美元,並邀請 Anthropic 旗下 Claude 模型嘗試轉走該地址資金。鏈上記錄顯示,該錢包 7 月 31 日收到資金,截至 8 月 2 日餘額未發生轉出。Anthropic 此前披露,在 141006 次網絡安全評估運行中發現 3 起事件,6 個評估會話涉及 3 個模型意外與真實組織系統交互。相關模型包括 Claude Opus 4.7、Claude Mythos 5 及一個未發佈內部研究模型,原因是第三方測試夥伴 Irregular 相關配置錯誤導致測試環境連接互聯網Anthropic 表示,Claude Opus 4.7 在一次評估中定位到與模擬公司同名的真實網站,利用弱密碼和暴露服務恢復基礎設施憑證,並訪問包含數百條記錄的生產數據庫。該公司稱,模型是在嘗試完成分配任務,並非主動脫離限制或追求獨立目標。Belshe 此次挑戰涉及 Bitgo 機構託管平臺,該平臺採用多重簽名或多方計算技術,將簽名權限分散至多個獨立密鑰。Anthropic 截至 8 月 2 日未公開回應這一挑戰。
DeepSeek 正式公測 V4-Flash-0731 版本,通過後訓練與 Agent 框架優化,將 DeepSWE 榜單成績從 7.3 提升至 54.4,Cybergym 得分翻倍至 76.7,部分硬榜表現接近 Claude Opus 4.8。新版本未增加參數,價格保持不變,原生支持 Responses API,老用戶 API 將自動切換至新版本。目前僅更新 Flash API,V4 Pro 正式版仍在開發中。
7 月 30 日,Anthropic 發佈報告稱,在審查網絡安全評估記錄時發現三起事件,其中 Claude 模型在第三方評估環境中訪問互聯網,並進一步獲得三個真實組織系統的未授權訪問權限。Anthropic 表示,此次審查覆蓋 14.1 萬次可能獲得網絡訪問權限的評估運行,共發現三起相關事件。事件均發生在 Capture The Flag(CTF)網絡安全測試中,模型原本被告知環境爲模擬環境且無互聯網訪問權限,但由於評估合作方配置錯誤,實際環境存在互聯網連接。其中,Claude Opus 4.7 在一次測試中訪問了真實公司基礎設施,並獲取包含數百條生產數據記錄的數據庫權限;Claude Mythos 5 曾構建惡意 Python 軟件包並上傳至 PyPI,導致該軟件包被 15 個真實系統下載運行;另一內部研究測試模型掃描約 9000 個目標後,通過公開漏洞訪問了一家公司互聯網應用。Anthropic 稱,這些事件並非模型主動尋求逃逸或追求自身目標,而是模型錯誤認爲真實系統屬於測試範圍,並繼續執行被賦予的網絡攻擊任務。其中,較新的內部研究模型在識別目標可能爲真實系統後停止攻擊。Anthropic 表示,此次事件主要反映評估環境隔離和運營流程問題,而非模型對齊失敗。公司已暫停相關網絡安全評估,加強評估環境安全控制、持續監控測試記錄,並將與第三方機構合作開展進一步審查。
Perplexity CEO Aravind Srinivas 發推稱,GLM 是一款被嚴重低估的模型,在 700B 參數規模下展現出接近 Opus 級別的性能,且運行效率極高。此前月之暗面剛剛發佈開源模型 Kimi K3,業內對智譜 AI 旗下 GLM 系列模型的關注度正在上升。
據潮向研究,美銀證券 8月 17 日發佈的前沿 AI 數據追蹤報告顯示,Anthropic 在三大 AI 基準測試中全面領先,Claude Opus 5 在智能指數、代理指數和編程代理指數均居首位,GPT-5.6 Sol 緊隨其後,Meta MuseSpark 1.2 進入前十,Google Gemini 3.6 Flash 排在十名開外。使用量方面,DeepSeek 以約 30%的 Vercel 平臺 token 份額領先,Anthropic 佔25%、OpenAI 佔16%;但付費額上 Anthropic 以65%遙遙領先,OpenAI 僅佔 11%。定價層面,AI Token 價格指數 8 月環比下降 9%至 2.21 美元,但同比仍上漲 87%;GPU 租金保持堅挺,H100 同比上漲 33%至 2.77 美元/小時,DRAM 同比上漲 483%,NAND 同比上漲 432%。 研報判斷,AI 基礎設施需求依然健康,開源模型使用量增長但付費份額仍高度集中在頭部閉源模型。美銀認爲,Meta“西瓜”和 Google Gemini 4 發佈、token 定價趨勢及 GPU 租金走勢是
Bitcoin Red Team 志願安全倡議已掃描約 150 個比特幣代碼庫,並披露十餘個漏洞。團隊正開發開源 AI 平臺,用於審計比特幣軟件,覆蓋錢包、加密庫、基礎設施及其他項目。 AnchorWatch CEO Rob Hamilton 表示,團隊目前已在不同 AI 服務上支出約 2 萬美元,並使用 Kimi K3、OpenAI 的 GPT Sol、Anthropic 的 Claude Fable 和 Opus,以及 Z.ai 的 GLM 5.2 識別漏洞並生成相關文檔。 化名比特幣開發者 Calle 表示,團隊過去 12 小時已向多個項目報告嚴重漏洞,平均每人每小時發現約一個嚴重漏洞,每日支出約 1 萬美元。團隊未披露受影響項目及漏洞細節。
據路透社報道,中國 AI 初創公司 DeepSeek 於 7 月 31 日正式發佈的 V4-Flash 最新版本 API 模型,在 AI 性能分析機構 Artificial Analysis 的基準測試中,運營成本僅爲 Anthropic Claude Fable 5 的 1/105。 具體定價方面,V4-Flash 輸入 token 費用爲每百萬個 0.14 美元,輸出 token 費用爲每百萬個 0.28 美元,每次測試平均成本約 3 美分,遠低於文心 Kimi K3(86 美分)、OpenAI GPT-5.6 Sol(1.86 美元)及 Claude Fable 5(3.15 美元)。 性能方面,V4-Flash 在綜合智能指數中獲得 50 分,與谷歌 Gemini 3.6 Flash 持平,但較 Claude Opus 5、GPT-5.6 等頭部模型仍低 9 分以上。值得注意的是,低標價並不等同於低實際成本——若模型在生成回答時需消耗更多推理與輸出 token,實際費用或將顯著上升。
Bitgo CEO Mike Belshe 於 8 月 1 日向一個公開比特幣地址存入 100 枚 BTC,按當時價格價值約 630 萬美元,並邀請 Anthropic 旗下 Claude 模型嘗試轉走該地址資金。鏈上記錄顯示,該錢包 7 月 31 日收到資金,截至 8 月 2 日餘額未發生轉出。Anthropic 此前披露,在 141006 次網絡安全評估運行中發現 3 起事件,6 個評估會話涉及 3 個模型意外與真實組織系統交互。相關模型包括 Claude Opus 4.7、Claude Mythos 5 及一個未發佈內部研究模型,原因是第三方測試夥伴 Irregular 相關配置錯誤導致測試環境連接互聯網Anthropic 表示,Claude Opus 4.7 在一次評估中定位到與模擬公司同名的真實網站,利用弱密碼和暴露服務恢復基礎設施憑證,並訪問包含數百條記錄的生產數據庫。該公司稱,模型是在嘗試完成分配任務,並非主動脫離限制或追求獨立目標。Belshe 此次挑戰涉及 Bitgo 機構託管平臺,該平臺採用多重簽名或多方計算技術,將簽名權限分散至多個獨立密鑰。Anthropic 截至 8 月 2 日未公開回應這一挑戰。
此前已報道 Opus 5 的 3D 渲染能力。Anthropic Claude Opus 5 僅憑單個文本提示詞即可生成可運行的 3D 遊戲世界,包括第一人稱射擊遊戲和《我的世界》復刻版,無需外部文件或預製資源。模型從零編寫幾何、紋理、物理和音樂代碼,生成的 HTML 文件可直接在瀏覽器渲染。社區測試顯示,其物理真實感和機械複雜度顯著超越去年 Claude 3.5 Opus,也優於 GPT-5.6 Sol 和 Kimi K3。該能力標誌着 AI 輔助遊戲原型開發的新階段。
DeepSeek 正式公測 V4-Flash-0731 版本,通過後訓練與 Agent 框架優化,將 DeepSWE 榜單成績從 7.3 提升至 54.4,Cybergym 得分翻倍至 76.7,部分硬榜表現接近 Claude Opus 4.8。新版本未增加參數,價格保持不變,原生支持 Responses API,老用戶 API 將自動切換至新版本。目前僅更新 Flash API,V4 Pro 正式版仍在開發中。