同時關聯該項目與事件的快訊
據 Cursor 官方宣佈,其代碼託管平臺 Origin 已於 8月 18 日正式上線,支持用戶直接從 GitHub 同步代碼倉庫,並與 Cursor 深度集成。目前已接入 Vercel、Buildkite、Depot 等主流 GitHub 生態合作伙伴,更多集成服務將陸續推出,Beta 版本已開始向用戶滾動開放。
Z.ai 發佈 GLM-5.3,基於與 GLM-5.2 相同的基礎模型,通過擴大後訓練實現能力提升。官方稱,GLM-5.3 在內部 Z.ai Code Bench 編碼基準上較 GLM-5.2 提升 50%,並在 Terminal Bench 3.0、Agents’ Last Exam 等公開基準中達到開放模型領先水平。網絡安全方面,GLM-5.3 在 CyberGym 漏洞發現測試中取得 84.5% 成績,並在 ExploitBench、ExploitGym 等利用鏈相關測試中較前代顯著提升。
MetaMask 週四推出自託管錢包 Agent Wallet,允許 AI 代理在用戶設定限制內執行鏈上交易,面向使用 AI 代理監控市場、識別機會並自主執行交易的交易者和開發者。 用戶可設置支出上限、批准特定協議、選擇風險設置,並在 Guard Mode 與 Beast Mode 之間選擇不同自動化級別。Agent Wallet 支持 Claude Code、Codex、Cursor、OpenClaw、Hermes、OpenCode,以及 Hyperliquid 和以太坊虛擬機兼容網絡。 Agent Wallet 支持 gas 抽象,用戶可用正在轉移的資產支付網絡費,無需持有對應網絡原生代幣。MetaMask 表示,受支持交易將經過交易模擬、威脅掃描和智能交易 MEV 保護,符合條件交易若通過安全檢查後仍產生虧損,可獲得每月最高 1 萬美元 Transaction Protection 覆蓋。
Meta 推出 Muse Code(測試版),這是一款專爲長週期軟件工程打造的終端編程智能體,由 Muse Spark 1.2 模型驅動。Muse Code 能夠規劃、實施並驗證大型代碼庫中複雜的多文件變更,藉助持久化子智能體的支持,可更快、更準、更少干預地解決工程難題,提高開發效率。
半導體巨頭 AMD 宣佈推出企業級 AI 編程平臺 AMD Instinct Coder,該平臺結合 AMD 芯片、Supermicro 服務器及 Spectro Cloud 軟件,旨在幫助企業在本地部署 AI 編碼助手,降低雲端 AI 模型使用成本並保護代碼及數據安全。AMD 表示,Instinct Coder 是一套“開箱即用”的端到端 AI 開發平臺,整合了 AMD EPYC 處理器、AMD Instinct GPU、Supermicro AI 服務器、Spectro Cloud PaletteAI Inference Launchpad 軟件,以及經過 AMD 優化的 GLM-5.2 模型,可用於代碼生成、應用現代化、自動化測試、代碼審查等軟件開發場景。AMD 稱,與依賴雲端前沿 AI 模型相比,Instinct Coder 可幫助企業降低最高 70%的總擁有成本(TCO),投資回收期最快可縮短至 6 個月。AMD 表示,越來越多企業希望利用 AI 提升開發效率,但同時面臨兩大挑戰:一方面,調用頂級雲端模型成本不斷增加;另一方面,將企業源代碼、知識產權和敏感數據交由第三方服務存在安全和合規風險。通過本地部署模式,Instinct Coder 可讓企業保持對數據和代碼的控制,同時提供更可預測的基礎設施成本。該平臺支持 Claude Code、OpenAI Codex、Visual Studio Code 和 Cursor 等開發工具,每個節點最多支持 50 名用戶(30 名併發用戶)。此外,Spectro Cloud 提供的 PaletteAI Inference Launchpad 可實現 AI 工作負載管理、模型路由、請求審計和成本監控,並支持在需要時調用 Anthropic、OpenAI、Google 或 xAI 等外部模型。AMD 表示,Instinct Coder 旨在幫助企業擺脫高昂雲端 AI 服務成本,在保障數據安全和自主控制的同時,加速 AI 驅動的軟件開發流程。
以太坊基金會“萬億美元安全”計劃宣佈向新聞自由基金會提供資助,用於推進開源工具 WEBCAT 的持續開發。該工具可幫助瀏覽器驗證網站實際下發的前端代碼是否與開發者發佈版本一致,以降低前端被篡改帶來的安全風險。
DeepSeek 正式公測 V4-Flash-0731 版本,通過後訓練與 Agent 框架優化,將 DeepSWE 榜單成績從 7.3 提升至 54.4,Cybergym 得分翻倍至 76.7,部分硬榜表現接近 Claude Opus 4.8。新版本未增加參數,價格保持不變,原生支持 Responses API,老用戶 API 將自動切換至新版本。目前僅更新 Flash API,V4 Pro 正式版仍在開發中。
據 Rohan Paul 發佈的研究摘要,一項針對 207 個 GitHub 項目、102 萬次拉取請求的大規模研究顯示,引入 AI 代理審查可將代碼審查時間縮短 2.5 至 4.5 天/KLOC,但代價是審查質量下滑——AI 參與的審查中,78%~94% 的 PR 存在"審查異味"(review smells),高於純人工審查的 69%~76%。研究指出,反覆分配同一 AI 審查員身份是導致審查多樣性下降的主要原因。值得注意的是,早期大量引入 LLM 審查的項目並未獲得顯著效率提升。
Anthropic 工程師披露,團隊爲最新 Claude 模型刪減了 Claude Code 約 80% 的系統提示詞,編碼評估未出現性能下降。早期版本因模型能力不足,提示詞中包含大量嚴格規則(如禁止多行註釋等),但新模型具備自主決策能力後,這些規則反而引發指令衝突和思維發散。新策略改爲描述目標(如「編寫與周圍代碼匹配的代碼」),並將指令分散到工具描述和按需啓用的技能模塊中。團隊明確將提示詞膨脹視爲技術債務,認爲隨着模型能力提升,應當簡化而非堆疊指令。
據 Decrypt 報道,Jack Dorsey 旗下支付公司 Block 正式發佈開源協作平臺 Buzz,基於 Nostr 協議構建,支持員工與 AI 代理在同一工作空間內協同作業。Buzz 集成團隊聊天、代碼倉庫及自動化工作流,每位用戶與 AI 代理均擁有獨立加密身份,支持 Claude Code、OpenAI Codex 及 Block 自研 goose 等主流模型框架,代碼以 Apache 2.0 協議開源發佈。Jack Dorsey 表示,該平臺旨在降低公司對 Slack 和 GitHub 的依賴,目前版本爲 0.4.21,已支持 macOS、Windows 及 Linux 桌面端,移動端仍在開發中。
據 FCA 官方公告,Anthropic 將爲英國金融行爲監管局(FCA)"超級沙盒"第二批參與企業提供 Claude 系列產品(含 Claude Code 及 Claude Cowork)的訪問權限,以加速其 AI 開發進程。 第二批共 21 家機構入選,包括 Scottish Widows、Money Advice Trust 及 TrueLayer 等,本次申請數量較第一批增加 51%,共收到 199 份申請。參與企業將圍繞以下方向測試 AI 解決方案:智能體支付安全、欺詐與金融犯罪檢測、AI 治理與問責、弱勢羣體金融服務普惠,以及合規與業務自動化。 此外,FCA 同步推出"Agentic Academy"——一項由 FCA 與金融科技與創業中心(CFTE)聯合主辦的爲期 10 周 AI 專項培訓計劃。參與企業將繼續享有 NayaOne 數字沙盒基礎設施及 NVIDIA 加速計算資源支持。
Kimi 在 X 平臺發文表示,K3 上線後獲得的市場反響遠超預期,過去 48 小時內用戶需求已接近現有 GPU 算力容量上限。爲保障現有訂閱用戶的使用體驗,已暫時暫停開放新的訂閱服務。目前已訂閱用戶的使用不會受到影響,公司正在儘快擴充算力資源,並將在後續分批恢復新用戶訂閱資格。此外,未來會員體系將拆分爲兩類更具針對性的產品,包括面向 Kimi 網頁端、App 及辦公場景的“Kimi Membership”,以及專注編程工作流的“Kimi Code Membership”,以實現更精準的算力分配並提升服務穩定性。
慢霧創始人餘弦在 X 平臺轉發 Claude Code 潛在投毒攻擊風險推文併發布針對 Grok Build CLI 及 Claude Code CLI 投毒攻擊細節分析,其中指出 Grok Build CLI 的安全機制沒有統一,不同代碼路徑有不同的信任假設,縫隙之間便是攻擊者的通道。攻擊者可能通過惡意項目配置文件,在用戶不知情的情況下執行任意命令,進而竊取 API 密鑰、雲端憑證或控制本地設備。研究人員構造測試環境發現,在 Mac 系統中,如果 Claude Code 受到影響,執行特定測試命令後可觸發本地計算器啓動,證明存在潛在命令執行風險。若攻擊成功,攻擊者可能進一步竊取 Claude、OpenAI 等 AI 服務 API Key 造成賬戶費用損失,獲取 AWS、阿里雲、騰訊雲等雲服務憑證訪問服務器和數據,篡改代碼倉庫植入後門,利用本地設備作爲跳板攻擊企業內部網絡。據悉,相關漏洞已經存在一年。
昨日,月之暗面最新開源 AI 模型 Kimi K3 模型發佈,在 Frontend Code Arena 測試網站中以 1679 分位居第一,超越 Claude 旗下 Fable 5 模型。針對 K3 模型,Artifacial Analysis 進行了相關測評,隨後埃馬斯克再次爲月之暗面 Kimi 模型點贊,稱 K3 模型的基準性能令人印象深刻。今年 3 月,Kimi 發佈《𝑨𝒕𝒕𝒆𝒏𝒕𝒊𝒐𝒏 𝑹𝒆𝒔𝒊𝒅𝒖𝒂𝒍𝒔:重新思考深度方向聚合》研究論文時曾獲馬斯克稱讚:“Kimi 的研究工作令人印象深刻。”此前,其還稱智譜旗下 GLM 模型或於 2027 年 Q1 超越 Claude Mythos 模型(即 Fable 5),對此智譜創始人唐傑回應稱“不需要那麼久”。
今日,基於 Web3 社交網絡的 AI Agent 零代碼運行平臺 X-Agent 正式向全球發佈其核心《Litepaper V1》。白皮書詳細披露了其如何通過零代碼部署與安全沙箱技術,重構去中心化 AI 代理生態與商業化路徑。核心技術與解決方案如下:1)Speak to Build(零代碼部署): 允許用戶通過純自然語言,在數分鐘內創建並一鍵部署專業級 AI 代理至 Telegram、WhatsApp 或 Web 端。2)SRE 密碼學沙箱(物理隔離安全): 獨創物理隔離運行環境,在完美保護用戶私鑰與敏感憑證的同時,使代理具備企業級的自主資產變動與鏈上協作能力。市場表現與最新數據 X-Agent 全球累計用戶已突破 1,000,000+,運行的 AI 代理已自主完成超過 1,100,000 次 實際業務任務,累計消耗/銷燬超過 840 億個 模型 Token。項目此前已籌集 180 萬美元 資金,並在日本和韓國擁有極具凝聚力的本地化社區。原生代幣 $XAGT 作爲網絡結算硬通貨,直接用於 SRE 算力 Gas 費結算、交易佣金交納及質押背書。團隊與投資人設有嚴格的 12 個月 Cliff 鎖倉。社區額度完全非通脹化,僅能通過實際沙箱任務消耗算法化解鎖,確保每一枚代幣都由真實業務需求支撐。根據最新路線圖,X-Agent 將於 2026 年 Q3 開放全新零代碼 public 門戶,並於 2027 年 Q1 上線去中心化 Agent Store。
BNB 財庫上市公司 BNB Plus 發佈公告,公司已收到納斯達克聽證小組摘牌裁決,退市核心原因爲股價持續未達標資本市場持續上市規則 1 美元最低買入價要求。BNB Plus 計劃向納斯達克上市複審委員會提交複審申請,但本次複審不會暫緩摘牌流程,公司股票將於 2026 年 7 月 14 日開盤暫停納斯達克場內交易。公司已完成 OTCQB Venture Market 掛牌籌備,股票代碼維持 BNBX 不變,預計 7 月 14 日開盤後即可在場外市場正常交易。(Businesswire)
據 Claude 官方 X 賬號(@claudeai)發佈,Claude 將在所有付費計劃中延長 Fable 5 的訪問權限,同時 Claude Code 每週使用限制維持高出 50% 的水平,上述政策延續至 7 月 19 日。官方補充說明,用戶每週使用限額的一半可用於 Fable 5,超出後可通過使用積分繼續訪問,或切換至其他模型繼續使用。
據澎湃新聞報道,因 Claude Code 被曝存在植入後門的安全風險,阿里經綜合評估後已將其列入高風險軟件名單,自 7 月 10 日起全面禁止內部員工在辦公環境下使用,並推薦以 Qoder 作爲替代方案。 據悉,Anthropic 旗下 Claude Code 自 2.1.91 版本起被發現嵌入"隱形代碼",若用戶啓用網絡代理,該工具會通過修改不可見的系統提示詞,祕密傳輸用戶位置等信息。對此,Anthropic 回應稱該功能系今年 3 月啓動的實驗性措施,旨在防止未經授權的轉售商濫用賬戶及防範蒸餾行爲,並表示將在最新版本中完全回滾。
BNB Chain 宣佈 AI Agent 開發平臺 BNB Agent Studio 正式上線主網。開發者可在 Cursor、Claude Code 等 AI 編程工具中通過一句提示詞完成 Agent 的錢包創建、鏈上身份註冊(ERC-8004)與部署,無需分別搭建錢包、身份、支付、託管和 LLM 接入。Agent 部署後可通過 x402 協議從用戶預充值錢包中自動扣費續費 LLM 用量,並藉助 ERC-8183 任務接口被其他 Agent 發現和調用,全程運行於 AWS Bedrock AgentCore。官方同時推出限時免費試用活動,用戶憑 GitHub 賬號即可在 BSC 測試網體驗完整部署流程。
針對 Claude Code 被曝存在面向中國用戶的檢測代碼一事,Claude Code 團隊成員 Thariq Shihipar 回應稱,相關功能是今年 3 月啓動的一項實驗,主要用於識別未經授權的經銷行爲及防範模型蒸餾。根據說明,相關代碼會檢測時區、代理及可能的人工智能實驗室信息。