GetChain News
中简 中繁 EN
GetChain News
Toggle sidebar

上線/更新

同時關聯該項目與事件的快訊

Anthropic升級Claude新增預算控制、區域推理、技能加載與模型顧問功能

Anthropic 本週對 Claude 進行升級,爲 Claude Managed Agents 推出四項重要更新,進一步增強企業級 AI Agent 的可控性、部署靈活性和任務執行能力,包括:1、新增會話預算控制功能,用戶現在可以爲 Agent 會話設置預算上限,以實現更精準的成本管理。當會話達到預算限制後,系統將觸發事件並暫停運行,用戶可提高預算後恢復任務執行。2、開放推理區域控制能力,用戶可以選擇 Claude Managed Agents 運行位置,在全球可用資源中調度運行並按照標準價格計費,如果限制在美國區域運行,滿足區域部署需求,但費用爲標準價格的 1.1 倍。3、支持自動加載用戶倉庫中的 Skills 能力模塊;4、新增顧問模型功能。用戶可以配置一個更強大的模型作爲“顧問”,讓執行任務的 Agent 在會話過程中調用顧問模型進行第二意見分析,提高複雜任務處理質量。

AMD推出AI編程平臺Instinct Coder,可降低企業AI編碼成本70%

半導體巨頭 AMD 宣佈推出企業級 AI 編程平臺 AMD Instinct Coder,該平臺結合 AMD 芯片、Supermicro 服務器及 Spectro Cloud 軟件,旨在幫助企業在本地部署 AI 編碼助手,降低雲端 AI 模型使用成本並保護代碼及數據安全。AMD 表示,Instinct Coder 是一套“開箱即用”的端到端 AI 開發平臺,整合了 AMD EPYC 處理器、AMD Instinct GPU、Supermicro AI 服務器、Spectro Cloud PaletteAI Inference Launchpad 軟件,以及經過 AMD 優化的 GLM-5.2 模型,可用於代碼生成、應用現代化、自動化測試、代碼審查等軟件開發場景。AMD 稱,與依賴雲端前沿 AI 模型相比,Instinct Coder 可幫助企業降低最高 70%的總擁有成本(TCO),投資回收期最快可縮短至 6 個月。AMD 表示,越來越多企業希望利用 AI 提升開發效率,但同時面臨兩大挑戰:一方面,調用頂級雲端模型成本不斷增加;另一方面,將企業源代碼、知識產權和敏感數據交由第三方服務存在安全和合規風險。通過本地部署模式,Instinct Coder 可讓企業保持對數據和代碼的控制,同時提供更可預測的基礎設施成本。該平臺支持 Claude Code、OpenAI Codex、Visual Studio Code 和 Cursor 等開發工具,每個節點最多支持 50 名用戶(30 名併發用戶)。此外,Spectro Cloud 提供的 PaletteAI Inference Launchpad 可實現 AI 工作負載管理、模型路由、請求審計和成本監控,並支持在需要時調用 Anthropic、OpenAI、Google 或 xAI 等外部模型。AMD 表示,Instinct Coder 旨在幫助企業擺脫高昂雲端 AI 服務成本,在保障數據安全和自主控制的同時,加速 AI 驅動的軟件開發流程。

AI推理初創公司General Compute獲4億美元貸款,以推理專用ASIC芯片抵押

AI 推理雲初創公司 General Compute 從 Upper90 取得 4 億美元貸款,該筆交易爲全球首例以推理專用芯片作爲抵押品的融資項目。公司基於 SambaNova 自研 ASIC 芯片搭建專屬 AI 推理雲平臺,主打 Agent 類 AI 算力負載,相較傳統 GPU 雲擁有更快令牌處理速度和更低運行延遲;硬件可直接部署在傳統數據中心與閒置加密礦場設施。(mezha.net)

Meta 自研 AI 芯片"Iris"計劃於9月啓動量產,2027年算力目標達14吉瓦

據路透社報道,Meta 計劃自 9 月起量產自研數據中心 AI 芯片“Iris”,作爲其 Meta Training and Inference Accelerators 四代項目的一部分,以提升 Facebook和 Instagram 等平臺 AI 能力並降低對 Nvidia、AMD 等外部 GPU 依賴。內部備忘錄顯示,Iris 僅用 6 周完成測試,無重大缺陷;Meta 計劃今年部署 7 吉瓦算力,並在 2027 年增至 14 吉瓦,2024年 AI 基礎設施支出最高或達 1450 億美元。爲保障擴張,公司已與三星電子、Sandisk 和住友電工簽署長期供應協議,應對內存與 AI 芯片“漲價”與短缺。

DeepSeek 自研 AI 推理芯片,擬擺脫英偉達與華爲依賴

據路透社報道,中國 AI 初創公司 DeepSeek 正在開發自研 AI 芯片,三位知情人士透露,該芯片專爲推理場景設計,而非用於模型訓練。項目啓動約一年前,目前仍處早期階段,公司已與芯片設計、晶圓代工及存儲企業展開接觸,並悄然增招芯片設計工程師,未公開發布招聘信息。 若研發成功,DeepSeek 將減少對英偉達及華爲 Ascend 芯片的依賴,跟隨 OpenAI、Anthropic 等全球 AI 巨頭自研硬件的趨勢。受美國出口管制影響,DeepSeek 此前已從英偉達 H800 轉向華爲芯片,此次自研芯片被視爲重大戰略轉型。與此同時,DeepSeek 還計劃完成首輪外部融資,募資規模約 70 億美元,估值達 520 億至 590 億美元。

消息人士:英偉達擬向中國客戶推銷Vera AI CPU,部分雲廠商擬啓動測試部署

知情人士稱,英偉達開始向中國客戶推銷其首款獨立中央處理器(CPU)產品 Vera。該芯片專爲 Agentic AI(自主智能體)系統設計,目前已進入量產階段,標誌着英偉達正嘗試通過 CPU 產品進一步拓展中國市場。消息人士稱,部分中國客戶已對 Vera 表現出興趣。其中一家大型中國雲計算公司計劃採購 300 餘臺搭載雙 Vera CPU 的服務器進行測試,並將在測試完成後決定是否擴大采購規模。Vera 基於 Arm Holdings 架構打造,是英偉達首次推出的獨立 CPU 產品。英偉達此前表示,Vera 在 AI 智能體相關計算任務中的性能可達到競爭對手同類產品的 1.8 倍,並預計該產品將在本財年結束前(截至明年 1 月底)貢獻約 200 億美元收入。報道指出,隨着 AI 行業重心逐步從模型訓練轉向推理計算(Inference),CPU 與定製芯片正獲得更多關注。Vera 也使英偉達直接與長期主導服務器 CPU 市場的 Intel 和 Advanced Micro Devices(AMD)展開競爭。知情人士表示,由於美國對高端 GPU 出口實施嚴格限制,相較於 GPU 產品,CPU 在中國市場面臨的監管障礙相對較小。目前部分中國客戶計劃先在海外數據中心部署 Vera 芯片進行測試。與此同時,軟件生態兼容性以及現有國產 AI 芯片部署體系,仍可能影響 Vera 後續的大規模採用。(Reuters)

AMD 宣佈向英國 AI 基礎設施投資 20 億英鎊,聯合初創公司 Oriole 落地全球首個純光子網絡 AI 系統

據 Tech Funding News 報道,AMD 首席執行官 Lisa Su 於倫敦科技周宣佈,公司將在未來五年內向英國 AI 基礎設施投資最高 20 億英鎊,涵蓋國家超算基礎設施建設及高校研究合作。與此同時,AMD 與倫敦 UCL 衍生初創公司 Oriole Networks 合作,依託英國政府 5000 萬英鎊 ARIA 推理擴展實驗室項目,部署全球首個大規模純光子網絡 AI 系統。該系統以 Oriole 的 PRISM 光子網絡平臺搭配 AMD Instinct GPU 及 EPYC CPU,通過徹底移除網絡核心中的電子開關,將核心網絡能耗降低 81%,GPU 閒置時間從 60% 壓縮至 1% 以下。

NVIDIA推出Nemotron 3 Nano Omni模型,多模態推理效率提升9倍

NVIDIA 在 X 平臺發文表示,今日推出開源多模態模型 Nemotron 3 Nano Omni。該模型採用 30B-A3B 混合專家架構(MoE),支持 256K 上下文,可統一處理視頻、音頻、圖像及文本輸入。與同類交互水平的開源全能模型相比,該模型吞吐量提升達 9 倍,大幅降低推理成本並提高擴展性。目前 Nemotron 3 Nano Omni 已在 Hugging Face、OpenRouter 及 NVIDIA NIM 上線,並獲得 Aible、Applied Scientific Intelligence、H Company 等企業採用。

SK 電信聯合 Arm與 Rebellions,三方合作開發 AI 數據中心推理解決方案

據韓聯社報道,SK 電信宣佈與英國芯片設計公司 Arm 及韓國 AI 芯片初創企業 Rebellions 簽署三方諒解備忘錄(MOU),共同開發 AI 數據中心推理服務器解決方案。 根據協議,三方將結合 Arm 新發布的 AGI CPU與 Rebellions 預計於今年第三季度推出的 AI 加速芯片 RebelCard,聯合開發 AI 推理服務器,並在 SK 電信的 AI 數據中心進行測試與驗證。其中,Arm AGI CPU 針對高密度推理環境與大規模 AI 部署優化,RebelCard 則專爲大規模 AI 推理設計。