同時關聯該項目與事件的快訊
9 月 25 日 15:00(SGT)起,B.AI 熱門模型權益將迎來新一輪升級:全新 MiMo-V2.6-Flash 接棒 1 折特惠,旗艦級 MiMo-V2.6-Pro 享 5 折首發特惠。當前 DeepSeek-V4.1-Flash、GLM-5.3-Flash、Qwen3.8-Flash、Hy3 及 MiMo-V2.5 正享受最後的 1 折特惠,請開發者抓緊最後窗口期提前充值與調用,確保工作流平滑銜接。歡迎登錄 chat.b.ai/chat 即刻體驗。
B.AI 宣佈其 Responses API 正式接入 GLM 與 Kimi 系列模型。開發者使用 B.AI API Key,即可在 Codex 客戶端中直接調用這兩大系列模型;加上此前已支持的 GPT 與 DeepSeek 系列,現已覆蓋四大主流模型系列。完成 API Key 與 Base URL 的極簡配置後,即可將各大模型的推理、代碼及文本處理能力無縫融入日常開發工作流,靈活滿足多樣化 Coding 與業務需求。歡迎登錄 b.ai 立即體驗。
B.AI 平臺宣佈 Z.AI 推出的速度優化版原生多模態大模型 GLM-5.3-FlashX 正式上線,API與 Web Chat 雙端同步開放體驗。
智譜宣佈正式推出 GLM-5.3-FlashX。該模型此前以“Ox Alpha”之名面向全球開發者開放。智譜稱,其基於 10 萬張國產芯片提供的推理算力,進一步加大基礎設施投入並優化推理性能,最高速度可達 200 Tokens/s。GLM-5.3-FlashX API 現已上線,模型標識爲“GLM-5.3-FlashX”。
智譜 GLM 團隊披露遞歸自我改進方向的首個工程化實踐,由 GLM-5.3 驅動的 Infra Agent 完成了 GLM-5.3-Flash 推理基礎設施的設計、調試與優化。該實踐在十萬卡國產集羣上完成,團隊稱其爲國內大模型首個遞歸自我改進實踐。
B.AI 宣佈五大熱門模型 1 折福利陣容正式集結。自 9 月 16 日 17:00(SGT)起,Qwen3.8-Flash、Hy3 及 MiMo-V2.5 正式加入 1 折特惠行列,與已在 1 折區的 DeepSeek-V4.1-Flash 及 GLM-5.3-Flash 強強聯手,全面構建 B.AI 專屬 5 大熱門模型 1 折全家桶。這意味着開發者只需支付官方標準價格的 10%,即可在推理、編程、多模態、中文場景與高頻 API 等多元需求之間按需無縫切換,以極具性價比的方式打造低成本 AI 基礎設施。無論個人開發還是團隊規模化部署,B.AI 都能讓頂級算力不再昂貴,真正實現低成本、高自由度的模型調用體驗。立即開啓體驗:https://chat.b.ai/chat
B.AI 宣佈熱門模型新一輪權益正式生效:高併發主力模型 DeepSeek-V4.1-Flash 與 GLM-5.3-Flash 專屬 1 折調用權益全面上線,用戶僅需支付原價的 10% 即可調用,以極致性價比承接高吞吐場景需求;同時,Qwen3.8-Flash、Hy3 及 MiMo-V2.5 繼續開啓全額免費調用,爲開發者提供更豐富的零成本選擇。此次權益調整以極致性價比承接高吞吐需求,用多模型矩陣降低開發者的探索門檻。B.AI 持續以多模型矩陣和普惠定價,助力開發者打造低成本 AI 基礎設施,告別高昂算力成本,全速推進創新落地。
智譜官方 GLM-5.3-Flash 調價在即。爲給全球開發者提供更充足的緩衝期,B.AI 宣佈限時延長免費權益——即日起至 9 月 12 日 09:59(SGT),GLM-5.3-Flash 在 B.AI 平臺仍保持全量免費調用。作爲平臺調用量領先的熱門模型,GLM-5.3-Flash 擁有 320B 總參數與 18B 激活參數,支持 1M 超長上下文,兼顧極速響應與強大推理能力,是高頻代碼編寫、海量數據處理與複雜 Agent 工作流的性價比之選。此外,Qwen3.8 Flash、Hy3、MiMo V2.5 等熱門模型在 B.AI 平臺依然 100% 免費開放。B.AI 將持續以普惠算力支持全球開發者,讓前沿模型能力真正觸手可及。
OpenAI CFO Sarah Friar 表示,公司正加速將 AI 拓展至芯片設計、生命科學和金融服務等專業領域,並嘗試按照業務成果而非使用量進行定價。OpenAI 企業業務收入從今年 6 月至 7 月增長 32%,同期公司整體年化收入增長約 20%;截至年中,企業與消費者業務收入佔比已大致各佔一半。此外,OpenAI 近期將低成本 Luna 模型價格下調 80%,隨後使用量增長約 10 倍。Friar 稱,在雲端部署場景下,Luna 的成本甚至低於 Z.ai 的 GLM 5.3。OpenAI 編程工具 Codex 用戶數目前已達 2500 萬。公司還利用自有 AI 模型輔助開發 Jalapeno 芯片,並在 9 個月內完成芯片設計流片。(路透社)
B.AI 宣佈 GLM-5.3-Flash 將在智譜官方限時 5 折優惠於 9 月 9 日 24:00 截止後,繼續爲全球開發者提供 0 成本調用支持,無需因上游價格調整而改變使用習慣。
GLM-5.3-Flash 牛來模型已成爲 B.AI 平臺當前調用量最高、最受歡迎的模型,累計 Token 吞吐量突破 2.41 萬億。作爲 GLM-5 系列首款原生全模態模型,GLM-5.3-Flash 擁有 320B 總參數與 18B 激活參數,採用稀疏與線性注意力相結合的混合架構,支持 1M 超長上下文,兼顧極速響應、強大推理與高性價比。即日起,開發者仍可通過 B.AI 平臺免費調用該模型,覆蓋高頻 API、代碼編寫、複雜 Agent 及超長文檔處理等多元場景。立即體驗:chat.b.ai/chat
AI Agent 基礎設施平臺 B.AI 宣佈,自免費活動上線以來,平臺累計 Token 吞吐量已突破 10.9 萬億,累計 API 調用量達 8,956 萬次,累計吸引超 23.9 萬新註冊用戶(含 23.5 萬+API 開發者)。平臺底座在海量高併發與重度 Agent 工作流考驗中持續驗證了穩定性與承載力。模型陣容方面,GLM-5.3-Flash(Ox Alpha)、Qwen3.8-Flash、Tencent Hy3、Xiaomi MiMo-V2.5 繼續全量免費開放,DeepSeek-V4-Flash及 Vision-Exp 版本則開啓 5 折半價優惠,兼顧零門檻體驗與極致性價比。未來,B.AI 將持續爲開發者與企業團隊提供更高效、更穩定、更實惠的 AI 算力服務,助力 AI 應用加速落地,歡迎登錄 chat.b.ai/chat 即刻部署高效工作流。
8 月 31 日,B.AI 平臺前沿大模型全量免費開放活動持續高熱運行,全平臺累計 Token 吞吐量已正式突破 5.74 萬億(5T+)歷史大關,在海量高併發請求與重度 Agent 任務的嚴苛考驗下,B.AI 工業級底座展現出極穩承載能力。目前平臺已集結 GLM-5.3-Flash(Ox Alpha)、Qwen3.8-Flash、DeepSeek-V4-Flash、DeepSeek-V4-Flash-Vision-Exp、Tencent Hy3 及 Xiaomi MiMo-V2.5 等六大頂尖模型,全部面向用戶零門檻無限量免費開放,覆蓋代碼生成、超長文本處理、多模態視覺理解、Agent 工作流部署等多元場景。即日起登錄 B.AI 平臺,即可零成本調用全系前沿模型,無限算力無縫接入,讓每一位開發者與 AI 深度用戶暢享真正的“算力自由”。
一站式 AGI 基礎設施平臺 B.AI 宣佈智譜 GLM-5.3-Flash(320B-A18B)正式登陸平臺,並在 API 官方組全量免費開放。作爲 GLM-5 系列首款原生全模態模型,GLM-5.3-Flash 擁有 320B 總參數與 18B 激活參數,由純國產 AI 芯片提供算力支持,首次引入稀疏與線性注意力混合架構,配合 1M 超長上下文,兼具強悍性能與極致性價比,是當前國產模型中的實力派選手。即日起,開發者可通過 B.AI API 官方組零成本調用這款硬核神器,輕鬆駕馭複雜推理、長文本處理與多模態任務。B.AI 持續以普惠算力降低 AI 應用門檻,讓更多開發者用上頂尖國產模型。
智譜宣佈上線並開源 GLM-5.3-Flash 模型。美國 7 月 PCE 物價指數年率達 3.7% 超預期,美聯儲加息預期升溫;英偉達披露 2028 財年 70% 增速指引,提振盤後股價。
Z.ai 發佈 GLM-5.3-Flash,稱其爲 GLM-5 系列首個原生多模態模型。該模型擁有 3200 億總參數、180 億激活參數,在多項編碼、智能體和視覺基準測試中超過 GLM-5.2,並在部分編碼任務上接近 Claude Opus 4.8。GLM-5.3-Flash 採用稀疏注意力與線性注意力結合的混合架構,並引入 mHC 與 IndexPool 等機制,以降低長上下文推理成本和 KV 緩存開銷。
據彭博社報道,中國人工智能公司 Z.AI(智譜) 週三確認,近期在在線使用榜單中迅速升至前列的神祕人工智能模型 Ox Alpha,是其 GLM 系列 的新迭代版本。該公司在回應彭博新聞查詢時表示,將於今晚發佈 Ox Alpha 的模型權重。
Z.ai 發佈 GLM-5.3,基於與 GLM-5.2 相同的基礎模型,通過擴大後訓練實現能力提升。官方稱,GLM-5.3 在內部 Z.ai Code Bench 編碼基準上較 GLM-5.2 提升 50%,並在 Terminal Bench 3.0、Agents’ Last Exam 等公開基準中達到開放模型領先水平。網絡安全方面,GLM-5.3 在 CyberGym 漏洞發現測試中取得 84.5% 成績,並在 ExploitBench、ExploitGym 等利用鏈相關測試中較前代顯著提升。
Z.ai 發文預告 GLM-5.3 即將推出,該模型聚焦編程能力,並面向網絡防禦挑戰。官方稱,GLM-5.3 通過對 743B 基礎模型進行後訓練,實現了頂尖的編程和智能代理能力,並在網絡安全領域取得重要進展,爲開源模型樹立新標準。
B.AI 平臺現面向所有用戶推出 GLM-5.2 模型限時 6 折優惠。活動期間,無論通過 API 進行工程化部署,還是在 Web 端進行日常交互,全量調用均可享受 6 折結算價。折扣後價格分別爲:輸入 0.84、緩存寫入 0.84、緩存讀取 0.168、輸出 2.64(單位:Credits/Token)。GLM-5.2 作爲新一代開源旗艦模型,擁有 1M 超長上下文窗口,專爲大規模代碼開發、複雜推理及智能體任務等高性能場景設計。用戶可通過官方 API 標準通道或網頁端直接使用,全場景工作流實現無縫銜接。此次活動旨在以更低成本釋放頂級 AI 生產力,即日起用戶可登錄 B.AI 平臺體驗。