GetChain News
中简 中繁 EN
GetChain News
Toggle sidebar

上线/更新

同时关联该项目与事件的快讯

B.AI 热门模型权益更新,9 月 25 日起 MiMo-V2.6 系列接棒特惠

9 月 25 日 15:00(SGT)起,B.AI 热门模型权益将迎来新一轮升级:全新 MiMo-V2.6-Flash 接棒 1 折特惠,旗舰级 MiMo-V2.6-Pro 享 5 折首发特惠。当前 DeepSeek-V4.1-Flash、GLM-5.3-Flash、Qwen3.8-Flash、Hy3 及 MiMo-V2.5 正享受最后的 1 折特惠,请开发者抓紧最后窗口期提前充值与调用,确保工作流平滑衔接。欢迎登录 chat.b.ai/chat 即刻体验。

B.AI Responses API 新增支持 GLM 与 Kimi 系列模型

B.AI 宣布其 Responses API 正式接入 GLM 与 Kimi 系列模型。开发者使用 B.AI API Key,即可在 Codex 客户端中直接调用这两大系列模型;加上此前已支持的 GPT 与 DeepSeek 系列,现已覆盖四大主流模型系列。完成 API Key 与 Base URL 的极简配置后,即可将各大模型的推理、代码及文本处理能力无缝融入日常开发工作流,灵活满足多样化 Coding 与业务需求。欢迎登录 b.ai 立即体验。

GLM-5.3-FlashX 正式登陆 B.AI,API 与 Web Chat 双端同步开放

B.AI 平台宣布 Z.AI 推出的速度优化版原生多模态大模型 GLM-5.3-FlashX 正式上线,API与 Web Chat 双端同步开放体验。

智谱正式上线 GLM-5.3-FlashX

智谱宣布正式推出 GLM-5.3-FlashX。该模型此前以“Ox Alpha”之名面向全球开发者开放。智谱称,其基于 10 万张国产芯片提供的推理算力,进一步加大基础设施投入并优化推理性能,最高速度可达 200 Tokens/s。GLM-5.3-FlashX API 现已上线,模型标识为“GLM-5.3-FlashX”。

智谱 GLM 公开递归自我改进实践,GLM-5.3-Flash 发布

智谱 GLM 团队披露递归自我改进方向的首个工程化实践,由 GLM-5.3 驱动的 Infra Agent 完成了 GLM-5.3-Flash 推理基础设施的设计、调试与优化。该实践在十万卡国产集群上完成,团队称其为国内大模型首个递归自我改进实践。

只需官方价 10%,B.AI 五大热门模型 1 折福利全面生效

B.AI 宣布五大热门模型 1 折福利阵容正式集结。自 9 月 16 日 17:00(SGT)起,Qwen3.8-Flash、Hy3 及 MiMo-V2.5 正式加入 1 折特惠行列,与已在 1 折区的 DeepSeek-V4.1-Flash 及 GLM-5.3-Flash 强强联手,全面构建 B.AI 专属 5 大热门模型 1 折全家桶。这意味着开发者只需支付官方标准价格的 10%,即可在推理、编程、多模态、中文场景与高频 API 等多元需求之间按需无缝切换,以极具性价比的方式打造低成本 AI 基础设施。无论个人开发还是团队规模化部署,B.AI 都能让顶级算力不再昂贵,真正实现低成本、高自由度的模型调用体验。立即开启体验:https://chat.b.ai/chat

B.AI 模型权益更新,两大主力模型 1 折调用全面生效

B.AI 宣布热门模型新一轮权益正式生效:高并发主力模型 DeepSeek-V4.1-Flash 与 GLM-5.3-Flash 专属 1 折调用权益全面上线,用户仅需支付原价的 10% 即可调用,以极致性价比承接高吞吐场景需求;同时,Qwen3.8-Flash、Hy3 及 MiMo-V2.5 继续开启全额免费调用,为开发者提供更丰富的零成本选择。此次权益调整以极致性价比承接高吞吐需求,用多模型矩阵降低开发者的探索门槛。B.AI 持续以多模型矩阵和普惠定价,助力开发者打造低成本 AI 基础设施,告别高昂算力成本,全速推进创新落地。

GLM-5.3-Flash 官方调价即将生效,B.AI 免费权益限时延长至 9 月 12 日

智谱官方 GLM-5.3-Flash 调价在即。为给全球开发者提供更充足的缓冲期,B.AI 宣布限时延长免费权益——即日起至 9 月 12 日 09:59(SGT),GLM-5.3-Flash 在 B.AI 平台仍保持全量免费调用。作为平台调用量领先的热门模型,GLM-5.3-Flash 拥有 320B 总参数与 18B 激活参数,支持 1M 超长上下文,兼顾极速响应与强大推理能力,是高频代码编写、海量数据处理与复杂 Agent 工作流的性价比之选。此外,Qwen3.8 Flash、Hy3、MiMo V2.5 等热门模型在 B.AI 平台依然 100% 免费开放。B.AI 将持续以普惠算力支持全球开发者,让前沿模型能力真正触手可及。

OpenAI CFO:企业收入单月增长32%,Luna降价80%后使用量增长约10倍

OpenAI CFO Sarah Friar 表示,公司正加速将 AI 拓展至芯片设计、生命科学和金融服务等专业领域,并尝试按照业务成果而非使用量进行定价。OpenAI 企业业务收入从今年 6 月至 7 月增长 32%,同期公司整体年化收入增长约 20%;截至年中,企业与消费者业务收入占比已大致各占一半。此外,OpenAI 近期将低成本 Luna 模型价格下调 80%,随后使用量增长约 10 倍。Friar 称,在云端部署场景下,Luna 的成本甚至低于 Z.ai 的 GLM 5.3。OpenAI 编程工具 Codex 用户数目前已达 2500 万。公司还利用自有 AI 模型辅助开发 Jalapeno 芯片,并在 9 个月内完成芯片设计流片。(路透社)

B.AI 持续提供 GLM-5.3-Flash 免费调用,保持 0 成本开发

B.AI 宣布 GLM-5.3-Flash 将在智谱官方限时 5 折优惠于 9 月 9 日 24:00 截止后,继续为全球开发者提供 0 成本调用支持,无需因上游价格调整而改变使用习惯。

GLM-5.3-Flash 登顶 B.AI 模型调用量榜首,累计吞吐量突破 2.41 万亿 Tokens

GLM-5.3-Flash 牛来模型已成为 B.AI 平台当前调用量最高、最受欢迎的模型,累计 Token 吞吐量突破 2.41 万亿。作为 GLM-5 系列首款原生全模态模型,GLM-5.3-Flash 拥有 320B 总参数与 18B 激活参数,采用稀疏与线性注意力相结合的混合架构,支持 1M 超长上下文,兼顾极速响应、强大推理与高性价比。即日起,开发者仍可通过 B.AI 平台免费调用该模型,覆盖高频 API、代码编写、复杂 Agent 及超长文档处理等多元场景。立即体验:chat.b.ai/chat

B.AI 累计 Token 吞吐量突破 10.9 万亿,免费活动持续释放算力红利

AI Agent 基础设施平台 B.AI 宣布,自免费活动上线以来,平台累计 Token 吞吐量已突破 10.9 万亿,累计 API 调用量达 8,956 万次,累计吸引超 23.9 万新注册用户(含 23.5 万+API 开发者)。平台底座在海量高并发与重度 Agent 工作流考验中持续验证了稳定性与承载力。模型阵容方面,GLM-5.3-Flash(Ox Alpha)、Qwen3.8-Flash、Tencent Hy3、Xiaomi MiMo-V2.5 继续全量免费开放,DeepSeek-V4-Flash及 Vision-Exp 版本则开启 5 折半价优惠,兼顾零门槛体验与极致性价比。未来,B.AI 将持续为开发者与企业团队提供更高效、更稳定、更实惠的 AI 算力服务,助力 AI 应用加速落地,欢迎登录 chat.b.ai/chat 即刻部署高效工作流。

B.AI全量免费活动持续,累计吞吐突破5.74万亿再创里程碑

8 月 31 日,B.AI 平台前沿大模型全量免费开放活动持续高热运行,全平台累计 Token 吞吐量已正式突破 5.74 万亿(5T+)历史大关,在海量高并发请求与重度 Agent 任务的严苛考验下,B.AI 工业级底座展现出极稳承载能力。目前平台已集结 GLM-5.3-Flash(Ox Alpha)、Qwen3.8-Flash、DeepSeek-V4-Flash、DeepSeek-V4-Flash-Vision-Exp、Tencent Hy3 及 Xiaomi MiMo-V2.5 等六大顶尖模型,全部面向用户零门槛无限量免费开放,覆盖代码生成、超长文本处理、多模态视觉理解、Agent 工作流部署等多元场景。即日起登录 B.AI 平台,即可零成本调用全系前沿模型,无限算力无缝接入,让每一位开发者与 AI 深度用户畅享真正的“算力自由”。

牛来模型 GLM-5.3-Flash 现已上线,B.AI 免费福利再加码

一站式 AGI 基础设施平台 B.AI 宣布智谱 GLM-5.3-Flash(320B-A18B)正式登陆平台,并在 API 官方组全量免费开放。作为 GLM-5 系列首款原生全模态模型,GLM-5.3-Flash 拥有 320B 总参数与 18B 激活参数,由纯国产 AI 芯片提供算力支持,首次引入稀疏与线性注意力混合架构,配合 1M 超长上下文,兼具强悍性能与极致性价比,是当前国产模型中的实力派选手。即日起,开发者可通过 B.AI API 官方组零成本调用这款硬核神器,轻松驾驭复杂推理、长文本处理与多模态任务。B.AI 持续以普惠算力降低 AI 应用门槛,让更多开发者用上顶尖国产模型。

智谱开源 GLM-5.3-Flash,美 PCE 超预期,英伟达盘后涨

智谱宣布上线并开源 GLM-5.3-Flash 模型。美国 7 月 PCE 物价指数年率达 3.7% 超预期,美联储加息预期升温;英伟达披露 2028 财年 70% 增速指引,提振盘后股价。

智谱上线并开源“牛来”模型 GLM-5.3-Flash,多模态能力与推理成本效率提升

Z.ai 发布 GLM-5.3-Flash,称其为 GLM-5 系列首个原生多模态模型。该模型拥有 3200 亿总参数、180 亿激活参数,在多项编码、智能体和视觉基准测试中超过 GLM-5.2,并在部分编码任务上接近 Claude Opus 4.8。GLM-5.3-Flash 采用稀疏注意力与线性注意力结合的混合架构,并引入 mHC 与 IndexPool 等机制,以降低长上下文推理成本和 KV 缓存开销。

中国智谱确认 Ox Alpha 为 GLM 系列新迭代,今晚将发布模型权重

据彭博社报道,中国人工智能公司 Z.AI(智谱) 周三确认,近期在在线使用榜单中迅速升至前列的神秘人工智能模型 Ox Alpha,是其 GLM 系列 的新迭代版本。该公司在回应彭博新闻查询时表示,将于今晚发布 Ox Alpha 的模型权重。

智谱 GLM-5.3 发布:编码与长程任务能力显著提升,模型权重将于两周后开放

Z.ai 发布 GLM-5.3,基于与 GLM-5.2 相同的基础模型,通过扩大后训练实现能力提升。官方称,GLM-5.3 在内部 Z.ai Code Bench 编码基准上较 GLM-5.2 提升 50%,并在 Terminal Bench 3.0、Agents’ Last Exam 等公开基准中达到开放模型领先水平。网络安全方面,GLM-5.3 在 CyberGym 漏洞发现测试中取得 84.5% 成绩,并在 ExploitBench、ExploitGym 等利用链相关测试中较前代显著提升。

GLM-5.3 即将发布,聚焦编程与网络安全能力

Z.ai 发文预告 GLM-5.3 即将推出,该模型聚焦编程能力,并面向网络防御挑战。官方称,GLM-5.3 通过对 743B 基础模型进行后训练,实现了顶尖的编程和智能代理能力,并在网络安全领域取得重要进展,为开源模型树立新标准。

B.AI 平台推出 GLM-5.2 旗舰模型限时 6 折优惠活动

B.AI 平台现面向所有用户推出 GLM-5.2 模型限时 6 折优惠。活动期间,无论通过 API 进行工程化部署,还是在 Web 端进行日常交互,全量调用均可享受 6 折结算价。折扣后价格分别为:输入 0.84、缓存写入 0.84、缓存读取 0.168、输出 2.64(单位:Credits/Token)。GLM-5.2 作为新一代开源旗舰模型,拥有 1M 超长上下文窗口,专为大规模代码开发、复杂推理及智能体任务等高性能场景设计。用户可通过官方 API 标准通道或网页端直接使用,全场景工作流实现无缝衔接。此次活动旨在以更低成本释放顶级 AI 生产力,即日起用户可登录 B.AI 平台体验。