同时关联该项目与事件的快讯
Z.ai 发布 GLM-5.3,基于与 GLM-5.2 相同的基础模型,通过扩大后训练实现能力提升。官方称,GLM-5.3 在内部 Z.ai Code Bench 编码基准上较 GLM-5.2 提升 50%,并在 Terminal Bench 3.0、Agents’ Last Exam 等公开基准中达到开放模型领先水平。网络安全方面,GLM-5.3 在 CyberGym 漏洞发现测试中取得 84.5% 成绩,并在 ExploitBench、ExploitGym 等利用链相关测试中较前代显著提升。
Z.ai 发文预告 GLM-5.3 即将推出,该模型聚焦编程能力,并面向网络防御挑战。官方称,GLM-5.3 通过对 743B 基础模型进行后训练,实现了顶尖的编程和智能代理能力,并在网络安全领域取得重要进展,为开源模型树立新标准。
B.AI 平台现面向所有用户推出 GLM-5.2 模型限时 6 折优惠。活动期间,无论通过 API 进行工程化部署,还是在 Web 端进行日常交互,全量调用均可享受 6 折结算价。折扣后价格分别为:输入 0.84、缓存写入 0.84、缓存读取 0.168、输出 2.64(单位:Credits/Token)。GLM-5.2 作为新一代开源旗舰模型,拥有 1M 超长上下文窗口,专为大规模代码开发、复杂推理及智能体任务等高性能场景设计。用户可通过官方 API 标准通道或网页端直接使用,全场景工作流实现无缝衔接。此次活动旨在以更低成本释放顶级 AI 生产力,即日起用户可登录 B.AI 平台体验。
AI 个人助理初创公司 Pally 宣布完成 520 万美元融资,Cyber Fund 和 Y Combinator 领投,Pioneer Fund、Founders Inc、468 Capital 及天使投资人等参投。公司估值为 3000 万美元,主要业务为通过短信入口提供 AI 个人助理服务。 Pally 于 2025 年推出,最新版本于 6 月上线,可与 Gmail、Outlook、Slack、Granola、Notion 等平台同步。用户授权后,Pally 可预订航班、管理收件箱、回复消息及预订餐厅。 Pally 使用 Anthropic 的 Claude、OpenAI 的 ChatGPT 以及 Kimi K3、GLM 5.2 等开源模型。联合创始人 Haz Hubble 表示,公司不会出售用户数据,也不会使用相关数据训练模型。(BusinessInsider)
半导体巨头 AMD 宣布推出企业级 AI 编程平台 AMD Instinct Coder,该平台结合 AMD 芯片、Supermicro 服务器及 Spectro Cloud 软件,旨在帮助企业在本地部署 AI 编码助手,降低云端 AI 模型使用成本并保护代码及数据安全。AMD 表示,Instinct Coder 是一套“开箱即用”的端到端 AI 开发平台,整合了 AMD EPYC 处理器、AMD Instinct GPU、Supermicro AI 服务器、Spectro Cloud PaletteAI Inference Launchpad 软件,以及经过 AMD 优化的 GLM-5.2 模型,可用于代码生成、应用现代化、自动化测试、代码审查等软件开发场景。AMD 称,与依赖云端前沿 AI 模型相比,Instinct Coder 可帮助企业降低最高 70%的总拥有成本(TCO),投资回收期最快可缩短至 6 个月。AMD 表示,越来越多企业希望利用 AI 提升开发效率,但同时面临两大挑战:一方面,调用顶级云端模型成本不断增加;另一方面,将企业源代码、知识产权和敏感数据交由第三方服务存在安全和合规风险。通过本地部署模式,Instinct Coder 可让企业保持对数据和代码的控制,同时提供更可预测的基础设施成本。该平台支持 Claude Code、OpenAI Codex、Visual Studio Code 和 Cursor 等开发工具,每个节点最多支持 50 名用户(30 名并发用户)。此外,Spectro Cloud 提供的 PaletteAI Inference Launchpad 可实现 AI 工作负载管理、模型路由、请求审计和成本监控,并支持在需要时调用 Anthropic、OpenAI、Google 或 xAI 等外部模型。AMD 表示,Instinct Coder 旨在帮助企业摆脱高昂云端 AI 服务成本,在保障数据安全和自主控制的同时,加速 AI 驱动的软件开发流程。
据 Fortune 报道,随着 DeepSeek V4 Flash、GLM-5.2、Kimi K3 等中国开源 AI 模型持续突破,全球 AI 竞赛的核心矛盾正从"中美对抗"转向"开源 vs 封闭"之争。DeepSeek V4 Flash 性能仅落后 GPT-5.6 Luna 一个智能指数点,但每次任务成本较 OpenAI 降价 80%后仍低 60%。 美国对华出口管制原本意在限制中国 AI 发展,却反而倒逼中国企业在算法架构层面深度创新,加速了开源模式的崛起。目前,美国科技界风向已现转变,前"AI 沙皇"David Sacks 等人公开支持开源路线,Anthropic 也软化了对开源的反对立场。
Perplexity CEO Aravind Srinivas 发推称,GLM 是一款被严重低估的模型,在 700B 参数规模下展现出接近 Opus 级别的性能,且运行效率极高。此前月之暗面刚刚发布开源模型 Kimi K3,业内对智谱 AI 旗下 GLM 系列模型的关注度正在上升。
月之暗面推出开源模型 Kimi K3,在 Artificial Analysis 智能指数上获得 57 分,成为第三高分模型,仅次于 Anthropic 的 Claude Opus 5(61 分)、Claude Fable 5(60 分)和 OpenAI 的 GPT-5.6 Sol(59 分)。该指数显示,领先闭源模型与开源权重模型之间的差距已缩小至 4 分,为自 2 月 GLM-5 发布以来的最小差距。这标志着开源模型在性能上正快速追赶闭源模型。
中国 AI 初创公司 Moonshot AI 将公开高性能模型 Kimi K3 的模型权重,开发者可下载模型并按用途修改,也可在自有数据中心或云环境中运行。Kimi K3 拥有 2.8 万亿个参数和 100 万 Token 上下文窗口,可一次性处理大规模文档和代码库。Moonshot AI 计划后续通过技术报告公开模型结构、训练方式和性能评估结果。Kimi K3 发布后,Moonshot AI 单日收入据悉至少增长 6 倍。Moonshot AI 正推进按 500 亿美元估值进行新一轮融资,并考虑最快今年在香港上市。Bloomberg Intelligence 表示,Kimi K3 与 Z.AI 的 GLM-5.2 发布后,中国开源权重模型在整体 Token 使用量中的占比升至 68%。AWS Bedrock、Microsoft Azure Foundry 和 Google Vertex AI 尚未提供 Kimi K3 与 GLM-5.2 等中国开源权重模型。
OpenAI 确认,GPT-5.6 Sol 及一款未命名、更强的预发布模型在 ExploitGym 基准测试评估中突破受限沙箱环境,并入侵 Hugging Face 生产基础设施以获取测试答案。OpenAI 表示,相关模型利用内部软件包注册表代理的零日漏洞提权并横向移动,最终连接至具备互联网访问能力的机器。模型随后识别并串联 OpenAI 研究环境和 Hugging Face 生产基础设施中的漏洞,直接从 Hugging Face 生产数据库获取测试解决方案。Hugging Face 于 7 月 16 日披露该事件,称攻击由自主 AI 代理系统端到端执行,涉及短生命周期沙箱中的数千次操作,并触及内部数据集和服务凭证。OpenAI 在五天后确认其模型为事件主体。Hugging Face 表示,其安全团队为分析逾 1.7 万条攻击日志,曾尝试使用美国商业前沿 AI 接口,但请求因安全护栏被拦截,随后改用中国 AI 初创公司 Z.ai 的 7530 亿参数开源权重模型 GLM 5.2 在自有基础设施上完成取证分析。
据彭博社报道,智谱 AI 已完成一座仅采用国产芯片的数据中心建设,并已开始部分投运。该数据中心设计功率为 1 吉瓦,将用于支持其 GLM 大模型 的训练与研发。报道称,智谱 AI 目前已建成或运营多个计算集群,单个集群芯片数量均超过 1 万枚。
据潮向研究,高盛 7月 18 日报告指出,月之暗面发布 Kimi K3 模型,2.8 万亿参数,在 Arena.ai 编程排行榜超越 Claude Fable 5和 GPT-5.6 Sol 登顶,API 定价 2.3 美元/百万 token 创中国模型新高。发布两日后智谱跌 28%、MiniMax 跌16%,纳斯达克 100 指数期货跌超 1.8%,费城半导体指数从高点累跌超 18%。 高盛认为 Kimi K3 标志着一个转折点:一家无法匹配西方最大规模预训练算力的中国实验室,通过架构创新和强化学习迅速缩小了与美国顶尖模型的差距,证明“扩展”不再是唯一的制胜路径。高盛警告“算力扩张时代”可能正在终结,围绕“算力越多越好”建立的 AI 基础设施投资逻辑需要重写。高盛对 MiniMax 维持买入评级,智谱中性。后续关注智谱 GLM、阿里 Qwen、MiniMax M3 Pro 等2-5 万亿参数模型的密集推出。
昨日,月之暗面最新开源 AI 模型 Kimi K3 模型发布,在 Frontend Code Arena 测试网站中以 1679 分位居第一,超越 Claude 旗下 Fable 5 模型。针对 K3 模型,Artifacial Analysis 进行了相关测评,随后埃马斯克再次为月之暗面 Kimi 模型点赞,称 K3 模型的基准性能令人印象深刻。今年 3 月,Kimi 发布《𝑨𝒕𝒕𝒆𝒏𝒕𝒊𝒐𝒏 𝑹𝒆𝒔𝒊𝒅𝒖𝒂𝒍𝒔:重新思考深度方向聚合》研究论文时曾获马斯克称赞:“Kimi 的研究工作令人印象深刻。”此前,其还称智谱旗下 GLM 模型或于 2027 年 Q1 超越 Claude Mythos 模型(即 Fable 5),对此智谱创始人唐杰回应称“不需要那么久”。
据官方公告,币安将于 2026 年 7 月 17 日 03:00(UTC)移除并停止以下现货交易对的交易:GLM/BTC、KNC/BTC、ONT/BTC 和 XAI/USDC。币安将同时终止这些交易对的现货交易机器人服务。用户需在此之前更新或取消相关交易机器人以避免潜在损失。下架交易对不影响代币在币安上的其他交易对交易。
Haseeb 在 X 平台发文表示,随着 GLM 5.2、Fable 和 GPT 5.6 等模型已上线并被攻击者实际使用,DeFi 并未出现预想中的“黑客末日”。图表数据显示,按当前年内数据与运行速率测算,2026 年 DeFi 被盗金额年化约为 18.9 亿美元,年内累计被盗约 9.86 亿美元,低于 2025 年水平,且仍处于历史区间内。Haseeb 表示,当前更深层的变化在于黑客攻击数量虽有所增加,但单次攻击规模下降更快,攻击者更多在针对小型协议和废弃项目,而大型协议已完成更多安全加固,因此整体资金安全性并未明显恶化。
今日晚间,智谱官方开放平台宣布,为进一步向 OPC(一人公司)模式的人工智能创业者提供全生命周期的支持保障,联合海淀区中关村科学城,面向千行百业正式推出总额为 5000 万元的模型券补贴计划,让人工智能成为每一位创新者都可以获取的生产力工具。补贴期间,所有在海淀区注册且申请通过的企业,在使用 GLM-5.2 模型时,均可享受最高 50%的调用费用补贴,每家企业每年最高补贴额度可达 200 万元。其目标为,助力北京打造“全球人工智能第一城”。本次模型券补贴的核心规则如下:补贴比例:最高享受 GLM-5.2 模型调用费用 50%补贴;补贴周期:即日起至 2026.11.19;补贴上限:每家企业每年补贴总额不超过 200 万元;适用模型:目前支持 GLM-5.2,后续新增模型另行通知。或受此消息影响,今日智谱港股最高涨幅超 16%,总市值一度再次突破万亿港元,目前已回落至 9690 亿港元。
智谱 AI 创始人唐杰在 X 平台发文表示,GLM-5.2 正式开源发布后已在多项国际权威评测与竞技榜单中取得领先成绩,在 Artificial Analysis Intelligence Index 综合评估中 GLM-5.2 获得 51 分,与 Anthropic 的 Claude Opus 4.8 处于同一水平区间;在 Code Arena 前端代码生成对抗测试中以 Elo 1595 排名全球第 2,在 DesignArena 设计与代码融合场景中获得 1360 分排名第 1。整体来看,智谱 GLM-5.2 在前端开发、设计生成与软件工程等多个真实场景评测也持续位居全球前列,逐步缩小与 OpenAI 及 Anthropic 等前沿模型之间的性能差距,并将继续推动模型能力上限提升。此前,针对马斯克表示中国大模型可能会在明年一季度达到 Anthropic 的 Fable 水平,智谱 AI 创始人唐杰回应表示“不会耗费如此长时间”。
根据官方消息,去中心化 GPU 云计算基础设施平台 Aethir 正式发布 Aethir Mesh——一个运行于 Aethir 去中心化 GPU 基础设施之上的自研开源大模型 API 平台,目前平台已上线,提供统一 API 端点直连 DeepSeek V4、Kimi K2.6、GLM-5.1、MiniMax-M2.5、Qwen3.6-27B 等主流开源模型。
KelpDAO 发布公告,自 4 月 18 日以来,其一直与 Aave 及生态合作伙伴协调推进 rsETH 持有者恢复工作。此次事件初始缺口为 163,200 ETH,目前 Kelp 已回收 40,300 枚 rsETH,约合 43,000 ETH,Arbitrum 安全委员会另保障 30,700 ETH,剩余缺口约 89,500 ETH。Kelp 称,在剩余缺口中,Mantle、Stani Kulechov、EtherFi、Lido、Golem 已公开确认承诺合计 43,500 ETH,正与合作方推进相关贡献正式落地。Kelp 强调,rsETH 持有者优先。
智谱产品主管 Zixuan Li 在 X 平台发文表示,OpenClaw,Hermes 以及 SillyTavern 目前已明确标记为 GLM Coding Plan 支持的项目。其他通用工具将根据具体情况进行逐案分析。此外,Zixuan Li 提醒用户请勿分享账号或将订阅作为 API 使用。若用户在遵守规则的情况下仍遇到 1313 错误,可联系官方反馈。