GetChain News
中简 中繁 EN
GetChain News
Toggle sidebar

上线/更新

同时关联该项目与事件的快讯

英伟达考虑调降 Rubin Ultra GPU 配置,应对 HBM 内存短缺

英伟达为应对 HBM 内存供应短缺,考虑降低新一代 Rubin Ultra GPU 的配置。据 The Information 援引知情人士消息,英伟达内部在过去数周至少测试了 3 种低 HBM 配置的 Rubin Ultra GPU,所需 HBM 容量低于最初公布规格。可能的降级路径包括从 HBM4E 下调至 HBM4、从 12Hi HBM 下调至 8Hi HBM。此举旨在在供应约束下推进产品发布计划。

西部数据:AI 存储竞争不是“闪存大战 HDD”,经济可扩展性才是关键

西部数据首席产品官 Ahmed Shihab 发布长文指出,随着人工智能基础设施快速扩张,存储领域的核心竞争不应简单归结为闪存(Flash)与机械硬盘(HDD)的较量,而在于能否构建具备长期经济可扩展性的 AI 存储架构。当前 AI 行业正面临一个关键问题:今年选择的存储架构,是否能够支撑未来数据规模增长至 PB 级甚至 EB 级,许多 AI 基础设施设计并非因性能不足而失败,而是在数据规模扩大后陷入成本困境。 Ahmed Shihab 补充称,闪存和 HDD 并非竞争关系,而是面向不同工作负载的互补技术。高性能场景,如模型权重、GPU 溢出、KV 缓存等,需要低延迟闪存支持;而训练数据集、日志、检查点、合规记录以及大规模历史数据等长期存储需求,则更适合采用具备成本优势的 HDD。AI 时代的存储架构将更加分层化,而不是依赖单一存储介质。“闪存负责关键时刻的性能,HDD 负责数据生命周期。未来 AI 存储的发展方向并非“闪存取代 HDD”,而是根据不同数据生命周期和业务需求进行精准分层。“真正的基础设施不是追求炫目的性能,而是能够支撑 AI 长期增长的可靠底座。” 美股行情显示,西部数

AI研究公司Mirendil与谷歌云达成超1亿美元算力协议

AI 研究初创公司 Mirendil 已与 Google Cloud 达成多年期合作协议,将获得大规模计算资源支持其“自我改进型 AI”(Self-Improving AI)研发。根据协议,Mirendil 将获得谷歌云提供的 TPU 和英伟达 GPU 算力资源,以及托管式 AI 训练集群,用于开发能够持续优化自身能力的 AI 系统。据悉,Mirendil 致力于研发“递归自我改进”(Recursive Self-Improvement)AI,即 AI 系统能够通过不断迭代、自我学习和优化,提高自身性能。该方向也是当前部分顶级 AI 实验室关注的研究领域。Mirendil 联合创始人兼 CEO Benham Neyshabur 透露,该协议总价值超过 1 亿美元,约相当于公司 6 月底完成的 10 亿美元估值种子轮融资金额的一半。(TechCrunch)

AMD推出AI编程平台Instinct Coder,可降低企业AI编码成本70%

半导体巨头 AMD 宣布推出企业级 AI 编程平台 AMD Instinct Coder,该平台结合 AMD 芯片、Supermicro 服务器及 Spectro Cloud 软件,旨在帮助企业在本地部署 AI 编码助手,降低云端 AI 模型使用成本并保护代码及数据安全。AMD 表示,Instinct Coder 是一套“开箱即用”的端到端 AI 开发平台,整合了 AMD EPYC 处理器、AMD Instinct GPU、Supermicro AI 服务器、Spectro Cloud PaletteAI Inference Launchpad 软件,以及经过 AMD 优化的 GLM-5.2 模型,可用于代码生成、应用现代化、自动化测试、代码审查等软件开发场景。AMD 称,与依赖云端前沿 AI 模型相比,Instinct Coder 可帮助企业降低最高 70%的总拥有成本(TCO),投资回收期最快可缩短至 6 个月。AMD 表示,越来越多企业希望利用 AI 提升开发效率,但同时面临两大挑战:一方面,调用顶级云端模型成本不断增加;另一方面,将企业源代码、知识产权和敏感数据交由第三方服务存在安全和合规风险。通过本地部署模式,Instinct Coder 可让企业保持对数据和代码的控制,同时提供更可预测的基础设施成本。该平台支持 Claude Code、OpenAI Codex、Visual Studio Code 和 Cursor 等开发工具,每个节点最多支持 50 名用户(30 名并发用户)。此外,Spectro Cloud 提供的 PaletteAI Inference Launchpad 可实现 AI 工作负载管理、模型路由、请求审计和成本监控,并支持在需要时调用 Anthropic、OpenAI、Google 或 xAI 等外部模型。AMD 表示,Instinct Coder 旨在帮助企业摆脱高昂云端 AI 服务成本,在保障数据安全和自主控制的同时,加速 AI 驱动的软件开发流程。

Bitdeer签署16年AI数据中心租约总收入规模达47亿美元

Bitdeer 宣布,子公司 Tydal Data Center AS 已与 Volta Tydal AS 签署一项为期 16 年的数据中心托管及服务协议,将在挪威 Tydal AI/HPC 园区提供 121 MW IT 负载容量(约 133 MW 总功率),全部用于部署 NVIDIA GPU,并服务一家头部 AI 实验室。协议基础期限内预计合同付款总额约为 47 亿美元,并附带 8 年续约选项,续约后的潜在合同总价值约为 80 亿美元。(Stocktitan)

SK海力士与闪迪公开HBF首个标准规格,容量最高512GB

SK 海力士与闪迪公开基于 NAND 闪存的下一代存储技术高带宽闪存(HBF)首个标准规格。SK 海力士于 8 月 4 日至 6 日在美国加州圣克拉拉举行的 FMS 2026 上提出该规格。HBF 通过类似高带宽内存(HBM)的垂直堆叠方式堆叠 NAND 闪存,以提升容量和数据传输速度。该规格按 8 层和 16 层 NAND die 两种堆叠配置定义,容量最高 512GB,带宽分三档,支持每秒 0.4TB 至 3.0TB。HBF 与处理器的连接方式采用行业标准 UCIe,可连接 GPU、CPU 等不同类型处理器。该规格通过开放数据中心技术协作组织 OCP 公开,HBF 联盟目前包括 Google 和 AI 半导体公司 Tenstorrent。SK 海力士还将在本次活动首次公开开发中的第 10 代(V10)375 层 4D NAND 晶圆和产品,并计划明年初启动采用该技术的高性能、高容量企业级 SSD(eSSD)量产。

铠侠推出 GP1 系列高性能固态硬盘,抢占 AI 存储市场

铠侠正式官宣其首款支持 GPU 直接访问高速闪存的 GP 系列固态硬盘 KIOXIA GP1。这一产品实现了 100M IOPS 的极致随机读取性能。铠侠表示 KIOXIA GP1 系列旨在支持将高速闪存介质引入显存系统的新兴 AI 存储架构。这种方法使 AI 系统能够以远低于增加 HBM 的成本访问更大的数据集,同时提高 GPU 利用率。

HIVE财年收入增长158%至2.98亿美元,AI GPU每小时收入约为挖矿设备24倍

HIVE Executive Chairman Frank Holmes 表示,公司位于 Bell Canada 曼尼托巴 AI fabric 的 504 枚英伟达 B200 GPU 集群,每 GPU 每小时收入约 2.90 美元;相比之下,HIVE 比特币挖矿设备每小时收入约 0.12 美元。 HIVE 2026 财年总收入达到 2.98 亿美元,同比增长 158%;比特币挖矿产生的数字货币收入增长 164%。同期平均算力为 22.2 EH/s,同比增长 290%,约占比特币全网算力 3%,并挖出 2885 枚 BTC。 HIVE 旗下 BUZZ HPC 部门承载 AI 和高性能计算业务,收入为 1950 万美元,较上一财年的 1000 万美元增长 94%。公司还与 Bell 及 AI 公司 Cohere 签署约 2.2 亿美元 GPU 云协议,并通过票据发行筹集 7500 万美元用于 AI 基础设施扩建。 HIVE 正在大多伦多地区建设一座 320 兆瓦 AI 数据中心,计划最终容纳超过 10 万枚 GPU。公司表示,该设施若于 2027 年下半年全面上线,年化经常性收入可达到约 3.6 亿美元。

大摩:AI 基建 ROIC 最高可达 46%,超大规模厂商维持超配评级

据潮向研究,摩根士丹利 7月 27 日发布研报,首次量化生成式 AI 投资的增量资本回报率(ROIC)。报告构建三套测算框架,超大规模云服务商 GPU 租赁业务 ROIC 约31%,自有基础设施模型 API 业务 ROIC 约46%,第三方算力 API 业务 ROIC 约25%。基准假设下,单个 1 吉瓦(GW)数据中心配置约 41 万块英伟达 GB300 GPU,利用率 75%,每小时租赁价格 8.5 美元。三大云巨头合计资本支出预计超 1.4 万亿美元。 大摩对微软、亚马逊、Meta、谷歌全部维持超配评级。报告指出,随着 AI 从训练阶段进入推理阶段,GPU 算力需求将持续增长。自建算力厂商凭借算力紧缺生态下的定价权,将获得可观利润。如果大摩的测算成立,这几千亿美元的 AI 资本开支将从“成本”认知切换为“增长资产”认知。

韩国国家 AI 计算中心 8月 3 日正式开工,三星 SDS 联合体主导建设

据韩联社报道,韩国国家 AI 计算中心将于 8月 3 日在全南光州海南市溔라시도企业城市举行开工典礼,正式启动建设。该项目由三星 SDS 联合体(成员包括三星 SDS、NAVER Cloud、三星物产、Kakao、三星电子、KT 等)承建,总投资 2.4 万亿韩元,规划用地面积约 4.9 万平方米。中心计划 2028 年前完成 1.5 万张 GPU 部署,2030 年前进一步扩展至 5 万张,供电规模最终将达 80MW。全南光州特别市预计该项目将带动 6.4 万亿韩元经济效益及 1.95 万个就业岗位。

Axe Compute获15亿美元AI基础设施客户合同,其2026年签署的合同总额超过30亿美元

Axe Compute Inc.(Nasdaq:AGPU)今日宣布与客户签署一项为期五年、总价值超过 15 亿美元的新合同,将在美国部署一个基于 NVIDIA Blackwell 架构的大型专用 AI 基础设施集群。该合同通过 Axe Compute 的 Build 项目获得,将提供超过 9200 块 NVIDIA Blackwell B300 GPU,用于构建一个由 Axe Compute 设计、部署、拥有和运营的专用集群。连同此前公布的 Build 协议,这份新合同使 Axe Compute 在 2026 年签署的合同总额超过 30 亿美元。Axe Compute 预计将在未来 30 天内收到与该协议及此前公布的合同相关的超过 5.34 亿美元的客户预付款,这些款项预计将涵盖大部分相关的 GPU 和基础设施资本支出。Axe Build 项目预计将从本季度开始产生月度收入,更多集群将于 2026 年第四季度激活。预计该协议以及此前宣布的合同将使年度运行率在部署完成后超过 6.96 亿美元,几乎是该公司本月早些时候公布的 3.85 亿美元运行率的两倍。据悉,Axe Compute Inc.是一个基于新云架构的人工智能基础设施平台。

Anthropic技术成员讽刺科技巨头拥抱开源:期待英微软开源Windows、英伟达开源CUDA

Anthropic 技术成员 Julian Schrittwieser 近日在社交平台发文,调侃部分科技巨头近年来对“开源”态度的转变,并称期待英伟达和微软进一步开放核心技术,并表示:“很高兴看到 Jensen Huang 成为开源的支持者,期待 CUDA 和 GPU 驱动开源发布;同时也期待 Satya Nadella 支持开源,希望未来能看到 Windows 和 Microsoft Office 开源。”Julian Schrittwiese 还回应外界关于其反对开放权重模型(open weight models)的猜测,表示这种解读并不准确。他认为,开放模型实际上可以在很多场景中发挥重要作用。不过,Schrittwieser 指出,令人感兴趣的是,一些过去长期对开源持非常谨慎甚至反对态度的公司,如今正在迅速转向支持开放生态。近年来,随着人工智能竞争加剧,开源模型、开放权重以及开发者生态成为科技行业的重要竞争领域。包括英伟达、微软等企业也不断强调对开放生态的支持,但业内对于“开放”的定义仍存在争议——部分企业开放模型接口、工具链或生态,而核心商业资产仍保持闭源。Julian Schrittwiese 的言论也引发讨论,焦点集中在科技巨头推动“选择性开源”是否代表真正的开放,还是一种新的生态竞争策略。

Axe Compute 新签超 13 亿美元 AI 基础设施合同,部署后 ARR 预计超 3.84 亿美元

Axe Compute(NASDAQ:AGPU)表示,公司已在美国和欧洲签署总额超过 13 亿美元的新客户合同,提前超过 2026 年全年 10 亿美元的签约目标。相关合同通过 Axe Compute Build 项目达成,公司将为客户设计、部署、持有并运营专用 AI 基础设施,客户可自主选择 GPU 类型、部署地区及基础设施配置。

Bitdeer 6月挖出990枚比特币,AI Cloud年化收入运行率达7600万美元

比特币矿企 Bitdeer Technologies Group 6 月挖出 990 枚比特币,较 5 月的 921 枚增长 7.5%,较去年同期的 203 枚增长 388%。截至 6 月底,其自营挖矿算力达到 73 EH/s,5 月为 70.2 EH/s,去年同期为 16.5 EH/s。 Bitdeer 6 月自营挖矿机器数量增加 1.2 万台至 24.3 万台,并在第三方数据中心以联合挖矿安排运营 5.6 万台自有矿机。相关算力环比增长 59% 至 15.9 EH/s。公司 6 月底持有 150 枚比特币,低于 5 月底的 171 枚。 Bitdeer 表示,其 AI Cloud 年化收入运行率由 5 月的 6900 万美元增至约 7600 万美元,GPU 利用率由 90% 升至 95%,外部订阅 GPU 数量由 3305 块增至 3517 块。该运行率由月末仍有效的合同 GPU 订单日收入年化计算,不属于已确认年收入或收入预测。 Bitdeer 已完成一份五年期 GPU 云合同的客户交付,相关部署包括两个 英伟达 GB300 NVL72 集群。公司还签署马来西亚新山一处数据中心 10 年租约,提供 21.7 兆瓦信息技术容量,计划于 2027 年第一季度交付,并支持 128 套 英伟达 GB300 NVL72 系统。

微软与Mistral扩大AI合作,签署数十亿美元欧洲AI基础设施协议

微软与法国人工智能初创公司 Mistral AI 于 7 月 21 日宣布扩大双方战略合作,围绕欧洲 AI 基础设施建设达成一项价值数十亿美元的协议,以提升欧洲地区 AI 计算能力。根据协议,微软将利用 Mistral 扩大的欧洲 GPU 基础设施,为其云计算和 AI 服务提供支持。该基础设施将基于数千颗英伟达 Vera Rubin GPU。产品方面,Mistral Medium 3.5 和 OCR 4 模型现已接入微软 Foundry 平台,Mistral Medium 3.5 同时加入 Microsoft Copilot Studio,可用于智能体应用、文档处理流程及行业定制化工作流。此外,双方将通过 Azure 和 Azure Local 扩展 AI 部署方式,支持云端、云连接以及完全离线环境,面向金融、医疗、制造等对数据合规要求较高的行业。(财联社)

Bitdeer 6月挖矿产出990枚BTC,同比增长388%

纳斯达克上市的比特币矿企 Bitdeer 发布 2026 年 6 月未经审计生产运营更新。公司 6 月比特币挖矿产出 990 枚,同比涨 388%;自挖算力 73EH/s,合计管理总算力 86.1EH/s,自有矿机 24.3 万台。旗下 Sealminer 内华达制造工厂已动工,预计 2026 年底竣工。AI 云业务方面,月度 ARR 提升至 7600 万美元,GPU 利用率 95%,已完成英伟达 GB300 NVL72 集群交付。目前 Bitdeer 全球总可控电力容量达 3.02 吉瓦,多地加密机房同步推进转型 AI 算力中心计划。(Globenewswire)

AMD发布AI机架系统Helios,微软、Meta等巨头加入部署阵营

AMD 正式推出首款面向人工智能的机架级 AI 系统 Helios,被视为 AMD 对标英伟达 Grace Blackwell 和 Vera Rubin AI 系统的重要产品,并获得微软、Meta、OpenAI、Oracle 等企业客户采用,试图在 AI 基础设施市场向英伟达发起更直接竞争。微软宣布将在 Azure 数据中心部署 AMD Helios 系统,成为最新一家采用该平台的客户。AMD 表示,Helios 预计将于今年晚些时候开始向客户交付,并用于支持前沿 AI 模型推理、Azure AI 服务以及企业级 AI 应用。市场分析机构 Futurum Group 数据显示,英伟达目前占据数据中心 GPU 市场超过 95%的份额,而 AMD 约占 4.5%。分析人士认为,如果 Helios 部署顺利,AMD 未来有机会获得 20%-25%的市场份额,对应数千亿美元规模的潜在市场空间。(CNBC)

Kimi K3需求远超预期,暂停开放新订阅并扩容算力

Kimi 在 X 平台发文表示,K3 上线后获得的市场反响远超预期,过去 48 小时内用户需求已接近现有 GPU 算力容量上限。为保障现有订阅用户的使用体验,已暂时暂停开放新的订阅服务。目前已订阅用户的使用不会受到影响,公司正在尽快扩充算力资源,并将在后续分批恢复新用户订阅资格。此外,未来会员体系将拆分为两类更具针对性的产品,包括面向 Kimi 网页端、App 及办公场景的“Kimi Membership”,以及专注编程工作流的“Kimi Code Membership”,以实现更精准的算力分配并提升服务稳定性。

韩国政府计划投入约4万亿韩元采购1万枚英伟达Vera Rubin GPU

韩国政府计划明年投入约 4 万亿韩元,采购 1 万枚英伟达最新 GPU Vera Rubin,以支持“全民 AI”等面向公众的服务扩展及国家级 AI 基础设施建设。 韩国科学技术信息通信部计划延长“AI 计算资源利用基础强化项目”,并将明年引入的 GPU 全部配置为 Vera Rubin。该项目由运营数据中心的云服务提供商等民营企业负责 GPU 购买、建设和服务全流程,资金来自政府预算。 韩国政府过去两年通过该项目等方式累计 확보超过 3 万枚 GPU,并向公共和民间部门提供。Vera Rubin 相比上一代 Blackwell 架构,训练性能最高提升 6 倍,推理性能提升逾 8 倍。 韩国科学技术信息通信部相关人士表示,GPU 확보计划和预算规模尚未确定。行业人士表示,目前数据中心空间余量不足,明年前 확보大规模新增资源并不容易,政府正在评估多种替代方案。

分析师:Kimi K3超大模型即将开源,AI基础设施平台或成为最大受益者

分析师 KawzInvests 表示,Moonshot AI(月之暗面)即将发布的 Kimi K3 可能成为开源 AI 领域的重要事件,其背后的基础设施需求或将推动 AI 云服务平台增长。Kimi K3 拥有约 2.8 万亿参数规模,是目前超大规模开源模型之一。Moonshot 官方评测显示,该模型性能仅落后于 Claude Fable 5 和 GPT 5.6 Sol 等前沿模型,完整模型权重预计将于 7 月 27 日开放。KawzInvests 指出,如此规模的模型无法在普通笔记本电脑甚至单台服务器上运行,用户需要由大量 GPU 组成的计算集群才能完成模型加载和推理。当顶级开源模型免费开放时,受益最大的可能并非普通用户,而是提供模型托管和推理服务的平台。以$DOCN(DigitalOcean)为例,其目前已支持 Kimi K2.6 等模型的无服务器推理服务。开发者无需部署硬件,只需通过 API 调用模型并按 Token 付费即可使用。此外,该平台还提供 70 多个模型托管服务,并覆盖 GPU 租赁、模型微调以及 AI Agent 开发工具。随着越来越多大型开源模型发布,开发者对于低门槛 AI 基础设施的需求将持续增加,模型托管、推理服务和 GPU 云平台可能成为开源 AI 浪潮中的关键受益方向。