美光电话会:2027 年超 75% 产能已售出,看不到供需平衡拐点
美光 2026 财年第四财季营收 542 亿美元、毛利率 87%,全年营收 1332 亿美元为上一财年的 3.5 倍,数据中心收入翻四倍。电话会上管理层称已签署 26 份战略客户协议,剩余履约义务约 1500 亿美元,2027 年超 75% 产出已获客户承诺,多数谈判转向 2028 年,并预计 2027、2028 财年存储供需比 2026 年更紧张。
美光 2026 财年第四财季营收 542 亿美元、毛利率 87%,全年营收 1332 亿美元为上一财年的 3.5 倍,数据中心收入翻四倍。电话会上管理层称已签署 26 份战略客户协议,剩余履约义务约 1500 亿美元,2027 年超 75% 产出已获客户承诺,多数谈判转向 2028 年,并预计 2027、2028 财年存储供需比 2026 年更紧张。
Google 的轨道计算卫星原型随 SpaceX 火箭从加州升空,这是该公司首次把自研芯片送入太空,卫星由 Planet Labs 建造,将验证 TPU 能否在轨运行。
Apple 修改全盘访问权限机制,以遏制 AI 智能体滥用。Meta 认为 FDA 不足以监管 Muse 读取消息,Apple 对此持不同意见。
Airbnb CTO Ahmad Al-Dahle 介绍了公司向 AI-native 转型的做法:目前 60% 的代码由 AI 编写,功能交付量同比增长近 80%,工程师人均 PR 吞吐量提升约 1.6 倍。
微软宣布将"仿生学"(biomimicry)设计推广到美国与德国 20 多个数据中心站点,通过增加花园、本地树木和生态修复,把设施"融入自然景观"。微软称自 2022 年起已在荷兰一处数据中心试点该方案,并承诺在美国所有新项目中采用。此举正值美国多地社区抗议数据中心带来的噪音、污染、砍树和水电账单上涨,微软 2022 年曾在圣安东尼奥为建数据中心砍伐逾 2600 棵树。
NVIDIA 提出 AI 工厂投资回报取决于三个因素:每兆瓦产出能力、硬件使用寿命和 token 需求,其平台以高吞吐、长服役周期和通用性同时优化这三项。SemiAnalysis AgentX 数据显示,Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 上每百万 token 成本最多低 45 倍。
CoreWeave 宣布在 CoreWeave Cloud 上提供 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网网络,成为首批交付该平台的云厂商之一,Cognition 是首个在生产环境运行 Vera Rubin 的客户。
推荐理由:CoreWeave 上线 Vera Rubin NVL72 并公布 Devin 实测吞吐数据,可据此判断智能体编码的算力成本走向。
Mistral 在慕尼黑开设德国中心,组建专注 Physics AI 与工业 AI 的研究团队,并计划到 2030 年建成 1 吉瓦欧洲算力。该中心将与 BMW 合作碰撞仿真、与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学(TUM)合作利用风洞设施开发汽车空气动力学数字孪生。
Google DeepMind 公布 Private AI Compute 的新技术能力,将持久化服务端记忆引入该平台,使 AI 助手能在多设备间保留上下文,同时维持接近端侧的隐私标准。
推荐理由:Google 公开了云端持久记忆的加密与验证机制,可据此了解跨设备 AI 记忆如何兼顾隐私。
NVIDIA 推出 DSX Ready 认证计划,用于评估合作伙伴产品是否符合 NVIDIA DSX AI 工厂参考设计要求,首批覆盖电池储能系统(BESS)和冷却分配单元(CDU)两类。
NVIDIA 发布 Halos,称其为首个也是唯一面向物理 AI 的全栈安全系统,覆盖设计、验证与部署各层。
NVIDIA 在开罗大埃及博物馆举办活动,展示埃及 AI 生态从能力建设走向规模化落地,其 Deep Learning Institute 埃及学员规模一年增长超十倍。
NVIDIA 在纽约气候周上介绍了 5 家用 AI 推进清洁能源的公司:ThinkLabs AI 用数字孪生和智能体把南加州爱迪生评估每份电网并网申请的时间从 30-45 天缩短到 2 分钟。
NVIDIA 在 MLPerf Inference v6.1 首次提交 Vera Rubin NVL72 预览结果,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高达 2.5 倍。
推荐理由:MLPerf v6.1 首次提交数据给出 Vera Rubin NVL72 相对 GB300 的吞吐倍数与 99% 扩展效率,可作推理基础设施选型的量化参照。
Cloudera 与 Mistral 宣布合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持完全控制。合作还支持企业用专有数据在受控环境中训练自有模型,覆盖 Cloudera 平台上 30 exabytes 的客户管理数据。
Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,由三星电子领投,Scaleup Europe Fund 与 PSG Equity 联合领投。公司称这是欧洲科技企业完成的最大规模股权融资,资金将用于扩展前沿研究、算力与商业增长。Mistral 目前业务覆盖 20 个国家,服务 125 家以上全球企业,包括 Airbus、ASML 和 HSBC。
推荐理由:Mistral 完成欧洲最大股权融资,读者可了解其主权开源全栈路线与投资方结构。
Mistral 与 HUMAIN 宣布战略合作,覆盖 AI 基础设施、先进模型开发与 AI 解决方案部署,初期聚焦网络安全和语音,并计划开发阿拉伯语表现强劲的前沿模型。合作规模达数亿欧元,Mistral 将探索使用 HUMAIN 数据中心基础设施,双方还将在沙特面向受监管行业制定联合市场策略。
加州大学圣地亚哥分校在 Google 支持下,正用 2000 台退役 Pixel 手机的主板搭建数据中心,为数百名师生提供低成本、低碳的云计算。SPEC 基准显示 25-50 台手机约等于一台现代服务器,手机主板占硬件隐含碳排约 50%。该系统预计 2026 年秋季上线。
Mistral AI 本周签署最终协议,收购奥地利 Physics AI 公司 Emmi AI,以强化其面向工业企业的 AI 转型服务能力。Emmi AI 专注物理 AI 与大型工程模型,可将多日计算替换为实时仿真并构建数字孪生,其 30 多名研究人员和工程师将于 5 月加入 Mistral 的 Science 与 Applied AI 团队。
推荐理由:Mistral 通过收购补齐物理仿真与工业数据能力,读者可了解其面向工程场景的 AI 布局方向。
OpenAI 公布其与 Department of War 的合同细节,内容涵盖安全红线、法律保护条款,以及 AI 系统在涉密环境中的部署方式。
推荐理由:OpenAI 官方披露与国防部门合同的边界设定,可了解 AI 进入涉密环境的合规与部署约束。
OpenAI 与 Amazon 宣布战略合作,将 OpenAI 的 Frontier 平台引入 AWS。合作范围涵盖 AI 基础设施扩展、定制模型以及企业级 AI 智能体。
推荐理由:OpenAI 与 Amazon 的这次合作把 Frontier 平台接入 AWS,读者可据此了解企业级 AI 基础设施与智能体的落地路径。
OpenAI 宣布推出 Frontier Alliance Partners,帮助企业从 AI 试点走向生产环境,实现安全、可扩展的智能体部署。
Hugging Face 宣布 GGML 及其 llama.cpp 团队加入,Georgi Gerganov 和团队将全职继续维护 llama.cpp,并保持技术方向与社区上的完全自主权。
推荐理由:官方说明 GGML 团队加入 Hugging Face 后的权责与资源安排,可据此判断 llama.cpp 后续走向。
OpenAI for Government 宣布在 GenAI.mil 上部署定制版 ChatGPT,为美国国防团队提供安全、注重安全的 AI 能力。
Mistral AI 宣布与 SAP 建立多年合作,将自家模型集成进 SAP 的 AI Foundation,共同为德国及欧洲开发主权 AI 技术栈和行业解决方案。Mistral AI 同时与 Helsing 合作加速面向国防与安全应用的 vision-language-action 模型研发,并将在未来数月内在德国开设办公室、大幅扩充本地团队。
Hugging Face 宣布与 Google Cloud 建立更深层合作,让企业用开放模型构建自有 AI。
北爱尔兰 C2k 与 Google for Education 合作的六个月试点中,100 名教师将 Gemini 和 Google Workspace 工具引入课堂,每位参与教师平均每周节省 10 小时,并沉淀出 600 多个 Gemini 使用案例。
Arm 将于 10 月 22-23 日参展 PyTorch Conference,展示基于 PyTorch 和 ExecuTorch 的 AI 应用开发与部署方案。
Hugging Face 宣布 Hub 存储从 Git LFS 迁移到 Xet,6 个月内已有 50 万个仓库、20 PB 数据完成迁移,超过 100 万用户在用 Xet,5 月起成为新用户和组织的默认选项。
推荐理由:官方复盘 Hub 从 Git LFS 迁移到 Xet 的工程细节,可看到大规模存储迁移如何做到对用户零打扰。
Mistral AI 发布 Mistral Compute,提供包含 GPU、编排、API 与服务的私有集成栈,形态从裸金属服务器到全托管 PaaS。该服务将搭载 NVIDIA 参考架构,可提供数万块 GPU,并包含用于区域和行业特定 AI 的训练套件。Mistral 称其面向欧洲、中东、亚洲及南半球等寻求美国或中国云厂商替代方案的机构,强调数据主权与脱碳能源。
推荐理由:Mistral 从模型厂商延伸到自有 AI 基础设施,读者可据此判断欧洲主权算力供给的另一种路径。
微软在 Build 大会上宣布扩大与 Hugging Face 的合作,Azure AI Foundry 的 Hugging Face Collection 现已提供 10,000+ 开源模型,可一键部署到 Azure 安全基础设施,覆盖文本、音频和图像任务。
Hugging Face 的 Xet 团队正在重新设计 Hub 的上传与下载架构,计划引入内容寻址存储(CAS)作为内容分发第一站,并基于"读简单、写智能"理念构建自定义协议。新架构在字节级别分析文件,对 tensor 文件(如 Safetensors)的压缩探索有望将上传速度提升 10-25%。CAS 节点将部署在 AWS 少数区域,以覆盖北美、欧洲和亚洲的主要上传流量。
Hugging Face 的 Xet 团队采用内容定义分块(CDC)将文件拆分为可变大小的块,仅传输和存储修改过的块,从而提升存储与迭代效率。在 CORD-19 数据集基准测试中,Xet 后端将平均下载时间从 51 分钟降至 19 分钟,上传从 47 分钟降至 24 分钟,存储占用从 8.9 GB 降至 3.52 GB。
AMD 发布基于 Zen5 架构的第五代服务器级 EPYC CPU(代号 Turin),最高 192 核 384 线程。Hugging Face 用 Meta Llama 3.1 8B 在 Turin(128 核)与 Genoa(96 核)上对比测试,借助 ZenDNN PyTorch 插件(zentorch)与 bfloat16,多数配置下解码吞吐提升约 2 倍。
视觉沟通软件公司 Prezi 加入 Hugging Face Expert Support Program,将更小、更高效的开源模型整合进其 ML 工作流。Prezi 旗舰产品 Prezi AI 结合视觉模型、文本模型和 VLM,专家建议在素材检索流程中加入开源 re-ranker 模型,以更低成本、更快速度找到最佳图文素材。
Mistral AI 于 6 月 5 日至 30 日举办线上微调黑客松,参赛项目须使用其全新微调 API,提交截止 6 月 30 日。前三名各获 2500 欧元 Mistral API 额度,入选者可申请 100 美元免费额度,需在 6 月 10 日前填写表单。评审按影响力、技术实现、创意和展示各占 25% 打分,团队最多 4 人。
Hugging Face 宣布 AMD Instinct MI300 已在 Hugging Face 平台获得一等公民级集成,用户无需改动代码即可通过 transformers 和 text-generation-inference 在 Azure ND MI300x V5 虚拟机上部署模型。
Hugging Face 与微软在 Microsoft Build 上宣布深化战略合作,将 Llama 3、Mistral 7B、Command R Plus、Qwen 1.5 110B 等热门开源大模型加入 Azure Model Catalog 的 Hugging Face Collection,支持从 Azure AI Studio 一键部署。
Ryght 正式公开发布面向生命科学知识工作者的免费安全平台 Ryght Preview,用于加速药物研发、临床试验与商业化中的数据分析。
AMD 与 Hugging Face 联合启动 Pervasive AI Developer Contest,设生成式 AI、机器人 AI 和 PC AI 三个赛道,总奖金 16 万美元,单个获奖者最高可得 1 万美元,并提供 700 个 AMD 平台供参赛者使用。