Hugging Face 与 Google Cloud 达成新合作,共建开放模型生态
Hugging Face 宣布与 Google Cloud 建立更深层合作,让企业用开放模型构建自有 AI。
Hugging Face 宣布与 Google Cloud 建立更深层合作,让企业用开放模型构建自有 AI。
Hugging Face 发布长文分析全球 AI 算力格局的变化,指出中国开源权重模型的推理已开始由华为昇腾、寒武纪等国产芯片承载,部分模型开始用国产芯片训练。
推荐理由:梳理美国出口管制与中国国产芯片、开源模型之间的因果链,并给出从硬件到软件栈的替代进展时间线。
OpenAI 发布 gpt-oss-safeguard 技术报告,介绍 gpt-oss-safeguard-120b 和 gpt-oss-safeguard-20b 两个开放权重推理模型。二者基于 gpt-oss 模型后训练,能依据给定策略进行推理并对内容打标,报告同时给出以原 gpt-oss 模型为基线的安全评估结果。
OpenAI 发布 gpt-oss-safeguard,这是一组用于安全分类的开放权重推理模型。开发者可以基于它应用并迭代自定义策略。
IBM 发布 Granite 4.0 家族最小的 Granite 4.0 Nano,含 4 个 instruct 模型及对应 base 版本,参数规模从约 350M 到约 1.5B,采用 hybrid-SSM 与 Transformer 两种架构,Apache 2.0 许可并在 vLLM、llama.cpp、MLX 上原生支持。
Hugging Face 改进 datasets 库的流式加载,load_dataset(streaming=True) 接口保持不变,启动请求最多减少 100 倍、数据文件解析快 10 倍、流式速度最多提升 2 倍。
推荐理由:官方给出流式加载的请求数、解析时间和吞吐变化,读者可据此判断大规模训练的数据管线是否值得切换。
Hugging Face 发布 huggingface_hub v1.0,这是该库五年来的首个大版本,带来破坏性变更。主要变化包括后端从 requests 迁移到 httpx、全新的 hf CLI 取代已弃用的 huggingface-cli、文件传输全面改用 hf_xet 替代 hf_transfer。
推荐理由:官方梳理了五年演进与 v1.0 的破坏性变更,读者可据此判断升级成本与迁移路径。
Hugging Face 发布 LeRobot v0.4.0,为开源机器人学习带来 LeRobotDataset v3.0、硬件插件系统以及 PI0.5、GR00T N1.5 等 VLA 模型集成。
推荐理由:LeRobot v0.4.0 把数据集、VLA 策略与硬件插件整合进同一开源栈,可据此判断机器人学习工具链的成熟度。
Meta 与 Hugging Face 合作推出 OpenEnv Hub,一个面向智能体环境的开放共享社区平台,环境可用于训练和部署。下周起开发者可在 Hugging Face 上访问该 Hub,以人类智能体身份直接与环境交互、让模型在环境中解题,并查看环境暴露的工具和观测定义;符合 OpenEnv 规范的环境上传后自动获得这些功能。
推荐理由:Meta 与 Hugging Face 联合推出智能体环境共享 Hub,并公开 0.1 规范草案,读者可据此了解智能体训练与部署环境的标准化路径。
Sentence Transformers 从 TU Darmstadt 的 UKP Lab 转由 Hugging Face 维护,Hugging Face 的 Tom Aarsen 自 2023 年底起已负责该项目并将继续领导。
Hugging Face 宣布与威胁情报与恶意软件分析平台 VirusTotal 合作,从即日起对 Hub 上 220 万以上公开模型和数据集仓库进行持续扫描。
Hugging Face 发布指南,介绍如何用 Chandra、OlmOCR-2 等开源权重 OCR 模型搭建文档处理流水线,并给出各模型的 OlmOCR 评测分数。指南覆盖模型能力对比、微调与开箱即用的取舍、选型要点,以及用多模态检索和文档问答超越传统 OCR。
Hugging Face 为开源工具 AI Sheets 发布重大更新,新增视觉支持,可在表格中查看、分析图像并抽取信息,也能从文本生成图像和编辑图像,全部由 Inference Providers 上的开放模型驱动。
Hugging Face 发起 AI for Food Allergies 项目,计划打造首个社区驱动的研究实验室,探索 AI 如何推进食物过敏研究。全球约 2.2 亿人患有至少一种食物过敏,美国约占总人口 10%。项目将连接前沿 AI 与生物医学,开发开放协作项目,服务研究者、临床医生和患者。
Intel 与 Hugging Face 联合在 Google Cloud C4 虚拟机(Intel Xeon 6 处理器)上对 OpenAI GPT OSS 大模型做文本生成基准测试,相比上一代 C3 实例实现 1.7 倍 TCO 提升,TPOT 吞吐/vCPU/美元提升 1.4 至 1.7 倍,每小时价格更低。
NVIDIA 发布 Nemotron-Personas-India,首个对齐印度真实人口、地理与文化分布的开放合成 Indic 人物数据集,采用 CC BY 4.0 许可。
Arm 将于 10 月 22-23 日参展 PyTorch Conference,展示基于 PyTorch 和 ExecuTorch 的 AI 应用开发与部署方案。
Hugging Face 推出 BigCodeArena,这是首个通过实际执行来评估代码生成模型的人类参与平台,支持 10 种语言和 8 种执行环境,可实时运行模型生成的代码并投票。平台自 2025 年 2 月上线以来已收集超 14,000 段对话、4,700+ 条偏好投票,覆盖 10 个前沿 LLM,o3-mini 与 o1-mini 在 Elo 排名中稳居第一梯队。
Hugging Face 发布 Retrieval Embedding Benchmark(RTEB)beta 版,用公开与私有数据集混合的方式评估嵌入模型的真实检索泛化能力。该基准覆盖 20 种语言,聚焦法律、医疗、代码、金融等企业领域,默认榜单指标为 NDCG@10,私有数据集由 MTEB 维护者评测,部分模型在私有集上出现明显性能下滑。
Hugging Face 用 OpenVINO.GenAI 在 Intel Core Ultra 上加速 Qwen3-8B,以 Qwen3-0.6B 为草稿模型做投机解码,生成速度提升约 1.3×;再对草稿模型剪掉 28 层中的 6 层并用 Qwen3-8B 生成的合成数据微调,加速比进一步升至约 1.4×。
NVIDIA 发布首个面向日本的主权 AI 开源合成数据集 Nemotron-Personas-Japan,含 600 万条日语合成人物画像(100 万条记录、每条 6 个画像),总 token 约 14 亿,采用 CC BY 4.0 许可,可商用。
Hugging Face 的 Swift 库 swift-transformers 发布 1.0 版本,为 Apple Silicon 平台本地模型推理提供 Tokenizers、Hub、Models and Generation 组件,Tokenizers 与 Hub 升级为顶层模块。
Hugging Face 发布 Smol2Operator,以 SmolVLM2-2.2B-Instruct 为基线,通过两阶段训练让原本无 grounding 能力的视觉语言模型获得 GUI 操作与智能体推理能力。
Hugging Face 发布 GAIA 的后继智能体基准 Gaia2,并开源配套的 Meta Agents Research Environments(ARE)框架,用于运行、调试和评测智能体。
推荐理由:GAIA 后继基准 Gaia2 转向读写与噪声环境,配套 ARE 框架可复现评测,便于对照各家模型在真实任务上的差距。
Hugging Face Hub 新增 Scaleway 作为 Inference Provider,用户可直接在模型页调用 gpt-oss、Qwen3、DeepSeek R1、Gemma 3 等开源权重模型。
Cloud Security Alliance 与 Noma Security 联合推出 RiskRubric.ai,为 AI 模型提供标准化风险评估,Haize Labs 和 Harmonic Security 参与贡献。
推荐理由:材料给出六个风险维度与 A-F 评级的具体做法,可了解开放模型安全评估的标准化路径。
Public AI 现已作为 Inference Provider 接入 Hugging Face Hub,用户可直接在模型页和 JS/Python 客户端 SDK 中调用 Swiss AI Initiative、AI Singapore 等机构的公开与主权模型。
Hugging Face 发布博客,介绍为支持 OpenAI gpt-oss 系列而在 transformers 中引入的多项升级,包括可从 Hub 下载的零构建内核、MXFP4 量化、张量并行、专家并行、动态滑动窗口层与缓存、连续批处理与 Paged Attention,以及更快的模型加载。
推荐理由:Hugging Face 官方拆解了为 gpt-oss 引入的六项 transformers 升级,读者可据此了解这些优化如何迁移到其他模型。
Together AI 与 Hugging Face 联合推出新能力,Hugging Face Hub 上任意兼容 LLM 均可通过 Together AI 基础设施微调,支持公开和私有仓库,训练完成后可自动上传回 Hub。
Hugging Face 发布 Jupyter Agent 项目,通过生成高质量 notebook 训练数据并微调 Qwen3-4B,使其在 DABStep 数据科学基准上成为最强小模型智能体。
Hugging Face 发布教程,介绍如何在 ZeroGPU Spaces 上用 PyTorch 提前编译(AoT)替代即时编译,在 Flux、Wan、LTX 等模型上获得 1.3 至 1.8 倍加速。
推荐理由:Hugging Face 官方给出在 ZeroGPU Spaces 上做 AoT 编译的完整步骤与实测加速比,可直接迁移到自己的演示应用。
NVIDIA 发布 Nemotron Post-Training Dataset V2,将此前英文推理数据翻译为法语、德语、意大利语、日语和西班牙语五种语言,共 600 万多语言推理样本。
推荐理由:NVIDIA 公开了多语言推理数据集的构建流程与筛选比例,读者可据此了解后训练数据的翻译与幻觉控制方法。
Hugging Face 发布 kernel-builder 库,让开发者可在本地开发自定义 CUDA kernel,再针对多种架构构建并发布到 Hugging Face Hub 供他人通过 get_kernel 直接调用。
Arm 与 ExecuTorch 0.7 beta 将默认启用 KleidiAI,为基于最新 Arm CPU 架构以及大量旧款手机的设备带来自动加速,Android 与跨平台开发者无需改代码即可通过 ExecuTorch 和 XNNPack 获得优化。
推荐理由:Arm 与 ExecuTorch 团队说明了 KleidiAI 默认启用后,旧款 Arm 设备也能跑起端侧 LLM 的路径与实测数据。
Hugging Face 发布开源无代码工具 AI Sheets,可在表格界面中通过提示词构建、转换和丰富数据集,支持调用 Hub 上数千个开放模型(含 OpenAI 的 gpt-oss)或本地模型。
推荐理由:Hugging Face 官方开源的无代码数据集工具,读者可了解如何用开放模型批量构建、标注和评测数据。
Hugging Face 在 Accelerate 中联合 Axolotl 集成了 ND-Parallel 功能,支持在训练脚本中任意组合数据并行、FSDP、张量并行与上下文并行等策略。
Hugging Face 的 TRL 新增面向视觉语言模型的对齐支持,包括混合偏好优化 MPO、多模态 GRPO 以及 Qwen 提出的 GSPO,并扩展 RLOO 和 Online DPO 到 VLM。
推荐理由:TRL 把 MPO、GRPO、GSPO 等对齐方法扩展到视觉语言模型,并给出可直接运行的训练脚本,读者可据此判断多模态后训练的工具选择。
Hugging Face 发布开源免费的实验追踪 Python 库 Trackio,提供本地 Gradio 仪表盘,并可同步到 Hugging Face Spaces 分享。
Hugging Face 将 CLI 从 huggingface-cli 正式更名为 hf,命令按 auth、cache、repo 等资源分组,upload 和 download 保留在根级,旧命令仍可用但会提示弃用警告。
PyArrow 和 Pandas 现已支持 Parquet 内容定义分块(CDC),可在 Hugging Face 的 Xet 存储层上对 Parquet 文件高效去重,只上传或下载发生变化的 chunk,从而降低传输与存储成本。