跳到正文

#开源生态

今日 0 条
7月21日周二
  1. Hugging Face Blog62

    Hugging Face 发布 Grabette 开源机器人操作数据采集系统

    Hugging Face 发布 Grabette,一套开源低成本的手持夹爪系统,用于记录机器人操作演示数据。它配备广角鱼眼相机和 RGBD 相机,分别负责策略视角与 6-DoF 轨迹追踪,硬件 BOM 成本约 490€,配套的机器人端夹爪 Gripette 约 120€。

    推荐理由:原文给出低成本手持夹爪的完整开源方案与浏览器处理流程,读者可据此判断机器人数据采集门槛的变化。

7月16日周四
  1. Hugging Face Blog88

    Hugging Face 披露 7 月安全事件:自主 AI 智能体驱动的入侵

    Hugging Face 披露本周检测到一起针对其部分生产基础设施的入侵,该事件端到端由自主 AI 智能体系统驱动,攻击者通过数据集处理流程中的两个代码执行路径获得初始访问,随后提升至节点级权限、窃取云与集群凭证并在周末横向移动至多个内部集群。

    推荐理由:Hugging Face 披露首起由自主 AI 智能体驱动的入侵,并说明防御方为何改用自托管开源模型做取证。

7月15日周三
  1. Hugging Face Blog88

    Thinking Machines 在 Hugging Face 发布 Inkling 多模态大模型及 Inkling-Small

    Thinking Machines 在 Hugging Face 发布 Inkling,一个约 1T 参数、支持 1M 上下文、原生接收图像文本音频输入的开源多模态 MoE 模型,同时发布 276B 总参数 12B 激活参数的 Inkling-Small。

    推荐理由:原文给出 Inkling 的架构细节、部署配置与多模态评测数据,可据此判断开源大模型在长上下文与多模态推理上的进展。

7月8日周三
  1. Hugging Face Blog62

    vLLM 的 transformers 建模后端实现原生推理速度

    Hugging Face 宣布 vLLM 的 transformers 建模后端在多个 LLM 架构上达到甚至超过 vLLM 手写原生实现的吞吐。该后端通过 torch.fx 做静态图分析、用 ast 重写源码,在运行时动态应用推理相关的层融合,从而匹配自定义实现的性能。

    推荐理由:原文给出 transformers 后端在 vLLM 中达到原生速度的实测对比与启用方式,读者可据此判断是否省去自定义移植。

7月7日周二
  1. Hugging Face Blog62

    SkyPilot 与 Hugging Face 打通零出网费存储,可在任意云运行 AI 负载

    SkyPilot 与 Hugging Face 联合推出 store: hf 存储后端,用一个 hf:// URL 和现有 HF_TOKEN 即可把 Hugging Face Bucket 或任意模型、数据集、Space 仓库挂载进 SkyPilot 任务,并在 20 多个云、Kubernetes、Slurm 和本地环境上运行。

    推荐理由:原文给出 hf:// 挂载方式与免出网费的具体机制,读者可据此判断跨云训练与推理的存储成本变化。

7月6日周一
  1. Hugging Face Blog28

    PRX Part 4:我们的数据策略

    PRX 系列第 4 篇披露其数据策略:预训练数据由公开与内部数据集混合组成,用 VLM 重新生成图像长描述,再转为可流式训练的语料。团队用 Lance 做数据构建与筛选、MDS 做流式训练,并将文本编码器从 T5Gemma 换成 Qwen3-VL、改为训练时实时计算文本 latent,实测吞吐仅损失约 3–4%(30 天训练约多花 1 天)。

  2. Hugging Face Blog34

    Hugging Face Kernels 项目重大更新:新增 kernel 仓库类型与代码签名

    Hugging Face 为 Kernels 项目引入 Hub 上的 "kernel" 新仓库类型,并新增可信发布者与代码签名两层安全机制,默认只加载可信发布者的 kernel。项目还重构了 kernels 与 kernel-builder 的 CLI,新增对 Torch Stable ABI 和 Apache TVM FFI 的支持,为智能体驱动的 kernel 开发打下基础。

7月2日周四
  1. Mistral AI66

    Mistral 发布 Leanstral 1.5,形式化验证性能升级并开源

    Mistral 发布 Leanstral 1.5,一个 Apache-2.0 许可、119B 总参数 6B 激活参数的模型,在形式化验证上大幅升级,miniF2F 达到 100%,PutnamBench 解出 587/672 题,FATE-H 达 87%、FATE-X 达 34%。

    推荐理由:官方给出 Leanstral 1.5 在形式化验证基准上的成绩与开源入口,读者可据此判断其在 Lean 4 证明工程中的可用性。

7月1日周三
  1. Hugging Face Blog62

    Hugging Face 与 Cerebras 将 Gemma 4 引入实时语音 AI

    Hugging Face 与 Cerebras 合作展示了一套实时语音到语音的开源流水线,用 Cerebras 加速 Gemma 4 31B 的推理。该架构为级联式模块化设计,依次经过 Nvidia Parakeet 语音识别、Cerebras 上的 Gemma 4 VLM 推理和阿里 Qwen3TTS 文本转语音,各层均可替换。

    推荐理由:原文给出了一套可替换的实时语音到语音开源架构,读者可据此了解各层组件如何组合并复用到自己的项目。

6月30日周二
6月26日周五
6月25日周四
  1. Hugging Face Blog62

    NVIDIA NeMo AutoModel 加速 Transformers MoE 微调

    NVIDIA 发布开源库 NeMo AutoModel,在 HuggingFace Transformers v5 之上加入 Expert Parallelism、DeepEP 融合 all-to-all 调度和 TransformerEngine 内核,微调 MoE 模型时训练吞吐提升 3.4-3.7 倍、GPU 显存减少 29-32%,且只需改动一行 import。

    推荐理由:原文给出同一 from_pretrained() 接口下的吞吐与显存对比数据,读者可据此判断 MoE 微调的迁移成本。

6月24日周三
6月23日周二
  1. Hugging Face Blog62

    Hugging Face 如何用 AI 与开源工具每周发布 huggingface_hub

    Hugging Face 将 huggingface_hub 的发版周期从每 4 到 6 周缩短到每周一次,整套流程跑在单个 GitHub Actions workflow 上,由 OpenCode 驱动开放权重模型(当前为 Z.ai 的 GLM-5.2)起草 release notes 和 Slack 公告。

    推荐理由:Hugging Face 公开了每周发版的完整 CI 流程,其中模型起草加确定性校验的循环可直接迁移到其他项目。

6月22日周一
6月18日周四
  1. Hugging Face Blog62

    Hugging Face 发布 agent-eval:在自有工具上评测开源模型的智能体表现

    Hugging Face 发布 agent-eval 工具,用于评测智能体使用某个库完成任务的全过程,而不只看最终答案,并以 transformers 为案例在模型、版本、任务三个维度上展开测试。

    推荐理由:原文给出了一套可复用的工具基准方法,并展示了同一改动对不同规模模型效果相反的具体证据。

6月17日周三
  1. Hugging Face Blog62

    用 Strands Agents 和 LeRobot 把 Hugging Face Hub 数据集接到机器人硬件

    AWS 开源的 Strands Robots SDK(Apache 2.0)把 LeRobot 栈封装成 AgentTools,让一个 Strands 智能体在单次循环里完成仿真录制演示、推送 LeRobotDataset 到 Hub、跑策略、再以改一个关键字参数的方式部署到实体 SO-101,并通过 Zenoh 对等网格广播指令到多台机器人。

    推荐理由:AWS 团队给出从 Hub 数据集到实体机器人的五步流程,可看到仿真与真机共用同一数据集格式的工程取舍。

  2. Hugging Face Blog88

    智谱发布 GLM-5.2:面向长程任务,支持 1M 上下文并采用 MIT 开源许可

    智谱发布旗舰模型 GLM-5.2,主打长程任务能力,首次在 1M token 上下文上稳定支撑长程工作,并以 MIT 开源许可发布。模型引入 IndexShare 架构,每 4 层稀疏注意力共享同一 indexer,在 1M 上下文下将每 token FLOPs 降低 2.9 倍,同时改进 MTP 层使投机解码接受长度最高提升 20%。

    推荐理由:GLM-5.2 把 1M 上下文与长程编码能力结合,并给出与闭源前沿模型的基准对比,可据此判断开源模型在长程任务上的位置。

6月11日周四
6月8日周一
  1. Hugging Face Blog62

    OpenEnv 转为委员会共管,定位智能体 RL 环境互操作层

    Hugging Face 宣布 OpenEnv 改由委员会协调,成员包括 Meta-PyTorch、Reflection、Unsloth、Modal、Prime Intellect、Nvidia、Mercor、Fleet AI、Microsoft、Hugging Face 和 RadixArk,项目迁至 huggingface/OpenEnv。

    推荐理由:OpenEnv 从单一项目转为多方共管的协议层,读者可据此判断开源智能体 RL 环境标准化的走向。

6月5日周五
6月4日周四
6月3日周三
5月28日周四
  1. Mistral AI66

    Mistral AI 发布 Search Toolkit 公开预览版

    Mistral AI 发布 Search Toolkit 公开预览版,这是一个用于构建生产级搜索管线的可组合框架,把摄取、检索和评估统一到共享接口下,并已开源、可部署在云、本地或边缘。

    推荐理由:Mistral 把摄取、检索与评估收进同一框架,读者可据此判断自建 RAG 检索链路的整合成本。

5月27日周三
  1. Mistral AI38

    Mistral 收购 Emmi AI,加码面向航空航天等行业的 Physics AI 基础研究

    Mistral 收购 Emmi AI,并加倍投入面向航空航天、汽车、半导体和能源等行业的 Physics AI 基础研究。其成果包括 AB-UPT 可在单块 GPU 上处理 9M 表面和 140M 体积网格的原始几何数据,以及首个大规模多物理过程端到端深度学习代理模型 NeuralDEM。相关论文还覆盖跨音速 3D 机翼 CFD 数据集、GyroSwin 等离子体湍流模拟等方向。

5月25日周一
5月22日周五
  1. Mistral AI82

    Mistral 发布 Mistral Medium 3.5 与 Vibe 云端远程智能体

    Mistral 发布 Mistral Medium 3.5,这是一个 128B 稠密模型,把指令遵循、推理和编码合并到同一套权重中,以修改版 MIT 许可开放权重,公开预览阶段成为 Mistral Vibe 和 Le Chat 的默认模型。

    推荐理由:Mistral 把编码智能体搬到云端并同步放出 128B 开源权重,读者可据此判断自托管与异步编码的可行边界。

5月14日周四
5月7日周四
5月6日周三
5月2日周六
4月29日周三
  1. Hugging Face Blog62

    Granite 4.1 LLM 是如何构建的:IBM 公开五阶段预训练与多阶段 RL 细节

    IBM Granite 团队公开了 Granite 4.1 系列稠密 LLM(3B、8B、30B)的完整训练流程,模型在约 15T token 上从零训练,采用五阶段预训练管线,上下文窗口最终扩展至 512K token。

    推荐理由:Granite 团队公开了从数据配比到多阶段 RL 的完整训练细节,可对照其 8B 稠密模型追平 32B MoE 的结论。