跳到正文

#Hugging Face

今日 2 条
7月15日周二
7月10日周四
  1. Hugging Face Blog40

    Hugging Face 详解异步机器人推理:解耦动作预测与执行

    Hugging Face 发布博客详解异步推理,将机器人动作预测与执行解耦为 PolicyServer 和 RobotClient 两个进程,通过 gRPC 通信(比 REST API 快约 5 倍),让机器人在计算下一段动作时持续执行当前动作。该方法在 SmolVLA 中引入,任务完成时间提速约 2 倍且成功率相当,适用于 ACT、OpenVLA、PI0 等输出动作块的策略。

  2. Hugging Face Blog65

    Hugging Face 发布 ScreenEnv,在 Docker 中部署全栈桌面智能体

    Hugging Face 发布 ScreenEnv,一个可在 Docker 容器中创建隔离 Ubuntu 桌面环境的 Python 库,用于测试和部署 GUI 智能体(Computer Use 智能体)。

    推荐理由:ScreenEnv 把桌面智能体的运行环境封装进 Docker,并同时提供 MCP 与直接 API 两种接入方式,读者可据此判断现有智能体架构能否低成本迁移。

7月9日周三
  1. Hugging Face Blog62

    Hugging Face 与 Pollen Robotics 发布开源机器人 Reachy Mini,399 美元起

    Hugging Face 与 Pollen Robotics 发布开源机器人 Reachy Mini,Lite 版 399 美元、带板载计算与电池的无线版 499 美元,均需另付税费和运费,预计约 90 天发货。

    推荐理由:官方给出开源桌面机器人的两档配置、价格与 Python SDK,可据此判断入门机器人 AI 实验的成本与上手门槛。

7月8日周二
7月4日周五
7月1日周二
6月28日周六
6月26日周四
6月23日周一
6月19日周四
  1. Hugging Face Blog62

    在消费级硬件上用 QLoRA 微调 FLUX.1-dev

    Hugging Face 发布教程,介绍用 diffusers 库以 QLoRA 在单张 GPU 上微调 FLUX.1-dev,峰值显存约 10GB 以下。在 RTX 4090 上,QLoRA 峰值显存约 9GB,标准 BF16 LoRA 需 26GB,700 步训练约 41 分钟。

    推荐理由:给出在单张消费级 GPU 上微调 FLUX.1-dev 的完整配置与显存对比,方法可直接复用。

6月16日周一
6月12日周四
6月11日周三
6月6日周五
6月4日周三
6月3日周二
  1. Hugging Face Blog71

    H Company 发布 GUI 自动化 VLM 系列 Holo1 与基准 WebClick

    H Company 发布 Holo1 系列 Action VLM 及多模态定位基准 WebClick,模型已开源在 Hugging Face。该系列包含 Holo1-3B 和 Holo1-7B,其中 7B 在常见 UI 定位基准上平均准确率达 76.2%,为小尺寸模型中最高。

    推荐理由:Holo1 开源了 GUI 定位模型与配套基准,读者可据此评估浏览器自动化在成本与精度上的取舍。

5月28日周三
5月25日周日
5月23日周五
5月21日周三
  1. Hugging Face Blog41

    Falcon-Arabic:阿拉伯语语言模型的突破

    阿联酋技术创新研究院(TII)发布 Falcon-Arabic,一款基于 Falcon 3 架构的 7B 参数多语言模型,支持阿拉伯语、英语等多种语言,上下文长度达 32,000 tokens。该模型在 OALL v2 基准上超越同规模阿拉伯语 LLM,甚至优于参数量达其 4 倍的模型,并在 Arabic MMLU、Exams、MadinahQA、Aratrust 等任务上领先。

  2. Hugging Face Blog62

    Hugging Face 发布 nanoVLM:用纯 PyTorch 训练视觉语言模型的最简仓库

    Hugging Face 发布 nanoVLM,一个用纯 PyTorch 训练视觉语言模型(VLM)的轻量工具包,可在免费 Colab 上启动训练。其视觉骨干采用 Google 的 SigLIP 编码器,语言骨干沿用 Llama 3 架构,两者通过 Modality Projection 模块对齐,训练目标为视觉问答。

    推荐理由:官方给出 nanoVLM 的架构选择与训练流程,读者可据此在免费 Colab 上跑通一个 VLM。

5月19日周一
5月15日周四
  1. Hugging Face Blog62

    Falcon-Edge 发布 1B 与 3B 三值量化语言模型系列

    Falcon-Edge 系列发布,基于 BitNet 架构,提供 1B 和 3B 两种规模,每种规模都有 base 与指令微调版本,权重以三值格式({-1, 0, 1})提供。

    推荐理由:Falcon-Edge 用一次预训练同时产出 bfloat16 与三值量化版本,并给出可直接微调的权重与工具包,读者可据此判断 1.58bit 模型的落地路径。

  2. Hugging Face Blog62

    Hugging Face 将 Transformers 定位为跨框架模型定义标准

    Hugging Face 宣布将 Transformers 打造为跨框架的模型定义中枢,模型架构只要被 Transformers 支持,就能在生态其他工具中获得支持。目前 Transformers 已支持 300+ 模型架构,平均每周新增约 3 个,并与 vLLM、SGLang、TGI 等推理引擎及 llama.cpp、MLX 打通互操作。官方还计划简化建模代码、弃用冗余组件,降低社区贡献门槛。

    推荐理由:Hugging Face 官方说明 Transformers 将作为跨框架的模型定义中枢,读者可据此理解模型一次贡献、多引擎复用的生态走向。

5月14日周三
5月13日周二