跳到正文

#Hugging Face

今日 2 条
9月26日周五
9月23日周二
9月22日周一
9月19日周五
9月18日周四
9月17日周三
9月16日周二
9月15日周一
  1. Hugging Face Blog30

    Hugging Face 用 Gradio 一条命令为 AI 生成内容添加可见水印

    Hugging Face 在 Gradio 中内置可见水印功能,创建 Space 时只需为 gr.Image、gr.Video 添加 watermark 参数,即可在 AI 生成的图像和视频上显示水印,水印支持文件名、图像或 numpy 数组,也可使用 QR 水印。gr.Chatbot 同样支持文本水印,用户复制 AI 回复时会自动附带署名,便于 AI 透明度与披露。

9月12日周五
9月11日周四
  1. Hugging Face Blog62

    Hugging Face 详解 transformers 为 gpt-oss 引入的六项优化技巧

    Hugging Face 发布博客,介绍为支持 OpenAI gpt-oss 系列而在 transformers 中引入的多项升级,包括可从 Hub 下载的零构建内核、MXFP4 量化、张量并行、专家并行、动态滑动窗口层与缓存、连续批处理与 Paged Attention,以及更快的模型加载。

    推荐理由:Hugging Face 官方拆解了为 gpt-oss 引入的六项 transformers 升级,读者可据此了解这些优化如何迁移到其他模型。

9月10日周三
9月9日周二
9月4日周四
  1. Hugging Face Blog60

    Google 发布 EmbeddingGemma 高效多语言嵌入模型

    Google 发布 EmbeddingGemma,一款面向端侧场景的多语言嵌入模型,参数量 308M,上下文窗口 2K,支持 100 多种语言,量化后内存占用低于 200MB。

    推荐理由:308M 参数、2K 上下文、支持 100 多种语言,可据此判断端侧 RAG 与多语言检索的落地空间。

9月3日周三
9月2日周二
8月21日周四
  1. Hugging Face Blog60

    NVIDIA 发布 600 万多语言推理数据集 Nemotron Post-Training Dataset V2

    NVIDIA 发布 Nemotron Post-Training Dataset V2,将此前英文推理数据翻译为法语、德语、意大利语、日语和西班牙语五种语言,共 600 万多语言推理样本。

    推荐理由:NVIDIA 公开了多语言推理数据集的构建流程与筛选比例,读者可据此了解后训练数据的翻译与幻觉控制方法。

8月19日周二
8月18日周一
8月14日周四
8月12日周二
8月8日周五
  1. Hugging Face Blog62

    Hugging Face 发布 AI Sheets:用开放 AI 模型处理数据集的无代码工具

    Hugging Face 发布开源无代码工具 AI Sheets,可在表格界面中通过提示词构建、转换和丰富数据集,支持调用 Hub 上数千个开放模型(含 OpenAI 的 gpt-oss)或本地模型。

    推荐理由:Hugging Face 官方开源的无代码数据集工具,读者可了解如何用开放模型批量构建、标注和评测数据。

8月7日周四
  1. Hugging Face Blog60

    TRL 为视觉语言模型加入 MPO、GRPO、GSPO 等对齐方法

    Hugging Face 的 TRL 新增面向视觉语言模型的对齐支持,包括混合偏好优化 MPO、多模态 GRPO 以及 Qwen 提出的 GSPO,并扩展 RLOO 和 Online DPO 到 VLM。

    推荐理由:TRL 把 MPO、GRPO、GSPO 等对齐方法扩展到视觉语言模型,并给出可直接运行的训练脚本,读者可据此判断多模态后训练的工具选择。

8月5日周二
8月1日周五
7月31日周四
  1. Hugging Face Blog38

    用 Python 实现 MCP 服务器:基于 Gradio 的 AI 购物助手

    Hugging Face 博客演示了如何用 Gradio 的 MCP 集成在 Python 中搭建 AI 购物助手,将 Python 函数自动转换为 LLM 可调用的 MCP 工具。该助手结合 IDM-VTON 扩散模型实现虚拟试衣,并通过 VS Code AI Chat 接入 vton 与 playwright 两个 MCP 服务器,让 LLM 能浏览线上服装店并生成试穿效果图。

7月29日周二
7月25日周五
7月23日周三
7月22日周二
  1. Hugging Face Blog60

    NVIDIA NIM 支持在 Hugging Face 上部署超 10 万个 LLM

    NVIDIA 宣布 NIM 推理微服务现可在 Hugging Face 上快速部署超过 10 万个 LLM。NIM 提供单个 Docker 容器,自动识别模型架构与量化格式(如 FP16、FP8、INT4),并在 NVIDIA TensorRT-LLM、vLLM 和 SGLang 之间选择推理后端,无需手动配置。

    推荐理由:NIM 单个容器即可自动识别模型格式并选择 TensorRT-LLM、vLLM 或 SGLang 后端,读者可据此判断部署流程能省掉多少手工调优。

7月18日周五
7月17日周四
7月16日周三
  1. Hugging Face Blog32

    Hugging Face 发布 Ettin Suite:同配方训练的 SoTA 配对编码器与解码器

    Hugging Face 推出 Ettin Suite,这是首个用相同数据(2T tokens)、架构和训练配方训练的 SoTA 配对编码器与解码器模型系列,参数规模覆盖 17M 至 1B。其编码器全面超越 ModernBERT,解码器则击败或持平 Llama 3.2 1B 与 SmolLM2。该系列首次实现两种架构的公平对比,结果显示编码器在分类与检索任务占优,解码器在生成任务领先。