跳到正文

#教程/实践

今日 3 条
1月12日周五
  1. Hugging Face Blog28

    如何用 Hugging Face 排行榜模板搭建自己的 LLM 排行榜:以 Vectara 幻觉排行榜为例

    Vectara 基于 Hugging Face 开源的排行榜模板,发布了新的 HHEM 幻觉排行榜,用于评估 GPT-4、Gemini、Llama 2 等 LLM 在文档摘要中的幻觉频率。该排行榜通过 requests 和 results 两个数据集管理模型评测请求与结果,并支持动态更新和社区提交新模型。Vectara 还公开了定制后的后端源码,可部署为 Hugging Face Space。

1月10日周三
  1. Hugging Face Blog78

    用 Unsloth 和 TRL 让 LLM 微调提速 2 倍

    Hugging Face 博客介绍社区工具 Unsloth,与 transformers、PEFT、TRL 完全兼容,可将 LLM 微调速度提升约 2 倍、显存占用最多降低 74%,且相对标准 QLoRA 精度损失为 0%。

    推荐理由:原文给出 Unsloth 与 TRL 的完整接入代码和 59 次基准数据,读者可据此判断微调提速与显存节省幅度。

1月2日周二
12月20日周三
  1. Hugging Face Blog62

    用投机解码让 Whisper 推理提速 2 倍

    Hugging Face 博客介绍如何用投机解码(Transformers 中的 assisted generation)将 Whisper 推理速度提升约 2 倍,且数学上保证输出与单独使用主模型完全一致。

    推荐理由:以 Whisper 为例给出投机解码的完整实现与基准数据,可迁移到其他自回归模型的推理加速。

12月11日周一
12月5日周二
11月7日周二
10月27日周五
10月25日周三
  1. Hugging Face Blog22

    用一行代码交互式探索你的 Hugging Face 数据集

    Hugging Face datasets 库与 Renumics Spotlight 集成,只需一行代码即可对数据集进行交互式可视化。Spotlight 直接读取 datasets 的 Arrow 表结构,无需复制或预处理数据,并支持利用模型预测和嵌入向量定位关键数据簇与模型失败模式。用户可通过 GUI 或 Python API 自定义布局,用于 EDA、模型调试和监控。

10月24日周二
10月3日周二
10月2日周一
9月29日周五
9月28日周四
9月19日周二
9月18日周一
9月15日周五
9月13日周三
9月12日周二
8月30日周三
8月9日周三
8月8日周二
8月4日周五
8月2日周三
  1. Hugging Face Blog31

    Zama 用 FHE 实现加密大语言模型推理,基于 Hugging Face GPT2 验证

    Zama 展示了如何借助 Hugging Face transformers 库,用全同态加密(FHE)在加密数据上运行 GPT2 的部分推理,从而同时保护用户数据隐私与模型 IP。实现中将 GPT2 首个多头注意力头改写为 FHE 兼容算子,权重与激活量化为整数,4-bit 量化可保留原模型 96% 的准确率。完整代码已在该用例示例中开源。

8月1日周二
7月17日周一
7月14日周五
7月5日周三
7月4日周二
7月3日周一
6月29日周四
6月19日周一
6月16日周五
6月15日周四
  1. Hugging Face Blog62

    用 Core ML 在 iPhone、iPad 和 Mac 上加速 Stable Diffusion

    Hugging Face 介绍了借助 Core ML 新优化在 iPhone、iPad 和 Mac 上加速 Stable Diffusion 的方法,核心是 6-bit palettization 量化,将权重从 16-bit 浮点压到每参数 6 bit,并在推理时逐层解压以节省内存。

    推荐理由:Hugging Face 与 Apple 官方给出 6-bit palettization 的量化原理与转换命令,读者可据此把 Stable Diffusion 压到端侧运行。