跳到正文

#数据/训练

今日 1 条
1月24日周二
  1. Hugging Face Blog52

    Hugging Face 解读对话智能体为何有用:IFT、SFT、CoT 与 RLHF 的分工

    Hugging Face 博客梳理了让对话智能体有用的关键技术,包括指令微调(IFT)、监督微调(SFT)、思维链(CoT)提示和基于人类反馈的强化学习(RLHF),并对比了 LaMDA、BlenderBot 3、Sparrow、ChatGPT/InstructGPT 和 Anthropic Assistant 在访问方式、训练数据、模型架构与评测方向上的差异。

1月9日周一
  1. Hugging Face Blog22

    AI 游戏开发:5 天做出农场游戏(第 2 天,用 ChatGPT 做游戏设计)

    Hugging Face 博客系列教程第二部分介绍如何用 ChatGPT 辅助农场游戏设计,作者让它以专业游戏设计师身份给出作物多样性、成长系统等建议,并自行取舍实现。文章同时解释语言模型与 Transformer 原理,指出 ChatGPT 常言之凿凿却出错,建议将其用作头脑风暴和加速工具而非开发流程的替代品。

1月3日周二
  1. Hugging Face Blog22

    Hugging Face 博客:图机器学习入门指南

    Hugging Face 发布图机器学习入门博客,介绍图的基本概念、表示方法及学习范式,涵盖从预神经网络方法到图神经网络(GNN),并延伸至面向图的 Transformer。文章还梳理了图级别、节点级别、边级别和子图级别的典型任务,如分子生成、Alphafold 的原子坐标预测、药物副作用预测与推荐系统中的缺失边预测。

1月2日周一
12月15日周四
12月14日周三
12月2日周五
11月17日周四
  1. Hugging Face Blog24

    用同态加密在加密数据上做情感分析:Concrete-ML 实战教程

    Hugging Face 博客发布教程,演示如何用 Concrete-ML 库在完全同态加密(FHE)环境下构建情感分析模型,无需密码学背景即可上手。方案先用 BERT 提取文本隐藏表示(hidden size 为 768),再交给 XGBoost 分类,并通过客户端/服务器协议部署到云端,最终在 Hugging Face Spaces 上提供完整演示。

11月8日周二
10月19日周三
10月7日周五
  1. Hugging Face Blog38

    Hugging Face 为模型和数据集引入 DOI

    Hugging Face 宣布用户可直接在 Hub 的仓库设置中为模型或数据集生成 DOI,其他人在模型或数据集页面点击“Cite this model/dataset”即可引用。该功能与 DataCite 合作实现,DOI 绑定对象的 URL、版本、创建日期等元数据,新版本发布时 DOI 可更新,旧版本 DOI 随之失效。带 DOI 的数据集和模型将永久保留,仅能通过向官方支持提交请求后删除。

9月26日周一
9月8日周四
9月7日周三
8月22日周一
8月10日周三
7月16日周六
7月14日周四
7月12日周二
  1. Hugging Face Blog78

    Hugging Face 发布 176B 参数开源多语言模型 BLOOM

    Hugging Face 发布 BLOOM,一个 176B 参数的多语言大语言模型,可生成 46 种自然语言和 13 种编程语言的文本,由 70 多个国家 1000 多名研究者协作完成,在法国 Jean Zay 超算上训练 117 天。

    推荐理由:BLOOM 以 176B 参数覆盖 46 种自然语言,并公开训练中间检查点,可据此了解开放大模型在透明度上的做法。

6月28日周二
6月23日周四
  1. OpenAI News71

    OpenAI 用 Video PreTraining 训练神经网络玩 Minecraft

    OpenAI 提出 Video PreTraining(VPT),在大量无标注的人类 Minecraft 游戏视频上训练神经网络,仅使用少量标注的承包商数据。经微调后,模型能学会制作钻石工具,这一任务通常需要熟练人类花费 20 分钟以上、约 24000 次操作。模型使用键盘按键和鼠标移动的原生人类接口,具有较强通用性,是迈向通用计算机操作智能体的一步。

    推荐理由:OpenAI 用大量无标注人类游戏视频预训练网络,展示从少量标注数据到通用计算机操作智能体的路径。

6月13日周一
  1. OpenAI News62

    OpenAI 训练批评写作模型帮助人类发现摘要缺陷

    OpenAI 训练了批评写作模型,用于描述摘要中的缺陷。人类评估者在看到模型批评后,发现摘要缺陷的频率明显提高。研究还显示,模型越大自我批评能力越强,规模对批评写作的提升大于对摘要写作的提升,这为用 AI 系统辅助人类监督 AI 系统提供了可能。

    推荐理由:OpenAI 用自训练模型写批评来辅助人类发现摘要缺陷,并给出模型规模与批评能力的关系。

6月9日周四
6月7日周二
5月23日周一
5月19日周四
  1. Hugging Face Blog12

    Sempre Health 如何借助 Hugging Face Expert Acceleration Program 加速其 ML 路线图

    Sempre Health 借助 Hugging Face 的 Expert Acceleration Program 搭建了自动分类并回复患者短信的 NLP 流水线,上线数周后近 20% 的入站消息由该系统自动处理,此前这些消息都会生成工单。该团队原本的规则系统只能覆盖约 80% 的短信,Hugging Face 团队在标签质量和模型选型上提供了指导。

5月17日周二
5月2日周一
4月28日周四
4月26日周二
4月25日周一
4月22日周五
4月12日周二
3月23日周三
  1. Hugging Face Blog22

    Hugging Face 机器学习专家访谈:Margaret Mitchell 谈伦理 AI

    Hugging Face 发布机器学习专家访谈,嘉宾 Margaret Mitchell 曾任 Google 伦理 AI 团队创始人兼联合负责人,现于 Hugging Face 制定伦理 AI 研究协议与包容性招聘体系。她因在微软 Seeing AI 项目中目睹图像数据偏差而转向伦理 AI,指出 ML 团队普遍缺乏相关概念与词汇,且行业"Alpha"文化使女性主导的伦理研究被轻视。

3月2日周三
2月2日周三
  1. Hugging Face Blog28

    如何用 Python 入门情感分析

    Hugging Face Hub 上已有超过 215 个公开的情感分析模型,用 Python 的 transformers pipeline 只需 5 行代码即可调用,默认模型对 "I love you" 和 "I hate you" 分别给出 0.9998 和 0.9991 的置信度。指南还介绍了 Twitter-roBERTa-base 等预训练模型,以及用自有数据微调情感分析模型的方法。

12月23日周四
12月8日周三
11月29日周一
  1. Hugging Face Blog36

    Hugging Face 推出 Data Measurements Tool:用于查看数据集的交互式工具

    Hugging Face 发布开源 Python 库与无代码界面 Data Measurements Tool,基于 Dataset 和 Spaces Hub 及 Streamlit 构建,可在线构建、测量和比较数据集。该工具能自动计算词汇量、标签分布、实例长度、重复项及 Zipf 定律拟合度等指标,帮助数据集创建者和用户进行负责任的数据开发。

11月19日周五