跳到正文

全部动态

今日 4 条
6月5日周一
6月2日周五
  1. Hugging Face Blog22

    如何在 Unity 中用 Hugging Face Unity API 实现语音识别

    Hugging Face 发布教程,演示如何借助 Hugging Face Unity API 在 Unity 游戏中实现语音识别,把玩家语音转成文本,可用于下达指令、与 NPC 对话或提升无障碍体验。教程从搭建含开始/停止按钮和 TextMeshPro 文本框的场景入手,用 Microphone.Start() 以 44100 Hz 录制最长 10 秒音频,再编码为 WAV 格式发送给 API。

6月1日周四
5月31日周三
  1. OpenAI News62

    OpenAI 用过程监督提升数学推理能力

    OpenAI 训练了一个模型,通过奖励每一步正确推理(过程监督)而非只奖励最终正确答案(结果监督),在数学问题求解上取得新的 SOTA。相比结果监督,过程监督除了提升性能,还带来对齐上的好处:直接训练模型产出被人类认可的思维链。

    推荐理由:OpenAI 用过程监督替代结果监督提升数学推理,并说明其对思维链对齐的作用。

  2. Hugging Face Blog22

    Hugging Face Hub 集成 BERTopic

    Hugging Face 宣布将主题建模工具 BERTopic 集成到 Hugging Face Hub,用户可直接在 Hub 上访问和共享 BERTopic 模型。BERTopic 基于 Transformer 嵌入向量与 c-TF-IDF 生成可解释的主题,此次集成让主题模型的发布、复用和协作更便捷。

5月25日周四
5月24日周三
  1. Hugging Face Blog78

    Hugging Face 联合 bitsandbytes 在 transformers 中支持 4-bit 量化与 QLoRA

    Hugging Face 与 bitsandbytes 合作,在 transformers 中支持以 4-bit 精度加载模型,覆盖文本、视觉和多模态等大多数 HF 模型,并可在 4bit 模型上训练适配器。

    推荐理由:Hugging Face 与 bitsandbytes 合作把 4-bit 量化接入 transformers,读者可据此了解消费级硬件跑大模型的具体路径。

5月23日周二
  1. Hugging Face Blog62

    Safetensors 通过外部安全审计,Hugging Face 等三方推动其成为默认格式

    Hugging Face 联合 EleutherAI 和 Stability AI 委托 Trail of Bits 对 safetensors 库做了外部安全审计,未发现可导致任意代码执行的关键安全漏洞,报告已完全公开。

    推荐理由:外部安全审计结果与三家机构推动默认格式的路线,能帮读者理解模型权重存储格式的安全取舍。

5月22日周一
5月18日周四
  1. OpenAI News75

    OpenAI 推出 ChatGPT iOS 应用

    OpenAI 发布 ChatGPT iOS 应用,支持对话同步和语音输入,并将最新的模型改进带到移动端。

    推荐理由:OpenAI 官方公布 ChatGPT iOS 应用,说明对话同步与语音输入两项能力,可据此了解其移动端入口的初始形态。

5月16日周二
5月15日周一
  1. Hugging Face Blog22

    Hugging Face 入选法国数据保护机构 CNIL 强化支持计划

    Hugging Face 被法国数据保护机构 CNIL 选中,加入其强化支持计划。该计划从 40 多个候选企业中选出三家“具有强劲经济发展潜力”的公司,为其理解和履行数据保护义务提供支持。Hugging Face 表示,此前 BigScience 和 BigCode 项目已在数据选择、治理与假名化工具方面投入隐私保护工作。

5月11日周四
  1. Hugging Face Blog62

    Hugging Face 提出辅助生成方法,降低文本生成延迟最高 10 倍

    Hugging Face 发布辅助生成(assisted generation)方法,用一个至少小一个数量级的助手模型生成候选 token,再由主模型一次前向验证,从而减少前向次数、降低文本生成延迟。

    推荐理由:Hugging Face 官方给出辅助生成方法的原理与可复现代码,读者可据此判断低延迟推理的落地条件。

5月9日周二
  1. OpenAI News61

    OpenAI 用 GPT-4 解释语言模型神经元并公开 GPT-2 数据集

    OpenAI 使用 GPT-4 自动为大型语言模型中的神经元行为撰写解释,并对这些解释打分。团队公开了覆盖 GPT-2 每个神经元的解释与评分数据集,并说明这些解释并不完美。

    推荐理由:OpenAI 用 GPT-4 自动解释并打分 GPT-2 神经元行为,公开了逐神经元解释数据集,可供研究模型可解释性方法。

  2. Hugging Face Blog62

    用 StarCoder 微调出编程助手 StarChat

    Hugging Face 团队基于 BigCode 的 16B 参数 StarCoder,用 OpenAssistant 对话数据集微调出编程助手 StarChat,并开源了代码、数据集与模型。

    推荐理由:完整给出了从对话提示词到 ChatML 格式、标签掩码与 DeepSpeed ZeRO-3 微调的可复现流程,并附代码与数据集链接。

5月8日周一
5月4日周四
  1. Hugging Face Blog78

    BigCode 发布 StarCoder:15B 参数开源代码大模型

    Hugging Face 与 ServiceNow 联合主导的 BigCode 发布 StarCoder 与 StarCoderBase,两个代码大模型基于 GitHub 上许可宽松的数据训练,覆盖 80 多种编程语言,参数量约 15B、训练 1 万亿 token。

    推荐理由:官方给出 StarCoder 的参数量、训练数据与 HumanEval 对比表,可据此判断开源代码模型当时的位置。

5月1日周一
4月27日周四
4月26日周三
4月25日周二
4月24日周一
4月17日周一
4月14日周五
4月12日周三
  1. Hugging Face Blog22

    Hugging Face 与 Substra 合作推出联邦学习演示空间,推动隐私保护 AI

    Hugging Face 与开源联邦学习框架 Substra 合作创建了一个演示 Space,让用户体验数据孤岛下联邦学习的训练效果。联邦学习让数据留在本地、仅传输模型权重,用多源数据训练的模型在验证集上几乎总是优于单一数据源模型。Substra 已在乳腺癌研究等真实场景中落地,MELLODDY 项目中 10 家生物制药公司借此共享了全球最大的小分子活性数据集。

4月11日周二
  1. OpenAI News40

    OpenAI 宣布启动漏洞赏金计划

    OpenAI 宣布推出漏洞赏金计划,邀请外界帮助发现其技术与服务中的安全漏洞。该计划是 OpenAI 致力于开发安全、先进 AI 的一部分,目标是打造安全、可靠、可信的技术与服务。

4月6日周四
4月5日周三
3月30日周四