跳到正文

#开源生态

今日 0 条
2月10日周三
2月9日周二
1月19日周二
1月18日周一
11月9日周一
11月2日周一
10月10日周六
7月3日周五
6月20日周六
3月1日周日
  1. Hugging Face Blog62

    如何用 Transformers 生成文本:不同解码方法详解

    Hugging Face 发布教程,介绍如何用 transformers 库实现自回归语言生成的多种解码方法,包括贪心搜索、beam search 和采样。文中以 GPT2 为例给出可运行代码,演示 num_beams、no_repeat_ngram_size、temperature、top_k、top_p 等参数的效果。

    推荐理由:系统梳理贪心、beam search 与采样等解码策略的差异,并给出 transformers 中可直接运行的参数配置。

2月14日周五
1月30日周四
11月5日周二
  1. OpenAI News70

    OpenAI 发布 GPT-2 最大版本 1.5B 及代码与模型权重

    OpenAI 发布 GPT-2 分阶段发布的最后一个版本,即参数量 1.5B 的最大版本,同时开放代码和模型权重,以便检测 GPT-2 模型的输出。OpenAI 表示,尽管自 8 月以来已有更大的语言模型发布,仍按原定分阶段发布计划推进,为社区提供一个完整分阶段发布流程的测试案例,并希望它对未来强大模型的开发者有用。

    推荐理由:OpenAI 按分阶段发布计划放出 GPT-2 最大版本及权重,可作为完整分阶段发布流程的参考案例。

10月11日周四
5月25日周五
  1. OpenAI News62

    OpenAI 发布 Gym Retro 完整版,游戏数量扩至 1000 款以上

    OpenAI 发布强化学习游戏研究平台 Gym Retro 的完整版,公开可用的游戏数量从约 70 款 Atari 游戏和 30 款 Sega 游戏扩展到覆盖多种模拟器的 1000 款以上。OpenAI 同时发布了用于向该平台添加新游戏的工具。

    推荐理由:OpenAI 把强化学习游戏平台 Gym Retro 的游戏规模从约百款扩到 1000 款以上,并公开了添加新游戏的工具。

3月6日周二
5月24日周三
  1. OpenAI News62

    OpenAI 开源 Baselines 项目,首批发布 DQN 及三个变体

    OpenAI 开源内部项目 OpenAI Baselines,目标是以与已发表结果相当的性能复现强化学习算法。算法将在未来数月内陆续发布,今天的首批发布包含 DQN 及其三个变体。

    推荐理由:OpenAI 开源内部复现强化学习算法的 Baselines 项目,首批放出 DQN 及其三个变体,可了解其复现思路与后续发布节奏。

5月15日周一
3月20日周一
4月27日周三
  1. OpenAI News62

    OpenAI 发布强化学习工具包 OpenAI Gym 公测版

    OpenAI 发布 OpenAI Gym 公测版,这是一个用于开发和比较强化学习(RL)算法的工具包。它包含一套持续扩充的环境,涵盖模拟机器人和 Atari 游戏,并提供一个用于比较和复现结果的站点。

    推荐理由:OpenAI 官方发布强化学习工具包公测,读者可了解其环境套件与结果对比站点的构成。