跳到正文

#OpenAI

今日 1 条
3月4日周一
2月26日周二
2月19日周二
  1. OpenAI News31

    OpenAI:AI 安全研究需要社会科学家参与

    OpenAI 发表论文指出,长期 AI 安全研究需要社会科学家参与,才能确保 AI 对齐算法在真实人类参与的场景下有效。论文认为,将先进 AI 系统与人类价值观对齐,需要解决人类理性、情绪与偏见等心理学层面的诸多不确定性。OpenAI 计划招聘社会科学家全职投入这一方向,以推动机器学习与社会科学的进一步合作。

12月19日周三
12月14日周五
12月6日周四
11月8日周四
11月7日周三
10月31日周三
10月22日周一
10月11日周四
10月9日周二
9月10日周一
8月23日周四
8月6日周一
  1. OpenAI News62

    OpenAI Five 基准测试结果:三局两胜击败 99.95 百分位 Dota 玩家队伍

    OpenAI Five 在基准测试中以三局两胜击败由 Blitz、Cap、Fogged、Merlini 和 MoonMeander 组成的 99.95 百分位 Dota 玩家队伍,其中四人有过职业 Dota 经历。比赛在直播观众面前进行,同时在线观看人数达 10 万。

    推荐理由:OpenAI Five 在公开直播中三局两胜击败 99.95 百分位人类队伍,可据此了解当时 AI 在复杂实时游戏中的表现边界。

7月30日周一
7月25日周三
7月18日周三
7月9日周一
7月4日周三
  1. OpenAI News62

    OpenAI 从单次演示中学会 Montezuma's Revenge

    OpenAI 训练智能体仅凭单次人类演示就在 Montezuma's Revenge 上取得 74,500 分的高分,超过此前所有已发表结果。其算法从演示中精心挑选状态出发,让智能体依次游玩一系列游戏,并用 PPO 优化游戏得分来学习,PPO 也是支撑 OpenAI Five 的同一强化学习算法。

    推荐理由:OpenAI 用单次人类演示让智能体在 Montezuma's Revenge 上取得 74,500 分,可了解其基于 PPO 的简单方法。

6月25日周一
  1. OpenAI News70

    OpenAI Five 已能击败 Dota 2 业余人类队伍

    OpenAI 宣布由五个神经网络组成的 OpenAI Five 已开始击败 Dota 2 业余人类队伍。该团队由五个神经网络构成,此次披露仅给出这一结果,未提供更多技术细节。

    推荐理由:OpenAI 官方披露五个神经网络组成的 OpenAI Five 已能击败 Dota 2 业余人类队伍,可了解早期多智能体协作的进展。

6月22日周五
6月11日周一
  1. OpenAI News82

    OpenAI 用无监督学习提升语言理解能力

    OpenAI 在一系列多样语言任务上取得当时最优结果,方法结合了 Transformer 与无监督预训练,并同步公开这套可扩展、与任务无关的系统。OpenAI 表示,这一结果说明监督学习方法与无监督预训练搭配效果很好,希望推动在更大、更多样数据集上继续探索这一思路。

    推荐理由:OpenAI 用 Transformer 加无监督预训练在多项语言任务上取得当时最优结果,并公开了这套与任务无关的系统。

5月30日周三
5月25日周五
  1. OpenAI News62

    OpenAI 发布 Gym Retro 完整版,游戏数量扩至 1000 款以上

    OpenAI 发布强化学习游戏研究平台 Gym Retro 的完整版,公开可用的游戏数量从约 70 款 Atari 游戏和 30 款 Sega 游戏扩展到覆盖多种模拟器的 1000 款以上。OpenAI 同时发布了用于向该平台添加新游戏的工具。

    推荐理由:OpenAI 把强化学习游戏平台 Gym Retro 的游戏规模从约百款扩到 1000 款以上,并公开了添加新游戏的工具。

5月16日周三
  1. OpenAI News75

    OpenAI 分析:2012 年以来最大 AI 训练算力每 3.4 个月翻倍

    OpenAI 发布一项分析,指出自 2012 年以来最大规模 AI 训练所用算力呈指数增长,翻倍周期为 3.4 个月,而摩尔定律的翻倍周期为 2 年。该指标自 2012 年以来增长超过 300,000 倍,若按 2 年翻倍则仅增长 7 倍。OpenAI 表示算力提升是 AI 进展的关键组成部分,若这一趋势延续,值得为远超当前能力的系统做准备。

    推荐理由:OpenAI 用 3.4 个月翻倍这一量化指标,给出 AI 训练算力增速与摩尔定律的对比参照。

5月3日周四
4月18日周三
4月5日周四
3月15日周四
3月7日周三
  1. OpenAI News31

    OpenAI 提出可扩展元学习算法 Reptile

    OpenAI 开发出可扩展元学习算法 Reptile,通过反复采样任务、执行随机梯度下降并将初始参数朝该任务最终参数更新。Reptile 是 Shortest Descent 算法在元学习场景的应用,数学上与一阶 MAML 相似,只需对 SGD 或 Adam 等优化器进行黑盒访问,计算效率与性能相近。

3月6日周二
2月26日周一
2月22日周四
2月20日周二
2月15日周四
2月7日周三
1月31日周三
12月6日周三