跳到正文

#OpenAI

今日 17 条
8月1日周四
7月22日周一
  1. OpenAI News80

    微软向 OpenAI 投资 10 亿美元并达成合作

    微软向 OpenAI 投资 10 亿美元,支持其构建通用人工智能(AGI)并让经济收益广泛分布。双方将在 Microsoft Azure 上合作开发可扩展至 AGI 的硬件和软件平台,联合开发新的 Azure AI 超算技术,微软同时成为 OpenAI 的独家云服务提供商。

    推荐理由:微软以 10 亿美元投资并成为 OpenAI 独家云服务商,读者可据此理解双方早期算力与平台合作框架。

7月10日周三
6月5日周三
5月23日周四
5月17日周五
4月23日周二
  1. OpenAI News62

    OpenAI 提出 Sparse Transformer,可处理长 30 倍的序列

    OpenAI 开发了 Sparse Transformer,一种深度神经网络,在预测文本、图像或声音序列中下一个内容的任务上创下新纪录。它通过注意力机制的算法改进提取序列模式,可处理的序列长度是此前的 30 倍。

    推荐理由:OpenAI 官方介绍 Sparse Transformer 对注意力机制的算法改进,可了解长序列建模在文本、图像和声音上的早期思路。

4月15日周一
  1. OpenAI News77

    OpenAI Five 击败 Dota 2 世界冠军 OG

    OpenAI Five 在 Finals 周末连续两局击败 Dota 2 世界冠军战队 OG,成为首个在电竞项目中战胜世界冠军的 AI。此前 OpenAI Five 与 DeepMind 的 AlphaStar 都曾在私下战胜高水平职业选手,但在直播的职业比赛中落败,因此这也是 AI 首次在直播中击败电竞职业选手。

    推荐理由:OpenAI Five 在直播中连胜 Dota 2 世界冠军 OG,可对照此前 AlphaStar 私下取胜却直播落败的经历。

3月26日周二
3月21日周四
3月13日周三
3月11日周一
  1. OpenAI News62

    OpenAI 成立利润上限公司 OpenAI LP

    OpenAI 宣布成立 OpenAI LP,一家采用利润上限(capped-profit)模式的新公司,目的是快速扩大在算力和人才上的投入,同时通过制衡机制确保使命落地。

    推荐理由:OpenAI 官方说明新公司架构的利润上限设计,可了解其兼顾投资扩张与使命约束的组织安排。

3月6日周三
3月4日周一
2月26日周二
2月19日周二
  1. OpenAI News31

    OpenAI:AI 安全研究需要社会科学家参与

    OpenAI 发表论文指出,长期 AI 安全研究需要社会科学家参与,才能确保 AI 对齐算法在真实人类参与的场景下有效。论文认为,将先进 AI 系统与人类价值观对齐,需要解决人类理性、情绪与偏见等心理学层面的诸多不确定性。OpenAI 计划招聘社会科学家全职投入这一方向,以推动机器学习与社会科学的进一步合作。

12月19日周三
12月14日周五
12月6日周四
11月8日周四
11月7日周三
10月31日周三
10月22日周一
10月11日周四
10月9日周二
9月10日周一
8月23日周四
8月6日周一
  1. OpenAI News62

    OpenAI Five 基准测试结果:三局两胜击败 99.95 百分位 Dota 玩家队伍

    OpenAI Five 在基准测试中以三局两胜击败由 Blitz、Cap、Fogged、Merlini 和 MoonMeander 组成的 99.95 百分位 Dota 玩家队伍,其中四人有过职业 Dota 经历。比赛在直播观众面前进行,同时在线观看人数达 10 万。

    推荐理由:OpenAI Five 在公开直播中三局两胜击败 99.95 百分位人类队伍,可据此了解当时 AI 在复杂实时游戏中的表现边界。

7月30日周一
7月25日周三
7月18日周三
7月9日周一
7月4日周三
  1. OpenAI News62

    OpenAI 从单次演示中学会 Montezuma's Revenge

    OpenAI 训练智能体仅凭单次人类演示就在 Montezuma's Revenge 上取得 74,500 分的高分,超过此前所有已发表结果。其算法从演示中精心挑选状态出发,让智能体依次游玩一系列游戏,并用 PPO 优化游戏得分来学习,PPO 也是支撑 OpenAI Five 的同一强化学习算法。

    推荐理由:OpenAI 用单次人类演示让智能体在 Montezuma's Revenge 上取得 74,500 分,可了解其基于 PPO 的简单方法。

6月25日周一
  1. OpenAI News70

    OpenAI Five 已能击败 Dota 2 业余人类队伍

    OpenAI 宣布由五个神经网络组成的 OpenAI Five 已开始击败 Dota 2 业余人类队伍。该团队由五个神经网络构成,此次披露仅给出这一结果,未提供更多技术细节。

    推荐理由:OpenAI 官方披露五个神经网络组成的 OpenAI Five 已能击败 Dota 2 业余人类队伍,可了解早期多智能体协作的进展。

6月22日周五
6月11日周一
  1. OpenAI News82

    OpenAI 用无监督学习提升语言理解能力

    OpenAI 在一系列多样语言任务上取得当时最优结果,方法结合了 Transformer 与无监督预训练,并同步公开这套可扩展、与任务无关的系统。OpenAI 表示,这一结果说明监督学习方法与无监督预训练搭配效果很好,希望推动在更大、更多样数据集上继续探索这一思路。

    推荐理由:OpenAI 用 Transformer 加无监督预训练在多项语言任务上取得当时最优结果,并公开了这套与任务无关的系统。

5月30日周三
5月25日周五
  1. OpenAI News62

    OpenAI 发布 Gym Retro 完整版,游戏数量扩至 1000 款以上

    OpenAI 发布强化学习游戏研究平台 Gym Retro 的完整版,公开可用的游戏数量从约 70 款 Atari 游戏和 30 款 Sega 游戏扩展到覆盖多种模拟器的 1000 款以上。OpenAI 同时发布了用于向该平台添加新游戏的工具。

    推荐理由:OpenAI 把强化学习游戏平台 Gym Retro 的游戏规模从约百款扩到 1000 款以上,并公开了添加新游戏的工具。

5月16日周三
  1. OpenAI News75

    OpenAI 分析:2012 年以来最大 AI 训练算力每 3.4 个月翻倍

    OpenAI 发布一项分析,指出自 2012 年以来最大规模 AI 训练所用算力呈指数增长,翻倍周期为 3.4 个月,而摩尔定律的翻倍周期为 2 年。该指标自 2012 年以来增长超过 300,000 倍,若按 2 年翻倍则仅增长 7 倍。OpenAI 表示算力提升是 AI 进展的关键组成部分,若这一趋势延续,值得为远超当前能力的系统做准备。

    推荐理由:OpenAI 用 3.4 个月翻倍这一量化指标,给出 AI 训练算力增速与摩尔定律的对比参照。

5月3日周四