跳到正文

#OpenAI

今日 1 条
8月15日周二
8月1日周二
7月26日周三
7月21日周五
7月20日周四
  1. OpenAI News62

    OpenAI 为 ChatGPT 推出自定义指令功能

    OpenAI 为 ChatGPT 推出自定义指令功能,用户可设置自己的偏好,ChatGPT 会在之后所有对话中记住这些偏好。该功能让用户对 ChatGPT 的回复方式拥有更多控制权。

    推荐理由:OpenAI 官方说明 ChatGPT 自定义指令的用途,读者可据此了解对话偏好设置的适用范围。

7月18日周二
7月17日周一
7月7日周五
6月29日周四
6月28日周三
6月13日周二
  1. OpenAI News80

    OpenAI 公布 API 更新:函数调用、更长上下文与更低价格

    OpenAI 宣布一系列 API 更新,包括更易控制的 API 模型、函数调用能力、更长的上下文以及更低的价格。官方未在摘要中给出具体模型版本、上下文长度和价格数字。

    推荐理由:OpenAI 官方公布 API 模型可控性、函数调用、上下文与价格四项变化,可据此判断接口能力与成本走向。

6月1日周四
5月31日周三
  1. OpenAI News62

    OpenAI 用过程监督提升数学推理能力

    OpenAI 训练了一个模型,通过奖励每一步正确推理(过程监督)而非只奖励最终正确答案(结果监督),在数学问题求解上取得新的 SOTA。相比结果监督,过程监督除了提升性能,还带来对齐上的好处:直接训练模型产出被人类认可的思维链。

    推荐理由:OpenAI 用过程监督替代结果监督提升数学推理,并说明其对思维链对齐的作用。

5月25日周四
5月22日周一
5月18日周四
  1. OpenAI News75

    OpenAI 推出 ChatGPT iOS 应用

    OpenAI 发布 ChatGPT iOS 应用,支持对话同步和语音输入,并将最新的模型改进带到移动端。

    推荐理由:OpenAI 官方公布 ChatGPT iOS 应用,说明对话同步与语音输入两项能力,可据此了解其移动端入口的初始形态。

5月9日周二
  1. OpenAI News61

    OpenAI 用 GPT-4 解释语言模型神经元并公开 GPT-2 数据集

    OpenAI 使用 GPT-4 自动为大型语言模型中的神经元行为撰写解释,并对这些解释打分。团队公开了覆盖 GPT-2 每个神经元的解释与评分数据集,并说明这些解释并不完美。

    推荐理由:OpenAI 用 GPT-4 自动解释并打分 GPT-2 神经元行为,公开了逐神经元解释数据集,可供研究模型可解释性方法。

4月25日周二
4月11日周二
  1. OpenAI News40

    OpenAI 宣布启动漏洞赏金计划

    OpenAI 宣布推出漏洞赏金计划,邀请外界帮助发现其技术与服务中的安全漏洞。该计划是 OpenAI 致力于开发安全、先进 AI 的一部分,目标是打造安全、可靠、可信的技术与服务。

4月5日周三
3月24日周五
3月23日周四
  1. OpenAI News80

    OpenAI 为 ChatGPT 推出插件支持

    OpenAI 宣布 ChatGPT 已实现插件的初步支持。插件是专为语言模型设计的工具,以安全为核心原则,可帮助 ChatGPT 获取最新信息、执行计算或调用第三方服务。

    推荐理由:OpenAI 官方给出插件机制的最初定义,可据此了解 ChatGPT 接入外部工具与实时信息的早期形态。

3月17日周五
3月14日周二
  1. OpenAI News93

    OpenAI 发布多模态大模型 GPT-4

    OpenAI 发布 GPT-4,称其为扩大深度学习规模的最新里程碑。GPT-4 是一个大型多模态模型,接受图像和文本输入、输出文本,在多项专业和学术基准上达到人类水平表现,但在许多真实场景中能力仍不及人类。

    推荐理由:OpenAI 官方给出 GPT-4 的多模态输入形态与基准表现,可据此了解其能力定位。

  2. OpenAI News89

    OpenAI 发布 GPT-4

    OpenAI 发布 GPT-4,可用于创意与技术写作任务。它能在写歌、写剧本等场景中生成、编辑内容,并与用户反复迭代,还能学习用户的写作风格。

    推荐理由:官方给出 GPT-4 在创意与技术写作上的生成、编辑与风格学习能力,可据此判断写作类任务的可用边界。

2月24日周五
2月16日周四
2月7日周二
1月24日周二
  1. Hugging Face Blog52

    Hugging Face 解读对话智能体为何有用:IFT、SFT、CoT 与 RLHF 的分工

    Hugging Face 博客梳理了让对话智能体有用的关键技术,包括指令微调(IFT)、监督微调(SFT)、思维链(CoT)提示和基于人类反馈的强化学习(RLHF),并对比了 LaMDA、BlenderBot 3、Sparrow、ChatGPT/InstructGPT 和 Anthropic Assistant 在访问方式、训练数据、模型架构与评测方向上的差异。

1月23日周一
1月11日周三
  1. OpenAI News38

    OpenAI 与乔治城大学、斯坦福互联网观测台联合研究语言模型被用于虚假信息活动的潜在风险

    OpenAI 研究人员与乔治城大学安全与新兴技术中心、斯坦福互联网观测台合作,调查大语言模型可能被用于虚假信息活动的风险。该合作基于一年多的研究,包括 2021 年 10 月汇集 30 位虚假信息研究者、机器学习专家与政策分析师的研讨会,最终形成联合报告,梳理语言模型对信息环境的威胁并提出潜在缓解措施的分析框架。

1月4日周三
1月3日周二
1月1日周日
12月23日周五