跳到正文

#OpenAI

今日 3 条
6月29日周四
6月28日周三
6月13日周二
6月1日周四
5月31日周三
  1. OpenAI News62

    OpenAI 用过程监督提升数学推理能力

    OpenAI 训练了一个模型,通过奖励每一步正确推理(过程监督)而非只奖励最终正确答案(结果监督),在数学问题求解上取得新的 SOTA。除性能提升外,过程监督还带来对齐收益:直接训练模型产出人类认可的思维链。

    推荐理由:OpenAI 用过程监督替代结果监督提升数学推理,并给出对对齐的额外收益,可了解训练方法差异。

5月25日周四
5月22日周一
5月18日周四
  1. OpenAI News78

    OpenAI 推出 ChatGPT iOS 应用

    OpenAI 发布 ChatGPT 的 iOS 应用,可同步用户的对话记录,并支持语音输入。该应用同时带来 OpenAI 最新的模型改进。

    推荐理由:OpenAI 官方发布 ChatGPT iOS 应用,给出对话同步与语音输入两项核心能力。

5月9日周二
4月25日周二
  1. OpenAI News62

    ChatGPT 新增关闭聊天记录功能

    ChatGPT 用户现在可以关闭聊天记录,自行选择哪些对话可以被用于训练模型。

    推荐理由:ChatGPT 新增关闭聊天记录开关,读者可据此了解对话数据是否用于模型训练的自主控制方式。

4月11日周二
  1. OpenAI News38

    OpenAI 宣布漏洞赏金计划

    OpenAI 宣布推出漏洞赏金计划,邀请外界帮助发现其技术与服务中的安全漏洞。该计划是 OpenAI 致力于开发安全、先进 AI 的一部分,目标是打造安全、可靠、可信的技术与服务。

4月5日周三
3月24日周五
3月23日周四
  1. OpenAI News82

    OpenAI 为 ChatGPT 推出插件支持

    OpenAI 宣布为 ChatGPT 实现插件的初步支持。插件是专为语言模型设计的工具,以安全为核心原则,可帮助 ChatGPT 获取最新信息、执行计算或使用第三方服务。

    推荐理由:OpenAI 官方给出 ChatGPT 插件的最初支持范围,读者可据此了解模型接入外部工具与实时信息的早期形态。

3月17日周五
3月14日周二
  1. OpenAI News92

    OpenAI 发布多模态大模型 GPT-4

    OpenAI 发布 GPT-4,称其为扩展深度学习的最新里程碑。GPT-4 是一个大型多模态模型,接受图像和文本输入、输出文本,在许多真实场景中能力不及人类,但在多项专业和学术基准上达到人类水平。

    推荐理由:OpenAI 官方给出 GPT-4 的多模态输入形态与基准表现,可据此了解这一代模型的能力边界。

  2. OpenAI News90

    OpenAI 发布 GPT-4

    OpenAI 发布 GPT-4,可生成、编辑并与用户迭代完成创意与技术写作任务,例如创作歌曲、撰写剧本,或学习用户的写作风格。

    推荐理由:OpenAI 官方发布 GPT-4,读者可据此了解新模型在创意与技术写作上的生成、编辑与迭代能力。

2月24日周五
  1. Hugging Face Blog35

    Hugging Face 详解大语言模型红队测试

    红队测试通过构造自然语言提示词诱导大语言模型输出有害内容,从而暴露其漏洞,与对抗攻击不同,其提示词对人类而言是正常可读的。红队测试可由人工或另一个语言模型执行,针对经 RLHF 或 SFT 对齐的模型需借助角色扮演等创造性手段。随着模型能力增强,开发可持续适配的红队方法并推动多方协作共享数据集与最佳实践变得至关重要。

2月16日周四
  1. OpenAI News62

    OpenAI 谈 AI 系统应如何表现以及由谁决定

    OpenAI 发文说明 ChatGPT 的行为是如何被塑造的,并介绍其改进计划,包括让用户拥有更多自定义空间,以及在相关决策中引入更多公众意见。

    推荐理由:OpenAI 说明 ChatGPT 行为如何被塑造,并给出用户自定义与公众参与决策的改进方向。

2月1日周三
  1. OpenAI News78

    OpenAI 推出 ChatGPT Plus 订阅试点

    OpenAI 宣布为 ChatGPT 推出试点订阅方案 ChatGPT Plus。ChatGPT 是一款对话式 AI,可与用户聊天、回答追问并指出错误假设。

    推荐理由:OpenAI 官方公布 ChatGPT 付费订阅试点,读者可据此了解其早期商业化路径的起点。

1月31日周二
1月24日周二
1月23日周一
1月11日周三
  1. OpenAI News42

    OpenAI 与乔治城大学、斯坦福互联网天文台联合研究:语言模型如何被用于虚假信息宣传及如何降低风险

    OpenAI 联合乔治城大学安全与新兴技术中心及斯坦福互联网天文台,研究大语言模型可能被用于虚假信息宣传的方式,并发布了一份基于一年多研究的联合报告。报告梳理了语言模型若被用于增强虚假信息宣传会对信息环境构成的威胁,并提出了一套分析潜在缓解措施的框架。

1月4日周三
1月3日周二
1月1日周日
12月23日周五
12月21日周三
  1. Hugging Face Blog42

    用 CLIPSeg 实现零样本图像分割

    Hugging Face 发布指南,介绍如何通过 transformers 使用零样本图像分割模型 CLIPSeg。CLIPSeg 在冻结的 CLIP 之上训练 Transformer 解码器,可生成粗略分割掩码,用于机器人感知、图像修复等任务,并支持以文本或示例图像作为提示词的"视觉提示"。

12月16日周五
12月15日周四
  1. OpenAI News62

    OpenAI 发布新版嵌入模型

    OpenAI 宣布推出新的嵌入模型,官方称其在能力、成本和使用简便性上均有明显改进。

    推荐理由:OpenAI 发布新版嵌入模型,官方称能力更强、成本更低且更易使用,可据此评估替换现有嵌入方案。

12月9日周五
  1. Hugging Face Blog62

    图解 RLHF:从预训练、奖励模型到 PPO 微调的三步流程

    Hugging Face 博客图解 RLHF 的完整训练流程,将其拆为预训练语言模型、收集人类偏好数据训练奖励模型、用 PPO 微调语言模型三个核心步骤。文中说明奖励模型输出标量奖励,训练时用 KL 散度惩罚策略偏离初始模型,并给出 OpenAI、Anthropic、DeepMind 在模型与奖励模型规模上的不同选择。

    推荐理由:把 RLHF 拆成预训练、奖励模型、PPO 微调三步,并列出 TRL、TRLX、RL4LMs 等开源工具与数据成本。

12月8日周四
11月30日周三
  1. OpenAI News96

    OpenAI 发布对话式模型 ChatGPT

    OpenAI 训练并发布名为 ChatGPT 的模型,以对话方式交互。官方称对话格式让 ChatGPT 能够回答追问、承认自身错误、质疑错误前提并拒绝不当请求。

    推荐理由:OpenAI 官方给出 ChatGPT 的对话式交互定位,读者可据此了解其与以往模型在交互方式上的差异。