跳到正文
3月17日周五
2月24日周五
1月11日周三
  1. OpenAI News40

    OpenAI 与乔治城大学、斯坦福互联网观测站联合研究:语言模型如何被用于虚假信息宣传及如何降低风险

    OpenAI 联合乔治城大学安全与新兴技术中心及斯坦福互联网观测站,研究大语言模型被用于虚假信息宣传的潜在风险,并发布了一份基于一年多研究的联合报告。报告梳理了语言模型若被用于放大虚假信息宣传对信息环境构成的威胁,并提出了分析潜在缓解措施的框架。

10月19日周三
  1. Hugging Face Blog62

    Hugging Face 发布 MTEB 大规模文本嵌入基准

    Hugging Face 发布 MTEB,一个衡量文本嵌入模型在多种嵌入任务上表现的基准,包含 8 类任务、56 个数据集,覆盖最多 112 种语言,榜单已汇总超过 2000 条结果。

    推荐理由:MTEB 把 56 个数据集、8 类任务和 112 种语言汇总到同一榜单,读者可据此理解文本嵌入模型的评测维度与取舍。

9月26日周一
6月28日周二
6月23日周四
  1. OpenAI News74

    OpenAI 用视频预训练让神经网络学会玩 Minecraft

    OpenAI 训练神经网络通过 Video PreTraining(VPT)在大量无标注的人类 Minecraft 游玩视频上学习,仅使用少量标注承包商数据。经微调后,模型能学会制作钻石工具,这一任务通常需要熟练人类花费 20 分钟以上、约 24000 次操作。模型使用键盘按键和鼠标移动这类原生人类交互接口,具有较强通用性,是迈向通用计算机操作智能体的一步。

    推荐理由:OpenAI 用大量无标注游戏视频预训练网络,仅少量标注数据微调即可完成钻石工具制作,为通用计算机操作智能体提供了一条路径。

6月13日周一
  1. OpenAI News62

    OpenAI 训练批评写作模型帮助人类发现摘要缺陷

    OpenAI 训练了批评写作模型,用于描述摘要中的缺陷。人类评估者在看到模型批评后,发现摘要缺陷的频率明显提高。研究还发现,模型规模越大自我批评能力越强,规模对批评写作的提升大于对摘要写作的提升。

    推荐理由:OpenAI 训练批评写作模型辅助人类发现摘要缺陷,为 AI 监督 AI 提供了一种可参考的思路。

5月23日周一
2月2日周三
12月16日周四
10月29日周五
  1. OpenAI News62

    OpenAI 训练系统求解小学数学应用题,准确率约为微调 GPT-3 的两倍

    OpenAI 训练了一个求解小学数学应用题的模型,准确率接近微调 GPT-3 模型的两倍。在自建数据集的同一批题目上,该系统的正确率为 55%,而 9-12 岁儿童小样本的正确率为 60%,即解题量约为这些孩子的 90%。

    推荐理由:OpenAI 用自建小学数学数据集对比微调 GPT-3,给出模型与 9-12 岁儿童在同一批题目上的准确率差距。

10月13日周三
  1. Hugging Face Blog22

    用遥感(卫星)图像和描述微调 CLIP

    一个跨 12 个时区的团队用 RSICD、UCM 和 Sydney 三个遥感数据集微调了 OpenAI 的 CLIP,让模型能按文本描述检索卫星图像。训练采用对比学习,并用 Torchvision 图像增强和 Marian MT 回译文本增强抑制过拟合,评估显示增强后过拟合明显下降。模型已开放下载,并提供在线 demo。

9月23日周四
7月15日周四
  1. Hugging Face Blog62

    Hugging Face 提出 DeDLOC:40 名志愿者协作预训练孟加拉语模型 sahajBERT

    Hugging Face 博客介绍 DeDLOC 协作分布式训练方法,通过自适应梯度聚合适应参与者的网络与硬件差异,并用 40 名志愿者预训练出孟加拉语模型 sahajBERT。

    推荐理由:DeDLOC 用 40 名志愿者在互联网上预训练出孟加拉语模型,为算力受限的社区提供了一条可复现的协作训练路径。

6月10日周四
3月9日周二
3月4日周四
  1. OpenAI News60

    OpenAI 在 CLIP 中发现多模态神经元

    OpenAI 在 CLIP 中发现一类神经元,无论概念以字面、符号还是概念形式呈现都会产生响应。这可能解释 CLIP 在分类出人意料的视觉变体时仍保持准确的原因,也是理解 CLIP 及类似模型所学关联与偏见的重要一步。

    推荐理由:OpenAI 公开 CLIP 中跨字面、符号与概念形式响应同一概念的多模态神经元发现,有助于理解模型的关联与偏见来源。

9月4日周五
6月17日周三
  1. OpenAI News62

    OpenAI 发布 Image GPT:用 Transformer 建模像素序列生成图像

    OpenAI 发现,与在语言上训练的大 Transformer 模型一样,在像素序列上训练的同一模型也能生成连贯的图像补全和样本。研究通过建立样本质量与图像分类准确率之间的相关性,表明其最佳生成模型在无监督设定下所含特征可与顶级卷积网络竞争。

    推荐理由:OpenAI 用同一套 Transformer 架构处理像素序列,并给出生成质量与分类精度相关的证据,可看早期统一建模思路。

5月28日周四
5月5日周二
  1. OpenAI News62

    OpenAI 分析:ImageNet 训练算力每 16 个月减半

    OpenAI 发布分析称,自 2012 年以来,在 ImageNet 分类上训练神经网络达到同等性能所需的算力每 16 个月减少一半。相比 2012 年,训练达到 AlexNet 水平的网络所需算力已减少 44 倍,而同期摩尔定律仅带来 11 倍的成本改善。研究认为,在近期投入较高的 AI 任务上,算法进步带来的收益超过传统硬件效率提升。

    推荐理由:OpenAI 用 ImageNet 训练算力数据量化算法进步速度,可与摩尔定律对比理解 AI 效率提升来源。

4月16日周四
1月23日周四
12月13日周五
12月5日周四
12月3日周二
10月15日周二
  1. OpenAI News78

    OpenAI 用机械手解魔方:纯仿真训练加 ADR 技术

    OpenAI 训练了一对神经网络,让类人机械手解开魔方,训练完全在仿真中完成,使用与 OpenAI Five 相同的强化学习代码,并搭配名为 Automatic Domain Randomization(ADR)的新技术。该系统能应对训练中从未见过的情况,例如被毛绒长颈鹿戳碰,说明强化学习不只适用于虚拟任务,也能解决需要极高灵巧度的物理世界问题。

    推荐理由:OpenAI 用同一套强化学习代码加 ADR 在仿真中训练机械手解魔方,可观察仿真到真实世界的迁移思路。

9月19日周四
  1. OpenAI News60

    OpenAI 用人类偏好微调 774M 参数 GPT-2

    OpenAI 用人类反馈对 774M 参数的 GPT-2 语言模型进行微调,在多项任务上成功匹配外部人类标注者的偏好,但这些偏好并不总与 OpenAI 自己的预期一致。在摘要任务中,标注者偏好直接照抄输入的句子,模型因此学会了复制;摘要任务需要 6 万条人类标注,而按不同风格续写文本等更简单的任务只需 5 千条。OpenAI 表示其动机是让安全技术更接近“机器与人对话”这一通用任务。

    推荐理由:OpenAI 用人类反馈微调 GPT-2 的早期实验,展示了偏好数据如何影响模型行为,也暴露了标注偏好与研究者预期的偏差。

9月17日周二
  1. OpenAI News62

    OpenAI 从多智能体交互中观察到工具使用的涌现

    OpenAI 在模拟捉迷藏环境中训练智能体,观察到它们逐步学会使用更复杂的工具,并形成六种不同的策略与反策略,其中一些策略是该环境原本未被设计支持的。OpenAI 认为,这种在简单环境中自监督涌现出的复杂性,说明多智能体共同适应未来可能产生更复杂、更智能的行为。

    推荐理由:OpenAI 在捉迷藏模拟环境中观察到智能体自发形成六种策略与反策略,可了解多智能体协同演化的一种研究路径。

8月22日周四
7月10日周三
  1. OpenAI News34

    OpenAI 为何认为负责任 AI 发展需要安全合作

    OpenAI 发布政策研究论文,提出四项可立即用于提升 AI 安全规范长期行业合作可能性的策略:沟通风险与收益、技术协作、提高透明度、激励标准。分析指出,行业安全合作对确保 AI 系统安全有益至关重要,但竞争压力可能引发集体行动问题,导致 AI 公司对安全投入不足。

4月23日周二
  1. OpenAI News62

    OpenAI 提出 Sparse Transformer,可处理长 30 倍的序列

    OpenAI 开发了 Sparse Transformer,一种深度神经网络,在预测文本、图像或声音序列中下一个内容的任务上创下新纪录。它通过对注意力机制做算法改进,从比以往长 30 倍的序列中提取模式。

    推荐理由:OpenAI 官方介绍 Sparse Transformer 对注意力机制的改进,可了解长序列建模在文本、图像和声音上的早期思路。

3月21日周四
3月6日周三
3月4日周一
2月19日周二
  1. OpenAI News42

    OpenAI:AI 安全研究需要社会科学家参与

    OpenAI 发布论文指出,长期 AI 安全研究需要社会科学家参与,以确保 AI 对齐算法在涉及真实人类时能够奏效。论文认为,要让先进 AI 系统与人类价值观正确对齐,必须解决人类理性、情绪与偏见等心理学层面的诸多不确定性,OpenAI 计划全职招聘社会科学家推进这一方向。

12月14日周五
  1. OpenAI News42

    OpenAI 研究:AI 训练如何扩展——梯度噪声尺度可预测并行性

    OpenAI 发现梯度噪声尺度这一统计指标能预测神经网络训练在多种任务上的可并行性。由于复杂任务的梯度噪声更大,未来更大的 batch size 可能变得有用,从而消除 AI 系统继续扩展的一项潜在限制。该结果表明神经网络训练并非神秘技艺,而是可以被严格化和系统化的。

12月6日周四
11月7日周三
  1. OpenAI News40

    OpenAI 用能量函数模型学习概念

    OpenAI 开发出一种基于能量的模型,仅需五次演示即可学会识别并生成以 2D 点集表达的概念,如 near、above、between、closest 和 furthest。该模型还展现出跨域迁移能力:在 2D 粒子环境中学会的概念可用于解决 3D 物理机器人的任务。