OpenAI 开放 DALL·E 测试版,将邀请 100 万候补用户
OpenAI 宣布 DALL·E 进入测试版,将在未来几周从候补名单中邀请 100 万人使用。用户可用每月重置的免费额度生成图像,也可按 115 次生成 15 美元的价格购买额外额度。
推荐理由:官方公布 DALL·E 测试版开放节奏与免费额度、付费增量,可据此了解早期图像生成产品的定价方式。
公司与模型
OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。
294 条精选近 30 天 22 条共收录 1,190 条
OpenAI 宣布 DALL·E 进入测试版,将在未来几周从候补名单中邀请 100 万人使用。用户可用每月重置的免费额度生成图像,也可按 115 次生成 15 美元的价格购买额外额度。
推荐理由:官方公布 DALL·E 测试版开放节奏与免费额度、付费增量,可据此了解早期图像生成产品的定价方式。
OpenAI 公布 DALL·E 2 研究预览进展,来自 118 个以上国家的 3000 多名艺术家已将 DALL·E 纳入自己的创作流程。OpenAI 表示,早期访问组的艺术家帮助发现了 DALL·E 的新用途,并在其决定 DALL·E 功能时提供了关键意见。
推荐理由:官方披露 DALL·E 2 研究预览的艺术家使用规模,可了解早期创作者如何把它接入创作流程。
OpenAI 训练神经网络通过 Video PreTraining(VPT)在大量无标注的人类 Minecraft 游玩视频上学习,仅使用少量标注承包商数据。经微调后,模型能学会制作钻石工具,这一任务通常需要熟练人类花费 20 分钟以上、约 24000 次操作。模型使用键盘按键和鼠标移动这类原生人类交互接口,具有较强通用性,是迈向通用计算机操作智能体的一步。
推荐理由:OpenAI 用大量无标注游戏视频预训练网络,仅少量标注数据微调即可完成钻石工具制作,为通用计算机操作智能体提供了一条路径。
OpenAI 训练了批评写作模型,用于描述摘要中的缺陷。人类评估者在看到模型批评后,发现摘要缺陷的频率明显提高。研究还发现,模型规模越大自我批评能力越强,规模对批评写作的提升大于对摘要写作的提升。
推荐理由:OpenAI 训练批评写作模型辅助人类发现摘要缺陷,为 AI 监督 AI 提供了一种可参考的思路。
OpenAI 更新 DALL·E 2 研究预览进展,早期用户迄今已生成超过 300 万张图像,并帮助改进了安全流程。OpenAI 表示将开始每周从候补名单中新增最多 1000 名用户。
推荐理由:官方披露 DALL·E 2 预览期已生成超 300 万张图像,并给出每周新增 1000 名候补用户的节奏。
OpenAI 发布新版 GPT-3 和 Codex,可在已有文本中编辑或插入内容,而不再只是补全现有文本。
推荐理由:OpenAI 为 GPT-3 和 Codex 增加编辑与插入能力,读者可了解文本补全之外的新交互方式。
OpenAI 训练出比 GPT-3 更能遵循用户意图的语言模型 InstructGPT,同时更真实、毒性更低,采用其对齐研究中的技术并引入人类参与训练。这些模型现已作为 OpenAI API 的默认语言模型部署。
推荐理由:OpenAI 官方说明 InstructGPT 的指令跟随与对齐改进,并交代其已成为 API 默认模型。
OpenAI 在 API 中新增 embeddings 端点,用于处理自然语言与代码任务,包括语义搜索、聚类、主题建模和分类。
推荐理由:OpenAI 在 API 中新增 embeddings 端点,读者可了解语义搜索、聚类与分类等任务的接入方式。
OpenAI 宣布其 API 不再需要等待名单即可使用,官方称更广泛的开放得益于安全方面的进展。
推荐理由:OpenAI 官方宣布 API 取消等待名单,读者可据此了解其开放范围与安全进展的关系。
OpenAI 训练了一个求解小学数学应用题的模型,准确率接近微调 GPT-3 模型的两倍。在自建数据集的同一批题目上,该系统的正确率为 55%,而 9-12 岁儿童小样本的正确率为 60%,即解题量约为这些孩子的 90%。
推荐理由:OpenAI 用自建小学数学数据集对比微调 GPT-3,给出模型与 9-12 岁儿童在同一批题目上的准确率差距。
OpenAI 发布改进版 Codex,这一 AI 系统可将自然语言转换为代码,即日起通过 API 以私有测试形式开放。
推荐理由:OpenAI 官方公布 Codex 改进版本并以私有测试形式开放 API,可据此了解自然语言转代码能力的接入方式。
OpenAI 发布 Triton 1.0,这是一门开源的类 Python 编程语言,让没有 CUDA 经验的研究者也能编写高效的 GPU 代码,多数情况下能达到专家水准。
推荐理由:OpenAI 开源 Triton 1.0,让没有 CUDA 经验的研究者也能写出接近专家水平的 GPU 代码。
OpenAI 表示已有超过 300 款应用通过其 API 使用 GPT-3,提供搜索、对话、文本补全等 AI 功能。
OpenAI 在 CLIP 中发现一类神经元,无论概念以字面、符号还是概念形式呈现都会产生响应。这可能解释 CLIP 在分类出人意料的视觉变体时仍保持准确的原因,也是理解 CLIP 及类似模型所学关联与偏见的重要一步。
推荐理由:OpenAI 公开 CLIP 中跨字面、符号与概念形式响应同一概念的多模态神经元发现,有助于理解模型的关联与偏见来源。
OpenAI 训练了一个名为 DALL·E 的神经网络,可根据自然语言描述生成图像,覆盖自然语言可表达的多种概念。
推荐理由:OpenAI 官方公布 DALL·E 这一从文本生成图像的神经网络,可据此了解文生图方向的早期起点。
OpenAI 发布名为 CLIP 的神经网络,通过自然语言监督高效学习视觉概念。CLIP 只需提供待识别视觉类别的名称,即可应用于任意视觉分类基准,类似 GPT-2 和 GPT-3 的零样本能力。
推荐理由:OpenAI 官方介绍 CLIP 用自然语言监督学习视觉概念,读者可了解零样本视觉分类的思路来源。
OpenAI 宣布已同意将 GPT-3 授权给 Microsoft,用于其自有产品和服务。材料未披露授权范围、金额或具体产品形态。
推荐理由:OpenAI 将 GPT-3 授权给 Microsoft 用于其自有产品与服务,可据此观察早期大模型商业授权路径。
OpenAI 将人类反馈强化学习(RLHF)应用于语言模型训练,使其在摘要任务上表现更好。
推荐理由:OpenAI 用人类反馈强化学习训练摘要模型,可了解 RLHF 在摘要任务上的早期应用思路。
OpenAI 发现,与在语言上训练的大 Transformer 模型一样,在像素序列上训练的同一模型也能生成连贯的图像补全和样本。研究通过建立样本质量与图像分类准确率之间的相关性,表明其最佳生成模型在无监督设定下所含特征可与顶级卷积网络竞争。
推荐理由:OpenAI 用同一套 Transformer 架构处理像素序列,并给出生成质量与分类精度相关的证据,可看早期统一建模思路。
OpenAI 发布 API,用于访问其开发的新 AI 模型。
推荐理由:OpenAI 官方发布 API,读者可了解其新模型首次以接口形式对外开放这一变化。