跳到正文
1月5日周二
  1. OpenAI News78

    OpenAI 发布 CLIP:用自然语言连接文本与图像

    OpenAI 发布名为 CLIP 的神经网络,通过自然语言监督高效学习视觉概念。CLIP 只需提供待识别视觉类别的名称,即可应用于任意视觉分类基准,类似 GPT-2 和 GPT-3 的零样本能力。

    推荐理由:OpenAI 官方介绍 CLIP 用自然语言监督学习视觉概念,读者可了解零样本视觉分类的思路来源。

4月30日周四
  1. OpenAI News62

    OpenAI 发布音乐生成神经网络 Jukebox 并开源模型权重与代码

    OpenAI 发布 Jukebox,一个能生成音乐并以原始音频形式输出、包含初级演唱的神经网络,覆盖多种曲风和艺术家风格。OpenAI 同时公开了模型权重和代码,并提供用于查看生成样本的工具。

    推荐理由:OpenAI 公开 Jukebox 的模型权重与代码,读者可据此了解早期音乐生成模型的开源形态。

4月25日周四
  1. OpenAI News62

    OpenAI 发布 MuseNet 音乐生成神经网络

    OpenAI 发布 MuseNet,一个可生成 4 分钟乐曲、支持 10 种乐器的深度神经网络,能融合从乡村到莫扎特再到披头士的风格。MuseNet 并未被显式编程音乐知识,而是通过预测数十万份 MIDI 文件中的下一个 token 来学习和声、节奏与风格。它沿用了与 GPT-2 相同的通用无监督技术,即预测序列中下一个 token 的大规模 Transformer 模型,无论序列是音频还是文本。

    推荐理由:OpenAI 用与 GPT-2 同源的通用无监督技术生成音乐,可观察同一架构跨模态迁移的早期路径。