跳到正文
热点事件持续更新

Prime Intellect发布INTELLECT-2分布式RL训练

2 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月7日,Prime Intellect 在官方博客发布 INTELLECT-2,称其为首个 32B 参数、通过全球分布式强化学习训练的模型,在动态异构的算力贡献者集群上以完全异步 RL 训练推理语言模型。据该报道,一台配备 4×RTX 3090 GPU 的机器即足以参与这一 32B 参数模型的训练;其完全异步的在线强化学习框架 prime-rl 已开源,允许任何人发起全球分布式强化学习训练,从而以完全无许可的方式向全球开放 GPU 资源贡献;完整训练数据集发布在 Huggingface 上。同一日发布的另一篇报道表述一致,并称 INTELLECT-2 连同代码与数据一并开源,以推动全球分布式训练领域的开放研究。截至上述报道,事件仍处于发布与启动阶段,尚无后续进展披露,也未出现与早先报道数字、时间或说法不一致的情况。上述条件与证据均针对 Prime Intellect 此次 INTELLECT-2 训练及 prime-rl 框架,不构成对其他模型或操作的普遍适用说明。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. Prime Intellect Blog
    Prime Intellect 发布 INTELLECT-2:首个全球分布式 32B 参数强化学习训练

    Prime Intellect 发布 INTELLECT-2,称这是首个 32B 参数、全球去中心化的强化学习训练,任何人都可无许可贡献异构算力。

  2. Prime Intellect Blog
    Prime Intellect 发布 INTELLECT-2:首个通过全球分布式强化学习训练的 32B 模型

    Prime Intellect 发布 INTELLECT-2,称其为首个通过全球分布式强化学习训练的 32B 参数模型,在动态异构的算力贡献者集群上以完全异步 RL 训练推理语言模型。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。