跳到正文
热点事件持续更新

Prime Intellect 发布全球分布式训练 10B 模型 INTELLECT-1

2 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

Prime Intellect 启动并发布 INTELLECT-1,称其为首个在全球分布式节点上训练的 10B 参数语言模型。据其介绍,模型基于 Llama-3 架构,规模是此前研究的 10 倍,在 1T token 数据集上训练 42 天,横跨五个国家、三大洲,最多同时使用 112 张 H100 GPU,全球分布式训练算力利用率达 83%,全美范围内达 96%。启动阶段,Prime Intellect 邀请任何人通过其平台贡献算力参与,并称后续也可更方便地用自有硬件贡献;其生产训练每 100 步同步一次,在 8xH100 节点组成的 island 上约需 40 分钟。发布时一并放出详细技术报告、INTELLECT-1 基础模型、中间检查点与后训练模型、聊天界面、预训练数据集、由 Arcee AI 提供的后训练数据集以及 PRIME 框架。早先报道称该模型将主要在 Hugging Face 的 Fineweb-Edu 开源数据集上训练。

AI 根据报道生成 · 2 小时前更新

事件进展

2 个进展

  1. 10月7日 19:14 · 1 篇报道
    Prime Intellect启动INTELLECT-1全球分布式训练
    Prime Intellect Blog:Prime Intellect 启动 INTELLECT-1:首个全球分布式训练的 10B 参数模型
  2. 10月7日 19:14 · 1 篇报道
    发布全球分布式训练的10B参数模型INTELLECT-1
    Prime Intellect Blog:Prime Intellect 发布 INTELLECT-1:全球分布式训练的 10B 参数模型

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. Prime Intellect Blog
    Prime Intellect 启动 INTELLECT-1:首个全球分布式训练的 10B 参数模型

    Prime Intellect 启动 INTELLECT-1,这是首个在全球分布式节点上训练的 10B 参数模型,基于 Llama-3 架构,邀请任何人贡献算力参与。

  2. Prime Intellect Blog
    Prime Intellect 发布 INTELLECT-1:全球分布式训练的 10B 参数模型

    Prime Intellect 发布 INTELLECT-1,称其为首个在全球范围内协作训练的 10B 参数语言模型,规模是此前研究的 10 倍。模型基于 Llama-3 架构,在 1T token 数据集上训练 42 天,横跨五个国家、三大洲,最多同时使用 112 张 H100 GPU,全球分布式训练算力利用率达 83%,全美范围内达 96%。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。