跳到正文
2月1日周二
1月21日周五
1月13日周四
1月11日周二
12月14日周二
12月2日周四
  1. Hugging Face Blog22

    Hugging Face 推出首个 ML-Agents 环境 Snowball Fight

    Hugging Face 发布首个自定义深度强化学习环境 Snowball Fight 1vs1,基于 Unity ML-Agents 构建,玩家可与深度强化学习智能体对战投掷雪球,游戏托管在 Hugging Face Spaces 并可在线游玩。训练环境已开源发布在 Hugging Face Hub,后续将推出使用 MA-POCA 算法的 2vs2 协作版本及更多自定义环境。

11月30日周二
11月19日周五
11月4日周四
10月26日周二
  1. Hugging Face Blog28

    大语言模型:新的摩尔定律?

    微软和 NVIDIA 发布 Megatron-Turing NLG 530B,号称全球最大最强的生成式语言模型,但训练需数百台 DGX A100 服务器、成本近 1 亿美元。作者质疑这类超大模型趋势:基准提升有限,却带来高昂成本、复杂度和碳足迹,并建议改用预训练模型、更小模型(如 DistilBERT 保留 97% 语言理解、体积小 40%、速度快 60%)和微调。

10月5日周二
9月14日周二
  1. Hugging Face Blog62

    Hugging Face 发布开源优化工具库 Optimum

    Hugging Face 发布开源库 Optimum,目标是成为 Transformer 生产性能的优化工具包,让模型在特定硬件上训练和推理达到更高效率。Optimum 与硬件伙伴合作构建,首个案例是与 Intel 的 Neural Compressor 配合,演示如何为 Intel Xeon CPU 量化模型。

    推荐理由:Hugging Face 官方开源 Optimum,读者可了解它如何把模型加速与硬件适配的复杂度封装起来。

7月28日周三
7月13日周二
7月8日周四
6月28日周一
5月25日周二
4月20日周二
4月16日周五
  1. Hugging Face Blog60

    Hugging Face 发布 Accelerate 库,五处改动让 PyTorch 训练脚本支持分布式与混合精度

    Hugging Face 发布 Accelerate 库,面向希望保留训练循环控制权的 PyTorch 用户,用统一 API 封装分布式训练(单机或多机多 GPU、TPU)与混合精度所需的样板代码。

    推荐理由:原文给出五处代码改动即可跑分布式与混合精度的具体做法,便于对照现有 PyTorch 训练脚本评估迁移成本。

4月8日周四
3月23日周二
3月18日周四
2月25日周四
  1. Hugging Face Blog36

    Hugging Face 工程师谈构建神经网络时的调试思路

    Hugging Face 工程师分享构建和调试神经网络的思考流程,强调第一步应放下机器学习、专注理解数据,包括标签是否平衡、噪声来源和预处理方式。第二步从最简基线做起,如文本分类用 word2vec 或 fastText 嵌入上的逻辑回归,以判断任务难度并建立合理对比。实现后应尝试过拟合 16 个样本的小批量,若无法达到 0 损失则很可能存在实现错误。

2月10日周三
2月9日周二
1月26日周二
1月25日周一
1月19日周二
1月18日周一
11月3日周二
9月10日周四
  1. Hugging Face Blog38

    Hugging Face 发布 pytorch_block_sparse:用块稀疏矩阵让语言模型更小更快

    Hugging Face 发布 PyTorch 扩展 pytorch_block_sparse,其 BlockSparseLinear 可直接替换 torch.nn.Linear,让语言模型更小更快。该库基于 NVIDIA CUTLASS 的块稀疏矩阵乘法,75% 稀疏度下矩阵运算约比稠密快 2 倍、内存占用减少 4 倍,但当前整体性能仍比 cuBLAS 稠密实现慢约 2 倍。

7月3日周五
1月30日周四
12月6日周三
6月28日周三
5月15日周一
12月5日周一
11月15日周二