跳到正文
4月20日周二
4月16日周五
  1. Hugging Face Blog60

    Hugging Face 发布 Accelerate 库,五处改动让 PyTorch 训练脚本支持分布式与混合精度

    Hugging Face 发布 Accelerate 库,面向希望保留训练循环控制权的 PyTorch 用户,用统一 API 封装分布式训练(单机或多机多 GPU、TPU)与混合精度所需的样板代码。

    推荐理由:原文给出五处代码改动即可跑分布式与混合精度的具体做法,便于对照现有 PyTorch 训练脚本评估迁移成本。

4月8日周四
3月23日周二
3月18日周四
2月25日周四
  1. Hugging Face Blog36

    Hugging Face 工程师谈构建神经网络时的调试思路

    Hugging Face 工程师分享构建和调试神经网络的思考流程,强调第一步应放下机器学习、专注理解数据,包括标签是否平衡、噪声来源和预处理方式。第二步从最简基线做起,如文本分类用 word2vec 或 fastText 嵌入上的逻辑回归,以判断任务难度并建立合理对比。实现后应尝试过拟合 16 个样本的小批量,若无法达到 0 损失则很可能存在实现错误。

2月10日周三
2月9日周二
1月26日周二
1月25日周一
1月19日周二
1月18日周一
11月3日周二
9月10日周四
  1. Hugging Face Blog38

    Hugging Face 发布 pytorch_block_sparse:用块稀疏矩阵让语言模型更小更快

    Hugging Face 发布 PyTorch 扩展 pytorch_block_sparse,其 BlockSparseLinear 可直接替换 torch.nn.Linear,让语言模型更小更快。该库基于 NVIDIA CUTLASS 的块稀疏矩阵乘法,75% 稀疏度下矩阵运算约比稠密快 2 倍、内存占用减少 4 倍,但当前整体性能仍比 cuBLAS 稠密实现慢约 2 倍。

7月3日周五
1月30日周四
12月6日周三
6月28日周三
5月15日周一
12月5日周一
11月15日周二
8月29日周一