跳到正文
10月10日周六
  1. Hugging Face Blog22

    基于 Transformer 的编码器-解码器模型详解

    Hugging Face 发布博客,详解基于 Transformer 的编码器-解码器架构如何建模序列到序列问题,聚焦其数学定义与推理用法。文章将架构拆解为编码器和解码器两部分,并关联 🤗Transformers 中的 T5、Bart、MarianMT、Pegasus 等模型的实际推理。该文不涉及模型训练,仅提供背景与图示说明。

9月10日周四
  1. Hugging Face Blog38

    Hugging Face 发布 pytorch_block_sparse:用块稀疏矩阵让语言模型更小更快

    Hugging Face 发布 PyTorch 扩展 pytorch_block_sparse,其 BlockSparseLinear 可直接替换 torch.nn.Linear,让语言模型更小更快。该库基于 NVIDIA CUTLASS 的块稀疏矩阵乘法,75% 稀疏度下矩阵运算约比稠密快 2 倍、内存占用减少 4 倍,但当前整体性能仍比 cuBLAS 稠密实现慢约 2 倍。

7月3日周五
3月1日周日
2月14日周五