跳到正文
12月20日周三
  1. Hugging Face Blog62

    用投机解码让 Whisper 推理提速 2 倍

    Hugging Face 博客介绍如何用投机解码将 Whisper 推理速度提升约 2 倍,且数学上保证输出与单独使用主模型完全一致。在 LibriSpeech 基准上,Whisper large-v2 的 73 个样本推理时间从 73 秒降至 33 秒,WER 保持 3.5%;荷兰语 VoxPopuli 上从 117 秒降至 62 秒,WER 保持 12.8%。

    推荐理由:原文给出可复用的投机解码实现与基准数据,读者可据此在现有 Whisper 流程中获得约 2 倍加速。

12月11日周一
  1. Hugging Face Blog52

    Hugging Face 详解混合专家模型 MoE

    Hugging Face 发布《Mixture of Experts Explained》长文,系统讲解 MoE 的构成、训练方式与推理权衡。文章指出 MoE 用稀疏层加门控网络替代部分 FFN 层,预训练更快、推理比同参数量稠密模型更快,但需把全部专家载入显存,例如 Mixtral 8x7B 需容纳 47B 稠密参数。

12月6日周三
12月5日周二
  1. Hugging Face Blog62

    Hugging Face 发布 Optimum-NVIDIA,一行代码加速 LLM 推理

    Hugging Face 发布 Optimum-NVIDIA 推理库,只需将 transformers 的 pipeline 导入改为 optimum.nvidia 一行代码,即可在 NVIDIA 平台获得最高 28 倍吞吐提升和 1200 tokens/秒,首 token 延迟最高降低 3.3 倍。

    推荐理由:Hugging Face 与 NVIDIA 联合推出的推理库,用一行代码替换即可获得最高 28 倍吞吐提升,适合关注 LLM 部署成本的读者。

12月1日周五
  1. Hugging Face Blog36

    Open LLM Leaderboard 深度解析 DROP 基准评分异常

    Hugging Face 对 Open LLM Leaderboard 新增的 DROP 基准进行深度排查,发现多数模型 f1-score 低于 10 分源于评测实现问题:数字后跟非空格空白字符时归一化失效,且以 . 作为停止符会截断浮点答案、让高质量模型因生成过长反而得分更低。改用 \n 作为停止符重新计算后,分数与模型整体表现的相关性明显改善。

11月9日周四
11月7日周二
11月3日周五
  1. Hugging Face Blog22

    Hugging Face Hub 推出存储区域功能

    Hugging Face 面向 Enterprise Hub 客户推出 Storage Regions,允许组织选择模型和数据集的存储位置。目前支持 US 和 EU 两个区域,Asia-Pacific 即将上线;存储在欧洲的仓库可获得约 4-5 倍的上传和下载速度提升,并满足 GDPR 合规需求。非默认区域的仓库会直接显示 Region 标签。

10月27日周五
10月25日周三
  1. Hugging Face Blog38

    用一行代码交互式探索你的 Hugging Face 数据集

    Renumics Spotlight 现可直接读取 Hugging Face datasets,只需一行 spotlight.show(ds) 即可对数据集做交互式可视化,无需复制或预处理数据。Spotlight 支持加载预测结果与嵌入向量,通过相似度图、混淆矩阵等布局定位关键数据簇与模型失败模式,并可在 GUI 或 Python API 中自定义检查流程。

10月24日周二
  1. Hugging Face Blog62

    RLHF 与 PPO 的 N 个实现细节:复现 OpenAI lm-human-preferences

    作者复现了 OpenAI 2019 年的 RLHF 代码库 openai/lm-human-preferences,在情感和描述性任务上得到与原始代码几乎一致的学习曲线,并整理出一份实现细节清单。

    推荐理由:作者复现 OpenAI 原始 RLHF 代码并逐条列出实现细节,其中 PyTorch 与 TensorFlow 版 Adam 的差异会直接影响训练稳定性。

10月19日周四
10月4日周三
10月3日周二
10月2日周一
9月29日周五
9月28日周四
9月26日周二
9月22日周五
9月19日周二
  1. Hugging Face Blog22

    Rocket Money 如何借助 Hugging Face 在生产环境扩展高波动 ML 模型

    Rocket Money 用 Hugging Face Inference API 托管其基于 BERT 家族、覆盖 4000+ 类别的交易分类模型,替代原有正则系统,该系统每月处理超 1 亿笔交易且负载波动大。经过三个月评估和模拟峰值负载测试后,Rocket Money 放弃 AWS Sagemaker 与自建方案,选择 Hugging Face 托管模型。

9月18日周一
  1. Hugging Face Blog52

    3D Gaussian Splatting 入门:原理、训练流程与图形学前景

    Hugging Face 博客发布 3D Gaussian Splatting 入门解读,介绍这种从少量图像学习真实感场景并实时渲染的栅格化技术。文章拆解其完整流程:先用 COLMAP 等 Structure from Motion 方法估计点云,再把每个点转为高斯并训练,训练采用随机梯度下降配合自动加密与剪枝,最后通过可微高斯栅格化投影、按深度排序并逐像素混合。

  2. Hugging Face Blog22

    Hugging Face 发布目标检测排行榜:详解 IoU、AP、AR 等评估指标

    Hugging Face 推出目标检测排行榜(Object Detection Leaderboard),对 Hub 上的目标检测模型按指标进行排名。该榜单基于 IoU、Average Precision(AP)和 Average Recall(AR)等指标评估模型,并详解了这些指标的计算方法及评估中可能出现的分歧与陷阱,帮助开发者挑选适合自身应用的开源模型。

9月15日周五
9月13日周三
9月12日周二
9月11日周一
9月8日周五
  1. Hugging Face Blog62

    Hugging Face 为 SDXL 推出 T2I-Adapter 可控生成支持

    Hugging Face Diffusers 团队与 T2I-Adapter 作者合作,在 diffusers 中为 Stable Diffusion XL 加入 T2I-Adapter 支持,并发布 sketch、canny、lineart、depth、openpose 五种条件的预训练 checkpoint。

    推荐理由:对比 ControlNet 的参数与显存占用,并给出 diffusers 中的调用方式,便于评估可控生成方案的取舍。

9月6日周三
  1. Hugging Face Blog78

    TII 的 Falcon 180B 上线 Hugging Face

    TII 发布 Falcon 180B 并上线 Hugging Face,模型有 1800 亿参数,在 3.5 万亿 token 的 RefinedWeb 数据上预训练,是当时最大的公开可用语言模型。

    推荐理由:原文给出 Falcon 180B 的参数量、训练数据与评测对比,可据此判断开源大模型当时的规模上限。

9月1日周五
8月30日周三