跳到正文
3月12日周三
  1. Hugging Face Blog82

    Google 发布 Gemma 3 开源多模态模型,覆盖 1B 至 27B 四种尺寸

    Google 发布 Gemma 3 系列开放权重模型,包含 1B、4B、12B、27B 四种尺寸,均有预训练和指令微调版本。4B、12B、27B 支持图像与文本输入及 140 多种语言,上下文窗口从 Gemma 2 的 8k 提升至 128k(1B 为 32k)。

    推荐理由:梳理 Gemma 3 的四种尺寸、多模态与 128k 上下文等规格,并给出 transformers 与端侧推理的可用路径。

3月11日周二
  1. Hugging Face Blog76

    Hugging Face 与 Yaak 发布 L2D 开源自动驾驶数据集

    Hugging Face 的 LeRobot 团队与 Yaak 联合发布 L2D,称其为全球最大的开源自动驾驶数据集,R4 版本包含 100 万条 episode、5000+ 小时驾驶数据、90+ TB 规模,来自德国 30 座城市 60 辆驾校车辆的 6 路环视摄像头与车辆状态数据。

    推荐理由:L2D 以 90TB 多模态驾驶数据接入 LeRobot 训练管线,可对比现有开源自驾数据集在规模与动作标注上的差异。

3月4日周二
  1. Hugging Face Blog37

    Hugging Face 与 JFrog 合作提升 AI 模型安全扫描透明度

    Hugging Face 宣布与 JFrog 合作,将 JFrog 扫描器集成到 Hugging Face Hub,用于检测模型权重中的恶意代码。JFrog 扫描器能解析并分析模型权重中的代码,比仅做模块名模式匹配的 picklescan 更进一步,可减少误报并覆盖 Keras Lambda 层等更多文件格式的漏洞。所有公开模型仓库在推送文件后将自动被扫描,无需额外操作。

2月27日周四
2月21日周五
2月10日周一
  1. Hugging Face Blog31

    Hugging Face 发布 Open Arabic LLM Leaderboard 2

    Hugging Face 联合 2A2I、TII 推出 Open Arabic LLM Leaderboard 2,升级阿拉伯语大模型评测榜。首版 OALL 上线不到 7 个月吸引超 46,000 名访客,收到 700 多个模型提交,参数规模从 1B 到 70B 以上,来自 180 多个机构。新版回应社区对阿拉伯语专项任务、评测透明度与数据集多样性的批评。

1月31日周五
1月30日周四
1月27日周一
  1. Hugging Face Blog62

    Diffusers 中的开源视频生成模型现状

    Hugging Face Diffusers 团队梳理了开源视频生成模型的现状,列出 CogVideoX、Mochi-1、HunyuanVideo、Allegro、LTX Video 等开放模型与 Sora、Veo 2、Kling 等闭源模型的对照。

    推荐理由:Diffusers 团队梳理开源视频生成模型现状,并给出显存优化与微调的实测数据,可据此评估本地部署门槛。

1月22日周三
1月16日周四
1月13日周一
  1. Hugging Face Blog22

    Hugging Face 发文:AI 智能体已至,全自主智能体不应被开发

    Hugging Face 发布分析文章指出,AI 智能体的风险随自主性等级上升而增加,建议不要开发能自行编写并执行代码的全自主智能体。文章按自主程度将智能体分为五级,从模型不影响程序流程的 Code ☆☆☆☆ 到模型自行编写并执行新代码的 Fully autonomous agent ★★★★,并认为半自主智能体在自主程度、可用任务和人类控制方式合适时,收益可能大于风险。

12月23日周一
12月5日周四
  1. Hugging Face Blog62

    Google 发布 PaliGemma 2 视觉语言模型,提供 3B 到 28B 三种规格

    Google 发布新一代视觉语言模型 PaliGemma 2,用 Gemma 2 替换前代的文本解码器,保留 SigLIP 图像编码器,提供 3B、10B、28B 三种参数规模,均支持 224x224、448x448、896x896 三种输入分辨率,而前代 PaliGemma 仅有 3B 版本。

    推荐理由:Google 开源视觉语言模型 PaliGemma 2 提供 3B 到 28B 多规格与三种分辨率,读者可据此判断微调选型空间。

12月2日周一
  1. Hugging Face Blog40

    开源开发者指南:欧盟 AI 法案(EU AI Act)要点解读

    Hugging Face 发布开源开发者指南,解读已正式生效的欧盟 AI 法案(EU AI Act)。法案按风险分级监管,仅通用目的 AI(GPAI)模型被直接监管,训练算力超 10^25 FLOPs 的模型被认定存在系统性风险。多数开源项目只需提供清晰文档、模型信息披露并遵守现有版权与隐私规则,Hugging Face 提供模型卡、数据集卡、Gradio 水印及个人数据脱敏等工具协助合规。

11月26日周二
11月25日周一
  1. Hugging Face Blog22

    如何一步步推导出 Transformer 的 SOTA 位置编码 RoPE

    Hugging Face 博客通过逐步改进位置编码方案,推导出 Llama 3.2 及多数现代 Transformer 使用的旋转位置编码(RoPE)。文章以 Llama 3.2 1B 为例,演示无位置信息时自注意力对同一 token 在不同位置输出完全相同,并提出位置编码应满足唯一性、线性关系、长度泛化、确定性生成和可扩展至多维等五项理想属性。

11月20日周三
  1. Hugging Face Blog47

    Hugging Face 如何用内容定义分块提升存储效率

    Hugging Face 的 Xet 团队正用内容定义分块(CDC)把文件拆成可变大小的块,只传输和存储被修改的块,从而提升存储效率与迭代速度。在 CORD-19 数据集基准中,Xet 后端相比 Git LFS 平均下载时间从 51 分钟降至 19 分钟、上传从 47 分钟降至 24 分钟,存储占用从 8.9 GB 降至 3.52 GB。

11月12日周二
  1. Hugging Face Blog22

    Hugging Face Hub 开放数据集托管与分享功能

    Hugging Face Hub 支持托管 TB 级数据集,并提供 Dataset Viewer、全文搜索、SQL Console 及 Pandas、DuckDB 等第三方库的一行代码加载支持。Xet 团队正将单文件上限从 50 GB 提升至 500 GB,同时改进存储与传输效率。数据集可设为公开、私有或门控访问,Nvidia、Google、NASA 等机构已在使用。

10月23日周三
10月22日周二
  1. Hugging Face Blog38

    Hugging Face 与 Protect AI 合作,为 ML 社区增强模型安全

    Hugging Face 宣布与 Protect AI 合作,将 Guardian 作为第三方扫描器集成到其模型扫描套件中,用于检测 pickle 等序列化格式的任意代码执行漏洞。所有公开模型仓库在推送文件后将自动被 Guardian 扫描,无需用户操作。Hugging Face 表示目前已扫描数亿个文件,但由于平台有超过 100 万个模型仓库,扫描结果可能不会立即显示。

10月21日周一
10月10日周四
10月3日周四
  1. Hugging Face Blog30

    中国 AI 出海全球扩张简析

    非凡研究 6 月报告显示,全球 1500 家活跃 AI 公司中 751 家位于中国,其中 103 家已出海扩张。腾讯云、华为、阿里等巨头聚焦东南亚与中东的云和 AI 基础设施,字节跳动七个月内推出 11 款海外应用,CapCut 月活超 3 亿、累计移动端收入达 1.25 亿美元。

9月25日周三
  1. Hugging Face Blog80

    Llama 3.2 发布:多模态视觉模型与 1B/3B 端侧文本模型上线 Hugging Face

    Meta 发布 Llama 3.2,共 10 个开放权重模型,包括 11B 和 90B 两个尺寸的视觉模型(各含 base 与指令微调版)以及 1B、3B 端侧文本模型,均已上线 Hugging Face Hub。

    推荐理由:Meta 与 Hugging Face 同步放出 10 个开放权重模型,含 11B/90B 视觉版与 1B/3B 端侧文本版,可据此判断本地多模态与端侧部署的可行边界。

9月17日周二
8月22日周四
8月13日周二
8月8日周四
  1. Hugging Face Blog62

    Hugging Face 收购 XetHub,将用其技术替换 Hub 的 Git LFS 存储后端

    Hugging Face 宣布收购西雅图公司 XetHub,其 12 人团队将加入,创始人此前在 Apple 构建并扩展内部 ML 基础设施。XetHub 的技术让 Git 可扩展到 TB 级仓库,HF CTO Julien Chaumond 表示团队将帮助 Hub 把存储后端换成自研的 LFS 替代方案。

    推荐理由:Hugging Face 收购 XetHub 并计划替换 Hub 的 Git LFS 存储后端,读者可了解大文件版本管理将如何变化。

7月30日周二
7月23日周二
  1. Hugging Face Blog88

    Meta 发布 Llama 3.1:8B、70B 与 405B,支持多语言和长上下文

    Meta 发布 Llama 3.1 系列开源模型,包含 8B、70B、405B 三种规模,各有基础版和指令微调版,上下文长度从 8K 提升到 128K token,支持英语、德语、法语、意大利语、葡萄牙语、印地语、西班牙语和泰语 8 种语言。

    推荐理由:Meta 发布 Llama 3.1 三档开源模型,128K 上下文与工具调用能力配合更宽松的许可证,读者可据此判断开源模型在合成数据与蒸馏上的可用边界。

7月9日周二
7月8日周一
  1. Hugging Face Blog25

    Hugging Face 为 Dataset Hub 推出四项数据集搜索新功能

    Hugging Face 为 Dataset Hub 的数据集搜索新增按模态、大小、格式和库四项筛选功能,可按文本、图像、音频等模态及行数区间检索,并支持 Parquet、WebDataset 等格式和 Pandas、Dask、Datasets 库兼容性过滤。这些筛选可相互组合,并与语言、任务、许可证等已有过滤器及文本搜索栏搭配使用。

6月27日周四
  1. Hugging Face Blog78

    Google 发布开源模型 Gemma 2,含 9B 与 27B 两个版本

    Google 发布开源大模型 Gemma 2,提供 9B 和 27B 两个参数规模,各有预训练基础版与指令微调版,上下文长度 8K tokens,采用与初代相同的宽松许可,允许再分发、微调和商用。

    推荐理由:原文给出 Gemma 2 的两种参数规模、训练数据量与评测对比,可据此判断开源小模型的能力位置。

6月24日周一
  1. Hugging Face Blog22

    Hugging Face 伦理与社会通讯 #6:构建更好的 AI,数据质量为何至关重要

    Hugging Face 发布《伦理与社会通讯 #6》,聚焦 AI 数据质量,提出高质量数据应满足相关性、全面性、时效性和偏见缓解等要求。文章以 Reddit 与 Google 的 RAG 搜索合作为例,说明低质数据会导致"披萨加胶水"这类错误推荐。文中强调数据质量需贯穿 AI 开发全生命周期,并给出数据去重、内容过滤、人工反馈和治理框架等实践策略。

6月20日周四
6月13日周四