跳到正文
2月8日周四
2月3日周六
  1. Hugging Face Blog62

    SegMind 发布 SegMoE 扩散模型混合专家框架

    SegMind 发布 SegMoE 框架,可从零构建混合专家(MoE)扩散模型,并已集成 Hugging Face diffusers。同时发布 SegMoE-2x1、SegMoE-4x2 和 SegMoE-SD4x2 三个模型,采用 Apache 2.0 许可,并提供 GitHub 仓库和 segmoe 包用于自建 MoE 模型。

    推荐理由:原文给出了从零构建 MoE 扩散模型的完整流程与显存门槛,读者可据此判断自己能否复现。

2月1日周四
1月10日周三
  1. OpenAI News62

    OpenAI 推出面向团队的 ChatGPT Team 套餐

    OpenAI 推出新的 ChatGPT 套餐 ChatGPT Team,面向各类规模的团队,提供安全、可协作的工作空间,让团队在工作中充分利用 ChatGPT。

    推荐理由:OpenAI 面向各类规模团队推出 ChatGPT 新套餐,读者可据此了解其安全协作工作区的定位。

12月11日周一
12月5日周二
  1. Hugging Face Blog62

    Hugging Face 发布 Optimum-NVIDIA,一行代码加速 LLM 推理

    Hugging Face 发布 Optimum-NVIDIA 推理库,只需将 transformers 的 pipeline 导入改为 optimum.nvidia 一行代码,即可在 NVIDIA 平台获得最高 28 倍吞吐提升和 1200 tokens/秒,首 token 延迟最高降低 3.3 倍。

    推荐理由:Hugging Face 与 NVIDIA 联合推出的推理库,用一行代码替换即可获得最高 28 倍吞吐提升,适合关注 LLM 部署成本的读者。

11月9日周四
11月7日周二
11月6日周一
11月3日周五
  1. Hugging Face Blog22

    Hugging Face Hub 推出存储区域功能

    Hugging Face 面向 Enterprise Hub 客户推出 Storage Regions,允许组织选择模型和数据集的存储位置。目前支持 US 和 EU 两个区域,Asia-Pacific 即将上线;存储在欧洲的仓库可获得约 4-5 倍的上传和下载速度提升,并满足 GDPR 合规需求。非默认区域的仓库会直接显示 Region 标签。

10月19日周四
  1. OpenAI News70

    DALL·E 3 在 ChatGPT Plus 和 Enterprise 上线

    OpenAI 宣布 DALL·E 3 现已在 ChatGPT Plus 和 Enterprise 中可用。官方表示为更广泛发布开发了一套安全缓解方案,并同步分享了内容溯源研究方面的进展。

    推荐理由:OpenAI 官方宣布 DALL·E 3 在 ChatGPT Plus 和 Enterprise 上线,并说明为扩大发布准备了安全缓解措施。

10月11日周三
10月4日周三
10月3日周二
9月25日周一
9月22日周五
9月11日周一
9月8日周五
  1. Hugging Face Blog62

    Hugging Face 为 SDXL 推出 T2I-Adapter 可控生成支持

    Hugging Face Diffusers 团队与 T2I-Adapter 作者合作,在 diffusers 中为 Stable Diffusion XL 加入 T2I-Adapter 支持,并发布 sketch、canny、lineart、depth、openpose 五种条件的预训练 checkpoint。

    推荐理由:对比 ControlNet 的参数与显存占用,并给出 diffusers 中的调用方式,便于评估可控生成方案的取舍。

8月31日周四
8月28日周一
  1. OpenAI News78

    OpenAI 推出 ChatGPT Enterprise

    OpenAI 发布 ChatGPT Enterprise,主打企业级安全与隐私,并称其为迄今最强的 ChatGPT 版本。

    推荐理由:OpenAI 官方发布面向企业的 ChatGPT 版本,读者可据此了解其安全隐私定位与能力版本变化。

8月25日周五
  1. Hugging Face Blog80

    Meta 发布 Code Llama,Hugging Face 同步集成

    Meta 发布 Code Llama 系列代码模型,包含 7B、13B、34B 三个参数规模,基于 Llama 2 初始化并用 5000 亿 token 代码数据训练,采用与 Llama 2 相同的社区许可并允许商用。

    推荐理由:Meta 发布 Code Llama 系列并接入 Hugging Face 生态,读者可了解其参数规模、上下文窗口与多语言基准表现。

8月23日周三
  1. Hugging Face Blog62

    Hugging Face 将 AutoGPTQ 集成进 Transformers,支持 8/4/3/2-bit 量化

    Hugging Face 把 AutoGPTQ 库集成进 Transformers,用户可用 GPTQ 算法将模型量化为 8、4、3 甚至 2-bit 精度运行,4-bit 量化精度损失可忽略,小批量下推理速度与 fp16 基线相当。

    推荐理由:Hugging Face 官方说明 GPTQ 量化如何接入 Transformers 生态,读者可据此判断低比特部署的可行路径与限制。

8月22日周二
  1. OpenAI News62

    OpenAI 开放 GPT-3.5 Turbo 微调并更新 API

    OpenAI 宣布开发者现在可以用自己的数据微调 GPT-3.5 Turbo,以适配各自的用例,同时更新了 API。原文仅给出这一句说明,未披露微调价格、可用范围或具体 API 变更细节。

    推荐理由:OpenAI 开放 GPT-3.5 Turbo 微调,开发者可用自有数据定制模型,是当时最受关注的 API 能力变化。

8月15日周二
8月10日周四
  1. Hugging Face Blog28

    Hugging Face Hub 上线 AWS Marketplace:可用 AWS 账户直接付费

    Hugging Face Hub 已上线 AWS Marketplace,用户可通过 AWS 账户订阅并支付 Hugging Face 的使用费用。订阅后,Inference Endpoints、Spaces 硬件升级和 AutoTrain 等服务的组织用量费用将自动计入 AWS 账单,价格与 Hugging Face 公开定价一致。连接需使用具备 admin 角色的组织账户,暂不支持个人账户。

8月8日周二
7月24日周一
7月20日周四
  1. OpenAI News62

    OpenAI 为 ChatGPT 推出自定义指令功能

    OpenAI 为 ChatGPT 推出自定义指令功能,用户可设置自己的偏好,ChatGPT 会在之后所有对话中记住这些偏好。该功能让用户对 ChatGPT 的回复方式拥有更多控制权。

    推荐理由:OpenAI 官方说明 ChatGPT 新增自定义指令,读者可了解偏好设置会如何跨对话持续生效。

7月7日周五
6月22日周四
6月13日周二