跳到正文

内容形态

产品更新 最新动态

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

243 条精选近 30 天 22 条共收录 619 条

更新

精选归档 · 第 11 页

11月6日周一第 201–220 条
10月19日周四
  1. OpenAI News70

    DALL·E 3 在 ChatGPT Plus 和 Enterprise 上线

    OpenAI 宣布 DALL·E 3 现已在 ChatGPT Plus 和 Enterprise 中可用。官方表示为更广泛发布开发了一套安全缓解方案,并同步分享了内容溯源研究方面的进展。

    推荐理由:OpenAI 官方宣布 DALL·E 3 在 ChatGPT Plus 和 Enterprise 上线,并说明为扩大发布准备了安全缓解措施。

10月3日周二
9月25日周一
9月8日周五
  1. Hugging Face Blog62

    Hugging Face 为 SDXL 推出 T2I-Adapter 可控生成支持

    Hugging Face Diffusers 团队与 T2I-Adapter 作者合作,在 diffusers 中为 Stable Diffusion XL 加入 T2I-Adapter 支持,并发布 sketch、canny、lineart、depth、openpose 五种条件的预训练 checkpoint。

    推荐理由:对比 ControlNet 的参数与显存占用,并给出 diffusers 中的调用方式,便于评估可控生成方案的取舍。

8月28日周一
  1. OpenAI News78

    OpenAI 推出 ChatGPT Enterprise

    OpenAI 发布 ChatGPT Enterprise,主打企业级安全与隐私,并称其为迄今最强的 ChatGPT 版本。

    推荐理由:OpenAI 官方发布面向企业的 ChatGPT 版本,读者可据此了解其安全隐私定位与能力版本变化。

8月25日周五
  1. Hugging Face Blog80

    Meta 发布 Code Llama,Hugging Face 同步集成

    Meta 发布 Code Llama 系列代码模型,包含 7B、13B、34B 三个参数规模,基于 Llama 2 初始化并用 5000 亿 token 代码数据训练,采用与 Llama 2 相同的社区许可并允许商用。

    推荐理由:Meta 发布 Code Llama 系列并接入 Hugging Face 生态,读者可了解其参数规模、上下文窗口与多语言基准表现。

8月23日周三
  1. Hugging Face Blog62

    Hugging Face 将 AutoGPTQ 集成进 Transformers,支持 8/4/3/2-bit 量化

    Hugging Face 把 AutoGPTQ 库集成进 Transformers,用户可用 GPTQ 算法将模型量化为 8、4、3 甚至 2-bit 精度运行,4-bit 量化精度损失可忽略,小批量下推理速度与 fp16 基线相当。

    推荐理由:Hugging Face 官方说明 GPTQ 量化如何接入 Transformers 生态,读者可据此判断低比特部署的可行路径与限制。

8月22日周二
  1. OpenAI News62

    OpenAI 开放 GPT-3.5 Turbo 微调并更新 API

    OpenAI 宣布开发者现在可以用自己的数据微调 GPT-3.5 Turbo,以适配各自的用例,同时更新了 API。原文仅给出这一句说明,未披露微调价格、可用范围或具体 API 变更细节。

    推荐理由:OpenAI 开放 GPT-3.5 Turbo 微调,开发者可用自有数据定制模型,是当时最受关注的 API 能力变化。

8月8日周二
7月24日周一
7月20日周四
  1. OpenAI News62

    OpenAI 为 ChatGPT 推出自定义指令功能

    OpenAI 为 ChatGPT 推出自定义指令功能,用户可设置自己的偏好,ChatGPT 会在之后所有对话中记住这些偏好。该功能让用户对 ChatGPT 的回复方式拥有更多控制权。

    推荐理由:OpenAI 官方说明 ChatGPT 新增自定义指令,读者可了解偏好设置会如何跨对话持续生效。

6月13日周二
5月24日周三
  1. Hugging Face Blog78

    Hugging Face 在 transformers 中集成 bitsandbytes 4-bit 量化与 QLoRA

    Hugging Face 与 bitsandbytes 合作,在 transformers 中支持以 4-bit 精度加载和运行模型,覆盖文本、视觉、多模态等大部分 HF 模型,并可在 4bit 模型上训练 LoRA 适配器。

    推荐理由:Hugging Face 把 4-bit 量化与 QLoRA 微调接入 transformers,读者可据此判断消费级显卡能跑多大模型。

5月18日周四
  1. OpenAI News62

    OpenAI 推出 ChatGPT iOS 应用

    OpenAI 发布 ChatGPT iOS 应用,可同步对话记录并支持语音输入,同时带来最新的模型改进。该应用由 OpenAI 官方推出,面向 iPhone 用户提供移动端使用入口。

    推荐理由:OpenAI 官方发布 ChatGPT iOS 应用,读者可了解其对话同步与语音输入等基础能力。

4月25日周二
  1. OpenAI News62

    ChatGPT 新增关闭聊天记录功能

    ChatGPT 用户现在可以关闭聊天记录,自行选择哪些对话可以被用于训练 OpenAI 的模型。

    推荐理由:原文说明 ChatGPT 新增关闭聊天记录选项,读者可据此了解对话数据是否用于模型训练的自主控制方式。

3月23日周四
  1. OpenAI News80

    OpenAI 为 ChatGPT 引入插件支持

    OpenAI 宣布为 ChatGPT 实现插件的初步支持。插件是专为语言模型设计的工具,以安全为核心原则,可帮助 ChatGPT 获取最新信息、执行计算或调用第三方服务。

    推荐理由:OpenAI 官方给出 ChatGPT 插件机制的初步支持,读者可据此了解模型接入外部信息与服务的早期形态。

3月9日周四
  1. Hugging Face Blog62

    Hugging Face 将 trl 与 peft 集成,可在 24GB 消费级 GPU 上微调 20B 大模型

    Hugging Face 官方发布 trl 与 peft 的集成,让大语言模型的 RLHF 微调成本大幅降低。方案先用 LLM.int8() 以 8 位精度加载模型,再用 peft 添加低秩适配器只训练少量参数,并借助 disable_adapters 复用同一模型获取参考模型与当前模型的 logits,从而省去第二份模型副本。

    推荐理由:trl 与 peft 的集成给出了在 24GB 消费级 GPU 上做 RLHF 微调的具体路径,可迁移到自有训练流程。