跳到正文
2月3日周二
2月2日周一
  1. OpenAI News62

    OpenAI 发布 macOS 版 Codex 应用

    OpenAI 发布 macOS 版 Codex 应用,定位为 AI 编码与软件开发的指挥中心,支持多个智能体、并行工作流和长时间运行的任务。

    推荐理由:OpenAI 官方发布 Codex 桌面应用,读者可了解其多智能体并行与长任务编排的定位。

1月30日周五
  1. Google DeepMind71

    Google DeepMind 向美国 AI Ultra 订阅用户开放 Project Genie 世界模型原型

    Google DeepMind 开始向美国 18 岁以上的 Google AI Ultra 订阅用户开放 Project Genie,这是一个由 Genie 3、Nano Banana Pro 和 Gemini 驱动的实验性研究原型,支持创建、探索和混编交互式世界。

    推荐理由:Google DeepMind 把 Genie 3 世界模型做成可交互原型,读者可据此了解世界模型从研究走向订阅制产品的路径。

1月29日周四
  1. OpenAI News62

    OpenAI 将于 2 月 13 日在 ChatGPT 中退役 GPT-4o、GPT-4.1、GPT-4.1 mini 和 o4-mini

    OpenAI 宣布将于 2026 年 2 月 13 日在 ChatGPT 中退役 GPT-4o、GPT-4.1、GPT-4.1 mini 和 OpenAI o4-mini,与此前已公布的 GPT-5(Instant、Thinking 和 Pro)退役同步进行。API 端目前没有变化。

    推荐理由:OpenAI 官方给出 ChatGPT 中多款旧模型的退役时间,读者可据此安排现有工作流的模型迁移。

  2. Hugging Face Blog62

    Gradio 团队开源 Daggr:用 Python 串联 AI 工作流并自动生成可视化画布

    Gradio 团队发布开源 Python 库 Daggr,用于把 Gradio 应用、ML 模型和自定义函数串联成 AI 工作流,并自动生成可视化画布。画布可查看任意节点的中间输出、修改输入并单独重跑某一步,无需执行整条流水线,还支持状态持久化和用 backup nodes 替换模型。

    推荐理由:Gradio 团队开源 Daggr,用代码定义工作流并自动生成可视化画布,可单独重跑某一步,为多模型串联调试提供了一种轻量方案。

1月28日周三
  1. Mistral AI62

    Mistral 发布终端编码智能体 Mistral Vibe 2.0

    Mistral 发布终端编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型系列驱动,新增自定义子智能体、多选项澄清、斜杠命令技能和统一智能体模式,CLI 修复持续自动更新。

    推荐理由:官方给出 Vibe 2.0 的自定义子智能体、斜杠命令技能与定价变化,可据此判断终端编码智能体的能力边界与成本。

1月27日周二
1月22日周四
1月21日周三
1月20日周二
1月16日周五
  1. OpenAI News67

    OpenAI 面向全球推出 ChatGPT Go

    OpenAI 宣布 ChatGPT Go 已在全球上线,提供 GPT-5.2 Instant 的扩展访问、更高的使用额度和更长的记忆能力,定位为让先进 AI 在全球范围内更可负担。原文未披露具体价格、额度数值和上线地区清单。

    推荐理由:OpenAI 官方公布 ChatGPT Go 的全球开放范围与三项能力变化,可据此判断低价档位的可用边界。

1月15日周四
  1. Hugging Face Blog66

    OpenAI 发起 Open Responses 开放推理标准,Hugging Face 生态支持

    OpenAI 发起、开源社区构建、Hugging Face 生态支持的 Open Responses 开放推理标准发布,基于 Responses API 设计,面向智能体场景。该标准默认无状态,支持加密推理,将流式输出建模为语义事件序列,并原生支持内部与外部工具及子智能体循环。开发者可通过 Hugging Face Inference Providers 和 Spaces 上的早期访问版本试用。

    推荐理由:OpenAI 发起、Hugging Face 生态支持的开放推理标准,读者可了解它如何替代 Chat Completion 格式并支持智能体循环。

1月14日周三
  1. Google DeepMind71

    Google DeepMind 更新 Veo 3.1 Ingredients to Video,新增原生竖屏与 1080p/4K 放大

    Google DeepMind 更新 Veo 3.1 Ingredients to Video,让基于参考图生成的视频在短提示词下更富表现力,并提升角色身份、背景与物体的一致性。

    推荐理由:官方说明了 Ingredients to Video 在角色一致性与竖屏输出上的具体变化,可据此判断移动端短视频工作流是否值得迁移。

1月8日周四
1月7日周三
  1. OpenAI News62

    OpenAI 推出 ChatGPT Health

    OpenAI 发布 ChatGPT Health,这是一个独立体验,可安全连接用户的健康数据与应用。官方称其具备隐私保护,并采用由医生参与设计的方案。

    推荐理由:OpenAI 官方给出 ChatGPT Health 的定位与隐私设计,读者可据此了解健康数据接入这一新方向。

12月18日周四
12月17日周三
  1. OpenAI News62

    OpenAI 开放开发者向 ChatGPT 提交应用

    OpenAI 宣布开发者可以向 ChatGPT 提交应用,经审核通过后会在产品内新设的应用目录中展示,便于用户发现。官方同时更新了工具、指南和 Apps SDK,用于构建把真实操作带入 ChatGPT 的对话原生体验。

    推荐理由:OpenAI 开放 ChatGPT 应用提交与审核入口,开发者可据此判断接入路径和分发方式的变化。

12月16日周二
  1. Google DeepMind62

    Google DeepMind 发布 Gemma Scope 2 可解释性工具套件

    Google DeepMind 发布 Gemma Scope 2,一套面向 Gemma 3 全系列(270M 至 27B 参数)的开源可解释性工具。该套件结合稀疏自编码器(SAEs)与 transcoders,覆盖模型每一层,并新增 skip-transcoders、跨层 transcoders 及针对聊天版本的越狱、拒答和思维链忠实度分析工具。

    推荐理由:Gemma Scope 2 覆盖 Gemma 3 全系列并公开工具与演示,读者可了解可解释性工具在模型安全审计上的最新进展。

  2. OpenAI News72

    OpenAI 发布 ChatGPT Images 与 GPT-Image-1.5

    OpenAI 发布 ChatGPT Images 体验和 GPT-Image-1.5,后者已在 API 中提供。官方称新版 ChatGPT Images 速度更快,并提示可查看最新的 ChatGPT Images 2.5。

    推荐理由:OpenAI 在 API 中上线 GPT-Image-1.5,并同步更新 ChatGPT 图像生成体验,可据此了解图像模型迭代方向。

12月11日周四
  1. Hugging Face Blog60

    llama.cpp 新增模型管理功能:router 模式支持动态加载与切换模型

    llama.cpp server 新增 router 模式,可在不重启服务的情况下动态加载、卸载和切换多个模型。该模式采用多进程架构,每个模型独立运行,单个模型崩溃不影响其他模型;支持自动发现缓存或 --models-dir 目录中的 GGUF 文件、按需加载、LRU 淘汰(默认 --models-max 为 4)以及按请求中的 model 字段路由。

    推荐理由:llama.cpp 新增 router 模式,可在不重启服务的前提下动态加载、卸载和切换多个模型,适合本地多模型部署场景。

12月10日周三
12月9日周二
12月5日周五
12月1日周一
  1. Hugging Face Blog72

    Hugging Face 发布 Transformers v5,主打互操作性

    Hugging Face 发布 Transformers v5.0.0rc-0,主题是互操作性,官方称该库目前每天通过 pip 安装超过 300 万次、累计安装量超 12 亿次,模型架构从 v4 时的 40 个增至 400 多个。

    推荐理由:官方给出 v5 在简化模型定义、训练与推理上的取舍,读者可据此判断自家训练和部署链路要不要跟进。

11月26日周三
11月25日周二
11月24日周一
11月21日周五
  1. Hugging Face Blog62

    Hugging Face TRL 集成 RapidFire AI,微调实验提速最高 20 倍

    Hugging Face TRL 正式集成 RapidFire AI,用户可用 RFSFTConfig、RFDPOConfig、RFGRPOConfig 近乎零代码替换原有 SFT/DPO/GRPO 配置,在单张 GPU 上并发运行多组微调配置。

    推荐理由:官方集成给出了并发调度与实时控制的具体机制和基准数字,可据此判断微调实验流程能压缩多少时间。

11月20日周四
  1. Google DeepMind62

    Google 在 Gemini 应用中上线 AI 图像验证功能

    Google 在 Gemini 应用中上线图像验证功能,用户上传图片并提问即可借助 SynthID 数字水印判断该图是否由 Google AI 生成或编辑。SynthID 自 2023 年推出以来已为超过 200 亿件 AI 生成内容添加水印。

    推荐理由:原文说明了 Gemini 应用内图像验证的入口与 SynthID 水印机制,读者可据此了解 AI 生成内容的溯源方式。

11月19日周三
  1. Google DeepMind82

    Google 发布智能体开发平台 Antigravity

    Google 发布智能体开发平台 Antigravity,即日起免费公开预览,提供 Gemini 3 Pro 的宽松速率限制。该平台在传统 AI IDE 之外新增以智能体为中心的 Manager 界面,可并行编排多个工作区中的智能体,并支持浏览器控制与异步交互。

    推荐理由:Google 把 IDE 改造成以智能体为中心的开发平台,读者可据此判断异步编排与 Artifacts 验证会怎样改变编码工作流。

  2. Google Research80

    Google 发布生成式 UI:Gemini 应用与搜索 AI Mode 上线动态界面实验

    Google 发布生成式 UI 实现,由模型直接生成网页、游戏、工具等完整交互界面,而非只生成内容。该能力以 dynamic view 和 visual layout 两个实验在 Gemini 应用中推出,并集成到 Google Search 的 AI Mode,基于 Gemini 3 Pro 配合工具调用、系统指令与后处理实现。

    推荐理由:Google 把生成式 UI 从论文推进到 Gemini 与搜索的实测入口,读者可据此判断界面生成这一方向的产品化程度。

11月13日周四