跳到正文
10月13日周一
  1. OpenAI News66

    OpenAI 与 Broadcom 达成战略合作,将部署 10 吉瓦 OpenAI 自研 AI 加速器

    OpenAI 与 Broadcom 宣布多年期战略合作,将部署 10 吉瓦由 OpenAI 设计的 AI 加速器。双方将共同开发下一代系统与以太网方案,目标是在 2029 年前支撑可扩展且高能效的 AI 基础设施。

    推荐理由:OpenAI 与 Broadcom 联合设计加速器并规划 10 吉瓦部署,可观察自研芯片与算力基础设施的走向。

10月11日周六
10月6日周一
  1. OpenAI News72

    OpenAI Codex 正式可用,新增 Slack 集成、SDK 与管理工具

    OpenAI Codex 现已正式可用,面向开发者新增 Slack 集成、Codex SDK,以及用量看板和工作区管理等管理工具。官方称这些功能让 Codex 更易使用,也更容易在规模化场景下管理。

    推荐理由:Codex 从预览走向正式可用,新增 Slack 集成、SDK 与管理后台,读者可据此判断团队规模化使用的门槛变化。

  2. OpenAI News67

    OpenAI 发布 AgentKit、新版 Evals 与智能体 RFT

    OpenAI 发布 AgentKit、扩展后的 Evals 能力以及面向智能体的强化微调(RFT),用于帮助开发者更快从原型走向生产。官方称这批工具覆盖智能体开发、评估与微调环节。

    推荐理由:OpenAI 官方发布面向智能体开发的工具组合,读者可据此了解其从原型到生产的工具链布局。

10月2日周四
9月29日周一
9月26日周五
9月23日周二
  1. OpenAI News62

    OpenAI、Oracle 与 SoftBank 为 Stargate 新增五个 AI 数据中心站点

    OpenAI、Oracle 和 SoftBank 宣布为 Stargate 新增五个 AI 数据中心站点,推进一项 5000 亿美元、10 吉瓦的美国基础设施扩建计划。该计划旨在支撑下一代 AI,并创造数万个就业岗位。

    推荐理由:Stargate 新增五个站点,读者可了解 5000 亿美元、10 吉瓦级 AI 数据中心建设的推进节奏。

9月22日周一
9月19日周五
9月17日周三
9月11日周四
  1. Hugging Face Blog62

    Hugging Face 详解 transformers 为 OpenAI gpt-oss 引入的优化技巧

    Hugging Face 发布博客,介绍为支持 OpenAI gpt-oss 系列而在 transformers 中做的多项升级,包括可从 Hub 下载的零构建 Kernel、MXFP4 量化、张量并行、专家并行、动态滑动窗口层与缓存、连续批处理与 Paged Attention,以及更快的模型加载。

    推荐理由:Hugging Face 官方拆解了为 gpt-oss 引入 transformers 的七项工程改动,可据此了解量化、并行与缓存优化的落地方式。

9月9日周二
9月2日周二
  1. Mistral AI47

    Mistral AI 为 Le Chat 推出 Memories 记忆功能(beta)

    Mistral AI 为 Le Chat 推出 Memories(beta),采用自动保存、智能召回并始终显示来源链接的混合记忆方案。用户可随时关闭记忆、开启不使用记忆的隐身对话、编辑或删除单条记忆,并支持导出与导入,实现记忆的可移植与互操作。同步上线的 Memory Insights 可基于用户自身数据提示记忆趋势与摘要,后续将支持记忆分类、即时遗忘和更清晰的调用记录。

  2. Mistral AI60

    Mistral 为 Le Chat 上线 20+ MCP 连接器与 Memories 记忆功能

    Mistral 在 Le Chat 中发布 20+ 个基于 MCP 的安全连接器目录(beta),覆盖数据、生产力、开发、自动化与商务等类别,支持接入 Databricks、Snowflake、GitHub、Atlassian、Asana、Outlook、Box、Stripe、Zapier 等工具,并可添加自定义 MCP 连接器或连接任意远程 MCP 服务器。

    推荐理由:官方给出连接器目录与记忆功能的开放范围,读者可据此判断企业工作流接入的可行路径。

8月18日周一
8月13日周三
8月12日周二
8月8日周五
8月7日周四
8月5日周二
  1. OpenAI News82

    OpenAI 发布 gpt-oss-120b 与 gpt-oss-20b 两款开源权重模型

    OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 两款开源权重语言模型,采用 Apache 2.0 许可。官方称这两款模型在推理任务上优于同规模开源模型,具备较强的工具调用能力,并针对消费级硬件的高效部署做了优化。

    推荐理由:OpenAI 开源两款权重模型并给出尺寸与许可,读者可据此判断消费级硬件上的部署与推理选择。

8月1日周五
  1. Mistral AI42

    Mistral 通过微调 Pixtral-12B 提升卫星图像视觉语言模型性能

    Mistral 用 LoRA 微调 Pixtral-12B,在 Aerial Image Dataset(AID)卫星图像分类任务上显著优于基座模型。基座模型在 Playground、Stadium 等易混类别上会误判并偶发幻觉出不存在的类别名,微调后分类更准确。整个流程可通过 Mistral 微调 API 或 LaPlateforme UI 完成,无需大量超参数调优。

7月31日周四
7月30日周三
  1. Mistral AI62

    Mistral 发布 Codestral 25.08 及企业级编码栈

    Mistral AI 发布 Codestral 25.08 代码模型,并推出覆盖补全、语义检索与智能体工作流的企业级编码栈。Codestral 25.08 相比前代补全接受率提升 30%、建议后保留代码增加 10%、失控生成减少 50%,支持云、VPC 与本地部署。

    推荐理由:Mistral 官方给出编码栈各组件的能力数字与私有化部署路径,可据此判断企业自建编码助手的可行边界。

7月25日周五
7月23日周三
7月22日周二
  1. Hugging Face Blog62

    NVIDIA NIM 在 Hugging Face 上支持超 10 万个 LLM 快速部署

    NVIDIA 宣布通过 NIM 推理微服务在 Hugging Face 上解锁超过 10 万个 LLM 的快速可靠部署。NIM 现在提供单个 Docker 容器,可部署由 TensorRT-LLM、vLLM 和 SGLang 支持的多种 LLM,并自动完成模型格式识别、架构与量化格式检测、后端选择和性能配置,无需手动调优。

    推荐理由:NIM 用单个容器自动识别模型格式与量化方式并选择推理后端,读者可据此判断多模型部署流程能简化到什么程度。

7月17日周四
7月15日周二
  1. Hugging Face Blog62

    Hugging Face 将 Hub 存储从 Git LFS 迁移到 Xet

    Hugging Face 宣布 Hub 存储从 Git LFS 迁移到 Xet,6 个月内已有 50 万个仓库、20 PB 数据完成迁移,超过 100 万用户在使用 Xet。迁移依靠 Git LFS Bridge 和后台迁移流程实现,旧版客户端无需更换工作流即可继续上传下载。从本月起 Xet 将向所有用户开放,现有仓库会自动迁移,新建仓库默认启用 Xet,后续还将开源 Xet 协议及整套基础设施。

    推荐理由:Hugging Face 官方复盘 Hub 从 Git LFS 迁移到 Xet 的工程细节,可看到大规模存储迁移如何做到对用户零打扰。

7月10日周四
  1. Hugging Face Blog62

    Hugging Face 发布 ScreenEnv,在 Docker 中部署桌面智能体

    Hugging Face 发布 ScreenEnv,一个可在 Docker 容器中创建隔离 Ubuntu 桌面环境的 Python 库,用于测试和部署 GUI 智能体(Computer Use 智能体),支持 AMD64 与 ARM64,环境部署时间不到 10 秒。

    推荐理由:ScreenEnv 把桌面智能体的运行环境收敛到 Docker 沙箱,并同时提供 MCP 与直连 API 两种接入方式,便于对照现有智能体框架的部署路径。