跳到正文
7月9日周四
  1. Mistral AI57

    Mistral Studio 上线 Prompts 与 Skills 管理系统

    Mistral 在 Studio 中上线 Prompts 与 Skills 管理系统,为每个提示词和技能提供版本化、归属和可追溯能力。每个版本不可变并记录完整历史,支持版本对比、回滚、分类标签和审计日志,非开发者也能直接编辑测试并触发 CI/CD 上线。技能可作为 MCP 服务器直接从 Studio 调用,确保生产执行的是同一受治理资产。

  2. OpenAI News75

    OpenAI 推出 ChatGPT Work 智能体

    OpenAI 发布 ChatGPT Work,一个可跨应用和文件执行操作的智能体,必要时能持续跟进一个项目数小时,把目标转化为完成的工作。

    推荐理由:OpenAI 官方给出 ChatGPT Work 的定位与能力边界,读者可据此判断智能体进入工作流的形态。

  3. Google Research62

    Google 发布 SensorFM:面向可穿戴健康数据的通用基础模型

    Google Research 发布 SensorFM,一个从无标注可穿戴数据中学习的大型传感器基础模型,预训练语料来自五百万名同意参与者、超过一万亿分钟的多模态传感器信号,覆盖 100 多个国家、50 个美国州和 20 多种 Fitbit 与 Pixel Watch 设备。

    推荐理由:Google 用五百万人的万亿分钟可穿戴数据预训练通用生理表征,读者可了解基础模型在健康信号上的规模化路径。

7月8日周三
  1. Mistral AI71

    Mistral 发布 Robostral Navigate 具身导航模型

    Mistral 发布首个具身导航模型 Robostral Navigate,这是一个 8B 模型,仅用单个普通 RGB 相机、无需 LiDAR 或深度传感器,在 R2R-CE 验证未见集上达到 76.6% 成功率,比最佳单相机方案高 9.7 个百分点、比最佳多传感器方案高 4.5 个百分点。

    推荐理由:原文给出单目 RGB 相机下的导航成功率与训练方法,读者可据此判断紧凑模型做具身导航的可行边界。

7月7日周二
  1. Hugging Face Blog62

    微软在 Foundry Managed Compute 上线 Hugging Face 模型集合

    微软在 Build 2026 宣布 Foundry Managed Compute 及 Hugging Face 模型集合,将 Hugging Face 生态的开源权重模型引入 Foundry 模型目录,每周刷新,可一键部署到托管 GPU 平台。

    推荐理由:微软在 Foundry 上托管 Hugging Face 开源权重模型,读者可了解企业部署开源模型时被接管的运维环节。

  2. Hugging Face Blog76

    LeRobot v0.6.0 发布:世界模型策略、奖励模型与部署 CLI

    Hugging Face 发布 LeRobot v0.6.0,围绕机器人学习闭环引入世界模型策略(VLA-JEPA、FastWAM、LingBot-VA)、新一批 VLA(GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT)以及统一奖励模型 API(Robometer、TOPReward)。

    推荐理由:LeRobot v0.6.0 把世界模型策略、奖励模型与部署 CLI 串成闭环,读者可据此了解开源机器人学习栈的当前形态。

  3. Hugging Face Blog62

    SkyPilot 与 Hugging Face 打通零出口费存储,可在任意云运行 AI 负载

    SkyPilot 与 Hugging Face 联合推出 store: hf 存储后端,用一条 hf:// URL 和现有 HF_TOKEN 即可把 Hugging Face Bucket 或任意模型、数据集仓库挂载进 SkyPilot 任务,并在 20 多个云、Kubernetes、Slurm 和本地环境中调度运行。

    推荐理由:原文给出零出口费存储与跨云调度的组合方式,读者可据此判断数据与 GPU 分离时的成本结构。

7月6日周一
  1. Hugging Face Blog34

    PRX Part 4:我们的数据策略

    PRX 系列第 4 篇披露其数据策略:预训练数据由公开与内部数据集混合组成,用 VLM 重新生成图像长描述,再转为可流式训练的语料。团队用 Lance 做数据构建与筛选、MDS 做流式训练,并将文本编码器从 T5Gemma 换成 Qwen3-VL,改为训练中实时计算文本 latent,实测吞吐损失约 3–4%(30 天训练多约 1 天)。图像统一以 JPEG quality 92 编码。

  2. Hugging Face Blog34

    Hugging Face Kernels 项目重大更新:新增 kernel 仓库类型与代码签名

    Hugging Face 为 Kernels 项目引入 Hub 上的全新 "kernel" 仓库类型,并新增可信发布者与代码签名两层安全机制,默认只加载可信发布者的 kernel。项目还重构了 kernels 与 kernel-builder 的 CLI,新增对 Torch Stable ABI 和 Apache TVM FFI 的支持,为智能体自主开发 kernel 打下基础。

7月3日周五
  1. Google DeepMind38

    Google DeepMind 与 A24 宣布首个此类研究合作

    Google DeepMind 与 A24 宣布达成首个此类研究合作,将顶尖研究实验室与电影制作公司配对,帮助艺术家开发新工作流与技术。合作将跨越多个项目,让 A24 及其电影人直接参与塑造新技术,同时为 Google DeepMind 提供艺术家反馈。Google 还对 A24 进行了投资。

7月2日周四
  1. Mistral AI71

    Mistral 发布 Leanstral 1.5 形式化验证模型

    Mistral 发布 Leanstral 1.5,采用 Apache-2.0 许可,119B 总参数、6B 激活参数,在形式化验证上大幅升级:miniF2F 达到 100%,PutnamBench 解出 587/672 题,FATE-H 87%、FATE-X 34% 均为新 SOTA。

    推荐理由:官方给出 Leanstral 1.5 在形式化验证基准上的成绩与成本对比,可据此判断开源证明模型的实用边界。

7月1日周三
  1. Berkeley AI Research17

    2026 届 BAIR 博士毕业生展示:从机器人到 LLM 推理的研究全景

    伯克利人工智能研究实验室(BAIR)公布 2026 届博士毕业生名单,其研究覆盖机器人、具身智能、大语言模型与推理、计算机视觉、生成建模、AI 安全、人机交互及 AI for Science 等方向。毕业生去向包括 OpenAI、Mistral AI、Physical Intelligence、Amazon 等机构,以及 UCLA、普林斯顿 CITP 和芝加哥大学等学术岗位,部分人仍在探索下一步。

  2. Hugging Face Blog62

    Hugging Face 与 Cerebras 将 Gemma 4 引入实时语音 AI

    Hugging Face 与 Cerebras 联合演示了一套实时语音到语音的开源流水线,用 Cerebras 加速 Gemma 4 31B 的推理。该架构为模块化设计,依次经过 Nvidia Parakeet 语音识别、Cerebras 上的 Gemma 4 VLM 推理和阿里 Qwen3TTS 语音合成,各层均可替换。

    推荐理由:原文给出了一套可替换的实时语音到语音开源架构,读者可据此了解各层组件如何组合与复用。

6月30日周二
  1. Google Research76

    Google 发布 TabFM 零样本表格数据基础模型

    Google Research 发布 TabFM,一个面向表格数据分类与回归的零样本基础模型,将表格预测重构为上下文学习问题,无需手动训练、超参数调优和特征工程,单次前向传播即可对未见过的表格生成预测。

    推荐理由:原文给出零样本表格预测的架构设计与 TabArena 基准对比,可据此判断它能否替代传统树模型流程。

  2. Hugging Face Blog60

    Hugging Face 模型页展示 Every Eval Ever 评测结果

    Every Eval Ever(EEE)与 Hugging Face Community Evals 现已互通,评测结果可交叉发布并链接回完整记录。EEE 数据存储已收录约 229,000 条评测结果,覆盖 22,000 多个模型和 2,200 个基准,来自 31 种报告格式。

    推荐理由:原文给出 EEE 与 Community Evals 互通后的数据规模与转换工具,读者可据此判断评测结果如何被统一记录和追溯。

6月29日周一
  1. Import AI38

    Import AI 463:NVIDIA 用 ENPIRE 让机器人自我改进;中国 1 万卡 GPU 集群;人类时代挽歌

    NVIDIA 推出 ENPIRE 框架,让编码智能体驱动真实机械臂自主试错与策略改进,在 PushT、整理插针、用切割器剪扎带等任务上达到 99% 成功率,测试硬件为双 YAM 机械臂加 RTX 5090 工作站。GPT-5.5(Codex)与 Opus 4.7(Claude Code)表现互有胜负,Kimi-2.6 落后,8 个智能体并行能更快得到更高分。

6月27日周六
  1. Google Research62

    Google 用冻结多 token 预测加速 Pixel 上的 Gemini Nano 模型

    Google Research 发布新架构,将多 token 预测(MTP)头接到已冻结的 Gemini Nano v3 模型上,在不改动主干权重的前提下加速端侧推理,已上线 Pixel 9 和 10 系列。

    推荐理由:Google 把多 token 预测接到冻结的 Gemini Nano v3 上,读者可了解端侧推理在内存与能耗约束下的具体优化路径。