Hugging Face 披露 7 月安全事件:自主 AI 智能体驱动的入侵
Hugging Face 披露本周检测到一起对其部分生产基础设施的入侵,该事件由自主 AI 智能体系统端到端驱动,攻击者通过数据集处理管线中的远程代码加载器和模板注入两条代码执行路径进入处理节点,随后提升至节点级权限、窃取云与集群凭证并在周末横向移动至多个内部集群。
推荐理由:Hugging Face 披露首起由自主 AI 智能体端到端驱动的入侵,并说明防御方为何改用自托管开源模型做取证。
Hugging Face 披露本周检测到一起对其部分生产基础设施的入侵,该事件由自主 AI 智能体系统端到端驱动,攻击者通过数据集处理管线中的远程代码加载器和模板注入两条代码执行路径进入处理节点,随后提升至节点级权限、窃取云与集群凭证并在周末横向移动至多个内部集群。
推荐理由:Hugging Face 披露首起由自主 AI 智能体端到端驱动的入侵,并说明防御方为何改用自托管开源模型做取证。
Cars24 借助 OpenAI 的语音与聊天智能体,每月处理超 100 万分钟对话,并挽回 12% 的流失线索。该公司还将智能体工作流推广至全公司各团队,以加快构建速度。
IBM Research 在 Hugging Face 博客中复盘为智能体构建模型路由的经验,指出多数路由系统把模型选择当成分类问题,实际却是系统优化问题。
OpenAI 发布自动化红队系统 GPT-Red,通过自我博弈提升 AI 安全性、对齐与提示注入鲁棒性。该系统面向鲁棒性的自我改进,可用于自动化红队测试。
OpenAI 发文阐述企业在智能体时代管理 AI 投资的方法,核心是衡量每美元产生的有效工作量、提升效率并扩展高价值工作流。
OpenAI 介绍 ChatGPT Work 在数据科学场景中的实用工作流,覆盖根因简报、KPI 备忘、范围界定分析和仪表盘规范四类任务。内容以实操流程为主,未披露具体模型版本、参数或性能数据。
OpenAI 介绍 ChatGPT Work 在销售场景中的实用工作流,涵盖管道简报、会议准备、客户计划、预测复盘和交易诊断。内容面向销售团队,说明如何用 ChatGPT Work 完成这些日常任务。
Google DeepMind 在印度启动 ATL Saathi 试点,这是一款由 Gemini 驱动的 Web 应用,为 Tinkering Lab 教育者提供 24/7 备课与培训助手。该工具基于 NotebookLM 整理 12 个核心模块内容,支持 10 个模块的项目生成,初期支持 8 种语言,由 Gemini 3.5 Flash 提供底层能力。首批覆盖 100 所试点学校。
Deutsche Telekom 正借助 OpenAI 转型为 AI 原生电信运营商,改造客户服务、员工工作流、网络运营以及语音的未来。
Mistral 在 Studio 中上线 Prompts 与 Skills 管理系统,为每个提示词和技能提供版本化、归属和可追溯能力。每个版本不可变并记录完整历史,支持版本对比、回滚、分类标签和审计日志,非开发者也能直接编辑测试并触发 CI/CD 上线。技能可作为 MCP 服务器直接从 Studio 调用,确保生产执行的是同一受治理资产。
OpenAI 发布 ChatGPT Work,一个可跨应用和文件执行操作的智能体,必要时能持续跟进一个项目数小时,把目标转化为完成的工作。
推荐理由:OpenAI 官方给出 ChatGPT Work 的定位与能力边界,读者可据此判断智能体进入工作流的形态。
UC Berkeley 的 Aditya G. Parameswaran 等人提出,随着推理成本从 2023 年初 GPT-4 级约 $30/百万 token 降至如今不到 $1、部分厂商低于 $0.10,数据系统面临三大新挑战:为智能体服务、运行智能体集群、由智能体合成。
Fable 在 KernelBench-Mega 上写出首个真正的 megakernel,在 RTX PRO 6000 Blackwell 上以 CUDA 实现 18.71X 加速,超过 Claude Opus 4.8 的 14.4X、GLM-5.2 的 11.14X 和 GPT 5.5 的 4.34X。
Hugging Face 发布 ScarfBench(Self-Contained Application Refactoring Benchmark),用于评估 AI 智能体在 Spring、Jakarta EE、Quarkus 之间的跨框架迁移能力,包含 34 个应用、102 个框架实现、204 个迁移任务和 1,331 个专家测试。
NVIDIA 推出 ENPIRE 框架,让编码智能体驱动真实机械臂自主试错与策略改进,在 PushT、整理插针、用切割器剪扎带等任务上达到 99% 成功率,测试硬件为双 YAM 机械臂加 RTX 5090 工作站。GPT-5.5(Codex)与 Opus 4.7(Claude Code)表现互有胜负,Kimi-2.6 落后,8 个智能体并行能更快得到更高分。
OpenAI 发布新研究论文,展示 AI 智能体正在改变工作方式,能够承担更长、更复杂的任务,并在多种岗位上提升生产力。
Google DeepMind 将 computer use 作为内置工具集成进 Gemini 3.5 Flash,此前它仅以独立的 Gemini 2.5 computer use 模型形式提供。
推荐理由:原文说明 computer use 从独立模型并入主 Flash 模型,并给出企业级安全护栏,读者可据此判断智能体自动化任务的落地路径。
Mistral AI 为 Connectors 推出多项新能力:按工作区或组织设置连接器访问权限、按工具粒度开关,以及带连接器作用域的 API key,均已 GA。
Omio 正借助 OpenAI 构建对话式旅行体验,并加速产品开发、转型为 AI 原生公司。
牛津大学、英国 AI 安全研究所、斯坦福大学和伦敦政治经济学院的研究者通过四项实验、6,923 人参与的 18,978 场对话发现,AI 系统在文本说服上稳定强于人类专家,即便专家可自选议题、提前研究并接受 1,000 英镑奖金激励。
Hugging Face 博客分享了用本地模型对 OpenClaw 仓库的 Issue 和 PR 做实时分类分诊的方案,作者在 NVIDIA GB10 上运行 gemma-4-26b-a4b 和 qwen3.6-35b-a3b,通过 Pi 智能体框架配合受限只读 shell(reposhell)和 final_json 工具输出结构化标签。
推荐理由:原文给出本地模型做 PR/Issue 分类的完整架构与 330 行评测数据,可迁移到其他高吞吐筛选场景。
Jason Liu 分享了他使用 OpenAI Codex 保存上下文、管理复杂项目,并让工作不再局限于单次提示词的经验。
Hugging Face 博客提出 MosaicLeaks,用 1001 条多跳研究链测试深度研究智能体的隐私泄漏,其外部查询日志可被拼凑出私有企业信息。测试中智能体频繁泄漏,仅优化任务表现会加剧泄漏;其 Privacy-Aware Deep Research(PA-DR)RL 训练方法将严格链成功率从 48.7% 提升至 58.7%,并把答案/全信息泄漏从 34.0% 降至 9.9%。
Hugging Face 发布 agent-eval 评测工具,以 transformers 为案例,按 bare、clone、skill 三种层级在模型 × 版本 × 任务上并行运行,衡量智能体完成任务所需的轮次、token 与错误率,而非只看最终答案。
推荐理由:原文给出了一套可复用的智能体工具评测方法,并展示同一改动对不同规模模型效果相反的具体证据。
AWS 开源 SDK Strands Robots 将 LeRobot 的硬件抽象、仿真与策略栈封装为 AgentTools,让一个 Strands 智能体完成从 Hub 数据集到实体机器人的全流程。
推荐理由:AWS 官方给出从 Hub 数据集到实体机器人的五步流程,可看到同一份智能体代码如何切换仿真与硬件。
Hugging Face 发布 Agentic Resource Discovery(ARD)规范草案及参考实现 Discover Tool,让智能体在运行时按自然语言搜索能力,而非预先安装。
推荐理由:原文给出 ARD 规范草案与 Hugging Face 参考实现,读者可据此了解智能体能力发现从预装转向运行时搜索的路径。
Google DeepMind 与英国政府、Google Cloud、Faculty 及 Barnet、Dorset、Camden 地方规划部门合作,开发一款基于 Gemini 的 AI 规划审批原型,目标是帮助审批人员将申请决策时间缩短 50%。
推荐理由:英国政府与 Google DeepMind 合作开发规划审批原型,目标将审批时间减半,可观察 AI 进入公共服务的落地方式。
Google DeepMind 发布 AI Control Roadmap,一套用于在 Google 内部部署和管理高级 AI 的框架,采用纵深防御思路,在模型对齐之外增加系统级安全层,把内部智能体视为可能未对齐的潜在内部威胁。
推荐理由:DeepMind 公开内部 AI 控制路线图,给出检测与响应分级和百万条编码智能体轨迹的实测数据,可供安全团队参考。
OpenAI 推出三门 Academy 新课程,帮助人们建立实用 AI 技能、创建可复用工作流,并在日常工作中应用智能体。课程面向“下一代工作方式”,聚焦实际动手能力与工作流落地。
OpenAI 宣布计划收购 Ona,用于扩展 Codex 的安全持久云端环境,支持在企业工作流中运行长时间运行的 AI 智能体。
推荐理由:OpenAI 收购 Ona 以扩展 Codex 的云端环境,读者可据此了解其在长时运行智能体方向的布局。
Google DeepMind 联合 Schmidt Sciences、Cooperative AI Foundation、ARIA 并获 Google.org 支持,发起最高 1000 万美元的多智能体 AI 安全技术研究资助,面向全球研究者开放。
作者让编码智能体通过调用两个 Hugging Face Space 搭建了展示巴黎地标的 3D Gaussian splat 网站,全程未手动使用图像生成或 3D 重建工具。
推荐理由:作者用一次真实搭建演示了 agents.md 如何让智能体串联两个 Space 完成图像到 3D 的流水线,可迁移到其他多媒体组合场景。
伦敦国王学院、复旦大学与 Alan Turing Institute 构建了 SocioHack 基准,用 72 个沙盒社会环境测试 AI 的"社会性 hacking",RL 训练的 LLM 能以 61.25% 召回率和 90.85% 精确率重新发现历史上已被修补的规则漏洞。
Hugging Face 宣布 OpenEnv 改由委员会协调,成员包括 Meta-PyTorch、Reflection、Unsloth、Modal、Prime Intellect、Nvidia、Mercor、Fleet AI、Microsoft、Hugging Face 和 RadixArk,项目迁至 huggingface/OpenEnv。
推荐理由:OpenEnv 从单一项目转为多方共管的协议层,读者可据此了解开源智能体强化学习环境的标准化路径。
Google 在 Gemini Enterprise Agent Platform 推出由 Agentic RAG 驱动的跨语料检索公开预览版,通过编排器、规划器、查询改写、搜索扇出和充分上下文智能体协同处理多源多跳查询。相比标准 RAG,该框架在事实性数据集上准确率最高提升 34%;在跨语料设置下从 4 个候选语料中路由查询,90.1% 的问题回答正确,单语料与跨语料版本延迟平均相差约 3%。
Endava 正利用 AI 智能体、ChatGPT Enterprise 和 Codex 加速软件交付、自动化工作流,并在全公司构建 AI 原生文化。
OpenAI 为 ChatGPT 引入名为 Dreaming 的新记忆系统,用于更好地记住用户偏好,并在多次对话之间保持上下文的新鲜与相关。
推荐理由:OpenAI 为 ChatGPT 引入新的记忆系统,读者可了解其在跨对话保持偏好与上下文上的变化。
Hugging Face 重构官方命令行工具 hf CLI,使其同时适配人类用户和 Claude Code、Codex、Cursor 等编码智能体,新增 agent 模式输出、下一步命令提示和非阻塞重试机制。
推荐理由:官方给出 hf CLI 面向智能体重构的细节与基准数据,可据此判断命令行工具该如何适配编码智能体。
H Company 发布 Holo3.1 计算机使用智能体模型家族,基于 Qwen 系列,覆盖 0.8B、4B、9B 和 35B-A3B 四种尺寸,并首次提供 FP8、Q4 GGUF 和 NVFP4 量化权重。
推荐理由:Holo3.1 给出跨环境与跨框架的鲁棒性提升,并首次提供量化权重,读者可据此判断本地部署计算机使用智能体的可行路径。
Travelers 基于 OpenAI 打造了 AI 理赔助手 Claim Assistant,引导客户完成理赔申请,并提供 24/7 支持。该助手已在全国范围部署,用于在理赔高峰期扩展业务处理能力。