跳到正文
  1. 美团技术团队75

    美团发布全场景 AI Agent 平台 CatPaw,搭载 LongCat 2.0

    美团正式上线全场景 AI Agent 平台 CatPaw,搭载本月开源的 LongCat 2.0(总参数 1.6T,原生支持 1M 上下文),提供 AI 智能工作台与企业级 Agent 开发托管能力。

    推荐理由:原文给出 CatPaw 的多端协作、专家技能与托管能力,读者可据此判断企业级 Agent 平台的落地形态。

  2. 美团技术团队62

    美团图灵团队公开 Agent 评测实践:从评测体系到长程 Agent 演进

    美团图灵 Agent 评测团队将内部博客公开,由浅入深讲解 Agent 评测,涵盖评测是什么、如何建立评测体系,以及长程 Agent 框架带来的变化。文章提出观测加评测等于持续迭代的研发公式,主张评测需覆盖结果、过程、效率、风险四层,并给出把模糊指标下钻为二元化 Rubric、追求人人一致与人机一致的实践方法。

    推荐理由:美团图灵团队公开两年 Agent 评测实践,给出从指标下钻到人机对齐的可迁移方法论与落地路径。

  1. Google Research66

    Google 发布基于 TEE 的联邦学习系统,Gboard 已采用

    Google 发布新一代联邦学习系统,利用可信执行环境(TEE)为数据匿名化提供可验证、可审计的保证,Gboard 已采用该系统上线英语和日语下一词预测模型,隐私保证更强且准确率提升。

    推荐理由:Google 公布基于 TEE 的新一代联邦学习系统设计,并给出 Gboard 已上线的实际部署情况,可了解隐私计算在端侧训练中的工程路径。

  2. NVIDIA Blog60

    NVIDIA 推出 DGX Spark 64GB 配置,支持双机集群扩展本地 AI

    NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商推出 DGX Spark 64GB 统一内存版本,10 月 23 日开售,起售价 4,999 美元,预装 DGX OS 与 NVIDIA AI 软件栈。

    推荐理由:原文给出 64GB 新配置的价格、上市时间和双机集群方式,可据此判断本地跑大模型的门槛变化。

  3. NVIDIA Blog66

    NVIDIA GPU 如何加速 OpenAI GPT-6 Astra Ultrafast

    OpenAI 的 GPT-6 Astra Ultrafast 已在 NVIDIA Blackwell GPU 上运行,并面向 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户开放。

    推荐理由:原文给出 Astra Ultrafast 在 Blackwell 上的加速幅度与开放入口,读者可据此判断它对编码智能体循环的实际影响。

  1. NVIDIA Blog62

    NVIDIA 与 CoreWeave 将 Vera Rubin NVL72 和 Vera CPU 投入生产

    CoreWeave 宣布在 CoreWeave Cloud 上线 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网,并计划提供面向 AI 智能体的 NVIDIA Vera CPU。

    推荐理由:CoreWeave 上线 Vera Rubin NVL72 与 Vera CPU,并给出 Cognition 实测吞吐与沙箱启动数据,可据此判断智能体训练到推理的闭环成本。

  2. 雷峰网78

    DeepSeek 开源 TileLang 等算子工具链,原生支持华为昇腾 950

    DeepSeek 将 TileLang 算子开发工具及 DeepGEMM、DeepEP、FlashMLA、TileKernels、DeepSelect 五大计算与通信库同步推出昇腾版本,TileLang 官宣原生支持华为昇腾 950 NPU。

    推荐理由:原文拆解了 TileLang 前后端解耦架构与昇腾适配路径,可据此判断国产算子工具链的迁移成本。

  3. 开源中国78

    DeepSeek Harness v0.2 发布桌面版,插件靠 npm 包名安装

    DeepSeek Harness 发布 v0.2 预览版,同时放出 macOS 和 Windows 桌面端安装包,可在官网 deepseek.com/harness 下载,无需再折腾命令行。新版本预置常用能力,支持丢入文档、表格或 PDF 处理,插件安装以 npm 包名完成,并能让 AI 自己写插件。

    推荐理由:桌面版把插件安装简化为 npm 包名,并支持 AI 自行编写插件,可据此判断上手门槛的变化。

  4. 爱范儿84

    OpenAI 开发者大会发布 Dot、ChatGPT Space 与 GPT-6.1 Sol

    OpenAI 在开发者大会上一口气公布 Dot、ChatGPT Space、GPT-6.1 Sol、UltraFast、Pro 500、Decisions API、Agents API、云端 Codex 和 OpenAI Marketplace 等更新,主线是把模型、智能体、协作空间和商业分发连成工作平台。

    推荐理由:发布会一口气铺开 Dot、Space、GPT-6.1 Sol 与 Agents API,读者可据此看清 OpenAI 把 ChatGPT 推向智能体工作平台的完整布局。

  5. 爱范儿78

    OpenAI DevDay 2026 发布 dots、ChatGPT Space 与 GPT-6.1 Sol 等 20 多项更新

    OpenAI 在 DevDay 2026 上发布 20 多项功能和产品更新,包括由 GPT-6 Astra 驱动的 24 小时在线智能体助理 dots、协作空间 ChatGPT Space、云端 Codex Cloud,以及新模型 GPT-6.1 Sol。

    推荐理由:梳理 DevDay 2026 的 20 多项更新,并点出 ChatGPT 从对话工具转向企业工作流服务这条主线。

  6. 智东西87

    OpenAI DevDay 2026 发布 21 项更新,推出个人智能体 Dot 与 GPT-6.1 Sol

    OpenAI 在 DevDay 2026 上发布 21 项产品、功能与更新,包括由 GPT-6 Astra 驱动的全天候个人智能体 Dot、协作空间 ChatGPT Space 以及新模型 GPT-6.1 Sol。

    推荐理由:OpenAI 一次发布 21 项更新,覆盖个人智能体、协作空间与低价新模型,可据此观察其开发者生态布局。

  7. AWS Machine Learning Blog62

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和日常专业工作负载提供更强的推理能力。据 OpenAI 称,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,单任务成本约为后者的五分之一,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。

    推荐理由:原文给出 GPT-6.1 Sol 在 Bedrock 上的可用范围与成本对比,读者可据此判断智能体编码任务的性价比变化。

  1. Simon Willison88

    OpenAI DevDay 2026 现场实录:Dots 个人智能体、GPT-6.1 Sol 与 Ultrafast 发布

    Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体(由 Astra 驱动)、ChatGPT Space 协作空间、GPT-6.1 Sol 模型以及最高 300 tokens/秒的 Ultrafast 模式。

    推荐理由:现场逐条记录 DevDay 发布节奏与演示翻车细节,可对照官方口径看新功能实际表现。

  2. 开源中国78

    Manus 2.0 发布:自研 Agent 框架 Cascade 省 32% 成本,并推出 Manus Studio 与 Cue

    Manus 2.0 上线,官方将其定义为架构级更新,核心是自研 Agent 框架 Cascade、升级为共享工作区的桌面应用 Manus Studio,以及独立的个人 Agent 应用 Cue。Cascade 主打效率,官方称可节省 32% 成本,让项目从开始就保持轻量。视频编辑器把时间线交给用户操作。

    推荐理由:Manus 2.0 给出自研 Agent 框架 Cascade 的成本降幅与三块新形态,读者可据此判断其架构调整方向。

  3. 智东西78

    Manus 2.0 发布并推出多 Agent 群聊应用 Cue

    蝴蝶效应(Manus)推出 Manus 2.0 版本,并发布多 Agent 群聊应用 Cue,这是其今年 9 月 1 日宣布恢复独立运营后的首次大版本更新。

    推荐理由:Manus 2.0 与 Cue 的功能清单和自研框架数据,可用来观察个人智能体从通用入口转向垂直执行的方向。

  1. Hugging Face Blog71

    H 公司发布 Holo4 系列智能体模型,含 27B 稠密与 35B-A3B MoE 两个版本

    H 公司发布 Holo4 系列智能体模型,包含 27B 稠密版和 35B-A3B MoE 版,两者均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 格式开源在 Hugging Face。

    推荐理由:Holo4 用同一套权重覆盖 GUI、代码、MCP 与 API 四类接口,并公开全部评测轨迹,便于对照其成本与能力取舍。

  1. Microsoft Research62

    微软研究院:把物理 AI 推理从机器人卸载到边缘或云端

    微软研究院对移动操作机器人工作负载做了系统性测量,发现把物理 AI 推理从机载 GPU 卸载到边缘或云端 GPU 可提升任务表现并延长续航。

    推荐理由:微软研究院对机器人推理负载的系统性测量,给出了把推理从机载 GPU 卸载到边缘或云端的性能与续航数据。

  2. Google DeepMind62

    Google DeepMind 为 Private AI Compute 引入安全服务端持久记忆

    Google DeepMind 公布 Private AI Compute 的新技术能力,将持久化服务端记忆引入该平台,使 AI 助手能跨设备保留上下文,同时维持端侧级别的隐私标准。

    推荐理由:Google 给出私有 AI 计算新增持久化服务端记忆的架构思路,读者可了解云端记忆如何与端侧密钥结合。

  1. NVIDIA Blog62

    NVIDIA 发布 Isaac ROS 5.0,推进智能体化开源机器人开发

    NVIDIA 在 ROSCon 发布 Isaac ROS 5.0,新增智能体工作流与平台支持,支持 ROS Lyrical 和 Ubuntu 24.04,并免费开源。

    推荐理由:Isaac ROS 5.0 把智能体工作流引入机器人开发,并给出多家厂商的落地案例,可据此判断开源机器人栈的演进方向。

  2. Hugging Face Blog62

    Transformers 现已支持运行 llama.cpp 的 GGUF 量化模型

    Hugging Face 为 transformers 加入 GGUF 支持,用户可从 Hub 选取量化 checkpoint,通过 from_pretrained 传入 gguf_file 即可在本地生成,无需额外配置。

    推荐理由:Hugging Face 官方说明 transformers 如何直接加载 GGUF 量化权重,并给出与 llama.cpp 的对比数据,便于判断本地推理的新选择。