跳到正文
  1. 美团技术团队75

    美团发布全场景 AI Agent 平台 CatPaw,搭载 LongCat 2.0

    美团正式上线全场景 AI Agent 平台 CatPaw,搭载本月开源的 LongCat 2.0(总参数 1.6T,原生支持 1M 上下文),提供 AI 智能工作台与企业级 Agent 开发托管能力。

    推荐理由:原文给出 CatPaw 的多端协作、专家技能与托管能力,读者可据此判断企业级 Agent 平台的落地形态。

  1. NVIDIA Blog60

    NVIDIA 推出 DGX Spark 64GB 配置,支持双机集群扩展本地 AI

    NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商推出 DGX Spark 64GB 统一内存版本,10 月 23 日开售,起售价 4,999 美元,预装 DGX OS 与 NVIDIA AI 软件栈。

    推荐理由:原文给出 64GB 新配置的价格、上市时间和双机集群方式,可据此判断本地跑大模型的门槛变化。

  2. NVIDIA Blog66

    NVIDIA GPU 如何加速 OpenAI GPT-6 Astra Ultrafast

    OpenAI 的 GPT-6 Astra Ultrafast 已在 NVIDIA Blackwell GPU 上运行,并面向 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户开放。

    推荐理由:原文给出 Astra Ultrafast 在 Blackwell 上的加速幅度与开放入口,读者可据此判断它对编码智能体循环的实际影响。

  1. 雷峰网78

    DeepSeek 开源 TileLang 等算子工具链,原生支持华为昇腾 950

    DeepSeek 将 TileLang 算子开发工具及 DeepGEMM、DeepEP、FlashMLA、TileKernels、DeepSelect 五大计算与通信库同步推出昇腾版本,TileLang 官宣原生支持华为昇腾 950 NPU。

    推荐理由:原文拆解了 TileLang 前后端解耦架构与昇腾适配路径,可据此判断国产算子工具链的迁移成本。

  2. 开源中国80

    OpenAI 发布全天候运行 AI Agent dots,由 GPT-6 Astra 驱动

    OpenAI 在旧金山 DevDay 2026 开发者大会上发布个人智能体助理 dots,由 GPT-6 Astra 驱动,可全天候运行并拥有独立的云端电脑。dots 以戴贝雷帽、架眼镜的彩色小圆点形象出现在手机和笔记本屏幕上,可集成进第三方应用,Sam Altman 称其比 ChatGPT 更有野心。

    推荐理由:OpenAI 在 DevDay 发布由 GPT-6 Astra 驱动的全天候个人智能体 dots,可据此了解其形态与集成方式。

  3. 开源中国78

    DeepSeek Harness v0.2 发布桌面版,插件靠 npm 包名安装

    DeepSeek Harness 发布 v0.2 预览版,同时放出 macOS 和 Windows 桌面端安装包,可在官网 deepseek.com/harness 下载,无需再折腾命令行。新版本预置常用能力,支持丢入文档、表格或 PDF 处理,插件安装以 npm 包名完成,并能让 AI 自己写插件。

    推荐理由:桌面版把插件安装简化为 npm 包名,并支持 AI 自行编写插件,可据此判断上手门槛的变化。

  4. 爱范儿84

    OpenAI 开发者大会发布 Dot、ChatGPT Space 与 GPT-6.1 Sol

    OpenAI 在开发者大会上一口气公布 Dot、ChatGPT Space、GPT-6.1 Sol、UltraFast、Pro 500、Decisions API、Agents API、云端 Codex 和 OpenAI Marketplace 等更新,主线是把模型、智能体、协作空间和商业分发连成工作平台。

    推荐理由:发布会一口气铺开 Dot、Space、GPT-6.1 Sol 与 Agents API,读者可据此看清 OpenAI 把 ChatGPT 推向智能体工作平台的完整布局。

  5. AWS Machine Learning Blog62

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和日常专业工作负载提供更强的推理能力。据 OpenAI 称,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,单任务成本约为后者的五分之一,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。

    推荐理由:原文给出 GPT-6.1 Sol 在 Bedrock 上的可用范围与成本对比,读者可据此判断智能体编码任务的性价比变化。

  1. 开源中国78

    Manus 2.0 发布:自研 Agent 框架 Cascade 省 32% 成本,并推出 Manus Studio 与 Cue

    Manus 2.0 上线,官方将其定义为架构级更新,核心是自研 Agent 框架 Cascade、升级为共享工作区的桌面应用 Manus Studio,以及独立的个人 Agent 应用 Cue。Cascade 主打效率,官方称可节省 32% 成本,让项目从开始就保持轻量。视频编辑器把时间线交给用户操作。

    推荐理由:Manus 2.0 给出自研 Agent 框架 Cascade 的成本降幅与三块新形态,读者可据此判断其架构调整方向。

  2. OpenAI News62

    OpenAI 推出主动式助手 dots

    OpenAI 发布名为 dots 的主动式助手,可在复杂项目和日常任务中持续推进工作。官方称 dots 让用户在任务推进过程中保持控制权。

    推荐理由:OpenAI 官方给出 dots 的定位与可控性说明,读者可据此判断这类主动式助手与现有助手形态的差别。

  1. GitHub Blog · AI & ML62

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体流水线

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需给出 GitHub 仓库地址,智能体就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。

    推荐理由:GitHub Security Lab 把模糊测试的建 harness、读覆盖率、崩溃分诊交给 LLM 智能体,并公开了可复用的开源流水线。

  2. Google DeepMind74

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 基础上为原生实时对话模型加入近实时视觉形象,可同时处理视觉与音频输入并输出带表情和口型同步的音视频。

    推荐理由:官方给出 Live Avatar 的多模态对话、异步工具调用与 97 语言同步细节,可据此判断企业级实时数字人落地的能力边界。

  1. NVIDIA Blog62

    NVIDIA 发布 Isaac ROS 5.0,推进智能体化开源机器人开发

    NVIDIA 在 ROSCon 发布 Isaac ROS 5.0,新增智能体工作流与平台支持,支持 ROS Lyrical 和 Ubuntu 24.04,并免费开源。

    推荐理由:Isaac ROS 5.0 把智能体工作流引入机器人开发,并给出多家厂商的落地案例,可据此判断开源机器人栈的演进方向。

  2. Hugging Face Blog62

    Transformers 现已支持运行 llama.cpp 的 GGUF 量化模型

    Hugging Face 为 transformers 加入 GGUF 支持,用户可从 Hub 选取量化 checkpoint,通过 from_pretrained 传入 gguf_file 即可在本地生成,无需额外配置。

    推荐理由:Hugging Face 官方说明 transformers 如何直接加载 GGUF 量化权重,并给出与 llama.cpp 的对比数据,便于判断本地推理的新选择。

  1. OpenAI News62

    OpenAI 推出面向金融服务的 ChatGPT

    OpenAI 发布 ChatGPT for Financial Services,内置金融数据并接入 GPT-6 Astra,用于研究、建模和生成可直接交付客户的材料。

    推荐理由:OpenAI 面向金融行业推出专用 ChatGPT,内置金融数据并接入 GPT-6 Astra,可用于研究与建模。

  2. Hugging Face Blog62

    Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111,73 个节点覆盖 11 条媒体管线

    Hugging Face 发布 Workflow1111,用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张工作流画布,由 11 条媒体管线和 73 个节点组成,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 式标注器、背景移除、PNG Info 与图生视频。

    推荐理由:原文展示了用 Gradio Workflow 重建 A1111 全部管线并暴露 REST 与 MCP 接口的做法,可据此判断节点式工作流的落地形态。

  3. OpenAI News67

    OpenAI 在 API 中上线 GPT-Live-1 语音模型

    OpenAI 在 API 中推出 GPT-Live-1,支持自然的全双工语音对话。该模型在指令遵循上更强,并支持自定义音色和电话(telephony)接入。

    推荐理由:OpenAI 把全双工语音对话能力开放到 API,开发者可据此评估语音应用的接入方式。

  4. OpenAI News62

    OpenAI 发布 Agents API

    OpenAI 发布 Agents API,这是一个由 Codex harness 驱动的托管服务,用于构建和上线云端智能体。该服务支持编排、长时间运行的会话以及工具调用。

    推荐理由:OpenAI 官方发布托管式 Agents API,读者可了解其基于 Codex harness 的编排与长时会话能力。

  1. Google DeepMind74

    Google DeepMind 发布 AlphaGenome Atlas,覆盖人类基因组 90 亿个单碱基变异预测

    Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组全部约 90 亿个单核苷酸变异效应预测的平台,并以免费网站门户向学术研究开放。

    推荐理由:DeepMind 把 AlphaGenome 的预测预计算成 1PB 数据集并开放免费门户,读者可据此判断基因组变异解读的门槛变化。

  2. OpenAI News62

    OpenAI 发布 ChatGPT Images 2.5

    OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精致的图像,并更贴近用户原本的构想。

    推荐理由:OpenAI 官方发布 ChatGPT Images 2.5,读者可了解其在个性化图像生成上的定位与输入方式。