美团发布全场景 AI Agent 平台 CatPaw,搭载 LongCat 2.0
美团正式上线全场景 AI Agent 平台 CatPaw,搭载本月开源的 LongCat 2.0(总参数 1.6T,原生支持 1M 上下文),提供 AI 智能工作台与企业级 Agent 开发托管能力。
推荐理由:原文给出 CatPaw 的多端协作、专家技能与托管能力,读者可据此判断企业级 Agent 平台的落地形态。
美团正式上线全场景 AI Agent 平台 CatPaw,搭载本月开源的 LongCat 2.0(总参数 1.6T,原生支持 1M 上下文),提供 AI 智能工作台与企业级 Agent 开发托管能力。
推荐理由:原文给出 CatPaw 的多端协作、专家技能与托管能力,读者可据此判断企业级 Agent 平台的落地形态。
华为在10月1日的Mate 90系列及全场景新品发布会上推出Mate 90系列,全系搭载旗舰τ芯片,采用逻辑折叠芯粒堆叠架构,实现125TB/秒跨Die带宽和30%关键路径时延下降,Mate 90 Pro Max整机性能较上代提升31%。
DeepSeek Harness 发布 v0.2.1-alpha.1,新增实验性 Claude Code Mods 兼容层,让按 Claude Code Mods 接口编写的扩展有机会接入 DSH 插件系统运行。
Meta 发布开源项目 Muse Gadgets,让爱好者自行搭建 AI 硬件,包含面向 ESP32 开发板的固件和用于把自制设备接入 Meta AI 智能体 Muse 的 Linux SDK,代码采用 Apache 2.0 许可,并设有 Discord 社区讨论。
开源无代码平台 NocoBase 更新,其 AI 员工现已支持知识库文档引用。NocoBase 目前维护 main、next 和 develop 三个分支,其中 main 为最稳定版本,推荐安装;next 包含即将发布的新功能,面向测试用户收集反馈。
Meta 发布开源项目 Muse Gadgets,提供开源固件和 Linux SDK,让开发者用 Raspberry Pi 或 ESP32 等低成本硬件连接其个人 AI 智能体 Muse,并给出彩色电子墨水屏、HDMI 电视棒等项目示例,同时开设 Discord 频道支持用户。
Meta 推出开源项目 Muse Gadgets,开发者可用 ESP32 开发板运行 Muse 固件,或通过 Linux SDK 在树莓派 5 等边缘设备上运行 Muse 客户端,并访问 gadgets.muse.ai 领取 API Token。
Meta 开源了相关代码,允许用户自制搭载其新 AI 智能体 Muse 的硬件设备。官方建议的玩法包括把 Muse 装到彩色 E Ink 屏上显示提醒、接入 HDMI 棒在大屏上显示,或放到小尺寸触屏设备上做成类似 DIY Muse Charm 的形态。
The Verge 记者 Allison Johnson 实测了 OpenAI 本周发布的智能体平台 Dots,它拥有可自定义名字的拟人化头像,界面与 Meta Muse 类似,但定位更偏企业办公软件。
NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商推出 DGX Spark 64GB 统一内存版本,10 月 23 日开售,起售价 4,999 美元,预装 DGX OS 与 NVIDIA AI 软件栈。
推荐理由:原文给出 64GB 新配置的价格、上市时间和双机集群方式,可据此判断本地跑大模型的门槛变化。
openJiuwen 开源智能路由框架 model-router,并首发 x-router 自演进路由算法,在 Agent 与模型之间增加一层按请求动态选模的决策能力。
Earendil 旗下 Pi 发布 1.0 版本并推出 Pi Durable,两者登上 Hacker News 首页。Pi 1.0 带来 Codemode 原生支持 MCP、Jev 与图像模型,新增虚拟模型扩展、延迟工具加载、Anthropic 模型缓存预热、对话中途系统消息、新 TUI 主题和默认全屏模式。
OpenAI 的 GPT-6 Astra Ultrafast 已在 NVIDIA Blackwell GPU 上运行,并面向 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户开放。
推荐理由:原文给出 Astra Ultrafast 在 Blackwell 上的加速幅度与开放入口,读者可据此判断它对编码智能体循环的实际影响。
Amazon Quick 为 AI 构建的 Quick Apps 推出 Live Data in Apps,应用每次打开时都会实时查询受治理的 Quick Sight 数据集,不再依赖构建时的静态快照。查询以查看者身份执行,现有行级和列级安全规则自动生效,SPICE 与 Direct Query 数据集均支持,查看者需为已认证的 Quick 用户并逐数据集授权。
OpenAI 宣布在全球范围上线两项 ChatGPT 购物功能,包括虚拟试穿服装与配饰,以及可保存商品的收藏功能。虚拟试穿以 Try On 按钮出现在购物结果中,用户上传自拍或全身照即可预览上身效果,也可上传商品截图让 ChatGPT 试穿。OpenAI 称新功能基于新发布的 ChatGPT Images 2.5 模型,该模型在光照、纹理和编辑指令遵循上有所改进并降低了生成延迟。
针对团队使用 Codex 和 Claude Code 时的 API Key 与模型权限管理问题,开发者开源了 Zentrola。它面向从个人到团队的场景,解决真实 API Key 是否分发、新成员可用哪些模型、成员离职后如何撤销权限,以及上游服务商故障时是否需通知所有人临时修改等管理难题。
华为发布 Mate90 系列旗舰手机,全系搭载旗舰韬芯片,首发第二代玲珑屏、第三代红枫原色影像和鸿蒙7系统,整机性能相比 Mate80 系列提升 20% 至 31%。
华为发布 Mate 90、Mate 90 Pro、Mate 90 Pro Max、Mate 90 RS 非凡大师四款旗舰,5999 元起即日全系开售。Mate 90 Pro Max 首发麒麟 9050 Pro,多核性能提升 23%、GPU 渲染提升 40%、NPU 提升 140%,并支持 120 帧极致光追。
The Den 借助 ChatGPT Work 将拨款申请的准备时间从 3 天缩短至 2 小时,酒牌材料从 4 天缩短至 3 小时,每周因此省出 10-15 小时用于业务增长。这家社交俱乐部正筹备开设新门店。
DeepSeek 将 TileLang 算子开发工具及 DeepGEMM、DeepEP、FlashMLA、TileKernels、DeepSelect 五大计算与通信库同步推出昇腾版本,TileLang 官宣原生支持华为昇腾 950 NPU。
推荐理由:原文拆解了 TileLang 前后端解耦架构与昇腾适配路径,可据此判断国产算子工具链的迁移成本。
Simon Willison 用 GPT-6 Astra 构建了实验性工具 Photo Scrubber,可自动识别人脸并模糊处理。该工具基于 Google 的 MediaPipe C++ 库,通过 @mediapipe/tasks-vision 编译为 WebAssembly,并使用 BlazeFace 人脸检测模型,全程在本地运行。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需给出 GitHub 仓库地址,智能体就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。
推荐理由:GitHub Security Lab 把模糊测试的建 harness、读覆盖率、崩溃分诊交给 LLM 智能体,并公开了可复用的开源流水线。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 基础上为原生实时对话模型加入近实时视觉形象,可同时处理视觉与音频输入并输出带表情和口型同步的音视频。
推荐理由:官方给出 Live Avatar 的多模态对话、异步工具调用与 97 语言同步细节,可据此判断企业级实时数字人落地的能力边界。
Liquid AI 发布实验性 DSpark 草稿模型 LFM2.5-VL-DSpark,为视觉语言模型 LFM2.5-VL-3B 加入投机解码路径,解码最高提速 3.13x(端侧)和 2.66x(H100),端到端最高提升 2.62x 和 2.27x。
Remedy Entertainment 的 CONTROL Resonant 已在发售当日登陆 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能串流游玩,支持 DLSS 4、光线追踪与最高 5K HDR,无需 100GB 本地安装。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组全部约 90 亿个单核苷酸变异效应预测的平台,并以免费网站门户向学术研究开放。
推荐理由:DeepMind 把 AlphaGenome 的预测预计算成 1PB 数据集并开放免费门户,读者可据此判断基因组变异解读的门槛变化。
Mistral 发布 Agentic Search,作为让模型在复杂文档中导航、阅读并核验信息的检索层,通过 Mistral Search Toolkit 和 Studio、Vibe 中的 Libraries 提供。
推荐理由:原文给出多步检索循环在 FinanceBench 与 OfficeQA Pro 上的准确率、token 与延迟变化,可据此判断传统一次性 RAG 的边界。
Mistral 宣布 Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行,同时 Mistral Priority Tier 进入公开预览,提供自定义速率限制和带 SLA 的可用性承诺。
推荐理由:Mistral 把区域推理、优先服务层级和第三方开源模型接入放在同一套基础设施上,读者可据此判断企业级 AI 部署的区域合规选项。