跳到正文
9月29日周二
  1. 开源中国78

    Manus 2.0 发布:自研 Agent 框架 Cascade 省 32% 成本,并推出 Manus Studio 与 Cue

    Manus 2.0 上线,官方将其定义为架构级更新,核心是自研 Agent 框架 Cascade、升级为共享工作区的桌面应用 Manus Studio,以及独立的个人 Agent 应用 Cue。Cascade 主打效率,官方称可节省 32% 成本,让项目从开始就保持轻量。视频编辑器把时间线交给用户操作。

    推荐理由:Manus 2.0 给出自研 Agent 框架 Cascade 的成本降幅与三块新形态,读者可据此判断其架构调整方向。

  2. 智东西78

    Manus 2.0 发布并推出多 Agent 群聊应用 Cue

    蝴蝶效应(Manus)推出 Manus 2.0 版本,并发布多 Agent 群聊应用 Cue,这是其今年 9 月 1 日宣布恢复独立运营后的首次大版本更新。

    推荐理由:Manus 2.0 与 Cue 的功能清单和自研框架数据,可用来观察个人智能体从通用入口转向垂直执行的方向。

9月28日周一
  1. Hugging Face Blog71

    H 公司发布 Holo4 系列智能体模型,含 27B 稠密与 35B-A3B MoE 两个版本

    H 公司发布 Holo4 系列智能体模型,包含 27B 稠密版和 35B-A3B MoE 版,两者均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 格式开源在 Hugging Face。

    推荐理由:Holo4 用同一套权重覆盖 GUI、代码、MCP 与 API 四类接口,并公开全部评测轨迹,便于对照其成本与能力取舍。

  2. 开源中国23

    AIGCPanel v2.5.0 支持豆包语音音色与数字人直播音色模板管理

    AIGCPanel v2.5.0 新增豆包语音音色支持,云端语音模型只需填入 API Key 即可使用。该版本还将数字人与直播的音色分别收进各自独立的音色库,便于模板管理。AIGCPanel 是一款支持 Windows / macOS / Linux 的一站式 AI 数字人桌面应用,内置数字人合成、语音合成与克隆、工具箱和智能直播。

  3. 开源中国31

    开源 AI 终端 uniTerm v1.9.5 发布:工作区管理升级、终端图片显示、SFTP 提速等 50 余项更新

    开源 AI 终端 uniTerm v1.9.5 发布,带来工作区管理、终端体验等 50 余项更新。新版本支持点选创建与拖拽分屏,工作区可保存为连接随时恢复,并新增终端图片显示与 SFTP 传输提速。uniTerm 整合终端、文件传输、远程桌面、数据库客户端、容器 5 大类协议,覆盖 30+ 协议,安装包仅 15MB,内置可自主执行多轮 Shell 命令的 AI Agent。

9月26日周六
9月25日周五
9月24日周四
  1. Microsoft Research62

    微软研究院:把物理 AI 推理从机器人卸载到边缘或云端

    微软研究院对移动操作机器人工作负载做了系统性测量,发现把物理 AI 推理从机载 GPU 卸载到边缘或云端 GPU 可提升任务表现并延长续航。

    推荐理由:微软研究院对机器人推理负载的系统性测量,给出了把推理从机载 GPU 卸载到边缘或云端的性能与续航数据。

  2. Google DeepMind62

    Google DeepMind 为 Private AI Compute 引入安全服务端持久记忆

    Google DeepMind 公布 Private AI Compute 的新技术能力,将持久化服务端记忆引入该平台,使 AI 助手能跨设备保留上下文,同时维持端侧级别的隐私标准。

    推荐理由:Google 给出私有 AI 计算新增持久化服务端记忆的架构思路,读者可了解云端记忆如何与端侧密钥结合。

9月23日周三
9月22日周二
  1. Hugging Face Blog22

    oMLX 创作者 Jun Kim 加入 Hugging Face,支持 MLX 社区

    oMLX 创作者兼维护者 Jun Kim 加入 Hugging Face,继续领导该项目并支持 MLX 社区。oMLX 将保持 Apache 2.0 开源协议,从副业转为有资金支持的正式项目,有望带来更高稳定性和更快开发。Hugging Face 计划让 oMLX 成为新想法的试验场,并推动 transformers 模型定义快速转为 MLX 参考实现。

  2. Hugging Face Blog62

    Transformers 现已支持运行 llama.cpp 的 GGUF 量化模型

    Hugging Face 为 transformers 加入 GGUF 支持,用户可从 Hub 选取量化 checkpoint,通过 from_pretrained 传入 gguf_file 即可在本地生成,无需额外配置。

    推荐理由:Hugging Face 官方说明 transformers 如何直接加载 GGUF 量化权重,并给出与 llama.cpp 的对比数据,便于判断本地推理的新选择。

9月21日周一
  1. NVIDIA Blog38

    NVIDIA 谈 AI 安全:如何在智能体栈的每一层解决这一工程问题

    NVIDIA 提出 AI 安全是工程问题,需要明确的安全需求、可执行的管控、明确的责任人和防护有效的证据。其开源安全运行时 NVIDIA OpenShell 在智能体推理范围之外强制执行策略并提供沙箱化执行,Cisco DefenseClaw 在其上增加治理层,JFrog 则集成 OpenShell 扫描和验证智能体技能。

9月17日周四
  1. GitHub Blog · AI & ML78

    GitHub 用 Copilot 把 Copilot 运行时迁移到 Rust

    GitHub 用 Copilot 应用和 CLI 把 Copilot 智能体运行时从 TypeScript 完全重写为超过 80 万行生产级 Rust,代码主要由 AI 智能体编写,分布在 128 个 PR 中增量合并,而非一次性切换。

    推荐理由:一位工程师复盘用 Copilot 智能体把运行时从 TypeScript 迁到 Rust 的全过程,含并发会话协作与提示缓存数据。

9月16日周三
  1. NVIDIA Blog62

    NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1 并取得领先性能

    NVIDIA 在 MLPerf Inference v6.1 中首次提交 Vera Rubin NVL72 预览结果,在 Qwen3-VL 上吞吐量最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高达 2.5 倍。

    推荐理由:MLPerf Inference v6.1 结果给出 Vera Rubin NVL72 与 GB300 NVL72 的吞吐、扩展效率和软件优化数据,可作为推理基础设施选型的参考。

9月14日周一
9月12日周六
9月11日周五
9月10日周四
  1. Mistral AI38

    Cloudera 与 Mistral 达成合作,将专用主权智能引入企业数据

    Mistral 与 Cloudera 建立合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持完全控制。企业还能在受控环境中用专有数据训练自有模型,数据与由此产生的智能均归企业所有。Cloudera 平台承载 30 exabytes 客户自管数据。