跳到正文
今天10月4日周日2 条
  1. The Verge · AI38

    微软用“仿生学”改造数据中心:在树林里伪装,就能让邻居不讨厌吗?

    微软宣布将“仿生学”方案推广至美国与德国 20 多个数据中心站点,通过增加花园、本地树种和生态修复,把设施“融入自然景观”以减少噪音、绿地和生物多样性方面的社区反弹。微软称自 2022 年起已在荷兰一处数据中心试点,并计划对所有美国新项目采用该方案;其在圣安东尼奥曾为建数据中心砍伐 33 英亩逾 2600 棵树,引发当地争议。

  2. Hugging Face Blog71

    微软与 Hugging Face 发布 ThinkingBox:按数据库终态给 AI 智能体打分

    微软 Copilot Studio 团队与 Hugging Face 联合发布 ThinkingBox,通过隔离的 MCP 工具会话运行智能体,再根据其留下的后端终态和副作用判分,而非看它生成的回答。

    推荐理由:微软与 Hugging Face 联合发布的智能体评测基准,用数据库终态而非回答文本判分,并给出 20 次重复下的稳定性与成本对比。

10月1日周四
9月30日周三
  1. 爱范儿84

    OpenAI 开发者大会发布 Dot、ChatGPT Space 与 GPT-6.1 Sol

    OpenAI 在开发者大会上一口气公布 Dot、ChatGPT Space、GPT-6.1 Sol、UltraFast、Pro 500、Decisions API、Agents API、云端 Codex 和 OpenAI Marketplace 等更新,主线是把模型、智能体、协作空间和商业分发连成工作平台。

    推荐理由:发布会一口气铺开 Dot、Space、GPT-6.1 Sol 与 Agents API,读者可据此看清 OpenAI 把 ChatGPT 推向智能体工作平台的完整布局。

9月29日周二
  1. Microsoft Research62

    微软研究院发布 Quine:面向生物学复杂性的 AI 研究系统

    微软研究院发布 Quine,一个面向生物学复杂性的 AI 研究系统,由跨序列、结构、功能、细胞状态和成像等多模态数据训练的世界模型,以及连接模型、科学工具、文献与研究者的交互式 harness 组成。

    推荐理由:微软研究院公开 Quine 的多模态生物世界模型与实验闭环,并给出胰腺癌化合物筛选的湿实验验证结果。

  2. Microsoft Research22

    微软亚洲研究院新加坡分院成立一年:推进研究、合作与人才培养

    微软亚洲研究院新加坡分院(MSRA – Singapore)作为微软在东南亚的首个研究实验室,成立一年来聚焦下一代 AI 模型与智能体系统、领域专用 AI、AI 原生研究实践及生态与人才培养四大方向。该实验室与新加坡医疗生态伙伴合作推进多模态医疗 AI 和自进化诊断智能体,并与 EDB、IMDA 等机构在物流、医疗等领域开展合作。

9月26日周六
9月25日周五
9月24日周四
  1. Microsoft Research62

    微软研究院:把物理 AI 推理从机器人卸载到边缘或云端

    微软研究院对移动操作机器人工作负载做了系统性测量,发现把物理 AI 推理从机载 GPU 卸载到边缘或云端 GPU 可提升任务表现并延长续航。

    推荐理由:微软研究院对机器人推理负载的系统性测量,给出了把推理从机载 GPU 卸载到边缘或云端的性能与续航数据。

9月21日周一
9月17日周四
  1. GitHub Blog · AI & ML78

    GitHub 用 Copilot 把 Copilot 运行时迁移到 Rust

    GitHub 用 Copilot 应用和 CLI 把 Copilot 智能体运行时从 TypeScript 完全重写为超过 80 万行生产级 Rust,代码主要由 AI 智能体编写,分布在 128 个 PR 中增量合并,而非一次性切换。

    推荐理由:一位工程师复盘用 Copilot 智能体把运行时从 TypeScript 迁到 Rust 的全过程,含并发会话协作与提示缓存数据。

9月11日周五
  1. GitHub Blog · AI & ML30

    GitHub Copilot 应用新手指南:使用 diff、终端与浏览器面板

    GitHub Copilot 应用内置 diff、终端和浏览器三个面板,让用户无需离开应用即可审查、运行并预览 AI 智能体生成的代码改动。diff 面板以绿色和红色高亮显示新增与删除行,支持接受改动、留言或让 Copilot 继续修改;终端面板可直接运行项目命令,浏览器面板则通过 Pick & Polish 工具选中页面元素并让智能体调整。

9月5日周六
  1. GitHub Blog · AI & ML71

    GitHub 推出 Project HydraFusion,用多模型编排提供前沿级编码质量

    GitHub 发布研究预览版 Project HydraFusion,通过运行时编排在多个提供商的模型间选择,自动完成起草、评审、修订或升级到更强模型。它目前提供 Single、Cascade、Critique 三种执行模式,已在所有 GitHub Copilot 套餐中通过 Copilot CLI 的 /experimental 开放,按各模型标准费率计费。

    推荐理由:GitHub 官方披露 HydraFusion 的三种编排模式与三套基准的成本质量对比,可据此判断多模型编排在编码任务上的取舍。

9月1日周二
8月31日周一
8月21日周五
  1. Microsoft Research36

    微软 Skala 1.1 发布:训练数据扩大 2.5 倍,并集成进 CP2K 等主流 DFT 软件

    微软研究院发布深度学习交换关联泛函 Skala 1.1,训练数据比首个公开版本多 2.5 倍,在 GMTKN55 上取得 2.8 kcal/mol 的加权平均误差,55 个类别中 32 项排名第一。Skala 现已在 CP2K 中可用,并正集成进 Psi4、FHI-aims、ORCA 和 VASP,同时推出持续追踪各版本计算性能的 living benchmark。

8月13日周四
  1. Microsoft Research40

    MindTopo:微软研究院推出评估 VLM 拓扑空间推理能力的新基准

    微软研究院推出 MindTopo 基准,用于评估多模态大语言模型在连通性、封闭、顺序、分离和绳结五类拓扑关系上的推理与规划能力。测试显示,当前模型在静态图像识别上表现明显优于交互式规划任务,失败多发生在规划阶段而非感知阶段,模型在场景变化中会丢失结构关系或提出违反物理约束的动作。图像与视频生成仅在单帧关系可见时偶有帮助,跨序列仍不可靠。

8月12日周三
8月4日周二
  1. Microsoft Research71

    微软研究院开源 Orchard:可扩展智能体 AI 框架

    微软研究院发布开源框架 Orchard,核心是 Kubernetes 环境服务 Orchard Env,可复用于软件工程、网页导航和个人助理等任务,并支持在 Codex、OpenClaw、ZeroClaw 等真实部署框架内直接训练智能体。

    推荐理由:微软研究院开源了可复用的智能体环境服务与三套训练配方,读者可据此了解小模型在真实任务上的训练路径。

7月7日周二
  1. Hugging Face Blog62

    微软在 Foundry Managed Compute 上线 Hugging Face 模型集合

    微软在 Build 2026 宣布 Foundry Managed Compute 及 Hugging Face 模型集合,将 Hugging Face 生态的开源权重模型引入 Foundry 模型目录,每周刷新,可一键部署到托管 GPU 平台。

    推荐理由:微软在 Foundry 上托管 Hugging Face 开源权重模型,读者可了解企业部署开源模型时被接管的运维环节。

6月17日周三
6月8日周一
  1. Hugging Face Blog66

    OpenEnv 转为委员会共管,成为智能体强化学习的开源协议层

    Hugging Face 宣布 OpenEnv 改由委员会协调,成员包括 Meta-PyTorch、Reflection、Unsloth、Modal、Prime Intellect、Nvidia、Mercor、Fleet AI、Microsoft、Hugging Face 和 RadixArk,项目迁至 huggingface/OpenEnv。

    推荐理由:OpenEnv 从单一项目转为多方共管的协议层,读者可据此了解开源智能体强化学习环境的标准化路径。

1月20日周二
  1. Hugging Face Blog62

    微软发布 Differential Transformer V2:差分注意力去掉自定义 kernel 与 RMSNorm

    微软 unilm 团队发布 Differential Transformer V2(DIFF V2),在保持 KV 头数量不变的前提下把 query 头数翻倍,使解码速度与标准 Transformer 持平,且不再需要自定义注意力 kernel。

    推荐理由:微软团队给出 DIFF V2 的代码与消融对比,读者可据此理解差分注意力在解码速度与训练稳定性上的取舍。

5月19日周一
6月24日周一
5月21日周二
3月22日周五
3月20日周三
10月4日周三
5月24日周三
11月30日周三
9月16日周五
7月14日周四
5月23日周一
10月26日周二
  1. Hugging Face Blog28

    大语言模型:新的摩尔定律?

    微软和 NVIDIA 发布 Megatron-Turing NLG 530B,号称全球最大最强的生成式语言模型,但训练需数百台 DGX A100 服务器、成本近 1 亿美元。作者质疑这类超大模型趋势:基准提升有限,却带来高昂成本、复杂度和碳足迹,并建议改用预训练模型、更小模型(如 DistilBERT 保留 97% 语言理解、体积小 40%、速度快 60%)和微调。