一个智能体如何串联两个 Hugging Face Space 搭建 3D 巴黎画廊
作者让编码智能体通过调用两个 Hugging Face Space 搭建了展示巴黎地标的 3D Gaussian splat 网站,全程未手动使用图像生成或 3D 重建工具。
推荐理由:作者用一次真实搭建演示了 agents.md 如何让智能体串联两个 Space 完成图像到 3D 的流水线,可迁移到其他多媒体组合场景。
作者让编码智能体通过调用两个 Hugging Face Space 搭建了展示巴黎地标的 3D Gaussian splat 网站,全程未手动使用图像生成或 3D 重建工具。
推荐理由:作者用一次真实搭建演示了 agents.md 如何让智能体串联两个 Space 完成图像到 3D 的流水线,可迁移到其他多媒体组合场景。
Notion 借助 Codex 一次性生成规格说明,并为网页端构建了 AI Voice Input 功能。Codex 还帮助 Notion 在小型团队中放大工程产能。
OpenAI 发布面向 AI 时代的产业政策构想,主张以人为先,聚焦扩大机会、共享繁荣,并在先进智能演进过程中建设有韧性的制度。
Hugging Face 官方博客给出把 GitHub Actions 的 CI 任务迁移到 Hugging Face Jobs 的分步教程,只需把 runs-on 从 ubuntu-latest 改成 hf-jobs-cpu-upgrade 或 hf-jobs-t4-small 等标签。
推荐理由:原文给出把 GitHub Actions 任务改到 Hugging Face Jobs 上运行的完整步骤与实测数据,可据此迁移自家 CI。
OpenAI 确认已向 SEC 秘密提交 S-1 草案,但尚未确定后续行动的时间安排。
推荐理由:OpenAI 官方确认已向 SEC 秘密提交 S-1 草案,读者可据此了解其上市进程的当前节点。
Google DeepMind 公布在塞拉利昂开展的预注册试验结果,使用 Guided Learning 的学生数学成绩比对照组提升 0.258 个标准差,约相当于 1.2 至 1.7 年的常规学习进度,八周内完成。
推荐理由:原文给出塞拉利昂预注册试验的量化结果与教师主导设计,可了解 AI 辅助教学在真实课堂中的效果边界。
OpenAI 公布名为“Built to benefit everyone”的未来 AI 愿景计划,聚焦可及性、安全与共同繁荣,目标是确保 AGI 惠及所有人。
Hugging Face 宣布 OpenEnv 改由委员会协调,成员包括 Meta-PyTorch、Reflection、Unsloth、Modal、Prime Intellect、Nvidia、Mercor、Fleet AI、Microsoft、Hugging Face 和 RadixArk,项目迁至 huggingface/OpenEnv。
推荐理由:OpenEnv 从单一项目转为多方共管的协议层,读者可据此了解开源智能体强化学习环境的标准化路径。
OpenAI 发起 Economic Research Exchange,用于研究 AI 对就业、生产力和经济的影响,现已开放选定研究项目的申请。
Google 在 Gemini Enterprise Agent Platform 推出由 Agentic RAG 驱动的跨语料检索公开预览版,通过编排器、规划器、查询改写、搜索扇出和充分上下文智能体协同处理多源多跳查询。相比标准 RAG,该框架在事实性数据集上准确率最高提升 34%;在跨语料设置下从 4 个候选语料中路由查询,90.1% 的问题回答正确,单语料与跨语料版本延迟平均相差约 3%。
Google Research 在 Nature 发表 PHRM 研究系统,利用手机前摄在面部解锁后拍摄视频,在后台被动估算心率和静息心率。该系统与 ECG 对比的 MAPE 低于 10%,每日 RHR 与 Fitbit Charge 6 对比的 MAE 为 4.39 bpm,并在浅、中、深三种肤色分组中均达到预设的非劣效标准。
推荐理由:Google 用手机前摄在解锁后被动测心率,论文给出跨肤色误差与可申请的数据和模型资源。
NVIDIA 发布 Nemotron 3.5 Content Safety,基于 Gemma 3 4B IT 微调,把多模态输入、多语言覆盖、自定义企业策略和可审计推理统一到一次推理调用中。
推荐理由:NVIDIA 在 4B 小模型上把多模态、多语言、自定义策略与可审计推理合并进单次推理,并公开训练数据集。
Endava 正利用 AI 智能体、ChatGPT Enterprise 和 Codex 加速软件交付、自动化工作流,并在全公司构建 AI 原生文化。
OpenAI 为 ChatGPT 引入名为 Dreaming 的新记忆系统,用于更好地记住用户偏好,并在多次对话之间保持上下文的新鲜与相关。
推荐理由:OpenAI 为 ChatGPT 引入新的记忆系统,读者可了解其在跨对话保持偏好与上下文上的变化。
OpenAI 发布《智能时代的生物防御》行动计划,提出面向 AI 驱动的生物韧性建设方案。该计划聚焦利用 AI 能力应对生物安全威胁,具体措施与细节未在文中展开。
Hugging Face 重构官方命令行工具 hf CLI,使其同时适配人类用户和 Claude Code、Codex、Cursor 等编码智能体,新增 agent 模式输出、下一步命令提示和非阻塞重试机制。
推荐理由:官方给出 hf CLI 面向智能体重构的细节与基准数据,可据此判断命令行工具该如何适配编码智能体。
Google Research 在 GitHub 上以 Apache 2.0 协议开源其水文建模框架,供各国气象与水文机构将 AI 洪水预报接入自身工作流。该框架是基于 PyTorch 的 Python 包,采用 LSTM 网络架构,可用开源 Caravan 数据集训练,并支持加入本地数据微调。
推荐理由:Google 开源其洪水预报水文建模框架,读者可了解模型架构、训练数据与业务化接入方式。
OpenAI 为 GPT-Rosalind 推出新能力,面向生命科学研究,增强生物推理、药物化学、基因组分析和实验工作流能力。
推荐理由:OpenAI 为 GPT-Rosalind 增加生命科学方向能力,读者可据此了解该模型在生物推理与基因组分析上的定位。
DharmaOCR 团队将 DPO 用于结构化 OCR 任务,用模型自身产生的重复循环失败样本构建偏好对,在全部测试的视觉语言模型家族中均降低文本退化,平均降幅 59.4%,最高 87.6%(Nanonets-OCR2-3B 从 1.61% 降至 0.20%)。
Wasmer 借助 Codex 与 GPT-5.5 构建了面向边缘计算的 Node.js 运行时,开发速度提升 10x 至 20x,交付周期从数月缩短到数周。
OpenAI 公布其 AI 公共政策议程,涵盖安全、青少年保护、劳动力转型和全球标准,以确保 AI 惠及社会。
OpenAI 公布了一份针对美国前沿 AI 治理的蓝图,提议建立覆盖安全、韧性与国家安全的联邦框架。
Reachy Mini 对话应用现可通过 MCP 调用托管在公开 Hugging Face Spaces 上的工具,用一条命令 `reachy-mini-conversation-app tool-spaces add` 即可为机器人添加天气查询、网页搜索等能力,工具在 Space 中运行,无需下载代码到本地。
H Company 发布 Holo3.1 计算机使用智能体模型家族,基于 Qwen 系列,覆盖 0.8B、4B、9B 和 35B-A3B 四种尺寸,并首次提供 FP8、Q4 GGUF 和 NVFP4 量化权重。
推荐理由:Holo3.1 给出跨环境与跨框架的鲁棒性提升,并首次提供量化权重,读者可据此判断本地部署计算机使用智能体的可行路径。
Travelers 基于 OpenAI 打造了 AI 理赔助手 Claim Assistant,引导客户完成理赔申请,并提供 24/7 支持。该助手已在全国范围部署,用于在理赔高峰期扩展业务处理能力。
OpenAI 发布 ChatGPT Sites 相关内容,介绍用 Codex 创建轻量网站或应用。原文仅给出这一句说明,未提供更多功能细节。
OpenAI 为 Codex 推出新插件、站点(sites)和标注(annotations)功能,面向分析师、营销人员、设计师、投资者等团队,帮助其用 AI 完成更多工作。原文未披露具体版本号、参数规模或可用性细节。
OpenAI 呼吁就青少年 AI 安全采取全球行动,并提议设立一个国际研究所,以加强针对青少年的防护措施、标准制定与机会拓展。
OpenAI 发布《The Next Era of Knowledge Work》报告,探讨 Codex 如何通过 AI 驱动的研究、数据分析、工作流自动化和内容创作提升生产力。报告称 Codex 正从开发者工具扩展为面向所有人的生产力工具。
OpenAI 公布其在 AI 政策与政治倡导上的立场,强调透明度、支持审慎监管与 AI 安全,并明确任何外部政治团体都无权代表公司发声。
JetBrains 发布 Mellum2,一个从零训练的 12B 参数混合专家(MoE)模型,覆盖自然语言与代码,每个 token 仅激活 2.5B 参数,采用 Apache 2.0 许可。官方称其面向路由、RAG、摘要、子智能体和高吞吐编码等低延迟场景,相比同规模模型推理速度提升超过 2 倍,模型已在 Hugging Face 开放下载,技术报告发布于 arXiv。
推荐理由:JetBrains 开源 12B MoE 模型,每 token 仅激活 2.5B 参数,可据此判断轻量模型在路由与 RAG 场景的部署取舍。
Hugging Face 博客指出,企业 AI 试点大规模失败,症结在于缺少"智能体逻辑"这一引导层。IBM 用知识图谱、程序分析库等软件原语约束 LLM,在 Cobol/PL-1 应用理解中实现约 30× token 消耗降低,Aster 测试生成在 75+ 个 Java 应用上覆盖率提升 20%-45%、token 消耗最多降低 15×。
OpenAI 在密歇根动工建设 1GW 数据中心项目,作为 Stargate 的一部分,用于扩展 AI 基础设施接入、创造就业并支持当地社区。
推荐理由:OpenAI 在密歇根启动 1GW 数据中心,读者可了解 Stargate 基础设施扩张的规模与落地节奏。
OpenAI 前沿模型与 Codex 现已在 AWS 上正式可用,企业可通过已有的 AWS 环境、管控和采购流程接入 OpenAI。客户可在 AWS 上开始使用 OpenAI,从评估到生产部署的推进更快。
推荐理由:OpenAI 前沿模型与 Codex 上线 AWS,企业可在既有云环境与采购流程中直接接入。
OpenAI 封禁了一个疑似源自中国的集群,该集群利用 AI 生成社交媒体内容,批评美国数据中心与 AI 基础设施。相关行动被命名为 Data Center Bandwagon 活动。
OpenAI 封禁了一批疑似来自中国的账号,这些账号利用 AI 生成关于美国科技政策、关税和贸易限制的评论与漫画。该行动针对名为"Tech and Tariffs"的影响力活动,目标是影响美国科技政策讨论。
Braintrust 工程师借助 Codex 与 GPT-5.5 加快实验与编码速度,将客户需求直接转化为代码。
波士顿儿童医院借助 OpenAI 技术改善患者护理、减轻运营负担,并帮助诊断出 40 多例罕见病病例。
OpenAI 推出 Rosalind Biodefense,向经过审核的开发者及美国政府合作伙伴扩大开放 GPT-Rosalind 的受信任访问权限。该项目旨在利用前沿 AI 推进生物防御、公共卫生与流行病防范工作。
Hugging Face 发布 PyTorch 性能分析系列第一篇,介绍如何用 torch.profiler 分析矩阵乘法加偏置的算子。文章基于 PyTorch 2.13 与 NVIDIA A100-SXM4-80GB,讲解 profiler 表格与 trace 的读法,并演示 torch.compile 带来的变化。