跳到正文
6月13日周六
  1. Google Research38

    Google Research 研究 AI 如何帮助用户理解皮肤问题

    Google Research 公布两项关于 AI 辅助皮肤问题理解的研究,其中发表于 JAMA Dermatology 的大规模调查显示,2345 名参与者使用 AI 工具后尝试命名皮肤状况的比例超 62%,准确率 23%,约为对照组 8% 的近三倍。但 AI 组在判断下一步就医建议上未取得统计显著改善,且比对照组更易给出不够紧急的建议。

  2. Google Research38

    Google 支持加州大学圣地亚哥分校用 2000 台退役 Pixel 手机搭建低碳计算平台

    加州大学圣地亚哥分校在 Google 支持下,正用 2000 台退役 Pixel 手机的主板搭建数据中心,为数百名师生提供低成本、低碳的云计算。研究显示 25-50 台手机约等于一台现代服务器,20 台手机组成的集群已能支撑 75 人以上课程的评分负载,且延迟低于 AWS 默认后端。该系统预计 2026 年秋季上线。

6月12日周五
6月11日周四
  1. Google Research29

    Google Research 提出 Regularized f-Divergence Kernel Tests,用于审计机器遗忘

    Google Research 在 AISTATS 2026 提出 Regularized f-Divergence Kernel Tests,用相对距离检验判断遗忘后的模型在分布上更接近安全重训模型还是原始受损模型。该框架基于 f-divergence,支持 Chi-squared、KL 和 Hockey-stick 等散度,可自动选择最优散度与超参数,无需样本划分,并在任意样本量下控制假阳性。

6月10日周三
6月9日周二
  1. Google DeepMind78

    Google DeepMind 发布 Gemma 4 12B:统一无编码器多模态模型

    Google DeepMind 发布 Gemma 4 12B,一款面向笔记本电脑的智能体多模态模型,介于边缘端 E4B 与 26B MoE 之间,是首个支持原生音频输入的中等规模 Gemma 模型。

    推荐理由:Gemma 4 12B 用无编码器架构把视觉与音频直接接入 LLM 主干,读者可据此判断本地多模态智能体的硬件门槛。

  2. Hugging Face Blog62

    一个智能体如何串联两个 Hugging Face Space 搭建 3D 巴黎画廊

    作者让编码智能体通过调用两个 Hugging Face Space 搭建了展示巴黎地标的 3D Gaussian splat 网站,全程未手动使用图像生成或 3D 重建工具。

    推荐理由:作者用一次真实搭建演示了 agents.md 如何让智能体串联两个 Space 完成图像到 3D 的流水线,可迁移到其他多媒体组合场景。

  3. Hugging Face Blog62

    如何把 GitHub CI 迁移到 Hugging Face Jobs

    Hugging Face 官方博客给出把 GitHub Actions 的 CI 任务迁移到 Hugging Face Jobs 的分步教程,只需把 runs-on 从 ubuntu-latest 改成 hf-jobs-cpu-upgrade 或 hf-jobs-t4-small 等标签。

    推荐理由:原文给出把 GitHub Actions 任务改到 Hugging Face Jobs 上运行的完整步骤与实测数据,可据此迁移自家 CI。

6月8日周一
  1. Google DeepMind62

    Google DeepMind 在塞拉利昂开展 AI 学习试验并发布教师培训指南

    Google DeepMind 公布在塞拉利昂开展的预注册试验结果,使用 Guided Learning 的学生数学成绩比对照组提升 0.258 个标准差,约相当于 1.2 至 1.7 年的常规学习进度,八周内完成。

    推荐理由:原文给出塞拉利昂预注册试验的量化结果与教师主导设计,可了解 AI 辅助教学在真实课堂中的效果边界。

  2. Hugging Face Blog66

    OpenEnv 转为委员会共管,成为智能体强化学习的开源协议层

    Hugging Face 宣布 OpenEnv 改由委员会协调,成员包括 Meta-PyTorch、Reflection、Unsloth、Modal、Prime Intellect、Nvidia、Mercor、Fleet AI、Microsoft、Hugging Face 和 RadixArk,项目迁至 huggingface/OpenEnv。

    推荐理由:OpenEnv 从单一项目转为多方共管的协议层,读者可据此了解开源智能体强化学习环境的标准化路径。

6月5日周五
  1. Google Research58

    Google 在 Gemini Enterprise Agent Platform 上线 Agentic RAG

    Google 在 Gemini Enterprise Agent Platform 推出由 Agentic RAG 驱动的跨语料检索公开预览版,通过编排器、规划器、查询改写、搜索扇出和充分上下文智能体协同处理多源多跳查询。相比标准 RAG,该框架在事实性数据集上准确率最高提升 34%;在跨语料设置下从 4 个候选语料中路由查询,90.1% 的问题回答正确,单语料与跨语料版本延迟平均相差约 3%。

  2. Google Research71

    Google 研究用手机前摄实现被动心率监测

    Google Research 在 Nature 发表 PHRM 研究系统,利用手机前摄在面部解锁后拍摄视频,在后台被动估算心率和静息心率。该系统与 ECG 对比的 MAPE 低于 10%,每日 RHR 与 Fitbit Charge 6 对比的 MAE 为 4.39 bpm,并在浅、中、深三种肤色分组中均达到预设的非劣效标准。

    推荐理由:Google 用手机前摄在解锁后被动测心率,论文给出跨肤色误差与可申请的数据和模型资源。

6月4日周四
  1. OpenAI News62

    OpenAI 为 ChatGPT 推出 Dreaming 记忆系统

    OpenAI 为 ChatGPT 引入名为 Dreaming 的新记忆系统,用于更好地记住用户偏好,并在多次对话之间保持上下文的新鲜与相关。

    推荐理由:OpenAI 为 ChatGPT 引入新的记忆系统,读者可了解其在跨对话保持偏好与上下文上的变化。

  2. Hugging Face Blog62

    Hugging Face 将 hf CLI 重构为面向智能体优化的 Hub 命令行工具

    Hugging Face 重构官方命令行工具 hf CLI,使其同时适配人类用户和 Claude Code、Codex、Cursor 等编码智能体,新增 agent 模式输出、下一步命令提示和非阻塞重试机制。

    推荐理由:官方给出 hf CLI 面向智能体重构的细节与基准数据,可据此判断命令行工具该如何适配编码智能体。

  3. Google Research62

    Google 开源洪水预报水文建模框架

    Google Research 在 GitHub 上以 Apache 2.0 协议开源其水文建模框架,供各国气象与水文机构将 AI 洪水预报接入自身工作流。该框架是基于 PyTorch 的 Python 包,采用 LSTM 网络架构,可用开源 Caravan 数据集训练,并支持加入本地数据微调。

    推荐理由:Google 开源其洪水预报水文建模框架,读者可了解模型架构、训练数据与业务化接入方式。

6月3日周三
  1. OpenAI News62

    OpenAI 为 GPT-Rosalind 推出新能力

    OpenAI 为 GPT-Rosalind 推出新能力,面向生命科学研究,增强生物推理、药物化学、基因组分析和实验工作流能力。

    推荐理由:OpenAI 为 GPT-Rosalind 增加生命科学方向能力,读者可据此了解该模型在生物推理与基因组分析上的定位。