跳到正文
5月14日周四
5月13日周三
  1. OpenAI News58

    OpenAI 回应 TanStack npm 供应链攻击

    OpenAI 就 TanStack「Mini Shai-Hulud」供应链攻击发布回应,说明已采取的系统与签名证书保护措施,并解释 macOS 用户为何必须在 2026 年 6 月 12 日前更新 OpenAI 应用。文中还介绍了事件经过、受影响范围以及 OpenAI 如何加强对软件供应链威胁的防御。

5月12日周二
  1. Hugging Face Blog22

    在 AWS 上构建基础模型训练与推理的积木:计算、网络与存储架构解析

    Hugging Face 博客发布技术文章,解析 AWS 基础设施如何与开源软件栈配合支撑基础模型全生命周期。文章梳理了 Amazon EC2 P5(H100/H200)与 P6(B200/B300)实例的算力规格,并指出预训练、后训练与推理正走向融合的基础设施需求:紧耦合加速计算、高带宽低延迟网络与分布式存储。

5月11日周一
  1. Import AI32

    Import AI 456:RSI 与经济增长、AI 监管的“激进可选性”与神经计算机

    Institute for Law & AI 提出“激进可选性”监管思路,主张政府短期避免过度监管,同时提前建设信息收集、举报人保护、评估与人才等能力,以便在强大 AI 冲击世界时能迅速应对。Meta 与 KAIST 的论文提出 Neural Computer,试图用神经网络在学习到的运行时状态中统一计算、内存与 I/O。

  2. OpenAI News22

    OpenAI 谈企业如何规模化落地 AI

    OpenAI 发文阐述企业如何将 AI 从早期实验推进到规模化复利效应,关键在于信任、治理、工作流设计与大规模质量保障。文章聚焦企业从试点走向全面铺开的路径,强调这四方面能力是 AI 产生持续影响的基础。

5月8日周五
5月7日周四
  1. OpenAI News62

    OpenAI 在 API 中推出新的实时语音模型

    OpenAI 在 API 中推出新的实时语音模型,可进行推理、翻译和语音转写,用于构建更自然、更智能的语音体验。

    推荐理由:OpenAI 在 API 中上线新的实时语音模型,读者可据此了解语音接口在推理、翻译与转写上的能力扩展。

5月6日周三
  1. Google DeepMind71

    Google DeepMind 发布 AlphaEvolve 一年落地成果

    Google DeepMind 汇总了 Gemini 驱动的编码智能体 AlphaEvolve 发布一年来的落地成果,覆盖数学、量子物理、基因组、电网与 AI 基础设施等领域。

    推荐理由:官方汇总 AlphaEvolve 一年落地案例,涵盖基因组、电网、TPU 与量子模拟,可据此判断编码智能体的跨领域迁移边界。

  2. Hugging Face Blog34

    Hugging Face 为 Open ASR Leaderboard 引入私有数据集防刷榜

    Hugging Face 与 Appen Inc.、DataoceanAI 合作,为 Open ASR Leaderboard 引入覆盖多口音、朗读与对话场景的高质量英文 ASR 私有数据集,以防止 benchmaxxing 和测试集污染。榜单默认平均 WER 仍只基于公开数据集计算,用户可通过开关选择是否纳入私有数据集查看影响。该榜单自 2023 年 9 月上线以来访问量已超 710K 次。

5月5日周二
  1. OpenAI News74

    OpenAI 发布 GPT-5.5 Instant,更新 ChatGPT 默认模型

    OpenAI 发布 GPT-5.5 Instant,将其作为 ChatGPT 的默认模型,官方称其回答更智能、更准确,并减少了模型幻觉。该版本还改进了个性化控制。

    推荐理由:OpenAI 更新 ChatGPT 默认模型,读者可据此了解回答准确性与个性化控制的变化方向。

5月4日周一
5月2日周六
4月30日周四
  1. Google DeepMind62

    Google DeepMind 发布 AI co-clinician 医疗 AI 研究计划

    Google DeepMind 宣布 AI co-clinician 研究计划,探索 AI 智能体在医生临床监督下协助患者诊疗的“三方照护”模式。在 98 个真实初级保健查询的盲评中,该系统 97 例无关键错误,优于医生常用的两款 AI 系统;在 140 项问诊技能评估中,AI 在 68 项达到或超过初级保健医生水平,但专家医生在识别危险信号和指导关键体格检查上整体仍更强。

    推荐理由:DeepMind 公开医疗 AI 智能体的多模态评测细节,读者可据此了解 AI 在临床问诊中已达标与仍欠缺的具体环节。