跳到正文
5月16日周六
5月14日周四
5月13日周三
  1. OpenAI News58

    OpenAI 回应 TanStack npm 供应链攻击

    OpenAI 就 TanStack「Mini Shai-Hulud」供应链攻击发布回应,说明已采取的系统与签名证书保护措施,并解释 macOS 用户为何必须在 2026 年 6 月 12 日前更新 OpenAI 应用。文中还介绍了事件经过、受影响范围以及 OpenAI 如何加强对软件供应链威胁的防御。

5月8日周五
5月7日周四
5月6日周三
4月29日周三
4月28日周二
4月22日周三
  1. OpenAI News62

    OpenAI 发布 Privacy Filter 开放权重模型

    OpenAI 发布 Privacy Filter,一款用于检测和脱敏文本中个人身份信息(PII)的开放权重模型,官方称其准确率达到 SOTA。目前公开信息仅为摘要,未披露模型规模、许可协议与开放入口。

    推荐理由:OpenAI 开源一款用于检测和脱敏文本 PII 的开放权重模型,可了解其在隐私合规场景的定位。

4月21日周二
  1. Hugging Face Blog40

    AI 与网络安全的未来:为什么开放性至关重要

    Hugging Face 发文讨论 Mythos 与 Project Glasswing 发布后 AI 网络安全格局,指出 Mythos 的关键不在模型本身,而在于其嵌入的系统——大算力、软件数据训练、漏洞探测与修补脚手架及一定自主性共同构成的能力配方。文章认为开放代码与工具可分散检测、验证、协调、补丁传播四个阶段,缩小攻防能力差距,并主张采用半自主 AI 智能体在组织内部署防御。

4月16日周四
4月14日周二
4月10日周五
4月8日周三
4月6日周一
4月3日周五
3月31日周二
3月26日周四
  1. Google DeepMind60

    Google DeepMind 发布首个经实证验证的 AI 有害操纵评测工具

    Google DeepMind 发布关于 AI 有害操纵的研究,称其为首个经实证验证的评测工具,并公开运行同类人类被试研究所需的全部材料。研究覆盖英国、美国、印度共 9 项实验、逾 10000 名参与者,聚焦金融与健康等高风险场景,发现 AI 在健康话题上的有害操纵效果最弱,且在一个领域的成功不能预测另一个领域。

    推荐理由:原文公开了可复用的有害操纵评测工具与万人级实验数据,读者可据此了解AI操纵能力的测量方式与边界。

3月25日周三
  1. OpenAI News60

    OpenAI 推出安全漏洞赏金计划

    OpenAI 推出 Safety Bug Bounty 计划,用于识别 AI 滥用与安全风险,覆盖范围包括智能体漏洞、提示注入和数据外泄。

    推荐理由:OpenAI 把智能体漏洞、提示注入和数据外泄纳入漏洞赏金范围,可观察安全边界如何随智能体落地扩展。

3月24日周二
3月23日周一
3月19日周四
3月17日周二
3月16日周一
3月12日周四
  1. Google Research62

    Google 与 BIDMC 开展 AMIE 对话式诊断 AI 真实临床可行性研究

    Google Research 与 Beth Israel Deaconess Medical Center 合作开展了一项前瞻性单中心可行性研究,让 AMIE 在门诊初级保健就诊前与患者进行文本问诊,全程由医生通过视频监督。

    推荐理由:Google 与 BIDMC 的这项前瞻性研究给出了 AMIE 在真实门诊流程中的安全与诊断数据,可对照其与 PCP 的差异。

3月11日周三
3月10日周二
3月9日周一
3月6日周五
3月5日周四
3月3日周二
2月28日周六
  1. OpenAI News62

    OpenAI 公布与美国国防部合同的细节

    OpenAI 公布其与美国国防部(Department of War)合同的细节,说明其中的安全红线、法律保护以及 AI 系统在涉密环境中的部署方式。材料仅提供摘要,未披露合同金额、期限或具体部署系统。

    推荐理由:OpenAI 官方披露与国防部门合同的边界条款,可了解其安全红线与法律保护如何界定。

2月27日周五
2月25日周三
2月19日周四
2月18日周三
2月13日周五
  1. OpenAI News62

    OpenAI 在 ChatGPT 中推出 Lockdown Mode 与 Elevated Risk 标签

    OpenAI 在 ChatGPT 中推出 Lockdown Mode 和 Elevated Risk 标签,帮助组织防御提示词注入和 AI 驱动的数据外泄。两项功能面向企业安全场景,具体能力与开放范围原文未进一步说明。

    推荐理由:OpenAI 为 ChatGPT 增加 Lockdown Mode 与 Elevated Risk 标签,读者可了解企业防御提示词注入的新手段。

2月6日周五