Import AI 465:开放与闭源模型网络能力差距收窄、Kimi K3 与 Demis 的 AGI 监管方案
英国 AI Security Institute 分析显示,开放权重模型与闭源前沿模型的网络能力差距正在收窄:GLM-5.2 最接近 4.3 个月前发布的 Claude Opus 4.6,DeepSeek-V4-Pro 介于 Claude Opus 4.5 与 GPT-5 之间,而 2025 年大部分时间测得的差距为 6 到 10 个月。
英国 AI Security Institute 分析显示,开放权重模型与闭源前沿模型的网络能力差距正在收窄:GLM-5.2 最接近 4.3 个月前发布的 Claude Opus 4.6,DeepSeek-V4-Pro 介于 Claude Opus 4.5 与 GPT-5 之间,而 2025 年大部分时间测得的差距为 6 到 10 个月。
OpenAI 分享了部署长时程运行 AI 模型的经验,指出这类模型带来新的安全风险与已观察到的失效情况,并通过迭代式部署改进了防护措施。
OpenAI 正通过适龄保护、学习工具、家长控制和专家合作,让 ChatGPT 对青少年更安全。这些措施针对青少年使用 AI 的场景设计,兼顾安全防护与学习用途。
Google DeepMind 与 Isomorphic Labs 公布生物韧性联合方案,一方面防止威胁行为者滥用其模型,一方面让政府和科研机构用 AI 应对疫情。过去 12 个月,双方已推进超 15 项合作,覆盖预防、检测与响应三环节,包括将 SynthID 水印技术适配生物学、用 AlphaEvolve 优化宏基因组测序算法,并向可信研究者开放最新 AI 系统以加速疫苗设计。
Hugging Face 披露本周检测到一起对其部分生产基础设施的入侵,该事件由自主 AI 智能体系统端到端驱动,攻击者通过数据集处理管线中的远程代码加载器和模板注入两条代码执行路径进入处理节点,随后提升至节点级权限、窃取云与集群凭证并在周末横向移动至多个内部集群。
推荐理由:Hugging Face 披露首起由自主 AI 智能体端到端驱动的入侵,并说明防御方为何改用自托管开源模型做取证。
Cars24 借助 OpenAI 的语音与聊天智能体,每月处理超 100 万分钟对话,并挽回 12% 的流失线索。该公司还将智能体工作流推广至全公司各团队,以加快构建速度。
OpenAI 提出"反向联邦制"的 AI 治理思路,主张由各州法律先行,逐步搭建全国性的安全、民主 AI 框架。该方案强调州与联邦协同推进美国 AI 安全。
Deutsche Telekom 正借助 OpenAI 转型为 AI 原生电信运营商,改造客户服务、员工工作流、网络运营以及语音的未来。
OpenAI 公布 GPT-5.5 Bio Bug Bounty 生物漏洞赏金计划详情。该计划面向 GPT-5.5 在生物领域的安全漏洞,具体奖励金额、参与方式与范围尚未在原文中披露。
OpenAI 阐述了其与政府和国家安全机构合作的原则,强调负责任地使用 AI、民主问责与公共安全。该合作框架聚焦于在国家安全场景中确保 AI 的负责任部署。
OpenAI Academy 与 Walton Family Foundation 合作推出动手实践的 AI Skills Jams,帮助 K–12 教育者掌握课堂实用的 AI 技能。
三菱日联金融集团(MUFG)正借助 ChatGPT Enterprise 构建 AI 原生组织,以改进工作流程并大规模提供全新的 AI 驱动金融服务。
Australian Payments Plus 借助 ChatGPT Enterprise 和 Codex 应对支付业务的复杂性,实现提速、提质,同时保留人工判断。
Google DeepMind 与 A24 宣布达成首个此类研究合作,将顶尖研究实验室与电影制作公司配对,帮助艺术家开发新工作流与技术。合作将跨越多个项目,让 A24 及其电影人直接参与塑造新技术,同时为 Google DeepMind 提供艺术家反馈。Google 还对 A24 进行了投资。
伯克利人工智能研究实验室(BAIR)公布 2026 届博士毕业生名单,其研究覆盖机器人、具身智能、大语言模型与推理、计算机视觉、生成建模、AI 安全、人机交互及 AI for Science 等方向。毕业生去向包括 OpenAI、Mistral AI、Physical Intelligence、Amazon 等机构,以及 UCLA、普林斯顿 CITP 和芝加哥大学等学术岗位,部分人仍在探索下一步。
OpenAI Signals 数据显示 ChatGPT 全球采用率持续增长,用户使用频率上升、探索更多能力,并推动各区域和各语言的增长。
OpenAI 发布新报告,梳理 AI 可能如何重塑欧盟各职业,指出哪些岗位面临自动化、增长或工作流程变化。报告以欧盟为范围,对职业层面进行分类,但未披露具体岗位清单或量化预测。
HP Inc. 宣布与 OpenAI 启动 Frontier 战略合作,将 AI 部署到客户体验、软件开发和企业运营中。此次合作在双方既有 OpenAI Frontier 伙伴关系基础上升级扩展。
GPT-5 Pro 帮助免疫学家 Derya Unutmaz 解开了一个困扰三年的免疫学谜题,为 T 细胞行为提供了新见解。这一突破有望支持癌症与自身免疫疾病研究。
OpenAI 正通过 Appia Foundation 参与构建先进 AI 的共享标准,支持评估框架、安全实践与全球合作。
Omio 正借助 OpenAI 构建对话式旅行体验,并加速产品开发、转型为 AI 原生公司。
OpenAI 推出 Daybreak 计划下的 Patch the Planet,帮助开源维护者借助 AI 与专家审核发现、验证并修复漏洞。该计划面向开源维护者,聚焦漏洞的查找、验证与修复环节。
三星电子在全球范围内部署 ChatGPT Enterprise 和 Codex,供员工使用,这是 OpenAI 规模最大的企业 AI 落地项目之一。
Google DeepMind 与英国政府、Google Cloud、Faculty 及 Barnet、Dorset、Camden 地方规划部门合作,开发一款基于 Gemini 的 AI 规划审批原型,目标是帮助审批人员将申请决策时间缩短 50%。
推荐理由:英国政府与 Google DeepMind 合作开发规划审批原型,目标将审批时间减半,可观察 AI 进入公共服务的落地方式。
英国 AI Security Institute 对齐团队与 Timaeus 联合成立非营利机构 Sequent,认为对齐研究"尚未走上正轨",计划两年内扩至 40-80 名全职员工,初期募资 1 亿至 1.5 亿美元,研究方向涵盖可扩展监督、学习理论、博弈论与 personas。
OpenAI 推出 Partner Network,投入 1.5 亿美元帮助全球合作伙伴加速企业级 AI 的采用、部署与转型。
加州大学圣地亚哥分校在 Google 支持下,正用 2000 台退役 Pixel 手机的主板搭建数据中心,为数百名师生提供低成本、低碳的云计算。研究显示 25-50 台手机约等于一台现代服务器,20 台手机组成的集群已能支撑 75 人以上课程的评分负载,且延迟低于 AWS 默认后端。该系统预计 2026 年秋季上线。
OpenAI 宣布计划收购 Ona,用于扩展 Codex 的安全持久云端环境,支持在企业工作流中运行长时间运行的 AI 智能体。
推荐理由:OpenAI 收购 Ona 以扩展 Codex 的云端环境,读者可据此了解其在长时运行智能体方向的布局。
OpenAI 宣布支持欧盟 AI 内容透明度实践准则,推进内容溯源标准与工具,帮助人们识别 AI 生成内容。该准则旨在构建可信的 AI 生态。
BBVA 已将 ChatGPT Enterprise 扩展至 10 万名员工,并与 OpenAI 建立合作,加速全球 AI 驱动的银行业务转型。
OpenAI 发布新报告,披露与 PRC 相关的影响力行动利用 AI 针对美国科技议题,涉及数据中心叙事、关税以及对 ChatGPT 的不实说法。
Google DeepMind 联合 Schmidt Sciences、Cooperative AI Foundation、ARIA 并获 Google.org 支持,发起最高 1000 万美元的多智能体 AI 安全技术研究资助,面向全球研究者开放。
LSEG 借助 OpenAI 在全球业务中规模化可信 AI,加速洞察产出并缩短发布周期,同时赋能 4000 名员工。
Google DeepMind 推出为期三个月的机器人加速器项目,从欧洲选拔 15 家早期机器人初创公司,提供技术指导并开放其 AI 技术栈与 Gemini 机器人模型。入选企业覆盖物流、制造、医疗、气候和导航等领域,本周在伦敦启动。
OpenAI 确认已向 SEC 秘密提交 S-1 草案,但尚未确定后续行动的时间安排。
推荐理由:OpenAI 官方确认已向 SEC 秘密提交 S-1 草案,读者可据此了解其上市进程的当前节点。
OpenAI 发起 Economic Research Exchange,用于研究 AI 对就业、生产力和经济的影响,现已开放选定研究项目的申请。
Endava 正利用 AI 智能体、ChatGPT Enterprise 和 Codex 加速软件交付、自动化工作流,并在全公司构建 AI 原生文化。
OpenAI 公布其 AI 公共政策议程,涵盖安全、青少年保护、劳动力转型和全球标准,以确保 AI 惠及社会。
OpenAI 公布了一份针对美国前沿 AI 治理的蓝图,提议建立覆盖安全、韧性与国家安全的联邦框架。
Travelers 基于 OpenAI 打造了 AI 理赔助手 Claim Assistant,引导客户完成理赔申请,并提供 24/7 支持。该助手已在全国范围部署,用于在理赔高峰期扩展业务处理能力。