OpenAI 的 Jakub Pachocki 谈"异类心智":AI 能力越强,对齐越难
OpenAI 的 Jakub Pachocki 反思日益强大的 AI 及其对齐难题,称其如同"异类心智",呼吁加强安全防护并推动国际协调。
OpenAI 的 Jakub Pachocki 反思日益强大的 AI 及其对齐难题,称其如同"异类心智",呼吁加强安全防护并推动国际协调。
OpenAI 披露内部数据,展示编程智能体正在重塑其 AI 研究流程,涉及智能体使用情况、实验速度、任务复杂度与研究加速等方面。
GitHub 发布研究预览版 Project HydraFusion,通过运行时编排在多个提供商的模型间选择,自动完成起草、评审、修订或升级到更强模型。它目前提供 Single、Cascade、Critique 三种执行模式,已在所有 GitHub Copilot 套餐中通过 Copilot CLI 的 /experimental 开放,按各模型标准费率计费。
推荐理由:GitHub 官方披露 HydraFusion 的三种编排模式与三套基准的成本质量对比,可据此判断多模型编排在编码任务上的取舍。
Google Research 用 UK Biobank 欧洲人群与 Biobank Japan 近 20 万日本人群数据,在 8 项临床指标上评估多基因风险评分(PRS)的跨人群迁移效果。结果显示,目标人群样本达 15k 以上时,专用模型优于混合欧洲数据训练;而遗传相关性高的性状可继续受益于欧洲数据直至 25-40k+ 样本。
Google 与 HHMI Janelia 及剑桥等合作者发布雄性果蝇脑与中枢神经系统的完整连接组图谱,成果发表于 Cell,包含超过 166,000 个神经元和 1.25 亿个突触连接,是迄今神经元数量最多的脑图谱。
推荐理由:Google 与 HHMI Janelia 等合作发布迄今神经元数量最多的脑图谱,读者可了解 AI 在连接组学中的具体用法。
Google DeepMind 与 Google Research 发布 WeatherNext 3,称其为目前最先进、最准确的全球天气模型,直接学习实时卫星观测数据,每小时生成一次预报,地表变量分辨率达 5 公里,整体比上一代 WeatherNext 2 清晰约 5 倍。
推荐理由:官方给出与上一代的分辨率、更新频率和降水精度对比,可据此判断AI天气预报在谷歌产品中的落地程度。
OpenAI 推出 Daybreak for Frontline Defenders,以 10 亿美元投入为关键服务扩大前沿网络 AI 的使用权限、培训与支持。
H Company 发布 NeoMME,一个 260M 和 800M 的多语言多模态编码器家族,用单个双向 Transformer 同时处理文本 token 和 32×32 图像 patch,从零以掩码离散扩散目标预训练,不依赖预训练视觉塔或因果语言模型。
Playco 借助 GPT-6 Astra,从一个灰盒基础版本构建了三款主题游戏原型,人工修复量比使用上一代模型减少 50%。
Legora 借助 GPT-6 Astra 在数分钟内审阅 41 份文档,找出全部 4 处预设错误,并在该财务审阅工作流中把表现提升近 40%。
OpenAI 发布新一代模型 GPT-6 Astra,官方称其为目前最智能且对齐程度最高的模型。该模型在计算机操作、编码、网络安全和科学等方向具备 SOTA 能力。
推荐理由:OpenAI 官方发布新一代模型,读者可据此了解其在计算机操作、编码与安全等方向的能力定位。
Hugging Face 博主用 TRL 和 OpenEnv 复现了 Surya Narreddi 让语言模型用 p5.brush 写 JavaScript 画水彩画的创意,参考图池、RL 环境、训练脚本和模型全部开源。
OpenAI 发布 GPT-6 Astra 安全概览,称其是已广泛部署的最强模型,也是首个在 Preparedness Framework 下达到网络安全能力 Critical 级别的模型。
推荐理由:OpenAI 官方给出 GPT-6 Astra 的安全能力定级,读者可据此了解该模型在网络安全维度上的定位。
Hugging Face 发布 funes,一个面向编码智能体的持久记忆层,支持 Claude Code、Codex、pi 和 Hermes,通过一条 add 命令把本机已有会话索引为可召回的记忆。
推荐理由:Hugging Face 官方发布的本地记忆层,给出安装命令与跨智能体召回机制,可据此判断多机多智能体协作的落地方式。
一份公开的低成本方案用 TRL 的 GRPO 对 LFM2.5-350M 做微调,仅约 500 条样本、100 个训练步,在 IFStruct 基准上把通过率从 22.6% 提升到 29.7%。微调可在免费版 Colab 或 Kaggle GPU 上完成,评测则通过 llama.cpp 在本地 MacBook 上运行,代码已开源在 GitHub。
Google 推出 Fairwind Program,面向 Google Cloud 客户、政府机构和网络安全合作伙伴限量开放其最先进的网络防御能力,首批提供 Gemini 3.8 Flash Cyber 模型与 CodeMender harness 组合,用于自主发现、验证并修复漏洞。
推荐理由:原文给出受限访问计划的能力组合与准入条件,读者可据此判断前沿网络防御能力的开放节奏。
Google DeepMind 发布 Gemini 3.8 Flash 与 Gemini 3.8 Flash Cyber,前者面向长时程编码与自主智能体,后者面向漏洞发现与自动修补。
推荐理由:官方给出两款 Flash 变体的基准、定价与开放渠道,可据此判断长时程编码与安全场景的选型取舍。
ATV Big Air Tour 使用 ChatGPT Work 加速营销与周边商品业务,将原本 3 天的工作量缩短到 3 小时。该团队还用它在 15 分钟内把商品照片做成了一个库存网站。
Hugging Face 发布 BenchMIRT,一种在单条提示词层面审计 LLM 基准测试的多维 IRT 方法,可分离同一基准中混杂的不同能力信号。该方法基于 100 个 LLM 在 16 个基准、超 34K 道题上的结果训练,在未被告知基准对应能力的情况下自动恢复出安全与通用推理两个主导维度。分析显示 BBQ、WMDP 等安全基准的得分与通用推理关联更强,单一基准分数可能混合多种信号。
Google Research 提出 MAPL-EMIT,一个基于 Swin-S 视觉 Transformer 的深度学习框架,可从 NASA EMIT 高光谱卫星数据中自动检测、预测增强并定位甲烷羽流,在专家标注羽流上召回率达 84%。团队用 360 万个合成甲烷羽流训练模型,并在地球引擎上开放全球羽流数据库,同时在 Kaggle 发布训练模型与合成数据、在 GitHub 发布推理库。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出智能体视频理解功能,视频分析 token 消耗最多降低 88%、成本最多降低 66%、准确率最多提升 7%。
推荐理由:官方给出 token 与成本降幅及准确率变化,并说明 API 开启方式,便于开发者评估长视频分析方案。
Basis、Clay 和 Exa Labs 正用 AI 智能体改进用户引导、客户账户管理和开发者集成。OpenAI 梳理了这三家 AI 原生公司的做法,供企业领导者参考借鉴。
OpenAI 表示 Astra 是其首个在 Preparedness Framework 下达到关键网络安全能力阈值的模型,发布时将配备更强的安全防护措施。该内容来自 OpenAI 官方博客 Path to Astra 一文,目前仅有摘要信息。
推荐理由:OpenAI 首次披露 Astra 触及 Preparedness Framework 的关键网络安全能力阈值,读者可据此了解前沿模型发布前的安全门槛。
OpenAI 宣布医疗机构现在可以把 EHR 及其他行业数据接入 ChatGPT,帮助临床医生安全获取患者上下文、医学研究等信息。原文未披露具体接入方式、支持机构范围或上线时间。
澳大利亚律所 Gilbert + Tobin 结合 CEO 主导的投入、严格治理与人工问责机制,在全所范围规模化部署 ChatGPT Enterprise 和 Codex。
Hugging Face 发布 @huggingface/kernels,一个从 Hub 加载并运行优化 WebGPU 内核的 JavaScript 库,同时上线 207 个内核的初始集合,均以独立仓库发布并采用 Apache-2.0 许可。
推荐理由:Hugging Face 把浏览器端 GPU 算子做成可版本化、可测试的独立仓库,并给出与 ORT WebGPU 的实测对比,便于判断浏览器推理的底层现状。
Google Research 发布 TimesFM-3,这是其首个原生支持多变量预测的时间序列基础模型,参数 330M,在超过 1 万亿时间点的真实与合成时间序列语料上预训练。
推荐理由:原文给出 330M 参数、1 万亿时间点预训练与三项基准排名,可据此判断多变量零样本预测的当前水位。
微软研究院推出 GigaPath-Flash 与 GigaTIME-Flash,以蒸馏自十亿参数 GigaPath 编码器的 22M 参数 ViT-S 骨干替代原模型,在 PANDA 前列腺分级和 EBRAINS 脑肿瘤分型基准上以约 50 倍更少算力达到原 GigaPath 3% 以内的性能。
OpenAI 表态支持加州 SB 1119 法案,该法案旨在为青少年提供强有力的、适龄的 AI 安全保障,同时保留其学习、创作和探索的机会。
Polimill 正利用 OpenAI 的 GPT 模型与 Codex 构建日本下一代公共 AI 基础设施,帮助地方政府检索和使用行政知识,同时加快开发进度。
OpenAI 宣布 ChatGPT Ads 年化收入运行率达到 10 亿美元,并将在全球范围扩张。该广告业务用于支撑免费和低价选项,以扩大 AI 的可及范围。
推荐理由:ChatGPT Ads 年化收入达 10 亿美元并启动全球扩张,可观察免费与低价 AI 访问的商业化路径。
OpenAI 宣布,在 Cursor 被 SpaceX 收购后,将逐步终止向 Cursor 提供 OpenAI 模型的合同。该决定由 OpenAI 官方发布,正文未披露终止时间表或具体条款。
推荐理由:OpenAI 官方说明在 Cursor 被 SpaceX 收购后终止模型供应合同,可了解这一商业动作的官方口径。
OpenAI 与泰国高等教育科研创新部(MHESI)联合启动一项为期八周的加速器项目,帮助 10 家健康、康养和教育领域的初创企业将 AI 原型转化为可信产品。
Voice Arena 与 Hugging Face 合作在 Open ASR Leaderboard 上新增 Monsoon en-IN 与 Monsoon hi-IN 两个评测集,印地语成为该榜单多语言标签页上的首个印度语言。
推荐理由:Open ASR Leaderboard 首次纳入印地语与印度英语评测集,读者可了解多语言语音评测如何按说话人属性拆解误差。
Google Research 在 Google Earth AI 下推出实验性研究能力行星预测引擎(PPE),可依据自然语言查询自主完成地理空间数据发现、特征工程、模型训练与评估,将建模周期从数周缩短至数分钟。
推荐理由:原文给出 PPE 在公共卫生、粮食安全与疫情预测上的量化提升,可据此判断自主地理空间建模的可行边界。
Google DeepMind 发布 Gemini Omni 1.1 Flash,通过 Gemini API 在 Google AI Studio 提供面向开发者的生成视频能力。
推荐理由:官方给出场景延展、首尾帧插值与 4K 放大等具体能力与 API 入口,可据此判断生成视频工作流的可控性变化。
Google DeepMind 宣布推出全球首个针对专有前沿模型的双盲评测,将外部评测限制在密码学隔离环境中,避免模型提前接触测试题而污染基准。该试点与新加坡 AI 安全研究所、OpenMined、AVERI 和 MLCommons 合作,在隐私保护环境下用保密基准测试 Gemini Flash Lite 模型。
OpenAI 对 1000 多名学生开展随机研究,考察 ChatGPT 与批判性思维训练在真实大学作业中对学生表现、原创性和批判性思维的影响。
OpenAI 正在扩大在巴西的业务布局,深化与当地开发者、企业和社区的合作,以推动 AI 在巴西的普及应用。
Google 发布自监督基础模型 GlucoFM,采用双流设计分离缓慢血糖趋势与短期波动,并保留时间与缺失信息。在四个队列、七项临床任务共 14 组评估中,其 PR-AUC 平均比最佳 GluFormer 变体高 5.8 个百分点,糖尿病风险与 β 细胞功能障碍评估全部领先。