OpenAI 开源 GABRIEL:用 GPT 将定性文本与图像转为定量数据
OpenAI 推出开源工具包 GABRIEL,借助 GPT 把定性文本和图像转化为定量数据,帮助社会科学家大规模分析研究。该工具包已开源,面向社会科学研究场景。
OpenAI 推出开源工具包 GABRIEL,借助 GPT 把定性文本和图像转化为定量数据,帮助社会科学家大规模分析研究。该工具包已开源,面向社会科学研究场景。
OpenAI 构建了一套实时访问系统,将速率限制、用量追踪与 credits 结合,为 Codex 和 Sora 提供持续访问能力。该系统旨在突破单纯速率限制的局限,支撑这两个产品的规模化访问。
Hugging Face 发布 cuda-kernels Agent 技能,让 Claude Code、Codex 等编码智能体自动编写生产级 CUDA kernel,并完成 PyTorch 绑定与基准测试。
推荐理由:Hugging Face 把 CUDA kernel 开发经验打包成 Agent 技能,并给出两个真实模型的实测数据,可迁移到其他领域知识封装。
Google DeepMind 发布 Gemini 3 Deep Think 重大升级,面向科学、研究与工程难题,已在 Gemini 应用中向 Google AI Ultra 订阅用户开放,并首次通过 Gemini API 向部分研究者、工程师和企业提供早期访问。
推荐理由:官方给出 Deep Think 在 HLE、ARC-AGI-2、Codeforces 等基准上的具体成绩,并首次开放 API 早期访问,可据此判断其科研与工程场景的可用性。
OpenAI 发布 GPT-5.3-Codex-Spark,称其为首个实时编码模型,生成速度提升 15 倍,支持 128k 上下文。该模型目前面向 ChatGPT Pro 用户开放研究预览。
推荐理由:OpenAI 发布首个实时编码模型,给出 15 倍生成速度与 128k 上下文,可据此判断实时编码场景的可用性。
Meta 与 Hugging Face 联合推出开源框架 OpenEnv,用于让智能体连接真实工具与 API 而非模拟环境,采用 Gym 风格 API 和标准 MCP 工具调用接口。
推荐理由:Meta 与 Hugging Face 的 OpenEnv 框架及 Turing 日历环境给出了工具型智能体在权限与多步流程下的实测数据,可据此判断真实环境评测的难点。
OpenAI 技术人员 Ryan Lopopolo 提出 harness engineering,探讨在智能体优先的世界中如何利用 Codex。文章聚焦于围绕 AI 智能体构建工程实践,而非单纯依赖模型本身的能力。
Google Research 发布开源原型框架 DialogLab,用于创作、模拟和测试动态的人机群组对话,已在 ACM UIST 2025 展示。该框架将对话的社会设定与时间流程解耦,支持拖拽式场景搭建、human control 实时干预和对话动态可视化验证。
Google DeepMind 于 2025 年 8 月发布的生物声学基础模型 Perch 2.0 主要用鸟类等陆生动物音频训练,却在未接触任何水下音频的情况下,作为嵌入模型在海洋任务迁移学习中表现优异。
Google DeepMind 发布两篇论文,介绍由 Gemini Deep Think 驱动的数学研究智能体 Aletheia 及跨学科研究案例。
推荐理由:DeepMind 公开了 Gemini Deep Think 在数学与理论计算机科学研究中的两篇论文,读者可了解其智能体工作流与分级评估方式。
OpenAI for Government 宣布在 GenAI.mil 上部署定制版 ChatGPT,为美国国防团队提供安全、注重安全性的 AI 能力。
Hugging Face 发布 Transformers.js v4,已上线 NPM,可通过 npm i @huggingface/transformers 安装。
推荐理由:原文给出 WebGPU 运行时重写、构建提速与包体积变化等具体数据,可据此判断浏览器端本地推理的工程成熟度。
OpenAI 分享了其 AI 本地化思路:全球共享的前沿模型可在不牺牲安全性的前提下适配各地语言、法律与文化。该方案强调在保持模型统一的同时满足本地化需求。
SyGra 2.0.0 发布 Studio,一个把合成数据生成变成可视化流程的交互环境,画布上搭建的流程会自动生成 SyGra 兼容的图配置和任务执行脚本。
OpenAI 与 Ginkgo Bioworks 的云端自动化平台结合,构建了一个由 GPT-5 驱动的自主实验室,通过闭环实验将无细胞蛋白合成成本降低 40%。
OpenAI 推出 Trusted Access for Cyber,一个基于信任的框架,在扩大前沿网络安全能力访问范围的同时加强对滥用的防护。
Google 提出 Natively Adaptive Interfaces(NAI)框架,用多模态 AI 工具打造更具适应性的无障碍应用,以 Orchestrator 协调摘要、设置等子智能体替代静态导航。
OpenAI 发布企业平台 OpenAI Frontier,用于构建、部署和管理 AI 智能体。该平台提供共享上下文、入职引导、权限与治理能力。
推荐理由:OpenAI 官方给出企业级智能体平台的定位与治理能力,可据此判断其与现有 Agent 工具链的分工。
OpenAI 发布 GPT-5.3-Codex,这是一个 Codex 原生智能体,将前沿编码能力与通用推理结合,面向长周期、真实世界的技术工作。
推荐理由:OpenAI 发布 Codex 原生智能体模型,读者可据此了解其在编码与通用推理上的定位。
OpenAI 发布 GPT-5.3-Codex 系统卡,称其为目前能力最强的智能体编码模型。该模型将 GPT-5.2-Codex 的前沿编码性能与 GPT-5.2 的推理及专业知识能力结合在一起。
推荐理由:官方系统卡给出 GPT-5.3-Codex 的能力定位,读者可据此了解它在编码与推理上的组合方式。
Mistral 发布 Voxtral Transcribe 2,包含批量转写的 Voxtral Mini Transcribe V2 和面向实时场景的 Voxtral Realtime,支持说话人分离、上下文偏置和词级时间戳,覆盖 13 种语言。
推荐理由:官方给出两款语音转写模型的延迟、错误率与每分钟价格,可据此判断实时语音场景的选型成本。
Google Research 提出 Sequential Attention,用贪心选择机制逐步、自适应地挑选要加入模型的层、模块或特征,并将选择过程直接整合进单次模型训练,避免传统贪心算法带来的数量级训练开销。该方法在多个神经网络基准上取得 SOTA,实现快速单遍贪心选择,同时提升效率与可解释性,可扩展至大规模特征选择。
OpenAI 介绍 Codex App Server,这是一个双向 JSON-RPC API,用于把 Codex 智能体嵌入到应用中。该接口支持流式进度、工具调用、审批和 diff 等能力。
推荐理由:OpenAI 官方拆解 Codex App Server 的 JSON-RPC 接口设计,可供开发者了解如何把 Codex 智能体嵌入自有应用。
Hugging Face 在 Hub 上线 Community Evals,基准数据集仓库现在可以注册为 benchmark 并自动聚合全站上报的评测结果,在数据集卡片中展示排行榜。
推荐理由:Hugging Face 把评测分数从黑箱榜单搬到 Hub 仓库,读者可据此了解评测结果如何被公开、复现与追溯。
Google 宣布与 Included Health 合作,待 IRB 批准后启动一项全国性前瞻性随机对照研究,在真实虚拟护理工作流中评估对话 AI 的表现。
推荐理由:Google 与 Included Health 合作开展全国性随机对照研究,读者可了解医疗对话 AI 从模拟走向真实临床的评估路径。
H Company 发布迄今最大的 UI 定位模型 Holo2-235B-A22B Preview,在 ScreenSpot-Pro 上以 3 步智能体模式达到 78.5%、OSWorld G 达 79.0%,创下新 SOTA。
Hugging Face 博客第三篇中国开源 AI 系列文章指出,开源已成为中国 AI 机构近期的主流路线。Qwen 在 Hugging Face 上的衍生模型超过 113k,远超 Llama 的 27k 和 DeepSeek 的 6k;腾讯自 2025 年 5 月起以混元品牌加速开源视觉、视频与 3D 模型,百度则通过 Ernie 4.5 系列和 PaddlePaddle 重返开源生态。
Hugging Face 公布 PRX 文本到图像模型训练消融实验,基于 1.2B 参数的 PRX-1.2B 在 Flux VAE 潜空间训练 100k 步,数据集为 MidJourneyV6 生成的 100 万张 256×256 合成图像。
OpenAI 公布 Sora 信息流的设计理念,通过个性化推荐激发创意、促进连接,并以家长控制和强护栏保障体验安全。
Snowflake 与 OpenAI 达成 2 亿美元合作协议,将前沿智能引入企业数据,让 AI 智能体与洞察直接在 Snowflake 中运行。
OpenAI 发布 macOS 版 Codex 应用,定位为 AI 编码与软件开发的指挥中心,支持多个智能体、并行工作流和长时间运行的任务。
推荐理由:OpenAI 官方发布 Codex 桌面应用,读者可了解其多智能体并行与长任务编排的定位。
OpenAI 封禁了一批与代号 No Bell 行动相关的账号,该行动此前未被报道,疑似源自俄罗斯,利用 AI 生成针对美国及其盟友的批评内容,面向非洲受众传播。
OpenAI 封禁了一批很可能源自柬埔寨的账号,这些账号利用 AI 对印尼交友用户实施诈骗,包括翻译和互动。该行动代号“Date Bait”。
OpenAI 封禁了一个与中国执法相关人员关联的账号,该账号利用 AI 策划影响力活动、骚扰和网络行动。该事件被 OpenAI 归入“Cyber Special Operations”类别。
OpenAI 封禁了一批疑似中国来源的账号,这些账号利用 AI 研究美国人员、地点以及社会工程学手法。
OpenAI 宣布封禁一批利用 AI 支撑恋爱诈骗流程的账号,涉及外联、翻译、与受害者互动以及投资诈骗诱饵等环节。
OpenAI 封禁了一批与 Rybar 网络相关、部分可能源自俄罗斯的账号,这些账号利用 AI 在网站和社交平台上开展多语言影响力活动。该行动代号为 "Fish Food"。
OpenAI 封禁了一批很可能源自柬埔寨的账号,这些账号用 AI 冒充追损服务、律所和执法机构,专门针对诈骗受害者行骗。该行动代号 "False Witness"。
OpenAI 封禁了一批与代号“Trolling Stone”行动相关的账号,该行动此前未被公开报道。这些账号利用 AI 生成关于一名据称俄罗斯邪教领袖在阿根廷被捕的评论内容。
Google DeepMind 开始向美国 18 岁以上的 Google AI Ultra 订阅用户开放 Project Genie,这是一个由 Genie 3、Nano Banana Pro 和 Gemini 驱动的实验性研究原型,支持创建、探索和混编交互式世界。
推荐理由:Google DeepMind 把 Genie 3 世界模型做成可交互原型,读者可据此了解世界模型从研究走向订阅制产品的路径。