OpenAI 投资 Merge Labs,支持连接生物与人工智能的脑机接口
OpenAI 投资 Merge Labs,支持连接生物智能与人工智能的新型脑机接口,目标是最大化人类能力、自主性与体验。
OpenAI 投资 Merge Labs,支持连接生物智能与人工智能的新型脑机接口,目标是最大化人类能力、自主性与体验。
OpenAI 发起一项新的 RFP,旨在通过加速美国本土制造、创造就业并扩展 AI 基础设施来强化美国 AI 供应链。
OpenAI 发起、开源社区构建、Hugging Face 生态支持的 Open Responses 开放推理标准发布,基于 Responses API 设计,面向智能体场景。该标准默认无状态,支持加密推理,将流式输出建模为语义事件序列,并原生支持内部与外部工具及子智能体循环。开发者可通过 Hugging Face Inference Providers 和 Spaces 上的早期访问版本试用。
推荐理由:OpenAI 发起、Hugging Face 生态支持的开放推理标准,读者可了解它如何替代 Chat Completion 格式并支持智能体循环。
OpenAI 宣布与 Cerebras 合作,新增 750MW 高速 AI 算力,用于降低推理延迟。该算力将让 ChatGPT 在实时 AI 工作负载下响应更快。
推荐理由:OpenAI 与 Cerebras 达成算力合作,读者可了解其新增算力规模与对推理延迟的直接影响。
Google Research 利用 Android Auto 采集的急刹车事件(HBE,减速度超过 -3m/s²)与弗吉尼亚州、加州十年公开碰撞数据,通过负二项回归验证了 HBE 频率与路段碰撞率之间存在统计显著的正相关。
Google 通过 HAI-DEF 项目发布 MedGemma 1.5 4B,新增对 CT、MRI 和全切片病理等高维医学影像的支持,并保留 2D 图像与文本能力。
推荐理由:官方给出 MedGemma 1.5 与 MedASR 的基准对比和开源入口,可据此判断医疗多模态模型的可用边界。
Google DeepMind 更新 Veo 3.1 Ingredients to Video,让基于参考图生成的视频在短提示词下更富表现力,并提升角色身份、背景与物体的一致性。
推荐理由:官方说明了 Ingredients to Video 在角色一致性与竖屏输出上的具体变化,可据此判断移动端短视频工作流是否值得迁移。
Zenken 在全公司范围部署 ChatGPT Enterprise,提升了销售业绩、缩短了准备时间并提高了提案成功率。AI 支持的工作流帮助这支精简团队实现更个性化、更有效的客户互动。
Google Research 在 Science Advances 发表论文,介绍混合模型 NeuralGCM 直接以 2001 至 2018 年 NASA 卫星降水观测训练其机器学习部分,而非依赖再分析数据。
推荐理由:原文给出 NeuralGCM 在降水模拟上的误差下降与极端降水改进,可对照传统参数化方案的局限。
伯克利 AI 研究团队提出一种基于互信息的成像系统评估与优化框架,可直接从带噪测量中估计信息量,无需重建算法或任务专用解码器。该方法在彩色摄影、射电天文、无透镜成像和显微镜四个领域验证,信息估计能预测下游解码性能,优化后的设计达到 SOTA 端到端方法水平,且内存和算力需求更低。相关论文发表于 NeurIPS 2025。
OpenAI 与软银集团宣布与 SB Energy 合作,开发多吉瓦级 AI 数据中心园区,其中包括一座位于得克萨斯州、容量 1.2 GW 的设施,用于支持 Stargate 计划。
推荐理由:OpenAI 与软银、SB Energy 合作建设多吉瓦级 AI 数据中心,可了解 Stargate 计划的算力落地方式。
Datadog 采用 OpenAI 的 Codex 进行系统级代码审查。该实践将 Codex 用于跨系统的代码审查环节,而非仅限单点代码生成。
OpenAI 推出 OpenAI for Healthcare,提供安全的企业级 AI 并支持 HIPAA 合规。该产品旨在减轻行政负担并支持临床工作流程。
Netomi 借助 GPT-4.1 和 GPT-5.2 扩展企业级 AI 智能体,通过并发、治理与多步推理支撑可靠的生产工作流。该方案面向企业规模化部署,强调智能体系统在生产环境中的稳定性。
Tolan 基于 GPT-5.1 打造了一款语音优先的 AI 伴侣,结合低延迟响应、实时上下文重建和记忆驱动的人格,实现自然对话。
OpenAI 发布 ChatGPT Health,这是一个独立体验,可安全连接用户的健康数据与应用。官方称其具备隐私保护,并采用由医生参与设计的方案。
推荐理由:OpenAI 官方给出 ChatGPT Health 的定位与隐私设计,读者可据此了解健康数据接入这一新方向。
NVIDIA 发布 Cosmos Reason 2,一款面向物理 AI 的开源推理视觉语言模型,在 Physical AI Bench 和 Physical Reasoning 榜单上位列开源模型第一。
推荐理由:NVIDIA 开源视觉语言推理模型 Cosmos Reason 2 的发布细节,含 256K 上下文与 2B/8B 规格,可对照上一代判断物理 AI 推理能力进展。
Falcon-H1-Arabic 阿拉伯语模型家族发布,包含 3B、7B、34B 三个参数规模,采用 Mamba 与 Transformer 注意力并行的 Falcon-H1 混合架构。
Hugging Face 博客发布教程,介绍如何用 NVIDIA DGX Spark 配合 Reachy Mini 复现 CES 2026 主题演讲中的桌面智能体,代码已开源。
OpenAI Grove 第二期已开放申请,这是一个为期 5 周的创始人项目,面向从仅有想法到已有产品的任何阶段参与者。入选者可获得 5 万美元 API 额度、AI 工具早期访问权限以及 OpenAI 团队的实操指导。
Google 发布 2025 年度研究回顾,梳理了 8 大突破领域。模型方面,Gemini 2.5 于 3 月发布,Gemini 3 于 11 月推出,Gemini 3 Flash 于 12 月上线,其中 Gemini 3 Pro 登顶 LMArena 排行榜,并在 MathArena Apex 上取得 23.4% 的 SOTA 成绩。
Hugging Face 发布 8B 参数安全防护模型 AprielGuard,可检测 16 类安全风险及提示注入、越狱、思维链污染、记忆投毒、多智能体攻击等对抗攻击,并覆盖工具调用与推理轨迹等智能体工作流。模型提供推理与非推理两种模式,兼顾可解释分类与低延迟生产部署。
OpenAI 宣布全球使用其产品的客户已超过 100 万家。文章展示了 PayPal、Virgin Atlantic、BBVA、Cisco、Moderna 和 Canva 等公司如何借助 OpenAI 改变工作方式。
OpenAI 正在用强化学习训练的自动化红队加固 ChatGPT Atlas,抵御提示词注入攻击。这一发现与修补的循环有助于尽早识别新型攻击手法,并在 AI 智能体能力增强的同时强化浏览器智能体的防御。
Google Research 发布 2025 年度回顾,Gemini 3 成为其事实性最强的 LLM,在 SimpleQA Verified 和 FACTS 基准上达到 SOTA,并在 Gemini 3 中引入生成式 UI。Gemma 扩展至 140 多种语言,成为当前最佳多语言开源模型;量子方面,Willow 芯片上的 Quantum Echoes 算法比最强经典算法快 13000 倍。
OpenAI 推出针对思维链可监控性的新框架与评估套件,覆盖 24 种环境下的 13 项评估。结果显示,监控模型内部推理远比仅监控输出更有效,为 AI 系统能力提升后的可扩展控制提供了可行路径。
OpenAI 发布面向青少年与家长的 AI 素养资源,帮助其审慎、安全地使用 ChatGPT。指南包含经专家审核的建议,涵盖负责任使用、批判性思维、健康边界,以及如何支持青少年应对情绪或敏感话题。
OpenAI 与美国能源部签署谅解备忘录,深化在 AI 与先进计算领域的合作以支持科学发现。该协议基于双方与美国国家实验室的现有工作,为在能源部生态系统中将 AI 应用于高影响力研究建立框架。
OpenAI 更新 Model Spec,新增 Under-18 Principles,规定 ChatGPT 应基于发展科学为青少年提供安全、适龄的引导。此次更新强化了防护栏,明确了模型在更高风险情境下的预期行为,并延续其在 ChatGPT 青少年安全方面的整体工作。
OpenAI 发布 GPT-5.2-Codex,称其为自家最先进的编码模型。该模型主打长程推理、大规模代码转换以及增强的网络安全能力。
推荐理由:OpenAI 官方发布新一代编码模型,读者可据此了解其在长程推理与大规模代码改写上的定位。
OpenAI 发布 GPT-5.2 系统卡增补文件,涉及 GPT-5.2-Codex。该页面正文未能抓取,目前仅可确认标题与发布来源。
Hugging Face 发布 Transformers v5,将 tokenizer 架构与训练词表分离,类似 PyTorch 分离网络结构与权重,使 tokenizer 可检查、可定制、可从零训练。v5 提供清晰的类层级和单一快速后端,支持 BPE、Unigram、WordPiece 等算法,并可通过 AutoTokenizer 自动选择正确的 tokenizer 类。
Mistral 发布文档解析模型 Mistral OCR 3,在表单、扫描件、复杂表格和手写内容上相对 Mistral OCR 2 的整体胜率为 74%,官方称其准确率超过企业级文档处理方案和 AI 原生 OCR 方案。
推荐理由:官方给出 OCR 3 相对上一代在表单、手写和复杂表格上的胜率与定价,可据此判断文档解析成本与适用场景。
NVIDIA 发布 Nemotron 3 Nano 30B A3B,并公开其完整评测配方,基于开源库 NeMo Evaluator 构建,任何人可复跑评测流程并独立核验结果。
Google DeepMind 发布 Gemini 3 Flash,定位为兼顾前沿智能与速度、成本更低的模型,已在 Gemini API、Google AI Studio、Gemini CLI、Google Antigravity、Vertex AI 和 Gemini Enterprise 上线,并开始向 Gemini 应用和搜索 AI Mode 全量推送。
推荐理由:官方给出 Gemini 3 Flash 的基准分数、定价与上线渠道,可据此判断速度与成本权衡是否适合自身工作流。
OpenAI 推出面向新闻机构的 OpenAI Academy,该学习中心与美国新闻项目及 The Lenfest Institute 合作搭建,旨在帮助新闻编辑室有效使用 AI。Academy 提供培训、实用案例与负责任使用指南,支持记者、编辑和出版方在报道与运营中采用 AI。
OpenAI 宣布开发者可以向 ChatGPT 提交应用,经审核通过后会在产品内新设的应用目录中展示,便于用户发现。官方同时更新了工具、指南和 Apps SDK,用于构建把真实操作带入 ChatGPT 的对话原生体验。
推荐理由:OpenAI 开放 ChatGPT 应用提交与审核入口,开发者可据此判断接入路径和分发方式的变化。
OpenAI 发布企业 AI 应用现状报告,基于数据展示各组织如何从试验阶段走向实际生产力提升与新能力构建。
Google DeepMind 发布 Gemma Scope 2,一套面向 Gemma 3 全系列(270M 至 27B 参数)的开源可解释性工具。该套件结合稀疏自编码器(SAEs)与 transcoders,覆盖模型每一层,并新增 skip-transcoders、跨层 transcoders 及针对聊天版本的越狱、拒答和思维链忠实度分析工具。
推荐理由:Gemma Scope 2 覆盖 Gemma 3 全系列并公开工具与演示,读者可了解可解释性工具在模型安全审计上的最新进展。
OpenAI 推出 FrontierScience 基准,用于测试 AI 在物理、化学和生物学领域的推理能力,衡量其向真实科学研究迈进的程度。