Uber 用 OpenAI 驱动 AI 助手与语音功能,帮司机赚得更聪明、乘客叫车更快
Uber 正用 OpenAI 驱动其 AI 助手与语音功能,帮助司机更聪明地赚钱、乘客更快叫车,服务覆盖全球实时交易市场。
Uber 正用 OpenAI 驱动其 AI 助手与语音功能,帮助司机更聪明地赚钱、乘客更快叫车,服务覆盖全球实时交易市场。
Hugging Face 与 Appen Inc.、DataoceanAI 合作,为 Open ASR Leaderboard 引入覆盖多口音、朗读与对话场景的高质量英文 ASR 私有数据集,以防止 benchmaxxing 和测试集污染。榜单默认平均 WER 仍只基于公开数据集计算,用户可通过开关选择是否纳入私有数据集查看影响。该榜单自 2023 年 9 月上线以来访问量已超 710K 次。
OpenAI 公布 ChatGPT Futures 2026 届名单,26 位学生创新者入选,他们用 AI 进行构建、研究并推动现实世界影响。该届成员正在重新定义学习、创造力与机会。
OpenAI 的 B2B Signals 研究显示,前沿企业正通过深化 AI 采用、规模化 Codex 驱动的智能体工作流来构建持久的竞争优势。
Singular Bank 基于 ChatGPT 和 Codex 构建了内部助手 Singularity,帮助银行家在会议准备、投资组合分析和后续跟进上每天节省 60–90 分钟。
OpenAI 发布 GPT-5.5 Instant,将其作为 ChatGPT 的默认模型,官方称其回答更智能、更准确,并减少了模型幻觉。该版本还改进了个性化控制。
推荐理由:OpenAI 更新 ChatGPT 默认模型,读者可据此了解回答准确性与个性化控制的变化方向。
OpenAI 推出 MRC(Multipath Reliable Connection)超级计算机网络协议,并通过 OCP 开放发布,用于提升大规模 AI 训练集群的韧性与性能。
OpenAI 发布欧洲青年安全蓝图(European Youth Safety Blueprint)与 EMEA 青年福祉资助计划(EMEA Youth & Wellbeing Grants),面向青少年、家庭和教育工作者推进安全、负责任的 AI 使用。
OpenAI 扩展 ChatGPT 广告业务,推出测试版自助 Ads Manager、CPC 竞价和增强的衡量工具。官方称这些设计用于保护隐私,并将对话与广告保持分离。
OpenAI 与 PwC 达成合作,帮助企业用 AI 智能体自动化财务工作流、改进预测、强化管控并推动 CFO 职能现代化。
OpenAI 重建了其 WebRTC 技术栈,以支撑实时语音 AI 的低延迟、全球规模与流畅的对话轮转。
Google Research 公布其开放科学成果:十余年开源工具与数据集已服务全球超 25 万名研究人员和开发者。
Google DeepMind 宣布 AI co-clinician 研究计划,探索 AI 智能体在医生临床监督下协助患者诊疗的“三方照护”模式。在 98 个真实初级保健查询的盲评中,该系统 97 例无关键错误,优于医生常用的两款 AI 系统;在 140 项问诊技能评估中,AI 在 68 项达到或超过初级保健医生水平,但专家医生在识别危险信号和指导关键体格检查上整体仍更强。
推荐理由:DeepMind 公开医疗 AI 智能体的多模态评测细节,读者可据此了解 AI 在临床问诊中已达标与仍欠缺的具体环节。
OpenAI 推出 Advanced Account Security,提供抗钓鱼登录、更强的账户恢复能力以及增强保护,用于保护敏感数据并防止账户被接管。该功能面向账户安全场景,具体可用范围与上线时间未在原文中说明。
Google Research 汇总了科学家使用 Empirical Research Assistance(ERA)的四类实践:公共卫生领域,团队每周向 CDC 的流感。
推荐理由:Google 官方汇总 ERA 在流行病预测、宇宙学、碳监测与神经科学四类真实科研任务中的使用结果,可了解 AI 辅助科研的落地边界。
OpenAI 梳理了 GPT-5 中"哥布林"式输出的扩散时间线、根因与修复方案,将其归因于人格驱动的行为怪癖。
IBM Granite 团队发布技术文章,详解 Granite 4.1 系列(3B、8B、30B 稠密 decoder-only 模型)的构建流程:约 15T token 五阶段预训练、上下文扩展至 512K、约 4.1M 高质量样本的 SFT,以及基于 on-policy GRPO 与 DAPO loss 的多阶段强化学习。
推荐理由:Granite 团队公开了从数据配比到多阶段 RL 的完整训练细节,可对照其 8B 稠密模型追平 32B MoE 的取舍。
OpenAI 宣布扩展 Stargate,建设支撑 AGI 的算力基础设施,并新增数据中心容量以应对不断增长的 AI 需求。
OpenAI 提出一项五部分行动计划,旨在加强智能时代的网络安全,重点是普及 AI 驱动的网络防御并保护关键系统。
DeepInfra 成为 Hugging Face Hub 支持的 Inference Provider,首批上线对话与文本生成任务,可访问 DeepSeek V4、Kimi-K2.6、GLM-5.1 等开放权重 LLM。
NVIDIA 发布 Nemotron 3 Nano Omni,一款面向文档分析、多图推理、语音识别、长音视频理解和 GUI 智能体操作的全模态理解模型,在 MMlongbench-Doc、OCRBenchV2、WorldSense、DailyOmni、VoiceBench 等基准上取得领先成绩。
推荐理由:原文给出架构、训练配方与多模态基准对比,读者可据此判断开源全模态模型在文档、音视频与 GUI 智能体上的能力边界。
OpenAI 的 GPT 模型、Codex 和 Managed Agents 现已在 AWS 上可用,企业可在自己的 AWS 环境中构建安全的 AI 应用。
推荐理由:OpenAI 把 GPT 模型、Codex 与 Managed Agents 接入 AWS,读者可据此判断企业现有云环境能否直接落地。
OpenAI 发文说明其在 ChatGPT 中保障社区安全的方式,涵盖模型防护、滥用检测、政策执行以及与安全专家的合作。
OpenAI 宣布 ChatGPT Enterprise 和 OpenAI API 已获得 FedRAMP Moderate 授权,可供美国联邦机构安全采用 AI。该授权使联邦政府客户能够在合规框架下使用 OpenAI 的企业级产品与 API 服务。
Mistral AI 发布 Workflows 公开预览,定位为企业 AI 的编排层,提供持久化执行、可观测性和容错能力,用于把 AI 流程从概念验证推进到生产。
推荐理由:原文给出企业级 AI 编排层的持久化执行、可观测与人工审批能力,以及控制面与数据面分离的部署方式,可供评估生产落地路径。
Google DeepMind 宣布与韩国科学技术信息通信部(MSIT)建立合作,将在首尔办公室设立 AI Campus,向韩国学界开放 AlphaEvolve、AlphaGenome、AlphaFold、AI co-scientist 和 WeatherNext 等前沿模型。
OpenAI 与 Microsoft 宣布达成修订后的合作协议,简化双方合作关系并增加长期确定性,以支持持续的大规模 AI 创新。
推荐理由:OpenAI 与 Microsoft 修订合作协议,读者可据此了解双方长期合作框架的调整方向。
Choco 利用 OpenAI API 构建 AI 智能体,实现食品分销流程自动化,以提升生产力并推动业务增长。这是 OpenAI 发布的一则客户案例,聚焦 AI 在真实场景中的落地成效。
Hugging Face 博客介绍了基于 OpenAI 本周在 Hub 上开源的 Privacy Filter 构建三个 Web 应用的实践。Privacy Filter 是 1.5B 参数、50M 激活参数的 PII 检测模型,Apache 2.0 许可,单次前向处理 128k 上下文,覆盖八类 PII,在 PII-Masking-300k 基准上达到 SOTA。
推荐理由:原文给出三个基于 Privacy Filter 的完整应用示例,读者可参考其 gradio.Server 前后端分工方式来搭建自己的 PII 脱敏工具。
OpenAI 发布开源规范 Symphony,用于 Codex 编排,可把 issue tracker 变成常驻的智能体系统。该规范旨在提升工程产出并减少上下文切换。
OpenAI 发布由 Sam Altman 分享的五项原则,用于指导其确保 AGI 惠及全人类的工作。该内容以"我们的原则"为题,围绕 OpenAI 的使命展开。
OpenAI 发布一套新框架,分析 921 种职业和 1.48 亿个美国岗位,识别哪些角色面临自动化风险、重组、增长或受 AI 影响较小。
DeepSeek 发布 V4,两个 MoE 检查点上线 Hub:DeepSeek-V4-Pro 总参数 1.6T、激活 49B,DeepSeek-V4-Flash 总参数 284B、激活 13B,均支持 1M token 上下文窗口。
推荐理由:原文给出 V4 在长上下文推理成本与智能体后训练上的具体设计,可据此判断开源模型做长任务智能体的可行性。
OpenAI 发布 GPT-5.5,官方称其为面向编码、研究和数据分析等复杂任务打造的模型,可跨工具使用。目前公开信息仅为摘要,未披露参数、上下文窗口或评测数据。
推荐理由:OpenAI 官方发布 GPT-5.5,读者可据此了解新模型面向编码、研究与数据分析等复杂任务的定位。
OpenAI 分享 ChatGPT Work 的实用工作流,覆盖重复性任务、更新、研究、规划与团队运营等场景。内容面向日常办公,帮助用户把这些环节接入 ChatGPT Work 处理。
Hugging Face 发布教程,讲解如何在 Manifest V3 约束下用 Transformers.js 在 Chrome 扩展中运行本地 AI 功能,并以自家 Gemma 4 浏览器助手扩展为参考实现。
推荐理由:以官方发布的 Gemma 4 浏览器扩展为参照,拆解 MV3 下本地模型托管、消息契约与工具调用循环的架构取舍。
Google Photos 的 Auto frame 新增一项基于机器学习的重构图能力,把照片理解为 3D 场景并自动调整相机位置与焦距,生成原本未拍到的内容。该方法分两步:先用内部 3D 点图估计模型重建人体与面部并估算原焦距,再用生成式潜在扩散模型填补新视角下的空洞。该功能已上线,面向含人物的照片自动处理,重构图结果作为 Auto frame 候选中的第二个版本供用户选择。
推荐理由:Google Photos 把 3D 场景估计与生成式补全结合,读者可了解拍照后改变机位这一编辑思路的实现路径。
OpenAI 宣布 ChatGPT for Clinicians 面向通过验证的美国医生、执业护士和药剂师免费开放,用于支持临床诊疗、文书记录和研究工作。
推荐理由:OpenAI 面向美国临床人员免费开放 ChatGPT 临床版本,读者可据此了解医疗场景的准入范围与用途。
Google DeepMind 发布 Decoupled DiLoCo 分布式训练架构,将训练拆分为解耦的计算孤岛并以异步数据流连接,降低带宽需求并隔离硬件故障。
推荐理由:原文给出分布式训练在带宽、容错和跨代硬件上的实测结果,可据此判断大规模预训练基础设施的演进方向。
OpenAI 详解 Codex 智能体循环如何借助 WebSockets 与连接级缓存降低 API 开销并改善模型延迟。