OpenAI Codex 推出插件、站点与标注功能,覆盖多类岗位与工作流
OpenAI 为 Codex 推出新插件、站点(sites)和标注(annotations)功能,面向分析师、营销人员、设计师、投资者等团队,帮助其用 AI 完成更多工作。原文未披露具体版本号、参数规模或可用性细节。
OpenAI 为 Codex 推出新插件、站点(sites)和标注(annotations)功能,面向分析师、营销人员、设计师、投资者等团队,帮助其用 AI 完成更多工作。原文未披露具体版本号、参数规模或可用性细节。
OpenAI 前沿模型与 Codex 现已在 AWS 上正式可用,企业可通过已有的 AWS 环境、管控和采购流程接入 OpenAI。客户可在 AWS 上开始使用 OpenAI,从评估到生产部署的推进更快。
推荐理由:OpenAI 前沿模型与 Codex 上线 AWS,企业可在既有云环境与采购流程中直接接入。
OpenAI 推出 Rosalind Biodefense,向经过审核的开发者及美国政府合作伙伴扩大开放 GPT-Rosalind 的受信任访问权限。该项目旨在利用前沿 AI 推进生物防御、公共卫生与流行病防范工作。
Mistral 宣布将 Le Chat 升级为统一 AI 智能体 Vibe,同时覆盖工作与编码场景,原有对话、设置和订阅方案全部保留。
推荐理由:Mistral 把 Le Chat 升级为统一智能体 Vibe,读者可据此判断工作与编码两类长任务如何被同一入口承接。
Mistral AI 发布 Search Toolkit 公开预览版,这是一个用于构建 AI 应用生产级搜索管线的可组合框架,将数据摄取、检索和评测整合到共享接口下,开源并支持云端、本地和边缘部署。
推荐理由:原文给出检索管线的统一框架与内置评测指标,读者可据此判断自建 RAG 检索栈的整合成本。
Mistral 宣布将 Emmi AI 并入公司,推出面向工业工程的物理 AI 能力,作为其企业解决方案中的新基础能力。该能力从几何与边界条件直接预测物理场,单次前向推理在单张 GPU 上以秒级完成,用于加速产品设计、工装工艺设计和实时数字孪生,合作方包括 ASML、Airbus、Safran 和 Siemens Energy。
推荐理由:Mistral 把物理仿真 AI 纳入企业平台,读者可据此判断工业设计流程的算力与迭代节奏会如何变化。
OpenAI、Thrive 和 Crete 用 Codex 构建了一个可自我改进的税务智能体,用于自动完成报税、提升准确性并加速工作流。该方案展示了 Codex 在税务申报自动化场景中的落地方式。
Warp 正基于 GPT-5.5 及 OpenAI 模型,在本地、云端和开源开发流程中协调多个编码智能体。该工具将 GPT-5.5 用于跨环境的编码智能体调度,以支持开源协作开发。
Mistral 在 Studio 发布 Connectors(公开预览),内置连接器和自定义 MCP 均可通过 API/SDK 用于所有模型与智能体调用。连接器以 MCP 协议打包为可复用实体,集中注册后可在 LeChat 和 AI Studio 中使用,并支持程序化创建、修改、列出和删除。
推荐理由:原文给出连接器注册、直接工具调用与人工审批三段能力,读者可据此判断企业级 Agent 集成层的落地方式。
OpenAI 推进 AI 内容溯源,采用 Content Credentials、SynthID 并推出验证工具,帮助人们识别和信任 AI 生成媒体。
Google DeepMind 介绍其 Co-Scientist 正被用于细胞衰老逆转研究,帮助生物学家 Omar Abudayyeh 和 Jonathan Gootenberg 的实验室筛选基因通路。Co-Scientist 扫描数万篇论文后提出 20 多个新的候选基因因子,实验室测试验证了其中几个假设,成功让细胞进入更年轻状态并改善整体功能。它还能将原本需要长达六个月的筛选数据分析缩短到几天。
推荐理由:原文给出 Co-Scientist 在衰老研究中的具体产出与耗时对比,可了解 AI 智能体参与科研假设生成的实际方式。
PaddleOCR 3.5 发布,支持将 Hugging Face Transformers 作为推理后端,开发者可通过 engine="transformers" 运行 PP-OCRv5、PaddleOCR-VL 1.5 等模型。
Google DeepMind 在 Project Genie 中上线 Street View 真实影像锚定能力,用户可选取美国境内地点并叠加风格,生成以真实地点为起点的可交互世界。
推荐理由:Google DeepMind 把 Genie 的世界模型与 Street View 真实影像打通,读者可据此判断世界模型从纯生成走向现实锚定的路径。
Google DeepMind 推出 Gemini for Science,包含 Google Labs 上三个实验性工具:基于 Co-Scientist 的 Hypothesis Generation。
推荐理由:原文给出三类科学智能体实验工具与 Science Skills 的开放入口,可据此判断科研工作流的可迁移用法。
Google 宣布扩展内容透明度与验证工具,把 SynthID 验证从 Gemini 应用扩展到 Search,并将在未来几周进入 Chrome,该验证功能此前已在全球被使用 5000 万次。
推荐理由:Google 把 SynthID 与 C2PA 验证铺到 Search、Gemini、Chrome 和 Pixel,读者可据此了解内容溯源工具的实际覆盖范围。
OpenAI 在 ChatGPT 中推出个人理财功能,可连接账户、追踪支出与投资、管理订阅、制定预算并规划财务目标。该功能由 OpenAI 官方发布,具体开放范围与时间尚未在材料中说明。
推荐理由:OpenAI 官方披露 ChatGPT 个人理财功能的主要能力,读者可据此了解其覆盖的账户与预算场景。
OpenAI 宣布 Codex 可在 ChatGPT 移动端使用,用户能跨设备和远程环境实时监控、引导并批准编码任务。该功能把 Codex 的编码任务管理从桌面扩展到移动端。
ChatGPT 推出安全更新,提升敏感对话中的上下文感知能力,可随时间识别风险并更安全地回应。该更新帮助模型在敏感话题中更好地理解语境,从而做出更恰当的响应。
OpenAI 开放 Campus Network 学生社团意向表,邀请全球学生社团加入,以连接各地社团、获取 AI 工具、举办活动并共建 AI 校园社区。
OpenAI 在 API 中推出新的实时语音模型,可进行推理、翻译和语音转写,用于构建更自然、更智能的语音体验。
推荐理由:OpenAI 在 API 中上线新的实时语音模型,读者可据此了解语音接口在推理、翻译与转写上的能力扩展。
OpenAI 为 ChatGPT 推出可选安全功能 Trusted Contact,当系统检测到严重的自残风险时,会通知用户指定的可信任联系人。该功能为可选项,用户可自行设置信任对象。
Google DeepMind 汇总了 Gemini 驱动的编码智能体 AlphaEvolve 发布一年来的落地成果,覆盖数学、量子物理、基因组、电网与 AI 基础设施等领域。
推荐理由:官方汇总 AlphaEvolve 一年落地案例,涵盖基因组、电网、TPU 与量子模拟,可据此判断编码智能体的跨领域迁移边界。
Hugging Face 与 Appen Inc.、DataoceanAI 合作,为 Open ASR Leaderboard 引入覆盖多口音、朗读与对话场景的高质量英文 ASR 私有数据集,以防止 benchmaxxing 和测试集污染。榜单默认平均 WER 仍只基于公开数据集计算,用户可通过开关选择是否纳入私有数据集查看影响。该榜单自 2023 年 9 月上线以来访问量已超 710K 次。
OpenAI 推出 MRC(Multipath Reliable Connection)超级计算机网络协议,并通过 OCP 开放发布,用于提升大规模 AI 训练集群的韧性与性能。
OpenAI 扩展 ChatGPT 广告业务,推出测试版自助 Ads Manager、CPC 竞价和增强的衡量工具。官方称这些设计用于保护隐私,并将对话与广告保持分离。
OpenAI 推出 Advanced Account Security,提供抗钓鱼登录、更强的账户恢复能力以及增强保护,用于保护敏感数据并防止账户被接管。该功能面向账户安全场景,具体可用范围与上线时间未在原文中说明。
DeepInfra 成为 Hugging Face Hub 支持的 Inference Provider,首批上线对话与文本生成任务,可访问 DeepSeek V4、Kimi-K2.6、GLM-5.1 等开放权重 LLM。
OpenAI 的 GPT 模型、Codex 和 Managed Agents 现已在 AWS 上可用,企业可在自己的 AWS 环境中构建安全的 AI 应用。
推荐理由:OpenAI 把 GPT 模型、Codex 与 Managed Agents 接入 AWS,读者可据此判断企业现有云环境能否直接落地。
OpenAI 宣布 ChatGPT Enterprise 和 OpenAI API 已获得 FedRAMP Moderate 授权,可供美国联邦机构安全采用 AI。该授权使联邦政府客户能够在合规框架下使用 OpenAI 的企业级产品与 API 服务。
Mistral AI 发布 Workflows 公开预览,定位为企业 AI 的编排层,提供持久化执行、可观测性和容错能力,用于把 AI 流程从概念验证推进到生产。
推荐理由:原文给出企业级 AI 编排层的持久化执行、可观测与人工审批能力,以及控制面与数据面分离的部署方式,可供评估生产落地路径。
Choco 利用 OpenAI API 构建 AI 智能体,实现食品分销流程自动化,以提升生产力并推动业务增长。这是 OpenAI 发布的一则客户案例,聚焦 AI 在真实场景中的落地成效。
OpenAI 发布开源规范 Symphony,用于 Codex 编排,可把 issue tracker 变成常驻的智能体系统。该规范旨在提升工程产出并减少上下文切换。
Google Photos 的 Auto frame 新增一项基于机器学习的重构图能力,把照片理解为 3D 场景并自动调整相机位置与焦距,生成原本未拍到的内容。该方法分两步:先用内部 3D 点图估计模型重建人体与面部并估算原焦距,再用生成式潜在扩散模型填补新视角下的空洞。该功能已上线,面向含人物的照片自动处理,重构图结果作为 Auto frame 候选中的第二个版本供用户选择。
推荐理由:Google Photos 把 3D 场景估计与生成式补全结合,读者可了解拍照后改变机位这一编辑思路的实现路径。
OpenAI 宣布 ChatGPT for Clinicians 面向通过验证的美国医生、执业护士和药剂师免费开放,用于支持临床诊疗、文书记录和研究工作。
推荐理由:OpenAI 面向美国临床人员免费开放 ChatGPT 临床版本,读者可据此了解医疗场景的准入范围与用途。
OpenAI 介绍如何在 ChatGPT 中构建和使用工作区智能体(workspace agents),用于自动化重复性工作流、连接工具并简化团队运营。
OpenAI 在 ChatGPT 中推出工作区智能体(workspace agents),由 Codex 驱动,可自动化复杂工作流并在云端运行。官方称其能帮助团队跨工具安全地扩展工作。
推荐理由:OpenAI 官方公布 ChatGPT 工作区智能体的定位与运行方式,可据此了解其自动化工作流的切入点。
OpenAI 发布 ChatGPT Images 2.0,改进了文字渲染、多语言支持和视觉推理能力。原文同时提到可查看 Images 2.5 的新变化。
推荐理由:官方给出图像生成能力的三项具体改进方向,可据此判断多语言与文字渲染场景的可用性变化。
OpenAI 推出 Codex Labs,并与埃森哲、普华永道、Infosys 等合作,帮助企业在软件开发全生命周期中部署和扩展 Codex。OpenAI 同时公布 Codex 周活跃用户达到 400 万。
推荐理由:OpenAI 公布 Codex 周活 400 万并联合埃森哲、普华永道等推企业落地服务,可观察编码智能体的企业采用路径。
OpenAI 更新 macOS 和 Windows 版 Codex 应用,新增电脑操作、应用内浏览、图像生成、记忆和插件功能,用于加速开发者工作流。
推荐理由:原文列出 Codex 桌面端新增的电脑操作、应用内浏览、图像生成、记忆与插件,读者可据此判断开发工作流的变化。
OpenAI 更新 Agents SDK,新增原生沙箱执行和模型原生 harness,帮助开发者在文件与工具之间构建安全、长时间运行的智能体。
推荐理由:官方给出 Agents SDK 的两项能力变化,读者可据此判断长时运行智能体的构建方式有何调整。