OpenAI 发布 ChatGPT Images 2.5
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精致的图像,并更贴近用户原本的构想。
推荐理由:OpenAI 官方发布 ChatGPT Images 2.5,读者可了解其在个性化图像生成上的定位与输入方式。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精致的图像,并更贴近用户原本的构想。
推荐理由:OpenAI 官方发布 ChatGPT Images 2.5,读者可了解其在个性化图像生成上的定位与输入方式。
GitHub 发布研究预览版 Project HydraFusion,通过运行时编排在多个提供商的模型间选择,自动完成起草、评审、修订或升级到更强模型。它目前提供 Single、Cascade、Critique 三种执行模式,已在所有 GitHub Copilot 套餐中通过 Copilot CLI 的 /experimental 开放,按各模型标准费率计费。
推荐理由:GitHub 官方披露 HydraFusion 的三种编排模式与三套基准的成本质量对比,可据此判断多模型编排在编码任务上的取舍。
Playco 借助 GPT-6 Astra,从一个灰盒基础版本构建了三款主题游戏原型,人工修复量比使用上一代模型减少 50%。
Legora 借助 GPT-6 Astra 在数分钟内审阅 41 份文档,找出全部 4 处预设错误,并在该财务审阅工作流中把表现提升近 40%。
Hugging Face 发布 funes,一个面向编码智能体的持久记忆层,支持 Claude Code、Codex、pi 和 Hermes,通过一条 add 命令把本机已有会话索引为可召回的记忆。
推荐理由:Hugging Face 官方发布的本地记忆层,给出安装命令与跨智能体召回机制,可据此判断多机多智能体协作的落地方式。
Google 推出 Fairwind Program,面向 Google Cloud 客户、政府机构和网络安全合作伙伴限量开放其最先进的网络防御能力,首批提供 Gemini 3.8 Flash Cyber 模型与 CodeMender harness 组合,用于自主发现、验证并修复漏洞。
推荐理由:原文给出受限访问计划的能力组合与准入条件,读者可据此判断前沿网络防御能力的开放节奏。
ATV Big Air Tour 使用 ChatGPT Work 加速营销与周边商品业务,将原本 3 天的工作量缩短到 3 小时。该团队还用它在 15 分钟内把商品照片做成了一个库存网站。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出智能体视频理解功能,视频分析 token 消耗最多降低 88%、成本最多降低 66%、准确率最多提升 7%。
推荐理由:官方给出 token 与成本降幅及准确率变化,并说明 API 开启方式,便于开发者评估长视频分析方案。
OpenAI 宣布医疗机构现在可以把 EHR 及其他行业数据接入 ChatGPT,帮助临床医生安全获取患者上下文、医学研究等信息。原文未披露具体接入方式、支持机构范围或上线时间。
Hugging Face 发布 @huggingface/kernels,一个从 Hub 加载并运行优化 WebGPU 内核的 JavaScript 库,同时上线 207 个内核的初始集合,均以独立仓库发布并采用 Apache-2.0 许可。
推荐理由:Hugging Face 把浏览器端 GPU 算子做成可版本化、可测试的独立仓库,并给出与 ORT WebGPU 的实测对比,便于判断浏览器推理的底层现状。
ChatGPT for Teachers 扩展至 55 个美国学校系统,为超过 10 万名教育工作者和员工提供安全的 AI 工具、培训与支持。
OpenAI 公布自研推理芯片 Jalapeño 的首批结果,称其在 AI 推理上实现行业领先的速度与能效,为现代模型带来更高吞吐和更低延迟。该芯片为 OpenAI 定制,主打更快、更省电的推理表现。
OpenAI 为 ChatGPT Work 和 Codex 推出 Admin 插件,用于分析工作区用量、管理成员与权限、调整额度并处理管理请求。
GPT‑5.6 现已在 Kiro 中可用,帮助开发者完成软件的规划、构建、审查与测试,并带来更好的性价比。
Liquid AI 为 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 草稿模型检查点,通过投机解码在不改变输出质量的前提下提升解码速度,GPU 上吞吐最高提升 3.18 倍,端侧最高 2.87 倍。
推荐理由:官方给出三个模型的草稿检查点与 H100、MacBook 实测吞吐,可据此判断投机解码在端侧与云端的落地差异。
Mistral 发布 Agentic Search,作为让模型在复杂文档中导航、阅读并核验信息的检索层,通过 Mistral Search Toolkit 和 Studio、Vibe 中的 Libraries 提供。
推荐理由:原文给出多步检索循环在 FinanceBench 与 OfficeQA Pro 上的准确率、token 与延迟变化,可据此判断传统一次性 RAG 的边界。
OpenAI 推出新博客 Intelligence Age,探讨变革性 AI 将如何重塑权力、治理、经济与个人自由。
Stampli 借助 Codex 和 ChatGPT Work,在截止日期固定、设计资源被占用的情况下,把原本数周的发布物料制作压缩到数天,发布工时减少 68%。
Replit 推出 Free Mode,由 GPT-5.6 Luna 驱动,让任何人都能把想法变成可运行的软件,无需担心 token 成本。
推荐理由:Replit 用 GPT-5.6 Luna 支撑免费模式,读者可据此判断无 token 成本顾虑的软件创建门槛变化。
ChatGPT Ads 扩展至 31 个欧洲市场,广告主可在用户探索、比较选项和做出决策的过程中触达他们。
OpenAI 推出 ChatGPT for Teens,面向青少年学习与批判性思考场景,内置更强保护措施、健康使用功能和额外的家长控制选项。
OpenAI 预览新的 API 服务档 Ultrafast,运行 GPT-5.6 Sol 时最高提速 14 倍。该服务由 Cerebras 提供支持,输出速度最高可达每秒 750 个 token。
Hugging Face 的 OlmoEarth Studio 现已支持计算并导出嵌入向量,用户可通过 UI 或 API 选择区域、时段、编码器变体和影像源,输出 Cloud-Optimized GeoTIFF。
Mistral 宣布 Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行,同时 Mistral Priority Tier 进入公开预览,提供自定义速率限制和带 SLA 的可用性承诺。
推荐理由:Mistral 把区域推理、优先服务层级和第三方开源模型接入放在同一套基础设施上,读者可据此判断企业级 AI 部署的区域合规选项。
OpenAI 与 AWS 合作,通过 Amazon Bedrock 提供 Daybreak 网络安全能力,用于支持企业安全相关工作流。
NVIDIA 发布 Magpie TTS Multilingual,一个 364M 参数的开源权重语音合成模型,支持 12 种语言,本次新增现代标准阿拉伯语、韩语和巴西葡萄牙语,并通过更新训练数据提升了多种既有语言的质量。
推荐理由:原文给出 364M 开源权重模型的多语言覆盖与各 GPU 上的 TTFA 实测数据,可据此评估自建语音链路的延迟预算。
Model ML 借助 GPT-5.6 Sol,将金融工作从研究与分析一路推进到可编辑、可追溯的 PowerPoint 演示文稿和 Excel 工作簿。
ChatGPT Business 现已上线 Premium 席位,用量提升至 5 倍,且取消五小时使用限制。该席位提供灵活的席位选项,供团队每位成员按需选用。
Zapier 企业营销团队使用 ChatGPT Work 减少线索漏斗流失、制作营销活动素材并自动化报告。原文未披露具体模型版本、效率倍数或价格等细节。
Baseten 正式加入 Hugging Face Hub 的 Inference Providers 生态,初期支持对话与文本生成任务,可调用 Kimi K3、DeepSeek V4 Flash、GLM-5.2 等开放权重模型。
OpenAI 为 ChatGPT Work 和 Codex 推出新教育插件,面向 K–12 教师、高校教育者与学生,支持学习、教学、研究与开发。
OpenAI 用六个月搭建出支撑响应式语音 AI 的实时系统,为 GPT-Live 提供连续语音交互能力。该系统采用无轮次(turnless)语音模型与低延迟架构,让对话更快、更自然。
avatarin 基于 OpenAI 的 GPT-Realtime 为山田电机顾客提供 24/7 多语言支持。两周内该智能体被 30,000 人使用,92% 的问卷反馈为正面。
OpenAI 在 ChatGPT 中上线 Health 功能,符合条件的美国用户可安全连接医疗记录和 Apple Health,获得更个性化的健康洞察并更好地理解自身健康状况。
推荐理由:OpenAI 把医疗记录与 Apple Health 接入 ChatGPT,读者可据此判断个人健康数据进入对话产品的边界。
Hugging Face 在 Diffusers 中集成 Nunchaku Lite,可直接用 from_pretrained() 加载 Nunchaku 风格 4-bit 量化检查点,无需自定义 pipeline 或本地 CUDA 编译。
推荐理由:原文给出 Nunchaku Lite 在 Diffusers 中的原生加载方式与量化工具链,读者可据此判断消费级 GPU 跑扩散模型的内存与延迟取舍。
OpenAI 推出企业级 AI 智能体平台 OpenAI Presence,可部署可信的语音与聊天智能体,用于客户及内部工作流。
OpenAI 推出 ChatGPT for Small Businesses 计划,帮助创业者掌握 AI 技能、自动化工作,并借助 ChatGPT Work 实现业务增长。
Hugging Face 发布 Grabette,一套开源低成本的手持夹爪数据采集系统,用户无需机器人即可用手持设备录制操作演示,并自动转换为 LeRobot 格式数据集。
推荐理由:原文给出了一套无需机器人即可采集操作数据的开源方案,读者可据此判断数据采集门槛与开源生态的衔接方式。
Google DeepMind 在印度启动 ATL Saathi 试点,这是一款由 Gemini 驱动的 Web 应用,为 Tinkering Lab 教育者提供 24/7 备课与培训助手。该工具基于 NotebookLM 整理 12 个核心模块内容,支持 10 个模块的项目生成,初期支持 8 种语言,由 Gemini 3.5 Flash 提供底层能力。首批覆盖 100 所试点学校。
OpenAI 宣布 GPT-5.6 成为 Microsoft 365 Copilot 的首选模型,覆盖 Word、Excel、PowerPoint、Chat 和 Cowork,用于更快、更高质量地完成工作。
推荐理由:OpenAI 官方说明 GPT-5.6 成为 Microsoft 365 Copilot 首选模型,读者可据此了解该模型在办公套件中的落地范围。