Sora 信息流理念:个性化推荐、家长控制与安全护栏
OpenAI 公布 Sora 信息流的设计理念,通过个性化推荐激发创意、促进连接,并以家长控制和强护栏保障体验安全。
OpenAI 公布 Sora 信息流的设计理念,通过个性化推荐激发创意、促进连接,并以家长控制和强护栏保障体验安全。
OpenAI 发布 macOS 版 Codex 应用,定位为 AI 编码与软件开发的指挥中心,支持多个智能体、并行工作流和长时间运行的任务。
推荐理由:OpenAI 官方发布 Codex 桌面应用,读者可了解其多智能体并行与长任务编排的定位。
Google DeepMind 开始向美国 18 岁以上的 Google AI Ultra 订阅用户开放 Project Genie,这是一个由 Genie 3、Nano Banana Pro 和 Gemini 驱动的实验性研究原型,支持创建、探索和混编交互式世界。
推荐理由:Google DeepMind 把 Genie 3 世界模型做成可交互原型,读者可据此了解世界模型从研究走向订阅制产品的路径。
OpenAI 宣布将于 2026 年 2 月 13 日在 ChatGPT 中退役 GPT-4o、GPT-4.1、GPT-4.1 mini 和 OpenAI o4-mini,与此前已公布的 GPT-5(Instant、Thinking 和 Pro)退役同步进行。API 端目前没有变化。
推荐理由:OpenAI 官方给出 ChatGPT 中多款旧模型的退役时间,读者可据此安排现有工作流的模型迁移。
Gradio 团队发布开源 Python 库 Daggr,用于把 Gradio 应用、ML 模型和自定义函数串联成 AI 工作流,并自动生成可视化画布。画布可查看任意节点的中间输出、修改输入并单独重跑某一步,无需执行整条流水线,还支持状态持久化和用 backup nodes 替换模型。
推荐理由:Gradio 团队开源 Daggr,用代码定义工作流并自动生成可视化画布,可单独重跑某一步,为多模型串联调试提供了一种轻量方案。
Mistral 发布终端编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型系列驱动,新增自定义子智能体、多选项澄清、斜杠命令技能和统一智能体模式,CLI 修复持续自动更新。
推荐理由:官方给出 Vibe 2.0 的自定义子智能体、斜杠命令技能与定价变化,可据此判断终端编码智能体的能力边界与成本。
OpenAI 推出 Prism,一个内置 GPT-5.2 的免费 LaTeX 原生工作空间,让研究人员在同一处完成写作、协作与推理。
Praktika 利用 GPT-4.1 和 GPT-5.2 构建自适应 AI 导师,实现课程个性化、学习进度追踪,帮助学习者达到真实场景的语言流利度。
Higgsfield 借助 OpenAI 的 GPT-4.1、GPT-5 和 Sora 2,让创作者从简单输入直接生成电影级、适配社交平台的视频。该方案面向社交视频创作场景,强调以简单创意为起点完成成片输出。
ChatGPT 正在推出年龄预测功能,用于判断账号用户是否年满 18 岁,并对青少年账号应用相应保护措施。OpenAI 表示该功能会随时间推移持续优化准确性。
OpenAI 宣布 ChatGPT Go 已在全球上线,提供 GPT-5.2 Instant 的扩展访问、更高的使用额度和更长的记忆能力,定位为让先进 AI 在全球范围内更可负担。原文未披露具体价格、额度数值和上线地区清单。
推荐理由:OpenAI 官方公布 ChatGPT Go 的全球开放范围与三项能力变化,可据此判断低价档位的可用边界。
OpenAI 发起、开源社区构建、Hugging Face 生态支持的 Open Responses 开放推理标准发布,基于 Responses API 设计,面向智能体场景。该标准默认无状态,支持加密推理,将流式输出建模为语义事件序列,并原生支持内部与外部工具及子智能体循环。开发者可通过 Hugging Face Inference Providers 和 Spaces 上的早期访问版本试用。
推荐理由:OpenAI 发起、Hugging Face 生态支持的开放推理标准,读者可了解它如何替代 Chat Completion 格式并支持智能体循环。
Google DeepMind 更新 Veo 3.1 Ingredients to Video,让基于参考图生成的视频在短提示词下更富表现力,并提升角色身份、背景与物体的一致性。
推荐理由:官方说明了 Ingredients to Video 在角色一致性与竖屏输出上的具体变化,可据此判断移动端短视频工作流是否值得迁移。
OpenAI 推出 OpenAI for Healthcare,提供安全的企业级 AI 并支持 HIPAA 合规。该产品旨在减轻行政负担并支持临床工作流程。
Tolan 基于 GPT-5.1 打造了一款语音优先的 AI 伴侣,结合低延迟响应、实时上下文重建和记忆驱动的人格,实现自然对话。
OpenAI 发布 ChatGPT Health,这是一个独立体验,可安全连接用户的健康数据与应用。官方称其具备隐私保护,并采用由医生参与设计的方案。
推荐理由:OpenAI 官方给出 ChatGPT Health 的定位与隐私设计,读者可据此了解健康数据接入这一新方向。
OpenAI 发布面向青少年与家长的 AI 素养资源,帮助其审慎、安全地使用 ChatGPT。指南包含经专家审核的建议,涵盖负责任使用、批判性思维、健康边界,以及如何支持青少年应对情绪或敏感话题。
OpenAI 推出面向新闻机构的 OpenAI Academy,该学习中心与美国新闻项目及 The Lenfest Institute 合作搭建,旨在帮助新闻编辑室有效使用 AI。Academy 提供培训、实用案例与负责任使用指南,支持记者、编辑和出版方在报道与运营中采用 AI。
OpenAI 宣布开发者可以向 ChatGPT 提交应用,经审核通过后会在产品内新设的应用目录中展示,便于用户发现。官方同时更新了工具、指南和 Apps SDK,用于构建把真实操作带入 ChatGPT 的对话原生体验。
推荐理由:OpenAI 开放 ChatGPT 应用提交与审核入口,开发者可据此判断接入路径和分发方式的变化。
Google DeepMind 发布 Gemma Scope 2,一套面向 Gemma 3 全系列(270M 至 27B 参数)的开源可解释性工具。该套件结合稀疏自编码器(SAEs)与 transcoders,覆盖模型每一层,并新增 skip-transcoders、跨层 transcoders 及针对聊天版本的越狱、拒答和思维链忠实度分析工具。
推荐理由:Gemma Scope 2 覆盖 Gemma 3 全系列并公开工具与演示,读者可了解可解释性工具在模型安全审计上的最新进展。
OpenAI 发布 ChatGPT Images 体验和 GPT-Image-1.5,后者已在 API 中提供。官方称新版 ChatGPT Images 速度更快,并提示可查看最新的 ChatGPT Images 2.5。
推荐理由:OpenAI 在 API 中上线 GPT-Image-1.5,并同步更新 ChatGPT 图像生成体验,可据此了解图像模型迭代方向。
IBM 研究团队开源的可配置通用智能体 CUGA 上线 Hugging Face Spaces,演示环境内置一个小型 CRM 系统和 20 个预配置工具,用于销售数据查询与 API 交互。
推荐理由:CUGA 在 AppWorld 与 WebArena 上的成绩和 Hugging Face Space 入口,让读者能判断可配置智能体的落地方式。
llama.cpp server 新增 router 模式,可在不重启服务的情况下动态加载、卸载和切换多个模型。该模式采用多进程架构,每个模型独立运行,单个模型崩溃不影响其他模型;支持自动发现缓存或 --models-dir 目录中的 GGUF 文件、按需加载、LRU 淘汰(默认 --models-max 为 4)以及按请求中的 model 字段路由。
推荐理由:llama.cpp 新增 router 模式,可在不重启服务的前提下动态加载、卸载和切换多个模型,适合本地多模型部署场景。
Scout24 基于 GPT-5 打造了一款对话式助手,通过追问澄清、生成摘要和个性化房源推荐,重新定义房产搜索体验。
OpenAI 推出首批 OpenAI Certifications 认证课程及 AI Foundations 课程,帮助人们掌握实用 AI 技能、提升职业机会并适应未来工作需求。
Hugging Face 推出 swift-huggingface,一个面向 Hugging Face Hub 的完整 Swift 客户端,可独立使用并即将整合进 swift-transformers 替代现有 HubApi。
OpenAI 与 NORAD 合作为“NORAD Tracks Santa”推出三款 ChatGPT 节日工具,让家庭可以生成节日精灵、玩具涂色页和定制圣诞故事。
Hugging Face 发布 Transformers v5.0.0rc-0,主题是互操作性,官方称该库目前每天通过 pip 安装超过 300 万次、累计安装量超 12 亿次,模型架构从 v4 时的 40 个增至 400 多个。
推荐理由:官方给出 v5 在简化模型定义、训练与推理上的取舍,读者可据此判断自家训练和部署链路要不要跟进。
OpenAI 将数据驻留能力扩展至 ChatGPT Enterprise、ChatGPT Edu 和 API Platform,符合条件的客户可将静态数据存储在本地区域内。
JetBrains 正在将 GPT-5 集成到旗下编码工具中,帮助数百万开发者更快地设计、推理和构建软件。
Hugging Face Diffusers 宣布支持 FLUX.2,提供 Flux2Pipeline 与 Flux2Transformer2DModel,文本编码器使用 Mistral3ForConditionalGeneration。
推荐理由:Diffusers 集成 FLUX.2 并给出 4bit 量化加载示例,读者可据此了解在消费级显存上跑该模型的路径与限制。
OVHcloud 正式加入 Hugging Face Hub 的 Inference Provider 生态,用户可直接在模型页调用 gpt-oss、Qwen3、DeepSeek R1、Llama 等开源权重模型。
OpenAI 在 ChatGPT 中推出购物研究功能,帮助用户探索、比较和发现商品。该功能提供个性化的买家指南,用于简化购物决策过程。
Hugging Face TRL 正式集成 RapidFire AI,用户可用 RFSFTConfig、RFDPOConfig、RFGRPOConfig 近乎零代码替换原有 SFT/DPO/GRPO 配置,在单张 GPU 上并发运行多组微调配置。
推荐理由:官方集成给出了并发调度与实时控制的具体机制和基准数字,可据此判断微调实验流程能压缩多少时间。
Google 在 Gemini 应用中上线图像验证功能,用户上传图片并提问即可借助 SynthID 数字水印判断该图是否由 Google AI 生成或编辑。SynthID 自 2023 年推出以来已为超过 200 亿件 AI 生成内容添加水印。
推荐理由:原文说明了 Gemini 应用内图像验证的入口与 SynthID 水印机制,读者可据此了解 AI 生成内容的溯源方式。
Hugging Face 发布 Swift 包 AnyLanguageModel,作为 Apple Foundation Models 框架的替代方案,只需替换 import 语句即可保持同一套 API。
推荐理由:面向 Apple 平台的统一 LLM 调用接口,用同一套 API 在本地开源模型与云端模型间切换,可降低实验成本。
OpenAI 发布 ChatGPT for Teachers,一个具备教育级隐私和管理员控制的安全工作区。该版本面向通过验证的美国 K-12 教育工作者免费开放,有效期至 2027 年 6 月。
Google 发布智能体开发平台 Antigravity,即日起免费公开预览,提供 Gemini 3 Pro 的宽松速率限制。该平台在传统 AI IDE 之外新增以智能体为中心的 Manager 界面,可并行编排多个工作区中的智能体,并支持浏览器控制与异步交互。
推荐理由:Google 把 IDE 改造成以智能体为中心的开发平台,读者可据此判断异步编排与 Artifacts 验证会怎样改变编码工作流。
Google 发布生成式 UI 实现,由模型直接生成网页、游戏、工具等完整交互界面,而非只生成内容。该能力以 dynamic view 和 visual layout 两个实验在 Gemini 应用中推出,并集成到 Google Search 的 AI Mode,基于 Gemini 3 Pro 配合工具调用、系统指令与后处理实现。
推荐理由:Google 把生成式 UI 从论文推进到 Gemini 与搜索的实测入口,读者可据此判断界面生成这一方向的产品化程度。
OpenAI 在 ChatGPT 中推出群聊功能,支持多人以及 ChatGPT 在同一个对话中协作。官方说明该功能用于与他人和 ChatGPT 共同协作。