Amgen 如何使用 GPT-5
OpenAI 发文介绍生物医药公司 Amgen 如何使用 GPT-5。原文未披露具体应用场景、使用规模或效果数据。
OpenAI 发文介绍生物医药公司 Amgen 如何使用 GPT-5。原文未披露具体应用场景、使用规模或效果数据。
Hugging Face 的 TRL 新增面向视觉语言模型的对齐能力,包括混合偏好优化 MPO、多模态 GRPO 以及 Qwen 提出的 GSPO,并扩展 RLOO 与 Online DPO 支持 VLM。
推荐理由:TRL 把 MPO、GRPO、GSPO 等对齐方法扩展到视觉语言模型,并给出可直接运行的训练脚本与 notebook。
NVIDIA 的 AI-Q Blueprint 在 DeepResearch Bench 的 Hugging Face "LLM with Search" 榜单上以 40.52 分登顶,成为得分最高的全开源许可方案。
OpenAI 正在优化 ChatGPT 对用户困境时刻的支持,已上线休息提醒功能,并着手改进生活建议,整个过程参考专家意见。这些调整旨在让 ChatGPT 更好地帮助用户以自己期望的方式生活。
Mistral AI 发布 Codestral 25.08 代码模型,并推出覆盖补全、语义检索与智能体工作流的企业级编码栈。Codestral 25.08 相比前代补全接受率提升 30%、建议后保留代码增加 10%、失控生成减少 50%,支持云、VPC 与本地部署。
推荐理由:Mistral 官方给出编码栈各组件的能力数字与私有化部署路径,可据此判断企业自建编码助手的可行边界。
OpenAI 在 ChatGPT 中推出学习模式(study mode),这是一种新的学习体验,帮助用户一步步解决问题。该模式通过提问、脚手架和反馈引导学生,以支持更深入的学习。
Hugging Face 发布开源免费的实验追踪 Python 库 Trackio,提供本地 Gradio 仪表盘并支持同步到 Hugging Face Spaces 分享。
推荐理由:Hugging Face 官方开源实验追踪库,兼容 wandb API 且可同步到 Spaces 分享,读者可据此判断迁移成本。
Hugging Face 官方 CLI 从 huggingface-cli 正式更名为 hf,命令按资源分组为 hf auth、hf cache、hf repo 等,并保留 hf upload、hf download 在根层级。
Outtake 利用 GPT-4.1 和 OpenAI o3 驱动 AI 智能体,检测和处置数字威胁的速度比以往快 100 倍。
NVIDIA 宣布通过 NIM 推理微服务在 Hugging Face 上解锁超过 10 万个 LLM 的快速可靠部署。NIM 现在提供单个 Docker 容器,可部署由 TensorRT-LLM、vLLM 和 SGLang 支持的多种 LLM,并自动完成模型格式识别、架构与量化格式检测、后端选择和性能配置,无需手动调优。
推荐理由:NIM 用单个容器自动识别模型格式与量化方式并选择推理后端,读者可据此判断多模型部署流程能简化到什么程度。
Mistral 为 Le Chat 上线一批新功能,包括预览版 Deep Research 模式、由新语音模型 Voxtral 驱动的语音模式、由推理模型 Magistral 支持的多语言推理、用于整理对话的 Projects,以及与 Black Forest Labs 合作的高级图像编辑。
推荐理由:Mistral 官方一次性为 Le Chat 补齐深度研究、语音、推理与图像编辑能力,可据此判断其产品线的功能覆盖方向。
OpenAI 发布 ChatGPT agent 系统卡,介绍这一智能体模型整合了研究、浏览器自动化和代码工具,并在 Preparedness Framework 下配备安全防护措施。
推荐理由:OpenAI 官方系统卡披露 ChatGPT agent 的能力组合与安全框架,可了解其智能体设计与防护思路。
OpenAI 发布 ChatGPT agent,官方称其能够思考并行动,调用工具完成研究、预订和幻灯片等任务,全程由用户引导。
推荐理由:OpenAI 官方发布 ChatGPT agent,读者可据此了解其可调用工具完成研究、预订和幻灯片等任务的能力定位。
Gradio 5.38.0 为 MCP Server 带来五项改进:新增 "File Upload" MCP server 让智能体直接上传文件,支持实时进度通知,并可通过 gr.load_openapi 一行代码将 OpenAPI 规范转为 MCP 工具。此外新增 gr.Header 类型自动提取认证请求头,并支持用 api_description 参数自定义工具描述。
Invideo AI 借助 OpenAI 的 GPT-4.1、gpt-image-1 和文本转语音模型,把创意想法在几分钟内转化为专业视频,创作速度提升 10 倍。
Hugging Face 发布 ScreenEnv,一个可在 Docker 容器中创建隔离 Ubuntu 桌面环境的 Python 库,用于测试和部署 GUI 智能体(Computer Use 智能体),支持 AMD64 与 ARM64,环境部署时间不到 10 秒。
推荐理由:ScreenEnv 把桌面智能体的运行环境收敛到 Docker 沙箱,并同时提供 MCP 与直连 API 两种接入方式,便于对照现有智能体框架的部署路径。
Hugging Face 与 Pollen Robotics 发布开源机器人 Reachy Mini,Lite 版 399 美元、带板载计算与电池的无线版 499 美元,预计约 90 天发货。
推荐理由:原文给出了开源桌面机器人的价格、硬件配置与 Python SDK 入口,读者可据此判断它能否用于机器人 AI 实验。
Genspark 借助 GPT-4.1 和 OpenAI Realtime API 打造无代码个人智能体,45 天内做到 3600 万美元 ARR。
Retell AI 基于 GPT-4o 和 GPT-4.1 打造无代码语音自动化平台,帮助企业上线自然、实时的语音智能体,无需脚本或等待接通即可自动处理客户对话。该平台可降低通话成本、提升 CSAT,正被用于改造呼叫中心。
AI GTM 平台 Unify 采用 OpenAI 的 o3、GPT-4.1 和 CUA,自动化潜客挖掘、调研与外联流程。借助超个性化消息和全天候工作流,Unify 帮助团队规模化生成销售管道,同时聚焦高价值客户互动。
SGLang 新增 Hugging Face transformers 作为后端,可直接以高性能推理运行任意 transformers 兼容模型,无需原生支持。
Groq 现已作为推理服务商接入 Hugging Face Hub,支持 Llama 4、Qwen QWQ-32B 等开源模型,并集成到 JS 和 Python 客户端 SDK。Groq 基于 LPU 提供低延迟、高吞吐的推理,采用按需付费模式,用户可用自有 API key 或通过 HF 路由调用。PRO 用户每月获 2 美元推理额度,官方 SDK 支持将在 v0.33.0 版本发布。
Featherless AI 现已作为 Inference Provider 接入 Hugging Face Hub,支持 DeepSeek、Meta、Google、Qwen 等最新开源文本与对话模型,并集成到 JS 和 Python 客户端 SDK。
Mistral AI 发布 Mistral Compute,提供从裸金属服务器到全托管 PaaS 的私有集成 AI 基础设施栈,涵盖 GPU、编排、API、产品与服务。
推荐理由:Mistral 把自建训练与推理基础设施对外产品化,读者可据此判断欧洲主权 AI 算力供给的另一种路径。
Hugging Face 与 NVIDIA 在 GTC Paris 宣布合作推出 Training Cluster as a Service,让全球研究机构更便捷地获取大型 GPU 集群,按训练运行时长付费。
推荐理由:原文给出按训练时长付费的 GPU 集群申请入口和 NVIDIA DGX Cloud Lepton 的接入方式,读者可据此判断算力获取路径的变化。
Mistral 发布企业级 AI 编码助手 Mistral Code,整合 Codestral、Codestral Embed、Devstral 和 Mistral Medium 四个模型,支持云端、专属容量与气隙本地 GPU 部署,代码留在企业边界内。
推荐理由:官方给出企业级编码助手的模型组合、部署形态与首批客户,可据此判断私有化编码方案的落地路径。
Wix 的 AI Website Builder 由 OpenAI 提供支持,用户只需通过对话描述想法,即可在几分钟内创建完整网站。
Mistral 发布 Agents API,将自家语言模型与代码执行、图像生成、文档库、Web 搜索等内置连接器以及 MCP 工具结合,并提供跨对话的持久记忆与智能体编排能力。
推荐理由:官方给出 Agents API 的连接器、记忆与多智能体编排能力,可据此判断企业级智能体平台的搭建方式。
Dell 在 Dell Tech World 上发布新版 Dell Enterprise Hub,提供 Meta Llama 4 Maverick、DeepSeek R1。
CodeRabbit 采用 OpenAI 的 o3、o4-mini 和 GPT-4.1 模型改造代码审查流程,提升审查准确率并加快 PR 合并速度。该方案帮助开发者更快交付代码,减少 bug 并提高投资回报率。
Hugging Face 在博客中表示,未来目标是让 Transformers 成为各框架之间的模型定义中枢,模型架构只要被 Transformers 支持,就能在生态其他工具中获得支持。
推荐理由:Hugging Face 官方说明 Transformers 将作为跨框架模型定义中枢,读者可据此理解模型接入与部署链路的变化。
Hugging Face 与 Kaggle 推出集成,让 Hugging Face 模型可直接在 Kaggle 上被发现和使用。
Hugging Face 在 Inference Endpoints 上线新版 OpenAI Whisper 部署方案,基于 vLLM 实现,性能较此前版本最高提升 8 倍。
OpenAI 面向亚洲客户推出数据驻留功能,建立在其企业级数据隐私、安全与合规项目之上。该功能旨在为全球客户提供支持。
Mistral 发布 Le Chat Enterprise,一款由全新 Mistral Medium 3 模型驱动的企业级 AI 助手,提供企业搜索、Agent 构建器、自定义数据与工具连接器、文档库、自定义模型和混合部署等功能,全部功能将在未来两周内逐步上线。
推荐理由:Mistral 官方发布企业版助手,列出企业搜索、Agent 构建与混合部署等能力,可据此判断其企业落地路径。
圣安东尼奥马刺队正在使用定制 GPT 提升球迷互动、简化运营并推动各团队创新。这些定制 GPT 被用于球场内外的多个场景,以扩大球队的影响力。
Lowe's 与 OpenAI 合作构建了 Mylow 和 Mylow Companion 两款 AI 工具,为顾客和门店员工提供专家级家装项目支持。这些工具旨在让复杂的家居改造项目更易于规划、推进和完成。
Intel 发布权重仅训练后量化方法 AutoRound,通过符号梯度下降联合优化权重舍入与裁剪范围,支持 INT2-INT8 低比特量化。在 INT2 下其相对精度最高达主流基线 2.1 倍,量化 72B 模型在 A100 上仅需 37 分钟。
ChatGPT for Business 迎来 4 月更新,新增 o3 模型、图像生成、增强记忆以及内部知识接入能力。官方同步放出了这些功能的上手演示。
OpenAI 宣布最新图像生成模型已通过 gpt-image-1 在 API 中开放,开发者和企业可将其直接集成到自有工具和平台中,构建专业级、可定制的视觉内容。
推荐理由:OpenAI 将最新图像生成模型以 gpt-image-1 接入 API,开发者可据此评估自有产品集成图像生成的门槛变化。