ChatGPT 如何通过自定义指令与记忆实现个性化
OpenAI 介绍 ChatGPT 的个性化方式:通过自定义指令和记忆功能,让回复更相关、更一致、更贴合个人需求。文章属于使用指南,未披露新模型版本或参数细节。
OpenAI 介绍 ChatGPT 的个性化方式:通过自定义指令和记忆功能,让回复更相关、更一致、更贴合个人需求。文章属于使用指南,未披露新模型版本或参数细节。
OpenAI 介绍运营团队如何使用 ChatGPT 简化工作流、改善协作、标准化流程并加快执行速度。
ChatGPT 支持通过清晰的提示词生成并迭代图像,用户可在几分钟内产出高质量视觉内容。教程涵盖提示词撰写、设计反复修改等环节。
OpenAI 发布 ChatGPT 技能使用指南,介绍如何创建和使用技能来构建可复用工作流、自动化重复性任务,并确保输出一致且高质量。
OpenAI 发布面向初学者的 AI 基础科普内容,讲解 AI 是什么、如何运作,以及 ChatGPT 这类工具如何使用大语言模型。内容定位为清晰易懂的人工智能入门指南。
OpenAI 就 Axios 供应链攻击作出回应,已轮换 macOS 代码签名证书并更新应用,同时确认没有用户数据遭到泄露。
OpenAI 介绍客户成功团队如何使用 ChatGPT 管理客户账户、改善沟通、降低流失率并推动产品采用与续约。
OpenAI 发布面向销售团队的 ChatGPT 工作流指南,覆盖客户调研、会议准备、外联触达、销售管道复盘与销售执行等实用场景。
OpenAI 介绍在 ChatGPT 中处理文件的实用方法,涵盖从查找信息到整理、转换文档并融入工作流。内容面向日常使用场景,帮助用户把文件用进 ChatGPT 的工作流程中。
OpenAI 介绍如何用 ChatGPT 做头脑风暴:发散想法、梳理思路,并把粗略概念转化为结构化、可执行的计划。
Google Research 推出 ConvApparel,一个包含 4000 多组人机多轮对话(近 15000 轮)的服饰购物领域数据集,用于量化 LLM 用户模拟器与真实人类行为的真实感差距。
CyberAgent 借助 ChatGPT Enterprise 和 Codex 在广告、媒体与游戏业务中安全扩大 AI 应用,提升质量并加快决策。该案例展示了 OpenAI 企业级产品在跨业务场景下的落地方式。
Overworld 发布实时视频世界模型 Waypoint-1.5,在 RTX 3090 至 5090 等桌面硬件上可生成最高 720p、60 FPS 的实时环境,并新增面向更广消费级硬件的 360p 版本。
推荐理由:Waypoint-1.5 把实时生成世界模型下放到消费级显卡,读者可据此判断本地交互式世界生成的硬件门槛。
Sentence Transformers 发布 v5.4,可在同一套 API 中编码和比较文本、图像、音频与视频,并支持多模态重排模型。新增能力覆盖跨模态相似度、encode_query/encode_document 检索流程以及先检索后重排的 RAG 模式,官方同时列出了 Qwen3-VL、NVIDIA Nemotron、BGE-VL 等已支持模型。
推荐理由:官方给出 v5.4 多模态嵌入与重排的完整用法和模型清单,可据此判断跨模态检索的落地路径。
Google 发布两款学术智能体:PaperVizAgent 负责生成论文配图,ScholarPeer 负责自动同行评审。PaperVizAgent 由检索、规划、风格、可视化、评审五个智能体协作,在 0-100 分评测中总分 60.2,超过 GPT-Image-1.5、Nano-Banana-Pro、Paper2Any,是唯一超过 50.0 人类基线的框架。
OpenAI 阐述了企业级 AI 的下一阶段,随着各行业采用加速,其企业产品线涵盖 Frontier、ChatGPT Enterprise、Codex 以及公司范围内的 AI 智能体。
OpenAI 发布儿童安全蓝图,一份为负责任构建 AI 提供路线图的文件,涵盖安全防护、适龄设计和协作三方面,目标是保护并赋能年轻人在线体验。
Safetensors 已加入 PyTorch 基金会,成为 Linux 基金会旗下托管项目,与 DeepSpeed、Helion、Ray、vLLM 和 PyTorch 并列,商标、仓库与治理权归属 Linux 基金会而非单一公司。
OpenAI 宣布推出试点项目 OpenAI Safety Fellowship,用于支持独立的安全与对齐研究,并培养下一代人才。
Google Research 提出一套框架,用改编自 IRI、ERQ 等心理学问卷的情境判断测试(SJT),在真实用户-助手场景中评估 LLM 行为倾向与人类共识的对齐程度。
Google DeepMind 发布 Gemma 4 开源模型家族,包含 E2B、E4B、26B MoE 和 31B Dense 四种尺寸,采用 Apache 2.0 许可。
推荐理由:Gemma 4 以 Apache 2.0 开源并覆盖从手机到工作站的四种尺寸,读者可据此判断本地部署与微调的选择空间。
OpenAI 宣布收购 TBPN,以加速围绕 AI 的全球对话并支持独立媒体。此次收购旨在扩大与开发者、企业及更广泛科技社区的交流。
OpenAI 为 ChatGPT Business 和 Enterprise 版 Codex 新增按量付费(pay-as-you-go)定价,让团队能以更灵活的方式起步并扩展使用规模。
Google DeepMind 的 Gemma 4 多模态模型家族已在 Hugging Face 发布,采用 Apache 2.0 许可,支持图像、文本和音频输入并输出文本。
推荐理由:Hugging Face 官方给出 Gemma 4 五个尺寸的架构细节、部署路径与基准数据,可据此判断端侧多模态选型。
阿布扎比 TII 的 Falcon Vision 团队发布 Falcon Perception,一个 0.6B 参数的早期融合 Transformer,用自然语言提示做开放词汇定位与分割,在 SA-Co 上达到 68.0 Macro-F1,高于 SAM 3 的 62.3,但在存在性校准上落后(MCC 0.64 对 0.82)。
推荐理由:原文给出 0.6B 早期融合模型在 SA-Co 与 PBench 上的分项对比,可据此判断单骨干架构在开放词汇感知上的取舍。
Gradient Labs 基于 GPT-4.1 和 GPT-5.4 mini、nano 构建 AI 智能体,为每位银行客户提供 AI 客户经理,自动处理银行支持工作流。该方案主打低延迟与高可靠性。
Hugging Face 发布 gradio.Server,它扩展 FastAPI,让开发者用 React、Svelte 或原生 HTML/JS 等任意前端,同时复用 Gradio 的排队、并发控制、SSE 流式、MCP 支持和 Spaces 上的 ZeroGPU。
推荐理由:原文给出 gradio.Server 的完整后端示例,读者可据此判断自带前端与 Gradio 队列、ZeroGPU 如何配合。
Google Research 在论文《Forest vs Tree: The (N, K) Trade-off in Reproducible ML Evaluation》中研究了评测条目数与每条目标注者数的权衡,并已将模拟器在 GitHub 开源。
IBM 发布 Granite 4.0 3B Vision,一个面向企业文档理解的紧凑视觉语言模型,以 LoRA 适配器形式搭载在 Granite 4.0 Micro 之上,采用 Apache 2.0 许可在 Hugging Face 开放。
推荐理由:IBM 发布面向企业文档的紧凑视觉语言模型,给出表格、图表与 KVP 抽取的基准对比,可据此判断小模型在文档流水线中的位置。
OpenAI 宣布获得 1220 亿美元新融资,用于在全球范围扩展前沿 AI、投入下一代算力,并满足 ChatGPT、Codex 和企业级 AI 不断增长的需求。
推荐理由:OpenAI 以 1220 亿美元新融资扩张前沿 AI 与算力,读者可据此判断其后续投入规模与节奏。
Mistral AI 发布 Spaces CLI,可一条命令完成项目脚手架、开发环境启动与部署,内置 `spaces init`、`spaces dev` 等命令。该工具为每个交互式提示词提供对应的 flag 与 `-y` 参数,使 AI 智能体无需处理 ANSI 转义码即可自主操作,并在每次初始化时生成 context.json 与 AGENTS.md 供智能体读取项目上下文。
OpenMed 构建了覆盖结构预测、序列设计与密码子优化的端到端蛋白质 AI 流水线,其中 CodonRoBERTa-large-v2 以困惑度 4.10、Spearman CAI 相关性 0.40 显著优于 ModernBERT。团队随后将模型扩展至 25 个物种,用 55 GPU-hours 训练出 4 个生产模型,并搭建了目前其他开源项目尚未提供的物种条件化系统。
Google Quantum AI 发布白皮书,称未来量子计算机破解保护加密货币的椭圆曲线加密所需的 qubit 和门数比此前认为的更少。
推荐理由:Google Quantum AI 给出破解 ECDLP-256 所需量子资源的新估算,并说明如何在不泄露攻击细节的前提下公开漏洞。
Hugging Face 发布 TRL v1.0,将这一原本的研究代码库正式定位为有稳定性承诺的后训练库,目前实现超过 75 种后训练方法,月下载量 300 万次。
推荐理由:TRL v1.0 把稳定核心与实验层分开,并给出与同类后训练库的横向对比,便于判断选型与迁移成本。
OpenAI 与盖茨基金会面向亚洲灾害响应团队举办工作坊,帮助其把 AI 转化为实际行动。活动聚焦灾害响应场景中的 AI 应用落地。
Google DeepMind 公布 AI 指针的实验性方案,由 Gemini 驱动,让指针理解用户指向的内容及其对用户的意义,并给出四条交互原则:保持工作流不中断、展示与说明、用「这个」和「那个」的简略表达、把像素变成可操作实体。
推荐理由:Google DeepMind 公开 AI 指针的四条交互原则,并说明其已进入 Chrome 与 Googlebook,读者可据此判断 AI 交互从提示词转向指向与语音的路径。
拥有 230 年历史的 STADLER 借助 ChatGPT 改造知识工作,覆盖 650 名员工,实现节省时间并提升生产力。
Anthropic 正在限制 Pro/Max 订阅者在开放智能体平台中使用 Claude 模型,Hugging Face 提出两条迁移路径:通过 Hugging Face Inference Providers 调用开源模型,或在本地硬件上运行开源模型。
推荐理由:Anthropic 收紧 Claude 在开放智能体平台的访问后,文章给出托管与本地两条迁移路径和具体配置命令。
Google DeepMind 发布 Gemini 3.1 Flash Live,称其为目前质量最高的音频与语音模型,具备更高精度和更低延迟。该模型在 ComplexFuncBench Audio 上取得 90.8%,在 Scale AI 的 Audio MultiChallenge 上开启 thinking 后取得 36.1%,并支持多语言。
推荐理由:官方给出语音模型在函数调用与长程推理基准上的分数,并说明开发者、企业与普通用户三类入口的可用范围。
Google DeepMind 发布关于 AI 有害操纵的研究,称其为首个经实证验证的评测工具,并公开运行同类人类被试研究所需的全部材料。研究覆盖英国、美国、印度共 9 项实验、逾 10000 名参与者,聚焦金融与健康等高风险场景,发现 AI 在健康话题上的有害操纵效果最弱,且在一个领域的成功不能预测另一个领域。
推荐理由:原文公开了可复用的有害操纵评测工具与万人级实验数据,读者可据此了解AI操纵能力的测量方式与边界。