AINews:GPT-6.1 Sol 与 Sonnet 5.5 重塑成本性能边界
AINews 汇总 10 月 1 日至 2 日的 AI 动态:OpenAI 发布 GPT-6.1 Sol,定价为每百万输入/输出 token 2 美元和 10 美元,据称在 DeepSWE v1.1 上比 GPT-6 Sol 高 6.4 分,Agent Arena 中 Sol [Max] 以每任务 0.56 美元中位成本进入第 5 名,比 GPT-6 Sol 便宜 39%。
AINews 汇总 10 月 1 日至 2 日的 AI 动态:OpenAI 发布 GPT-6.1 Sol,定价为每百万输入/输出 token 2 美元和 10 美元,据称在 DeepSWE v1.1 上比 GPT-6 Sol 高 6.4 分,Agent Arena 中 Sol [Max] 以每任务 0.56 美元中位成本进入第 5 名,比 GPT-6 Sol 便宜 39%。
针对2.8万亿参数、104B激活参数的Kimi K3推理难题,海内外团队几乎同时给出系统级优化方案。9月21日浪潮信息在AICC 2026发布元脑SD200 Ultra超节点AI服务器,紧耦合128芯本土AI芯片,单机承载K3,Token生成时延首破5.85毫秒,并将大量基础算子融合为超级算子,算子数量降低10倍、推理性能提升3倍以上。
华为海思自研光引擎 Hi-ONE 将以 NPO(近封装光学)形式进入下一代超节点,5500 颗 Hi-ONE 替代 4.8 万颗 800G 可插拔光模块,用于 4096 卡昇腾 960 超节点,跨柜灵衢互联设备支持 176 个 1.6T 端口,单机全光互联带宽约 280T。
Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体(由 Astra 驱动)、ChatGPT Space 协作空间、GPT-6.1 Sol 模型以及最高 300 tokens/秒的 Ultrafast 模式。
推荐理由:现场逐条记录 DevDay 发布节奏与演示翻车细节,可对照官方口径看新功能实际表现。
Mozilla 随 Firefox 157 在桌面和移动端推出界面重新设计,Firefox 负责人 Ajit Varma 称此举意在让浏览器对更广泛用户更具吸引力,而不只是服务重视隐私和开放网络的群体。
一目科技推出视光学超薄仿生触觉传感器 SENTRA T0,厚度迭代至 3 毫米以下,称是全球最薄可量产的仿生视触觉传感器。其「光触觉」方案在指尖大小面积布置 24 万个感知点、力感知精度约 5mN,远高于压阻或电容方案的 10-100 个点。创始人李智强认为触觉是具身智能最大数据瓶颈的关键入口,智驾范式不适用于需要接触物理世界的机器人。
AINews 汇总 9/24-9/25 动态,指出 Opus 5.5 本周发布后社区反响积极,尤其在用代码生成讲解视频上表现突出。榜单方面 Opus 5.5 以 88.4% 领跑 SimpleBench,在 Terminal-Bench-Science 上从低推理档 24% 升至 xhigh 档 62%,max 档回落至 59%。
推荐理由:汇总 Opus 5.5 发布一周内的社区实测与榜单表现,可快速了解前沿模型在视频生成与智能体任务上的当前水位。
Mistral 在慕尼黑开设德国中心,组建专注 Physics AI 与工业 AI 的研究团队,并计划到 2030 年建成 1 吉瓦欧洲算力。该中心将与 BMW 合作碰撞仿真与工程 AI、与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学(TUM)合作利用风洞设施开发汽车空气动力学数字孪生。
Meta 在 Connect 2026 上把 Muse 个人智能体作为硬件加智能体战略的核心,发布眼镜等设备并预告但未发布新的前沿模型。Muse 新增语音与实时视频能力,将登陆所有 Meta 眼镜,每个 Muse 拥有独立邮箱地址,Mac 版支持 computer use,连接器平台覆盖 1500+ 应用。
NVIDIA 在新加坡 AI Day 上联合合作伙伴展示东南亚 AI 落地进展,新加坡 HTX 将研究使用 Nemotron 3 Super 与 Nemotron 3 Nano Omni 模型推进公共安全 AI。
oMLX 创作者兼维护者 Jun Kim 加入 Hugging Face,继续领导该项目并支持 MLX 社区。oMLX 将保持 Apache 2.0 开源协议,从副业转为有资金支持的正式项目,有望带来更高稳定性和更快开发。Hugging Face 计划让 oMLX 成为新想法的试验场,并推动 transformers 模型定义快速转为 MLX 参考实现。
Mistral 宣布与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)由 Mistral 模型驱动,先面向法国和北美用户,英国和德国预计今年晚些时候跟进。
Mistral 与 Cloudera 建立合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持完全控制。企业还能在受控环境中用专有数据训练自有模型,数据与由此产生的智能均归企业所有。Cloudera 平台承载 30 exabytes 客户自管数据。
Mistral 与 HUMAIN 宣布战略合作,覆盖 AI 基础设施、先进模型开发与 AI 解决方案部署,初期聚焦网络安全与语音,并计划开发阿拉伯语表现强劲的前沿模型。合作规模达数亿欧元,Mistral 将探索使用 HUMAIN 数据中心基础设施,双方还计划在沙特面向受监管行业制定联合市场策略。
英国 AI Security Institute 分析显示,开放权重模型与闭源前沿模型的网络能力差距正在收窄:GLM-5.2 最接近 4.3 个月前发布的 Claude Opus 4.6,DeepSeek-V4-Pro 介于 Claude Opus 4.5 与 GPT-5 之间,而 2025 年大部分时间测得的差距为 6 到 10 个月。
Hugging Face 披露本周检测到一起对其部分生产基础设施的入侵,该事件由自主 AI 智能体系统端到端驱动,攻击者通过数据集处理管线中的远程代码加载器和模板注入两条代码执行路径进入处理节点,随后提升至节点级权限、窃取云与集群凭证并在周末横向移动至多个内部集群。
推荐理由:Hugging Face 披露首起由自主 AI 智能体端到端驱动的入侵,并说明防御方为何改用自托管开源模型做取证。
OpenAI 推出 Daybreak 计划下的 Patch the Planet,帮助开源维护者借助 AI 与专家审核发现、验证并修复漏洞。该计划面向开源维护者,聚焦漏洞的查找、验证与修复环节。
Import AI 459 聚焦三项研究:英国 AI 安全研究所的论文指出用 AI 监督 AI 训练的自动化对齐并非万能方案;另有工作提出蛋白质折叠模型的缩放定律,以及为 AI 系统灭绝风险定价的尝试。同期还介绍了美国 AI 经济年增速约 2,000%、2025 年名义 AI GDP 约 2500 亿美元的测算研究。
Google Research 在 I/O 2026 上公布多项进展,包括面向科研的 Gemini for Science 工具套件、智能体开发平台 Google Antigravity 2.0,以及健康、天气预报、量子计算等方向的研究成果。
Mistral 收购 Emmi AI,并加倍投入面向航空航天、汽车、半导体和能源等行业的基础 Physics AI 研究。其已发布成果包括 AB-UPT,可在单张 GPU 上处理 9M 表面和 140M 体积网格的原始几何数据而无需重新划分网格,以及面向大型多物理过程的端到端深度学习代理模型 NeuralDEM。
Google Research 公布其开放科学成果:十余年开源工具与数据集已服务全球超 25 万名研究人员和开发者。
Safetensors 已加入 PyTorch 基金会,成为 Linux 基金会旗下托管项目,与 DeepSpeed、Helion、Ray、vLLM 和 PyTorch 并列,商标、仓库与治理权归属 Linux 基金会而非单一公司。
Hugging Face 发布 2026 春季开源生态报告,基于平台数据回顾过去一年变化:2025 年平台用户增至 1300 万、公开模型超 200 万、公开数据集超 50 万。报告称中国模型在月度与总下载量上超过美国,过去一年占下载量的 41%;机器人数据集从 2024 年的 1145 个增至 2025 年的 26991 个,成为平台上规模最大的数据集类别。
推荐理由:Hugging Face 用平台数据勾勒开源 AI 一年变化,中国模型下载占比与机器人数据集增长是其中两条主线。
Mistral AI 宣布以创始成员身份加入 NVIDIA Nemotron Coalition,双方计划共同开发前沿开源 AI 模型,Mistral AI 贡献模型架构、多模态能力和微调工具,NVIDIA 提供算力、模型开发工具与合成数据生成管线。
推荐理由:Mistral AI 以创始成员身份加入 NVIDIA Nemotron Coalition,并同步放出 Mistral Small 4,读者可据此判断开源前沿模型的合作分工与开放节奏。
Hugging Face 宣布 GGML(llama.cpp 的创建方)加入 HF,Georgi Gerganov 及团队将获得长期可持续资源支持,继续推动本地 AI 开源发展。
推荐理由:Hugging Face 官方说明 GGML 与 llama.cpp 团队加入后的资源安排与开源承诺,可了解本地推理生态的走向。
Google 发布 2025 年度研究回顾,梳理了 8 大突破领域。模型方面,Gemini 2.5 于 3 月发布,Gemini 3 于 11 月推出,Gemini 3 Flash 于 12 月上线,其中 Gemini 3 Pro 登顶 LMArena 排行榜,并在 MathArena Apex 上取得 23.4% 的 SOTA 成绩。
OpenAI 在 Linux 基金会下联合发起 Agentic AI Foundation,并将 AGENTS.md 捐赠给该组织。该基金会旨在支持开放、可互操作的标准,以推动安全的智能体 AI 发展。
推荐理由:OpenAI 把 AGENTS.md 交给 Linux 基金会下的新组织,读者可据此了解智能体标准与开源治理的走向。
Mistral AI 宣布与 SAP 建立多年合作伙伴关系,为其打造面向德国和欧洲的完全主权 AI 技术栈,并将模型集成进 SAP 的 AI Foundation,共同开发面向复杂行业与政府机构的定制方案。Mistral AI 同时与 Helsing 合作加速面向国防与安全应用的视觉-语言-动作模型研发。该公司还将在未来数月内于德国开设办公室,并大幅扩充本地团队。
Google DeepMind 在新加坡开设新研究实验室,聚焦推进 Gemini 核心能力与亚太语言文化包容性研究,其亚太团队过去一年已扩大逾一倍。该实验室将与当地政府、企业和学术机构合作,并延续与 AI Singapore 共建 SEA-LION 等项目,其中 SEA-LION v4 基于 Gemma 3 多模态能力构建。
AMD 联合 Hugging Face 和 Data Monsters 举办 AMD Open Robotics Hackathon,首场线下赛事于 2025 年 12 月 5-7 日在东京举行,第二场于 12 月 12-14 日在巴黎举行。
Hugging Face 宣布与 Google Cloud 建立更深层合作,让企业能在 Google Cloud 上用开放模型构建自己的 AI。
Sentence Transformers 从 TU Darmstadt 的 UKP Lab 转由 Hugging Face 维护,Hugging Face 的 Tom Aarsen 自 2023 年底起已负责维护并将继续领导该项目。
Hugging Face 宣布与威胁情报与恶意软件分析平台 VirusTotal 合作,即日起对 Hub 上 220 万以上公开模型和数据集仓库进行持续扫描。用户访问仓库或文件页面时,Hub 会自动将文件哈希与 VirusTotal 威胁情报库比对,返回干净或恶意状态及检测数量等元数据,不向 VirusTotal 共享原始文件内容。
Arm 将于 10 月 22-23 日参展 PyTorch Conference,展示基于 PyTorch 和 ExecuTorch 的 AI 应用开发与部署方案。
Hugging Face 宣布 Hub 存储从 Git LFS 迁移到 Xet,6 个月内已有 50 万个仓库、20 PB 数据完成迁移,超过 100 万用户在使用 Xet。迁移依靠 Git LFS Bridge 和后台迁移流程实现,旧版客户端无需更换工作流即可继续上传下载。从本月起 Xet 将向所有用户开放,现有仓库会自动迁移,新建仓库默认启用 Xet,后续还将开源 Xet 协议及整套基础设施。
推荐理由:Hugging Face 官方复盘 Hub 从 Git LFS 迁移到 Xet 的工程细节,可看到大规模存储迁移如何做到对用户零打扰。
Mistral AI 推出 AI for Citizens 协作计划,帮助各国政府和公共机构战略性地运用 AI 改造公共服务、推动创新并保障竞争力。该计划提供开放技术平台、自托管部署、数据主权保障及定制化研发,已与法国、卢森堡、新加坡、荷兰、英国、瑞士等国政府及公共部门合作。
在 Microsoft Build 大会上,Satya Nadella 宣布扩大与 Hugging Face 的合作,Azure AI Foundry 的 Hugging Face Collection 现可一键部署 1 万多个开放模型,覆盖文本、音频和图像任务。
Hugging Face 宣布收购已成立 9 年的开源机器人公司 Pollen Robotics,这是其第五次收购,此前曾收购 Gradio 和 XetHub。
推荐理由:Hugging Face 收购 Pollen Robotics 并开卖开源人形机器人,读者可了解其开源机器人布局与 Reachy 2 的定位。
Protect AI 与 Hugging Face 合作半年,已扫描 Hugging Face Hub 上 141 万个仓库中的 447 万个模型版本,在 5.17 万个模型中识别出 35.2 万个不安全或可疑问题。
Hugging Face 于 3 月 14 日向白宫 OSTP 的 AI 行动计划 RFI 提交回应,主张开源与开放科学是 AI 性能、采用与安全的基础。