美国逮捕被控向中国走私 3 亿美元 Nvidia 芯片的科技公司 CEO
美国司法部逮捕 Earthmade Computer 的 CEO Greg Lui,指控其用虚假单据将价值超 3 亿美元、含 Nvidia A100 和 H100 GPU 的服务器走私至中国,涉及马来西亚、新加坡等中转地,走私活动从 2023 年 10 月持续至 2026 年 8 月。
美国司法部逮捕 Earthmade Computer 的 CEO Greg Lui,指控其用虚假单据将价值超 3 亿美元、含 Nvidia A100 和 H100 GPU 的服务器走私至中国,涉及马来西亚、新加坡等中转地,走私活动从 2023 年 10 月持续至 2026 年 8 月。
苹果宣布将在 macOS 上为“完全磁盘访问”引入新的控制措施,要求用户在非常明确的操作下才能授予应用这一权限。苹果称该设置原本是为备份功能设计,但 AI 智能体增加了这一访问级别的风险,部分开发者使用该权限的方式可能让用户系统上的所有内容在不知情的情况下暴露。
The Verge 记者 Allison Johnson 实测了 OpenAI 本周发布的智能体平台 Dots,它拥有可自定义名字的拟人化头像,界面与 Meta Muse 类似,但定位更偏企业办公软件。
TechCrunch Equity 播客本期讨论 AI 消费市场的尴尬经济账:尽管白宫召集扎克伯格、贝索斯、马斯克与 Anthropic 的 Dario Amodei 签署 AI 安全承诺,特朗普还签署行政令将 AI 改名为“超级智能”,但真正为 AI 掏钱的消费者只有 2%,大钱仍来自企业。
Shivon Zilis 在 X 上引用 Big Tech Alert 关于 Musk 已取关她的帖子,宣布与 Elon Musk 分手。她曾于今年早些时候的庭审中称自己在 Musk 的"整个 AI 版图:Tesla、Neuralink 和 OpenAI"工作,每周工作 80 至 100 小时,而 Musk 则称她是其幕僚长。
OpenAI 发布 GPT-6 系列模型指南,面向初创公司讲解如何选择 GPT-6 模型、调节推理强度、优化提示词与技能、协调工具调用,并为生产环境准备相应工作流。
MIT Technology Review 报告指出,2026 年全球 AI 投资将达 2.5 万亿美元,同比增长 44%,但多数企业仍未能靠 AI 增长收入。报告将 AI 从工具转向运营模式的转变称为“智能体转型”,主张以流程重构为先、建设可组合架构与数据主权,让 AI 智能体能在数据所在处直接查询和准备数据。
AWS 提出 Adjudicated Query 设计模式,让业务用户在 Amazon Quick 聊天界面提出合规问题,实际判定交由确定性规则引擎完成,模型只负责把自然语言问题翻译为固定类型操作并叙述结果。
Amazon Bedrock AgentCore Gateway 可将 Claude Desktop 接入 Web Search,突破模型训练知识截止限制,查询流量全程留在 AWS 基础设施内,无需外部 API key。
AWS 团队在 Amazon SageMaker AI 上用多轮强化学习(MTRL)微调 Qwen3.6-27B 搜索智能体,仅调整 max_epochs、global_batch_size、rollout_max_concurrency 三个超参数,其余走默认值。
Ai2 开源 AstaBrief 8B,一个把研究问题与检索到的文献片段转成带引用报告的模型,基于 Qwen3-8B 经 SFT 和 DPO 训练,并同步开放训练数据。
推荐理由:原文公开了训练数据构造、引用过滤与评测细节,可供做科学文献合成与RAG报告生成的团队参考。
GitHub 提出 AI 时代开发者应强化的三项技能:学会指挥 AI 智能体而非仅使用它、不轻信 AI 的首次答案、用 AI 节省的时间去解决更大问题。文中以 GitHub Copilot 内置的 Rubber Duck agent 为例,说明它用第二个模型对计划、代码和测试进行批判性审查,以发现首个模型遗漏的问题。
Google 发布新一代联邦学习系统,利用可信执行环境(TEE)为数据匿名化提供可验证、可审计的保证,Gboard 已采用该系统上线英语和日语下一词预测模型,隐私保证更强且准确率提升。
推荐理由:Google 公布基于 TEE 的新一代联邦学习系统设计,并给出 Gboard 已上线的实际部署情况,可了解隐私计算在端侧训练中的工程路径。
Nvidia 宣布 Shield TV Pro 即刻涨价 100 美元至 299.99 美元,官方将原因归于 AI 导致的内存等组件成本全行业大幅上涨。这款 2019 年发布、搭载 Tegra X1+ 的流媒体盒子原价 199.99 美元,非 Pro 版已停产。由于没有 AI 前的硬件库存可消化,新生产的 Shield TV 同样受制于当前供应链压力。
Airbnb CTO Ahmad Al-Dahle 披露公司 AI 原生改造进展:60% 代码由 AI 编写,功能交付量同比增长近 80%,工程师人均 PR 吞吐量提升约 1.6 倍,约一半客服工单由 AI 独立解决。
NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商推出 DGX Spark 64GB 统一内存版本,10 月 23 日开售,起售价 4,999 美元,预装 DGX OS 与 NVIDIA AI 软件栈。
推荐理由:原文给出 64GB 新配置的价格、上市时间和双机集群方式,可据此判断本地跑大模型的门槛变化。
生成式 AI 的普及正让服务业员工直面顾客用 ChatGPT 反驳专业判断的困境。纽约服务员 Madison 称有客人以 ChatGPT 为由否认菜品含贝类过敏原,还有顾客拒绝侍酒师、点出不存在的酒;护林员 Jason 遇到游客拿着 AI 编造的露营地和不合理行程质疑地图,幼教 Casey 则见家长坚持 ChatGPT 给出的睡眠方案。Meta 新 AI 智能体 Muse 的推出可能加剧这一问题。
灵界 OS 6.0 稳定版更新窗口渲染与应用安装器两项内容。窗口渲染开启时的确认弹窗新增「不再提示」勾选,勾选后下次直接开启不再弹窗,取消勾选不记住,恢复出厂设置会清除该记录。应用安装器支持可选的 2.txt,每行写一个压缩包内已有文件名,安装时将这些文件带入应用,找不到所列资源文件则会报错。
AIBuildAI 团队发布并开源 PostTrain Agent,一个用于自主后训练大语言模型的递归自我改进(RSI)Agent,代码、知识库与技术报告均已公开。
MiniMax 于 9 月 28 日上线 M3.1-Flash-Preview,百万 token 上下文、原生多模态,在 MiniMax Code 首发并可通过 API 订阅套餐调用。
前 Google DeepMind 核心成员、AlphaGo 团队成员 Thore Graepel 撰文指出,大语言模型逐 token 预测本质是系统 1 式的直觉,链式思维仍由同一预测过程生成,因此不构成真正的推理。
openJiuwen 开源智能路由框架 model-router,并首发 x-router 自演进路由算法,在 Agent 与模型之间增加一层按请求动态选模的决策能力。
丘成桐参与的最新论文在致谢中感谢GPT 6 Astra和Claude Pro,称它们帮助探索了部分证明思路和计算。论文宣称证明七维空间28种球面每一种都能配上截面曲率严格为正的度量,补上了从非负曲率到正曲率的关键一步,并附带SageMath验证代码。丘成桐对AI的态度从2023年称AI不可能影响最尖端数学家,逐步转变为主张学生尽早学习使用AI工具。
arXiv 从 2026 年 10 月 1 日起执行新规,每个提交者每个自然月最多提交 2 篇论文,限制按提交次数计算,被拒稿也占用当月额度,且所有分类共用这一额度。
Earendil 旗下 Pi 发布 1.0 版本并推出 Pi Durable,两者登上 Hacker News 首页。Pi 1.0 带来 Codemode 原生支持 MCP、Jev 与图像模型,新增虚拟模型扩展、延迟工具加载、Anthropic 模型缓存预热、对话中途系统消息、新 TUI 主题和默认全屏模式。
爱范儿在 MiniMax Code 中用 Opus 5.5 案例的公开提示词测试 MiniMax M3.1 Flash Preview,覆盖动态作品集、手绘与水墨短片、时间轴交互场景和街机卡丁车等游戏原型。
华为、港中文、港科大的研究员联合推出 LegoFlow,一个把造题、答题、筛选、训练、评测全流程自动化的代码数据工程框架,每个环节封装为插件技能供 Claude Code、Codex 等编码智能体调用。
影身智能比李飞飞World Labs早两年押注原生4D世界模型路线,已用4到6台消费级摄像头加单块消费级GPU实时生成4D数据,并在福建晋江制鞋工厂落地机器人、拿到2亿元订单。其4D数据集已达万小时量级,产品形态为「影身360」,同时布局4D直播与4D游戏两条业务线。
ServiceNow CoreAI 构建了 AutoSynthData,利用目标模型的失败案例和更强教师的成功案例,自动生成并验证新的训练任务,把模型的能力缺口转化为训练数据。
寒武纪前高管梁军在与公司的股权激励纠纷中已接连输掉6起诉讼,近期将索赔金额从42.87亿元变更为278.32亿元,对应约1152万股争议股权。寒武纪称该案尚未开庭,涉案金额不代表法院最终审理结果,对公司日常研发及经营不存在影响。
清华唐杰团队在「Memory For LLM」工作中,从信息保存形式、更新方式、持续时长三个维度系统梳理了 LLM 模型层面的记忆机制。此前 TTT Layers、Titans、MemoryLLM 分别尝试用快速权重、可更新神经记忆模块和固定大小记忆池将历史信息写入模型内部,但信息写入权重后仍可能被新任务覆盖。
阿里巴巴 TaoLive AIGC 团队开源音视频联合流式生成模型 TaoMate-H3,基于 MiniMax H3,将三步 LoRA 推理与自回归生成结合,可按文本描述连续生成含对白、歌声或环境音的视频,支持分钟级续写和 480p、768p、1080p 横竖屏输出。
MIT 研究者 Alex Zhang 在 Latent Space 播客中讲述其从 GPU kernel、KernelBench 到递归语言模型(RLM)的研究路径,并称基于 RLM 的 harness 是首个接近解决 ARC-AGI-3 的方案,早于 OpenAI 的 Astra。
Chatham Financial 借助 Codex 和 GPT-5.6 构建技术并重构工作流,将交易验证时间从 30 分钟缩短到 4 分钟以内。该机构借此扩展其资本市场专业能力。
OpenAI 的 GPT-6 Astra Ultrafast 已在 NVIDIA Blackwell GPU 上运行,并面向 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户开放。
推荐理由:原文给出 Astra Ultrafast 在 Blackwell 上的加速幅度与开放入口,读者可据此判断它对编码智能体循环的实际影响。
AWS Professional Services 用四个智能体组成的模式,把每应用 3 到 4 周的 IaC 开发时间缩短到几分钟,该模式基于 Strands Agents SDK 构建、运行在 Amazon Bedrock AgentCore 上,通过 AgentCore Gateway 暴露的 MCP 工具连接源与目标。
据《时代》杂志报道,2025 年 12 月特朗普与马斯克秘密会面时花数小时与 Grok 聊天,询问委内瑞拉人对其总统被捕会作何反应,Grok 称马杜罗是不受欢迎的独裁者、许多委内瑞拉人可能会庆祝其下台。
美国联邦法官 Amit Mehta 驳回 Chegg 和 Penske Media 对 Google 提起的反垄断诉讼,认定 Google 在 AI overviews 等产品中的行为不违反反垄断法。
Amazon Quick 为 AI 构建的 Quick Apps 推出 Live Data in Apps,应用每次打开时都会实时查询受治理的 Quick Sight 数据集,不再依赖构建时的静态快照。查询以查看者身份执行,现有行级和列级安全规则自动生效,SPICE 与 Direct Query 数据集均支持,查看者需为已认证的 Quick 用户并逐数据集授权。
OpenAI 宣布在全球范围上线两项 ChatGPT 购物功能,包括虚拟试穿服装与配饰,以及可保存商品的收藏功能。虚拟试穿以 Try On 按钮出现在购物结果中,用户上传自拍或全身照即可预览上身效果,也可上传商品截图让 ChatGPT 试穿。OpenAI 称新功能基于新发布的 ChatGPT Images 2.5 模型,该模型在光照、纹理和编辑指令遵循上有所改进并降低了生成延迟。