团队使用 Codex 和 Claude Code,API Key 与模型权限怎么管?Zentrola 开源
针对团队使用 Codex 和 Claude Code 时的 API Key 与模型权限管理问题,开发者开源了 Zentrola。它面向从个人到团队的场景,解决真实 API Key 是否分发、新成员可用哪些模型、成员离职后如何撤销权限,以及上游服务商故障时是否需通知所有人临时修改等管理难题。
针对团队使用 Codex 和 Claude Code 时的 API Key 与模型权限管理问题,开发者开源了 Zentrola。它面向从个人到团队的场景,解决真实 API Key 是否分发、新成员可用哪些模型、成员离职后如何撤销权限,以及上游服务商故障时是否需通知所有人临时修改等管理难题。
NVIDIA 提出 AI 工厂投资回报由产能、使用寿命和需求三要素决定,其平台以每兆瓦吞吐量、硬件寿命和通用性同时优化这三项。SemiAnalysis AgentX 数据显示,Vera Rubin NVL72 每兆瓦吞吐量超 GB300 NVL72 的 30 倍,在 DeepSeek V4 Pro 上每百万 token 成本低至 45 分之一。
Latent Space 在 OpenAI DevDay 后访谈了负责 Computer Use 产品与工程的 Ari Weinstein 和 API 产品负责人 Nikunj Handa,梳理了 Dots、GPT-6.1 Sol、Agents API 与 Decisions API 等发布。
微软研究院实习生开发了一套端到端机器学习流水线,利用 L1 太阳风观测、AE 与 Dst 指数预报及地质电导率数据,为美国本土 66,935 座变电站生成 30-60 分钟前的局地空间天气风险估计。
Amazon Bedrock Knowledge Bases 可通过 AgenticRetrieveStream API 用自然语言查询理赔文档并返回带引用的答案。
AWS 官方博客给出在 Amazon Bedrock AgentCore Runtime Instances 上部署三智能体音乐制作流水线的完整教程,三个智能体分别负责作曲、交付与合规审查,通过同一 runtimeSessionId 共置在一台 GPU 实例上共享文件系统协作。
彭博社 Mark Gurman 爆料,苹果准备在 10 月 13 日发布三款智能家居产品:一款代号 J490 的智能家居中枢、新一代 HomePod mini 以及更新版 Apple TV,重启被冷落已久的智能家居产品线。
CoreWeave 宣布在 CoreWeave Cloud 上线 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网,并计划提供面向 AI 智能体的 NVIDIA Vera CPU。
推荐理由:CoreWeave 上线 Vera Rubin NVL72 与 Vera CPU,并给出 Cognition 实测吞吐与沙箱启动数据,可据此判断智能体训练到推理的闭环成本。
百度将文库、网盘十余年积累的内容资产作为AI办公的上下文优势,其GenFlow 1.0于去年4月以通用AI Agent形态切入写论文、做PPT等场景,今年8月官宣中文名“库库AI”并上线独立端。库库AI企业版已吸引3000家企业试用,同时开放连接器授权以调用飞书、钉钉等平台内容。海外版由Oreate AI焕新为「Kooko」,原平台一年内海外用户突破1000万。
DeepSeek 将 TileLang 算子开发工具及 DeepGEMM、DeepEP、FlashMLA、TileKernels、DeepSelect 五大计算与通信库同步推出昇腾版本,TileLang 官宣原生支持华为昇腾 950 NPU。
推荐理由:原文拆解了 TileLang 前后端解耦架构与昇腾适配路径,可据此判断国产算子工具链的迁移成本。
针对2.8万亿参数、104B激活参数的Kimi K3推理难题,海内外团队几乎同时给出系统级优化方案。9月21日浪潮信息在AICC 2026发布元脑SD200 Ultra超节点AI服务器,紧耦合128芯本土AI芯片,单机承载K3,Token生成时延首破5.85毫秒,并将大量基础算子融合为超级算子,算子数量降低10倍、推理性能提升3倍以上。
OpenAI 于 8 月 19 日正式开源 Codex Harness,开放的是支撑 Codex App、CLI 和 IDE Extension 的 Agent Loop,开发者可通过 SDK 和 App Server 接入任务管理、工具调用、事件回传与人工审批,模型和云端服务仍由 OpenAI 提供。
雷峰网在同一台服务器上用同一道长任务对比 OpenClaw v2026.7.1-2 与 v2026.8.1(2.0),两者总耗时基本持平(103.3 分钟对 106.1 分钟),但 2.0 的 LLM 请求从 74 次降到 46 次、工具调用从 100 次降到 65 次。
华为海思自研光引擎 Hi-ONE 将以 NPO(近封装光学)形式进入下一代超节点,5500 颗 Hi-ONE 替代 4.8 万颗 800G 可插拔光模块,用于 4096 卡昇腾 960 超节点,跨柜灵衢互联设备支持 176 个 1.6T 端口,单机全光互联带宽约 280T。
雷峰网将免费的 AgnesCode + Agnes 3.0 Flash 与 Codex + GPT-5.6 Sol 放在众智 FlagOS 大赛同一道 DeepSeek-V3 解码阶段融合 QKV-A 下投影算子题上对比,两组均完成任务。
用三张圆明园鼠首照片和一段自然语言指令,GPT-6 Astra 在 Codex 中调度 Aholo Lux3D 生成 3D 资产,再由 Blender 检查、调材质、加底座并渲染导出。
阶跃星辰发布 Step 5 Preview,在 Artificial Analysis Intelligence Index 上取得 44 分,位列全球开源前二,参数规模 600B,上下文窗口 1M token。
爱诗科技推出 PixVerse R2 并已全量上线,用户可在网页端体验动作指令与互动影游交互。R2 把能力与效率拆成两层推进,Omni Causal AR 负责抬高世界模型能力上限,Real-Time Acceleration 通过同源蒸馏、稀疏计算和金字塔式少步生成把能力带回低延迟区间,官方称 Scaling 同时发生在模型容量、数据、任务、控制信号和时间尺度五个维度。
Blueking Lite 本周更新,智能体问答现可展示知识库中的图片。系统管理支持查看 API 调用日志,CMDB 新增物理服务器 Redfish 采集,作业平台脚本库支持 ZIP 批量导入导出。
MateClaw 2.3.0 正式版于 2026 年 9 月 20 日发布,为 Persistent Goal 增加用户配置的托管 JSON 验收,Agent 发布不可变产物版本,服务端将检查结果绑定到当前要求与具体 generation,所有当前绑定有效后才允许完成目标。同版本还发布观察模式执行证据、Team Worker 受控干预、Skill 文档及文件夹上传。
DeepSeek Harness 发布 v0.2 预览版,同时放出 macOS 和 Windows 桌面端安装包,可在官网 deepseek.com/harness 下载,无需再折腾命令行。新版本预置常用能力,支持丢入文档、表格或 PDF 处理,插件安装以 npm 包名完成,并能让 AI 自己写插件。
推荐理由:桌面版把插件安装简化为 npm 包名,并支持 AI 自行编写插件,可据此判断上手门槛的变化。
开源 Windows 多 Agent 工作台 Termexo 发布 v0.10.9,将工作区内 Agent 状态收成按终端顺序排列的图标:空闲灰色、运行和思考绿色闪动、异常与等待授权红色、完成绿色对号。鼠标悬停可查看对应窗口名称,重命名终端后提示名称同步更新,帮助开发者定位需要处理的终端。
DeepSeek 于 9 月 30 日开源面向华为昇腾算力平台的基础设施组件,涵盖 TileLang 高级语言编译工具、计算库和分布式通信库,与此前面向英伟达平台的开源组件一一对应。其中 TileLang 昇腾版本是分量最重的一块,DeepSeek 称建立新一代自主可控的 GPU 软件生态需要先有通用且编程简单的语言工具。
开源知识库 KnowForge 发布 v2026.0.7,新增会员运营、开放平台、双向链接、读者问题洞察和多实例部署等能力。该版本支持将内容接入自有工具,并帮助运营者持续更新文档、了解读者关注的问题。KnowForge 可部署在自己的服务器上。
OpenAI 在开发者大会上一口气公布 Dot、ChatGPT Space、GPT-6.1 Sol、UltraFast、Pro 500、Decisions API、Agents API、云端 Codex 和 OpenAI Marketplace 等更新,主线是把模型、智能体、协作空间和商业分发连成工作平台。
推荐理由:发布会一口气铺开 Dot、Space、GPT-6.1 Sol 与 Agents API,读者可据此看清 OpenAI 把 ChatGPT 推向智能体工作平台的完整布局。
Amazon Bedrock 在印度上线 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过地理跨区域推理让印度客户在孟买(ap-south-1)和海得拉巴(ap-south-2)区域本地处理数据。
Amazon Bedrock 现支持在首尔区域使用 Claude Opus 5 和 Claude Sonnet 5、在新加坡区域使用 Claude Sonnet 5 进行区域内推理,请求和数据全程不离开所调用的 AWS 区域。
OpenAI 在 DevDay 2026 上发布 20 多项功能和产品更新,包括由 GPT-6 Astra 驱动的 24 小时在线智能体助理 dots、协作空间 ChatGPT Space、云端 Codex Cloud,以及新模型 GPT-6.1 Sol。
推荐理由:梳理 DevDay 2026 的 20 多项更新,并点出 ChatGPT 从对话工具转向企业工作流服务这条主线。
DeepSeek 推出 DeepSeek Harness v0.2 预览版,提供 macOS 和 Windows 桌面端安装包,用户下载后按引导即可使用,无需自行配置开发环境。
OpenAI 在 DevDay 2026 上发布 21 项产品、功能与更新,包括由 GPT-6 Astra 驱动的全天候个人智能体 Dot、协作空间 ChatGPT Space 以及新模型 GPT-6.1 Sol。
推荐理由:OpenAI 一次发布 21 项更新,覆盖个人智能体、协作空间与低价新模型,可据此观察其开发者生态布局。
GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和日常专业工作负载提供更强的推理能力。据 OpenAI 称,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,单任务成本约为后者的五分之一,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。
推荐理由:原文给出 GPT-6.1 Sol 在 Bedrock 上的可用范围与成本对比,读者可据此判断智能体编码任务的性价比变化。
Amazon Quick 的提示词工程决定其 AI 功能对自然语言请求的响应质量,适用于构建自定义智能体、编写自动化流程和对话式数据分析。文章提出核心原则:以具体细节消除歧义、用业务上下文校准输出、用示例代替描述,并给出适用于复杂请求的 CRISPE 结构化框架。
AWS 博客按组件拆解 Amazon Quick 的提示词写法:Quick Research 需明确目标、受众与范围,并自行拆解子问题、限定数据源;Quick Flows 要写清时间、数据源与输出格式,复杂逻辑用编号步骤,并可通过对话迭代修改。Quick Sight 的查询则需包含业务问题、指标、维度与可视化偏好。
基于 Amazon Quick 与 Amazon Bedrock AgentCore 的合同智能平台,用 AI 智能体从合同 PDF 中提取字段并交叉验证,解决 RAG 无法跨数百份合同做聚合统计的问题。
DeepSeek 推出 DeepSeek Harness 桌面端,官方提供 macOS 和 Windows 开箱即用安装包,登录即送 6 元赠金,有效期到 10 月 6 日。
Condé Nast 与 AWS 生成式 AI 创新中心合作,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,并选用 TwelveLabs Marengo 嵌入模型联合编码画面、音频与转录文本。
Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体(由 Astra 驱动)、ChatGPT Space 协作空间、GPT-6.1 Sol 模型以及最高 300 tokens/秒的 Ultrafast 模式。
推荐理由:现场逐条记录 DevDay 发布节奏与演示翻车细节,可对照官方口径看新功能实际表现。
HPE 提出,当 AI 从试验走向客服、IT、研究等常驻生产负载时,按 token 消费的模式会让支出变成难以预测的月度变量,企业需按工作负载判断是否转向自建容量。
远景科技集团创始人张雷在央视《对话》中提出“AI土豆论”,主张从能源基础设施端压低Token成本,而非只盯芯片和算法。其乌兰察布星河基地今年8月投产,园区总规划容量超2GW,通过AI电力系统闯绿电直连、气象预测调度、供电冷却协同和规模化复制四关,目标实现同等面积算力输出达传统数据中心10倍。
Codeaha v1.0.0 正式发布,这是一款本地优先、对国产大模型友好的 AI 编程 Agent。其会话、消息与代码变更全部落盘本地 SQLite,代码数据不出本机,并基于 Eino Graph 实现 Agent 推理。项目采用 GoFrame、Eino、mark3labs/mcp-go 与纯 Go 无 CGO 的 glebarez/go-sqlite 构建。