跳到正文
10月1日周四
  1. 开源中国42

    团队使用 Codex 和 Claude Code,API Key 与模型权限怎么管?Zentrola 开源

    针对团队使用 Codex 和 Claude Code 时的 API Key 与模型权限管理问题,开发者开源了 Zentrola。它面向从个人到团队的场景,解决真实 API Key 是否分发、新成员可用哪些模型、成员离职后如何撤销权限,以及上游服务商故障时是否需通知所有人临时修改等管理难题。

9月30日周三
  1. 雷峰网38

    百度库库AI如何打上下文之战:GenFlow 1.0到企业版与出海

    百度将文库、网盘十余年积累的内容资产作为AI办公的上下文优势,其GenFlow 1.0于去年4月以通用AI Agent形态切入写论文、做PPT等场景,今年8月官宣中文名“库库AI”并上线独立端。库库AI企业版已吸引3000家企业试用,同时开放连接器授权以调用飞书、钉钉等平台内容。海外版由Oreate AI焕新为「Kooko」,原平台一年内海外用户突破1000万。

  2. 智东西62

    浪潮信息与Inferact同时出手,2.8万亿参数Kimi K3推理效率战打响

    针对2.8万亿参数、104B激活参数的Kimi K3推理难题,海内外团队几乎同时给出系统级优化方案。9月21日浪潮信息在AICC 2026发布元脑SD200 Ultra超节点AI服务器,紧耦合128芯本土AI芯片,单机承载K3,Token生成时延首破5.85毫秒,并将大量基础算子融合为超级算子,算子数量降低10倍、推理性能提升3倍以上。

  3. 雷峰网62

    爱诗科技 PixVerse R2 全量上线:实时世界模型的分层 Scaling 方案

    爱诗科技推出 PixVerse R2 并已全量上线,用户可在网页端体验动作指令与互动影游交互。R2 把能力与效率拆成两层推进,Omni Causal AR 负责抬高世界模型能力上限,Real-Time Acceleration 通过同源蒸馏、稀疏计算和金字塔式少步生成把能力带回低延迟区间,官方称 Scaling 同时发生在模型容量、数据、任务、控制信号和时间尺度五个维度。

  4. 开源中国52

    MateClaw 2.3.0 发布:用不可变 JSON 托管验收长任务

    MateClaw 2.3.0 正式版于 2026 年 9 月 20 日发布,为 Persistent Goal 增加用户配置的托管 JSON 验收,Agent 发布不可变产物版本,服务端将检查结果绑定到当前要求与具体 generation,所有当前绑定有效后才允许完成目标。同版本还发布观察模式执行证据、Team Worker 受控干预、Skill 文档及文件夹上传。

  5. 开源中国78

    DeepSeek Harness v0.2 发布桌面版,插件靠 npm 包名安装

    DeepSeek Harness 发布 v0.2 预览版,同时放出 macOS 和 Windows 桌面端安装包,可在官网 deepseek.com/harness 下载,无需再折腾命令行。新版本预置常用能力,支持丢入文档、表格或 PDF 处理,插件安装以 npm 包名完成,并能让 AI 自己写插件。

    推荐理由:桌面版把插件安装简化为 npm 包名,并支持 AI 自行编写插件,可据此判断上手门槛的变化。

  6. 开源中国26

    Termexo v0.10.9 发布:五种 Agent 状态集中显示,终端内可确认完成

    开源 Windows 多 Agent 工作台 Termexo 发布 v0.10.9,将工作区内 Agent 状态收成按终端顺序排列的图标:空闲灰色、运行和思考绿色闪动、异常与等待授权红色、完成绿色对号。鼠标悬停可查看对应窗口名称,重命名终端后提示名称同步更新,帮助开发者定位需要处理的终端。

  7. 开源中国65

    DeepSeek 开源面向华为昇腾的基础设施组件

    DeepSeek 于 9 月 30 日开源面向华为昇腾算力平台的基础设施组件,涵盖 TileLang 高级语言编译工具、计算库和分布式通信库,与此前面向英伟达平台的开源组件一一对应。其中 TileLang 昇腾版本是分量最重的一块,DeepSeek 称建立新一代自主可控的 GPU 软件生态需要先有通用且编程简单的语言工具。

  8. 爱范儿84

    OpenAI 开发者大会发布 Dot、ChatGPT Space 与 GPT-6.1 Sol

    OpenAI 在开发者大会上一口气公布 Dot、ChatGPT Space、GPT-6.1 Sol、UltraFast、Pro 500、Decisions API、Agents API、云端 Codex 和 OpenAI Marketplace 等更新,主线是把模型、智能体、协作空间和商业分发连成工作平台。

    推荐理由:发布会一口气铺开 Dot、Space、GPT-6.1 Sol 与 Agents API,读者可据此看清 OpenAI 把 ChatGPT 推向智能体工作平台的完整布局。

  9. AWS Machine Learning Blog62

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和日常专业工作负载提供更强的推理能力。据 OpenAI 称,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,单任务成本约为后者的五分之一,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。

    推荐理由:原文给出 GPT-6.1 Sol 在 Bedrock 上的可用范围与成本对比,读者可据此判断智能体编码任务的性价比变化。

  10. AWS Machine Learning Blog22

    Amazon Quick 提示词工程基础指南

    Amazon Quick 的提示词工程决定其 AI 功能对自然语言请求的响应质量,适用于构建自定义智能体、编写自动化流程和对话式数据分析。文章提出核心原则:以具体细节消除歧义、用业务上下文校准输出、用示例代替描述,并给出适用于复杂请求的 CRISPE 结构化框架。

  11. AWS Machine Learning Blog22

    Amazon Quick 各组件提示词工程:模式与陷阱

    AWS 博客按组件拆解 Amazon Quick 的提示词写法:Quick Research 需明确目标、受众与范围,并自行拆解子问题、限定数据源;Quick Flows 要写清时间、数据源与输出格式,复杂逻辑用编号步骤,并可通过对话迭代修改。Quick Sight 的查询则需包含业务问题、指标、维度与可视化偏好。

9月29日周二
  1. Simon Willison88

    OpenAI DevDay 2026 现场实录:Dots 个人智能体、GPT-6.1 Sol 与 Ultrafast 发布

    Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体(由 Astra 驱动)、ChatGPT Space 协作空间、GPT-6.1 Sol 模型以及最高 300 tokens/秒的 Ultrafast 模式。

    推荐理由:现场逐条记录 DevDay 发布节奏与演示翻车细节,可对照官方口径看新功能实际表现。

  2. 智东西30

    远景张雷提出“AI土豆论”:让Token像土豆一样便宜要闯哪四关?

    远景科技集团创始人张雷在央视《对话》中提出“AI土豆论”,主张从能源基础设施端压低Token成本,而非只盯芯片和算法。其乌兰察布星河基地今年8月投产,园区总规划容量超2GW,通过AI电力系统闯绿电直连、气象预测调度、供电冷却协同和规模化复制四关,目标实现同等面积算力输出达传统数据中心10倍。