AlphaGo 核心作者 Thore Graepel:LLM 还没学会第 37 手那样的推理
AlphaGo 核心作者之一 Thore Graepel 在 MIT Technology Review 发文称 LLM 不会推理,并已离开 Google DeepMind 创业做可审计的机器推理。
AlphaGo 核心作者之一 Thore Graepel 在 MIT Technology Review 发文称 LLM 不会推理,并已离开 Google DeepMind 创业做可审计的机器推理。
TypeSafe AI 联合创始人兼 CEO Diogo Almeida 在 Latent Space 访谈中表示,Jev 日处理量已突破一万亿 token,夜间流量持续走高,说明大量调用来自机器自动化。
前 Google DeepMind 核心成员、AlphaGo 团队成员 Thore Graepel 撰文指出,大语言模型逐 token 预测本质是系统 1 式的直觉,链式思维仍由同一预测过程生成,因此不构成真正的推理。
MIT 研究者 Alex Zhang 在 Latent Space 播客中讲述其从 GPU kernel、KernelBench 到递归语言模型(RLM)的研究路径,并称基于 RLM 的 harness 是首个接近解决 ARC-AGI-3 的方案,早于 OpenAI 的 Astra。
TypeSafe AI CEO Diogo Almeida 在 Latent Space 播客中介绍其新模型 Jev,定位为面向代码消费的 System 1 大模型,按每美元智能优化,取名自杰文斯悖论。
Hugging Face 博客指出,企业 AI 试点大规模失败,症结在于缺少"智能体逻辑"这一引导层。IBM 用知识图谱、程序分析库等软件原语约束 LLM,在 Cobol/PL-1 应用理解中实现约 30× token 消耗降低,Aster 测试生成在 75+ 个 Java 应用上覆盖率提升 20%-45%、token 消耗最多降低 15×。
量子物理学家 Mario Krenn 使用 OpenAI o1 协助回答量子物理领域的重大问题。
Cognition CEO 兼联合创始人 Scott Wu 解释了 OpenAI o1 如何以更接近人类的方式做出编程决策。