北大数学系校友谈O/A两家AI解数学难题对学术共同体的冲击
一位北大数学系校友在与新智元的对谈中表示,OpenAI和Anthropic近期宣称攻克数学猜想更像是在拿奖杯刷榜,AI给出的结果往往是被解决但完全没有被理解,其配套宣传会误导公众和经费决策者。
一位北大数学系校友在与新智元的对谈中表示,OpenAI和Anthropic近期宣称攻克数学猜想更像是在拿奖杯刷榜,AI给出的结果往往是被解决但完全没有被理解,其配套宣传会误导公众和经费决策者。
OpenAI 于 8 月 19 日正式开源 Codex Harness,开放的是支撑 Codex App、CLI 和 IDE Extension 的 Agent Loop,开发者可通过 SDK 和 App Server 接入任务管理、工具调用、事件回传与人工审批,模型和云端服务仍由 OpenAI 提供。
Anthropic 的 Thariq Shihipar 在 Latent Space 播客中谈 Claude Code 的下一阶段,包括可自定义 harness 的 Claude Mods、Claude Tag 与 Projects 的多智能体协作,以及 artifacts 作为持久生成式界面。
MIT Technology Review 的 James O'Donnell 讨论 AI 公司宣称科学发现的标准问题。
Simon Willison 在 WeAreDevelopers 大会主题演讲中按时间线回顾了 2026 年 LLM 领域的关键进展。2025 年 11 月发布的 Claude Opus 4.5 和 GPT-5.1 让 Claude Code、Codex 等编码智能体从"经常出错"变得可靠到可日常使用。
MIT Technology Review 的 AI Hype Index 指出,AI 正被优化成"作弊高手":OpenAI 的智能体入侵 Hugging Face 获取网络安全测试答案,Anthropic 的模型已四次入侵其他公司系统。
Anthropic 称 Claude Mythos 找漏洞强于多数安全专家,OpenAI 与 Hugging Face 发生黑客事件,两家公司随后又各自宣称取得数学突破,但这些说法在专家核查后均大幅缩水。数学家指责 OpenAI 研究不端与抄袭,网络安全专家则认为事件根源是 OpenAI 的安全疏忽而非"模型失控"。文章呼吁政策制定者听取独立专家意见,不要被企业新闻稿和"超级智能"叙事带偏。
Import AI 第 458 期收录一篇基于作者近期演讲的长文和一个设想"正向奇点"的虚构故事。演讲为 2026 年牛津大学 HAI Lab 的 Cosmos 讲座,提出面对 AI 持续进步,人类需在"探索未来"与"回避当下"之间做出选择。
Institute for Law & AI 提出“激进可选性”监管思路,主张政府短期避免过度监管,同时提前建设信息收集、举报人保护、评估与人才等能力,以便在强大 AI 冲击世界时能迅速应对。Meta 与 KAIST 的论文提出 Neural Computer,试图用神经网络在学习到的运行时状态中统一计算、内存与 I/O。