AISI与Irregular发布推理预算扩展研究
先了解这件事
2026年10月7日,英国AI安全研究院(AISI)发布两项研究。其一,AISI与Irregular联合发现,前沿模型在网络任务上能有效利用比常规评测大10-50倍的token预算,成功率随之上升,约8%的AISI任务只有在预算从1000万提升到5000万token时才被解决。评测使用远超常规的预算:AISI为5000万总token,Irregular为1000轮;在AISI的5000万token上限下,每次运行平均成本约10美元,最高低于60美元;Irregular每轮1000次迭代的平均成本从简单挑战的不足1美元,到中等及多数困难挑战的最高20美元,个别更难的挑战接近100美元。研究指出这些结论基于网络任务,是否推广到其他领域仍需更多测试。其二,AISI用自建网络靶场评测前沿AI智能体的多步网络攻击能力,对比2024年8月至2026年2月发布的七款模型;两个靶场均不含主动防御者,检测仅被记录,不会阻止或延缓智能体。按当前定价,Opus 4.6进行一次1亿token的尝试约花费80美元。
AI 根据报道生成 · 2 小时前更新
事件进展
2 个进展
- 10月7日 19:14 · 1 篇报道AISI与Irregular发布推理预算扩展研究UK AI Security Institute Blog:AISI 研究:提高推理预算后 AI 网络任务成功率显著上升
- 10月7日 19:14 · 1 篇报道评估前沿AI智能体多步网络攻击能力UK AI Security Institute Blog:前沿 AI 智能体在多步网络攻击场景中表现如何
报道时间线
沿着报道,了解事件的不同侧面。
- UK AI Security Institute Blog英国 AI 安全研究院发布 2025 年度回顾
英国 AI 安全研究院(AISI)发布 2025 年度回顾,列出十项工作成果,包括发布英国政府首份《前沿 AI 趋势报告》,基于两年测试数据呈现前沿模型在网络安全、生物、化学和软件工程上的能力增长与防护措施改善。
- UK AI Security Institute BlogAISI 研究:提高推理预算后 AI 网络任务成功率显著上升
英国 AI 安全研究院(AISI)与 Irregular 的联合研究发现,前沿模型在网络任务上能有效利用比常规评测大 10-50 倍的 token 预算,成功率随之上升,约 8% 的 AISI 任务只有在预算从 1000 万提升到 5000 万 token 时才被解决。
- UK AI Security Institute Blog前沿 AI 智能体在多步网络攻击场景中表现如何
英国 AI 安全研究院(AISI)用自建网络靶场评测前沿 AI 智能体的多步网络攻击能力,对比 2024 年 8 月至 2026 年 2 月发布的七款模型。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。