跳到正文
热点事件持续更新

AISI与Irregular发布推理预算扩展研究

3 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月7日,英国AI安全研究院(AISI)发布两项研究。其一,AISI与Irregular联合发现,前沿模型在网络任务上能有效利用比常规评测大10-50倍的token预算,成功率随之上升,约8%的AISI任务只有在预算从1000万提升到5000万token时才被解决。评测使用远超常规的预算:AISI为5000万总token,Irregular为1000轮;在AISI的5000万token上限下,每次运行平均成本约10美元,最高低于60美元;Irregular每轮1000次迭代的平均成本从简单挑战的不足1美元,到中等及多数困难挑战的最高20美元,个别更难的挑战接近100美元。研究指出这些结论基于网络任务,是否推广到其他领域仍需更多测试。其二,AISI用自建网络靶场评测前沿AI智能体的多步网络攻击能力,对比2024年8月至2026年2月发布的七款模型;两个靶场均不含主动防御者,检测仅被记录,不会阻止或延缓智能体。按当前定价,Opus 4.6进行一次1亿token的尝试约花费80美元。

AI 根据报道生成 · 2 小时前更新

事件进展

2 个进展

  1. 10月7日 19:14 · 1 篇报道
    AISI与Irregular发布推理预算扩展研究
    UK AI Security Institute Blog:AISI 研究:提高推理预算后 AI 网络任务成功率显著上升
  2. 10月7日 19:14 · 1 篇报道
    评估前沿AI智能体多步网络攻击能力
    UK AI Security Institute Blog:前沿 AI 智能体在多步网络攻击场景中表现如何

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. UK AI Security Institute Blog
    英国 AI 安全研究院发布 2025 年度回顾

    英国 AI 安全研究院(AISI)发布 2025 年度回顾,列出十项工作成果,包括发布英国政府首份《前沿 AI 趋势报告》,基于两年测试数据呈现前沿模型在网络安全、生物、化学和软件工程上的能力增长与防护措施改善。

  2. UK AI Security Institute Blog
    AISI 研究:提高推理预算后 AI 网络任务成功率显著上升

    英国 AI 安全研究院(AISI)与 Irregular 的联合研究发现,前沿模型在网络任务上能有效利用比常规评测大 10-50 倍的 token 预算,成功率随之上升,约 8% 的 AISI 任务只有在预算从 1000 万提升到 5000 万 token 时才被解决。

  3. UK AI Security Institute Blog
    前沿 AI 智能体在多步网络攻击场景中表现如何

    英国 AI 安全研究院(AISI)用自建网络靶场评测前沿 AI 智能体的多步网络攻击能力,对比 2024 年 8 月至 2026 年 2 月发布的七款模型。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。