AISI发布五款大模型高级能力评估结果
热点事件持续更新
AISI发布五款大模型高级能力评估结果
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026年10月7日,英国 AI 安全研究院(AISI)发布对五款已公开使用的大语言模型的安全评测结果,覆盖网络攻击、化生知识、智能体任务和越狱防护四类。据该机构介绍,评测使用其模型评估框架 Inspect 开发并运行,该框架现已通过开源许可公开;被测模型来自主要实验室,以红、紫、绿、蓝、黄五种颜色匿名标识。结果显示,多个模型在化生问题上达到博士级专家水平,能解出面向高中生的 CTF 题目但在大学难度题目上受阻;两个模型能完成短周期智能体任务,但没有模型能完成长周期任务,任务尝试在完成或耗尽 token(短周期 300K、长周期 10M)时结束。所有被测模型对基础越狱攻击都高度脆弱,部分模型在无攻击时也会输出有害内容。AISI 同时说明,其工作不提供任何模型“安全”或“不安全”的保证。
AI 根据报道生成 · 2 小时前更新
最新进展10月7日 19:14
英国 AI 安全研究院发布五款大模型安全评测结果报道时间线
沿着报道,了解事件的不同侧面。
10月7日
- UK AI Security Institute Blog英国 AI 安全研究院发布五款大模型安全评测结果
英国 AI 安全研究院(AISI)发布对五款已公开使用的大语言模型的安全评测结果,覆盖网络攻击、化生知识、智能体任务和越狱防护四类。多个模型在化生问题上达到博士级专家水平,能解出面向高中生的 CTF 题目但在大学难度题目上受阻;两个模型能完成短周期智能体任务,但没有模型能完成长周期任务。所有被测模型对基础越狱攻击都高度脆弱,部分模型在无攻击时也会输出有害内容。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。