跳到正文
Hugging Face Blog·· 2024-05-24AI 评分47

Meta 发布 CyberSecEval 2:大语言模型网络安全风险与能力评估框架

CyberSecEval 2 - A Comprehensive Evaluation Framework for Cybersecurity Risks and Capabilities of Large Language Models

AI 导读

Meta 发布 CyberSecEval 2,用于评估 LLM 生成不安全代码、协助网络攻击、被提示词注入操纵以及滥用代码解释器的风险。相比 2023 年 12 月的首版,LLM 协助网络攻击的平均合规率从 52% 降至 28%。测试还显示提示词注入仍是未解决问题,LLM 目前难以可靠完成端到端漏洞利用。

来源:Hugging Face Blog · huggingface.co