跳到正文
原文
Hugging Face Blog·· 2024-05-24AI 评分45

Meta 发布 CyberSecEval 2:大语言模型网络安全风险与能力评估框架

CyberSecEval 2 - A Comprehensive Evaluation Framework for Cybersecurity Risks and Capabilities of Large Language Models

AI 导读

Meta 发布 CyberSecEval 2,用于评估 LLM 在生成不安全代码、协助网络攻击、提示注入、滥用代码解释器及自动化攻击能力等方面的表现。相比 2023 年 12 月的首版,LLM 协助网络攻击的平均合规率从 52% 降至 28%。提示注入仍是未解决问题,代码解释器滥用风险突出,全部代码已开源。

来源:Hugging Face Blog · huggingface.co