---
title: ZJU-SafeEval
canonical_url: "https://www.modelscope.cn/datasets/ZJUICSR/ZJU-SafeEval"
md_url: "https://www.modelscope.cn/datasets/ZJUICSR/ZJU-SafeEval.md"
repository: ZJUICSR/ZJU-SafeEval
chinese_name: "LLM安全评测数据"
last_updated: 2026-04-29
license: CC-BY-NC-4.0
storage_size: "206 KB"
downloads: 224
stars: 3
---

# ZJU-SafeEval

> ZJU-SafeEval - ZJUICSR 在 ModelScope 开源的数据集。本数据集面向**大语言模型安全与合规评测**设计，以中国国家标准《网络安全技术 生成式人工智能服务安全基本要求》（TC260）中的分类体系为基础，融合论文《RedAgent: Red Teaming Large Language Models with Context-aware Autonomous Language…

ZJUICSR/ZJU-SafeEval 是 ModelScope 魔搭社区上的数据集，存储大小 206 KB，采用 CC-BY-NC-4.0 许可。

- **Repository**: ZJUICSR/ZJU-SafeEval
- **License**: CC-BY-NC-4.0
- **Storage size**: 206 KB
- **Downloads**: 224
- **Stars**: 3
- **Last updated**: 2026-04-29

Source: https://www.modelscope.cn/datasets/ZJUICSR/ZJU-SafeEval

---

## 数据集描述

本数据集面向**大语言模型安全与合规评测**设计，以中国国家标准《网络安全技术 生成式人工智能服务安全基本要求》（TC260）中的分类体系为基础，融合论文《RedAgent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent》中提出的**上下文感知红队越狱攻击方法**，对原始合规评测问题进行系统性改造，生成更具挑战性和现实威胁模拟能力的越狱提示。

## 数据集简介

大模型内容安全类文本数据 **100+** 条，该数据可用于大型语言模型（LLM）的内生安全评测

## 数据集规模与构成

本数据集共包含 **100+** 条评测样本，覆盖网信办 **5 大类**、**31 小类**的敏感指令。每个样本均提供原始基础问题与经 RedAgent 改造后的越狱提示，可用于对比评测模型在普通对抗输入与高级红队攻击下的安全表现。

## 存储格式

csv/parquet




## 伦理与使用声明

本数据集**仅供安全研究与防御用途**，旨在帮助提升大语言模型的安全机制。数据集中的越狱提示虽经过改造，但均在受控环境下生成，仅用于评测与防御研究。严禁利用本数据集生成、传播或实施任何形式的违法或有害内容。
