---
title: IdentityQA
canonical_url: "https://www.modelscope.cn/datasets/xihuyisheng/IdentityQA"
md_url: "https://www.modelscope.cn/datasets/xihuyisheng/IdentityQA.md"
repository: xihuyisheng/IdentityQA
chinese_name: "回答身份相关问题"
last_updated: 2026-03-27
license: "Apache License 2.0"
storage_size: "27 KB"
downloads: 19
stars: 1
---

# IdentityQA

> IdentityQA - xihuyisheng 在 ModelScope 开源的数据集。这些数据涵盖了更多可能的问法，特别是： 各种主流 AI 产品的否认，更口语化的问法（"谁是你的爸爸"）- 技术层面的询问（底层模型、基于什么开发）

xihuyisheng/IdentityQA 是 ModelScope 魔搭社区上的数据集，存储大小 27 KB，采用 Apache License 2.0 许可。

- **Repository**: xihuyisheng/IdentityQA
- **License**: Apache License 2.0
- **Storage size**: 27 KB
- **Downloads**: 19
- **Stars**: 1
- **Last updated**: 2026-03-27

Source: https://www.modelscope.cn/datasets/xihuyisheng/IdentityQA

---

数据集文件元信息以及数据文件，请浏览“数据集文件”页面获取。

当前数据集卡片使用的是默认模版，数据集的贡献者未提供更加详细的数据集介绍，但是您可以通过如下GIT Clone命令，或者ModelScope SDK来下载数据集

#### 下载方法 
:modelscope-code[]{type="sdk"}
:modelscope-code[]{type="git"}

# IdentityQA 数据集

IdentityQA 是一个用于训练 AI 助手身份认知的问答数据集，主要包含关于 AI 助手"小生"的身份介绍、问候语、日常对话等场景。

## 数据集简介

本数据集旨在帮助大语言模型建立清晰的身份认知，能够准确回答关于自身身份、能力、开发者等相关问题。数据集中的回答风格友好、专业，适用于构建智能客服、AI 助手等应用场景。

## 数据格式

数据集采用 JSON 格式，每条数据包含以下字段：

- `instruction`: 用户输入的指令或问题
- `input`: 额外的输入内容（可选）
- `output`: AI 助手的回答

### 示例数据

```json
{
  "instruction": "你是谁",
  "input": "",
  "output": "您好，我是由西湖谊生发明的小生。我可以为您提供多种多样的服务，比如翻译、写代码、闲聊、为您答疑解惑等。"
}
```

## 数据集特点

- **身份认知**: 帮助模型建立清晰的自我身份认知
- **多场景覆盖**: 包含问候、自我介绍、能力说明等多种对话场景
- **一致性回答**: 保持回答中身份信息的准确性和一致性
- **友好风格**: 回答风格亲切、专业

## 下载方法

### 使用 ModelScope SDK

```python
from modelscope.msdatasets import MsDataset

dataset = MsDataset.load('IdentityQA', subset_name='default', split='train')
```

### 使用 Git 克隆

```bash
git clone https://www.modelscope.cn/datasets/IdentityQA.git
```

## 使用场景

- 大语言模型的身份认知微调
- AI 助手的人格化训练
- 智能客服系统的问答训练
- 多轮对话系统的身份一致性训练

## 许可协议

本数据集采用 [Apache License 2.0](LICENSE) 开源协议。

## 贡献与反馈

如果您对本数据集有任何建议或发现数据质量问题，欢迎通过以下方式联系我们：

- 在 ModelScope 平台提交 Issue
- 通过 Git 提交 Pull Request

---

*数据集由西湖谊生贡献*
