---
title: wenetspeech_correct
canonical_url: "https://www.modelscope.cn/datasets/iic/wenetspeech_correct"
md_url: "https://www.modelscope.cn/datasets/iic/wenetspeech_correct.md"
repository: iic/wenetspeech_correct
chinese_name: "wenetspeech纠错"
last_updated: 2024-09-02
license: "Apache License 2.0"
storage_size: "2.0 MB"
domain:
  - configs
  - text
tasks:
  - "{config_name=default, data_files=[{path=train.csv, split=train}, {path=test.csv, split=test}]}"
  - text-generation
language:
  - zh
type:
  - poetry_generation
downloads: 450
stars: 0
---

# wenetspeech_correct

> wenetspeech_correct - iic 在 ModelScope 开源的数据集。wenetspeech纠错

iic/wenetspeech_correct 是 ModelScope 魔搭社区上的{config_name=default, data_files=[{path=train.csv, split=train}, {path=test.csv, split=test}]}、text-generation数据集，涉及 configs、text 领域，存储大小 2.0 MB，采用 Apache License 2.0 许可。

- **Repository**: iic/wenetspeech_correct
- **License**: Apache License 2.0
- **Tasks**: {config_name=default, data_files=[{path=train.csv, split=train}, {path=test.csv, split=test}]}, text-generation
- **Domain**: configs, text
- **Storage size**: 2.0 MB
- **Downloads**: 450
- **Stars**: 0
- **Last updated**: 2024-09-02

Source: https://www.modelscope.cn/datasets/iic/wenetspeech_correct

---

## 概述：

wenet中文ASR识别结果,以及其答案

## 数据集描述：

本数据集包括训练集（14625245）测试集（13825）。其中，每一条数据有一个属性，输入句子text1，由文字组成。
## 范例：

{"text1":"云髻高梳鬓不分，扫除虚室事元君。新糊白纸屏风上，尽画蓬莱五色云。"}

## Clone with HTTP
* http://www.modelscope.cn/datasets/modelscope/chinese-poetry-collection.git
