---
title: KeSpeech_Process
canonical_url: "https://www.modelscope.cn/datasets/lukeewin01/KeSpeech_Process"
md_url: "https://www.modelscope.cn/datasets/lukeewin01/KeSpeech_Process.md"
repository: lukeewin01/KeSpeech_Process
chinese_name: "多方言ASR语音识别模型训练用数据集"
last_updated: 2026-08-10
license: "Apache License 2.0"
downloads: 135
stars: 0
---

# KeSpeech_Process

> KeSpeech_Process - lukeewin01 在 ModelScope 开源的数据集。这是国内多种方言训练ASR用的数据集，包括不限于，西南方言，东北方言，辽胶方言，中原方言等国内多种方言以及地方口音。

lukeewin01/KeSpeech_Process 是 ModelScope 魔搭社区上的数据集，采用 Apache License 2.0 许可。

- **Repository**: lukeewin01/KeSpeech_Process
- **License**: Apache License 2.0
- **Downloads**: 135
- **Stars**: 0
- **Last updated**: 2026-08-10

Source: https://www.modelscope.cn/datasets/lukeewin01/KeSpeech_Process

---

数据集文件元信息以及数据文件，请浏览“数据集文件”页面获取。

当前数据集卡片使用的是默认模版，数据集的贡献者未提供更加详细的数据集介绍，但是您可以通过如下GIT Clone命令，或者ModelScope SDK来下载数据集

#### 下载方法 
:modelscope-code[]{type="sdk"}
:modelscope-code[]{type="git"}

# 说明
这是基于KeSpeech数据集整理的用于训练国内多种方言语音识别模型用的数据集，删除了包含`<SPOKEN_NOISE>`标签的行，同时整合`phase1`和`phase2`。
KeSpecch数据集包括多种国内方言，包括但不限于，西南方言，东北方言，北京话，天津话，辽胶话，中原方言等。

更多内容欢迎访问个人博客：https://blog.lukeewin.top
