---
title: Mandarin_Chinese_Multi_Stream_Speech_Dataset_294_Speakers_203_Hours
canonical_url: "https://www.modelscope.cn/datasets/DatatangBeijing/Mandarin_Chinese_Multi_Stream_Speech_Dataset_294_Speakers_203_Hours"
md_url: "https://www.modelscope.cn/datasets/DatatangBeijing/Mandarin_Chinese_Multi_Stream_Speech_Dataset_294_Speakers_203_Hours.md"
repository: DatatangBeijing/Mandarin_Chinese_Multi_Stream_Speech_Dataset_294_Speakers_203_Hours
chinese_name: "203小时中文分轨自然对话精标副语言合成库"
last_updated: 2025-12-30
license: "Apache License 2.0"
storage_size: "659 KB"
domain:
  - image
tasks:
  - image-to-text
size_scale:
  - 100-10k
downloads: 23
stars: 0
---

# Mandarin_Chinese_Multi_Stream_Speech_Dataset_294_Speakers_203_Hours

> Mandarin_Chinese_Multi_Stream_Speech_Dataset_294_Speakers_203_Hours - DatatangBeijing 在 ModelScope 开源的数据集。中文自然对话精标副语言合成库，由多位中文母语发音人录制，自由对话风格。给定话题，发音人自我发挥，每段对话里，每人的音频存储在各自单独的wav文件中。专业语音学家标注了16种副语言标注、文字标注、时间戳等信息，精准匹配语音合成的研发需求。

DatatangBeijing/Mandarin_Chinese_Multi_Stream_Speech_Dataset_294_Speakers_203_Hours 是 ModelScope 魔搭社区上的image-to-text数据集，涉及 image 领域，存储大小 659 KB，采用 Apache License 2.0 许可。

- **Repository**: DatatangBeijing/Mandarin_Chinese_Multi_Stream_Speech_Dataset_294_Speakers_203_Hours
- **License**: Apache License 2.0
- **Tasks**: image-to-text
- **Domain**: image
- **Storage size**: 659 KB
- **Downloads**: 23
- **Stars**: 0
- **Last updated**: 2025-12-30

Source: https://www.modelscope.cn/datasets/DatatangBeijing/Mandarin_Chinese_Multi_Stream_Speech_Dataset_294_Speakers_203_Hours

---

# 203小时中文分轨自然对话精标副语言合成库

## 数据堂
详见https://www.datatang.com/dataset/1620?source=modelscope

## 数据集描述
中文自然对话精标副语言合成库，由多位中文母语发音人录制，自由对话风格。给定话题，发音人自我发挥，每段对话里，每人的音频存储在各自单独的wav文件中。专业语音学家标注了16种副语言标注、文字标注、时间戳等信息，精准匹配语音合成的研发需求。

### 格式：
48Khz，24bit,wav，单声道
### 录音环境：
录音棚环境
### 录音内容：
提供话题列表，录音人自由挑选，围绕所选话题自由对话
### 人员：
共计294名素人，其中男性150人，女性144人。
### 标注特点：
16种副语言标注，文字标注，时间戳标注，特殊标签
### 设备：
专业录音设备及软件
### 语种：
中文普通话
### 国家：
中国
### 语言地区代码：
zh-CN
### 字准率：
99%

## 数据集版权信息
版权归数据堂所有，商用数据。
