---
title: Phrolova_voice_zh
canonical_url: "https://www.modelscope.cn/datasets/Richopera/Phrolova_voice_zh"
md_url: "https://www.modelscope.cn/datasets/Richopera/Phrolova_voice_zh.md"
repository: Richopera/Phrolova_voice_zh
chinese_name: "弗洛洛音色数据集（张琦老师配音）"
last_updated: 2026-07-23
license: other
storage_size: "47 MB"
downloads: 56
stars: 0
---

# Phrolova_voice_zh

> Phrolova_voice_zh - Richopera 在 ModelScope 开源的数据集。《鸣潮》中张琦老师配音的弗洛洛音色。数据集包括 278 段切片音频，音源来自B站官方账号视频以及玩家自发游戏录屏，总时长 19 分 29.140 秒。仅供非商用的学习、玩家娱乐，分享初衷是便利视频与模组创作者，请使用者尊重张琦老师劳动成果，也尊重糯糯，本人不对他人利用本模型进行的任何非法或不良行为负责，且有权拒绝他人将本模型用于生成不良内容。

Richopera/Phrolova_voice_zh 是 ModelScope 魔搭社区上的数据集，存储大小 47 MB，采用 other 许可。

- **Repository**: Richopera/Phrolova_voice_zh
- **License**: other
- **Storage size**: 47 MB
- **Downloads**: 56
- **Stars**: 0
- **Last updated**: 2026-07-23

Source: https://www.modelscope.cn/datasets/Richopera/Phrolova_voice_zh

---

# 弗洛洛 中文语音训练数据集

## 数据集概述

这是用于训练 [鸣潮 弗洛洛 中配 GPT-SoVITS v2ProPlus](https://modelscope.cn/models/Richopera/Phrolova-zh-gpt-sovits-v2proplus/) 语音模型的中文语音数据集。

数据集经过人声分离、切片和自动语音识别处理。
它适用于非商业的语音合成学习、研究和本地实验。

> ⚠️ 本数据集采用自定义限制性协议。下载前请阅读 `LICENSE`。

## 数据统计

本数据集包括两个部分：
我用于训练[对应模型](https://modelscope.cn/models/Richopera/Phrolova-zh-gpt-sovits-v2proplus/)使用的数据集：`slicer_opt`；
后期实践中，补充了弗洛洛在2.5主线中最后一段的语音：`弗洛洛终`；
你若打算将其用于模型训练，可以将二者合并使用。
此处出于实事求是，将并未用于模型训练的部分独立放置。

tips：`slicer_opt` 中，“LUO1”前缀的最后几个音频，带有很大声的背景女声吟唱（我尝试过去和声，但效果不佳）。
你可以自行考虑是否需要在训练时排除这部分。
但值得一提的是，这部分正好是弗洛洛多种声音状态中相当差异化的一部分。

`slicer_opt`：
| 项目 | 数值 |
|---|---:|
| 音频数量 |  278  段 |
| 音频总时长 | 19:29.140 | 
| 音频格式 | WAV |
| 音频总大小 | 71.3 MB |
| 标注语言 | 中文（`ZH`） |

`弗洛洛终`：
| 项目 | 数值 |
|---|---:|
| 音频数量 |  50  段 |
| 音频总时长 | 3:39.230 | 
| 音频格式 | WAV |
| 音频总大小 | 13.3 MB |
| 标注语言 | 中文（`ZH`） |

## 目录结构

```text
.
├─ README.md
├─ LICENSE
├─ slicer_opt/
│  └─ *.wav
│  └─ slicer_opt.7z
├─ 弗洛洛终/
│  └─ *.wav
│  └─ 弗洛洛终.7z
├─ 弗洛洛终.list
└─ slicer_opt.list
```

`slicer_opt/` 与 `弗洛洛终/` 存放切片后的训练音频。
`slicer_opt.list` 与 `弗洛洛终.list` 存放每段音频的文本标注。

你可以通过下方哈希值来校验资源完整性。
| 文件名 | hash |
|---|---:|
| slicer_opt.7z | c70654ec0ab38eb0cc48332882fa53323c00af6f6eac885ad297be5aa7fbb24b 
|
| 弗洛洛终.7z | 6e605758378c445cc7c7e308a0ee4ff58b07b8a2761920f2e3f16728d04fa5d2
 | 
| slicer_opt.list | 8a42f8b7820b2dcc6eca7d7021f1bde80b46834f5574bf2141502ab3d5bd344b
 |
| 弗洛洛终.list | c088afb455b8d53b2861e124444c8b9995c648723449e966c0b5029b2c2b6ff5 |


## 标注格式

清单每行包含四个字段：

```text
音频路径|说话人标识|语言代码|文本内容
```

示例：

```text
slicer_opt/example.wav|nikki|ZH|这里填写与音频完全一致的文本。
```

训练前，你需要确认清单中的音频路径与仓库目录一致。
你也需要抽查文本是否与音频内容一致。

> ⚠️ 本数据集的初始文本来自自动语音识别。它可能包含错字、漏字或断句错误。

## 使用方式

1. 下载数据集并阅读 `LICENSE`。
2. 核对 `slicer_opt.list` 中的文件路径。
3. 抽查并修正自动识别文本。
4. 按 GPT-SoVITS 的数据集格式导入音频与标注。
5. 仅在本地开展非商业训练或实验。

本数据集不包含预训练模型和训练检查点。
如需要我训练的模型权重文件，[访问其对应仓库](https://modelscope.cn/models/Richopera/Phrolova-zh-gpt-sovits-v2proplus/)。

## 已知限制

- 训练素材来自已处理音频，不等同于原始无损录音。
- 人声分离可能留下伴奏、混响或背景噪声。
- 自动标注需要人工复核后再用于高质量训练。
- 数据集只覆盖中文语料，不能代表所有语言和发音场景。

## 使用许可

本数据集使用“Phrolova_voice_zh数据集非商业使用协议 v1.0”。

- 仅限个人、非商业的学习、研究和本地训练。
- 禁止转载、镜像或二次配布数据集及其衍生数据。
- 禁止公开发布使用本数据集训练的模型或权重。
- 发布非商业研究结论或二次创作时，必须保留署名。

完整条款见 [LICENSE](LICENSE.md)。

## 致谢

- [GPT-SoVITS](https://github.com/RVC-Boss/GPT-SoVITS)
- [花儿不哭](https://space.bilibili.com/5760446)
- [张琦老师](https://space.bilibili.com/76854555)

## 如有问题，联系：

邮箱： richopera@outlook.com （邮箱不一定及时看见，请见谅）

微信：RichoperaTA
