---
title: weibo_for_LLM_fine_tuning
canonical_url: "https://www.modelscope.cn/datasets/codenoob/weibo_for_LLM_fine_tuning"
md_url: "https://www.modelscope.cn/datasets/codenoob/weibo_for_LLM_fine_tuning.md"
repository: codenoob/weibo_for_LLM_fine_tuning
chinese_name: "大语言模型微调微博数据集"
last_updated: 2025-12-29
license: "Apache License 2.0"
storage_size: "6.8 KB"
downloads: 69
stars: 1
---

# weibo_for_LLM_fine_tuning

> weibo_for_LLM_fine_tuning - codenoob 在 ModelScope 开源的数据集。基于weibo谣言数据集的对大语言模型多功能分析任务的微调数据集。

codenoob/weibo_for_LLM_fine_tuning 是 ModelScope 魔搭社区上的数据集，存储大小 6.8 KB，采用 Apache License 2.0 许可。

- **Repository**: codenoob/weibo_for_LLM_fine_tuning
- **License**: Apache License 2.0
- **Storage size**: 6.8 KB
- **Downloads**: 69
- **Stars**: 1
- **Last updated**: 2025-12-29

Source: https://www.modelscope.cn/datasets/codenoob/weibo_for_LLM_fine_tuning

---

# Weibo Rumor Detection Dataset 

## 简介 (Introduction)

这是一个用于微博谣言检测的数据集，包含训练集和测试集。数据格式经过处理，适用于大语言模型（LLM）的微调（Fine-tuning）任务。

## 数据集结构 (Dataset Structure)

数据集包含以下字段：

- `instruction`: 任务指令，例如 "你是一个舆情分析专家，请判断以下文本是否为谣言，并给出简要分析。"
- `input`: 需要分析的微博文本内容。
- `output`: 模型的期望输出，包含谣言判定结果（【谣言】/【非谣言】）以及简要的分析理由。

## 文件说明 (File Description)

- `rumor_detection_train.json`: 训练数据文件。
- `rumor_detection_test.json`: 测试数据文件。
- `dataset_infos.json`: 数据集元数据描述文件。

## 示例 (Example)

```json
{
  "instruction": "你是一个舆情分析专家，请判断以下文本是否为谣言，并给出简要分析。",
  "input": "【今天凌晨消息：李天一终于逃过法律制裁，李双江四大名爹名不虚传】昨天，警方一位知情人向记者透露，李天一等人涉嫌强奸案在经过检察机关批捕程序后，目前，正在由公安机关开展继续侦查，该起案件尚未进入审查起诉阶段。爆料王表示6月起诉，物证都可以毁光了，报案人也可以处理好了，厉害！。",
  "output": "判定：【谣言】。分析：该文本使用了耸动的标题“逃过法律制裁”和未经验证的所谓‘知情人’爆料，试图引导舆论认为案件存在不公正处理。然而，原文描述的‘继续侦查’阶段是标准的法律程序，后续官方信息证实案件已依法进入起诉和审判程序，该文本对侦查阶段的常规流程进行了恶意揣测和曲解，属于典型的为博取关注而捏造细节的谣言。"
}
```

## 使用方法 (Usage)

本数据集遵循 ModelScope/HuggingFace 数据集格式，可直接用于相关平台的模型训练与评估。
