Chinese-DeepSeek-R1-Distill-data-110k Congliu

中文基于满血DeepSeek-R1蒸馏数据集(Chinese-Data-Distill-From-R1) 🤗 Hugging Face   |   🤖 ModelScope    |   🚀 Github    |   📑 Blog 注意:提供了直接SFT使用的版本,点击下载。将数据中的思考和答案整合成output字段,大部分SFT代码框架均可直接直接加载训练。 本数据集为中文开源蒸馏满血R1的数据集,数据集中不仅包含math数据,还包括大量的通用类型数据,总数量为110K。 为什么开源这个数据? R1的效果十分强大,并且基于R1蒸馏数据SFT的小模型也展现出了强大的效果,但检索发现,大部分开源的R1蒸馏数据集均为英文数据集。 同时,R1的报告中展示,蒸馏模型中同时也使用了部分通用场景数据集。 为了帮助大家更好地复现R1蒸馏模型的效果,特此开源中文数据集。 该中文数据集中的数据分布如下:… See the full description on the dataset page: https://huggingface.co/datasets/Congliu/Chinese-DeepSeek-R1-Distill-data-110k.

类型
dataset
许可
apache-2.0
语言
zh
下载量
1,101
点赞
781
访问
public
文件
0

标签

  • 蒸馏
  • 指令微调
  • 多语言语料
  • 数学推理
  • 大语言模型
  • 文本生成
  • 对话数据
  • 微调

摘要

该数据集是从满血DeepSeek-R1蒸馏出的中文语言数据集,包含11万条样本,覆盖数学(约3.6万)、考试、STEM及弱智吧、知乎等通用类型数据,用于复现R1蒸馏模型效果。数据经二次校验与Qwen2.5-72B打分,保留思考与输出字段,可直接用于SFT训练,适合中文学术与推理场景的微调。

README

--- license: apache-2.0 language: - zh size_categories: - 100K<n<1M task_categories: - text-generation - text2text-generation - question-answering --- # 中文基于满血DeepSeek-R1蒸馏数据集(Chinese-Data-Distill-From-R1) <p align="center"> 🤗 <a href="https://huggingface.co/datasets/Congliu/Chinese-DeepSeek-R1-Di…

查看完整页面 · 查看原文