openassistant-guanaco timdettmers
This dataset is a subset of the Open Assistant dataset, which you can find here: https://huggingface.co/datasets/OpenAssistant/oasst1/tree/main This subset of the data only contains the highest-rated paths in the conversation tree, with a total of 9,846 samples. This dataset was used to train Guanaco with QLoRA. For further information, please see the original dataset. License: Apache 2.0
- Typ
- dataset
- Downloads
- 4,577
- Likes
- 444
- Zugriff
- public
- Dateien
- 0
Tags
- Instruction-Tuning
- 对话数据
- Präferenzdaten
- 大语言模型
- Feinabstimmung
- Textdaten
- 多语言
Zusammenfassung
Dieser Datensatz ist eine Teilmenge des Open-Assistant-Datensatzes und enthält nur die höchstbewerteten Konversationspfade mit insgesamt 9.846 Stichproben. Er wird zum Training des Guanaco-Modells mit QLoRA verwendet und dient als hochwertige Quelle für die Feinabstimmung von Sprachmodellen auf Bas…
README
Dieses Datenset ist eine Teilmenge des Open Assistant-Datensets, das Sie hier finden: https://huggingface.co/datasets/OpenAssistant/oasst1/tree/main Diese Teilmenge der Daten enthält nur die am höchsten bewerteten Pfade im Gesprächsbaum, mit insgesamt 9.846 Beispielen. Dieses Datenset wurde verwend…