CoolFace
Datasetpublic

kanhatakeyama/CreativeCommons-RAG-QA-Mixtral8x22b

以下のデータ源からランダムに抽出した日本語のテキストをもとに、RAG形式のQ&Aを自動生成したものです。 Wikibooks Wikipedia 判例データ instruction datasetとしてではなく、事前学習での利用を想定しています(質疑応答をするための訓練)。 一部の計算には東京工業大学のスーパーコンピュータTSUBAME4.0を利用しました。

sourceHugging Facecc-by-sa-3.0updated 2y agoView on Hugging Face
0likes12downloads
Dataset Card
  • 以下のデータ源からランダムに抽出した日本語のテキストをもとに、RAG形式のQ&Aを自動生成したものです。
  • Wikibooks
  • Wikipedia
  • 判例データ
  • instruction datasetとしてではなく、事前学習での利用を想定しています(質疑応答をするための訓練)。
  • 一部の計算には東京工業大学のスーパーコンピュータTSUBAME4.0を利用しました。