CoolFace
Datasetpublic

okgoo/Indonesia-dialog-eliana

Indonesian Dialogue Dataset Deskripsi Indonesian Dialogue-eliana adalah dataset percakapan kecil berbahasa Indonesia yang dibuat untuk penelitian, pembelajaran, dan eksperimen dengan model bahasa ringan, chatbot, serta sistem AI pribadi dengan satu persona. Dataset ini disusun dalam bentuk pasangan percakapan, di mana masukan pengguna dipetakan ke respons asisten. Contoh Format { "YOU": "halo", "ELIANA": "hai" } Saat digunakan untuk pelatihan… See the full description on the dataset page: https://huggingface.co/datasets/okgoo/Indonesia-dialog-eliana.

sourceHugging Facecc-by-nc-sa-4.0updated 24d agoView on Hugging Face
0likes42downloads
Dataset Card

Indonesian Dialogue Dataset

Deskripsi

Indonesian Dialogue-eliana adalah dataset percakapan kecil berbahasa Indonesia yang dibuat untuk penelitian, pembelajaran, dan eksperimen dengan model bahasa ringan, chatbot, serta sistem AI pribadi dengan satu persona.

Dataset ini disusun dalam bentuk pasangan percakapan, di mana masukan pengguna dipetakan ke respons asisten.

Contoh Format

json
{
  "YOU": "halo",
  "ELIANA": "hai"
}

Saat digunakan untuk pelatihan, data dapat diubah menjadi urutan bergaya GPT, misalnya:

json
{
  "messages": [
    {
      "role": "user",
      "content": "halo"
    },
    {
      "role": "assistant",
      "content": "hai"
    }
  ]
}

Lisensi

Dataset ini dirilis di bawah lisensi Creative Commons Attribution-NonCommercial-ShareAlike 4.0 International (CC BY-NC-SA 4.0).

Anda diperbolehkan menggunakan, membagikan, dan mengadaptasi dataset ini untuk tujuan non-komersial, dengan ketentuan memberikan atribusi yang sesuai dan mendistribusikan versi yang telah diadaptasi di bawah lisensi yang sama atau lisensi yang kompatibel.

Batasan Penggunaan Tambahan

Dataset ini dapat digunakan untuk:

  • —pembelajaran pribadi
  • —penelitian
  • —eksperimen non-komersial
  • —proyek gratis dan tidak dimonetisasi
  • —proyek pendidikan terbuka

Dataset ini tidak boleh digunakan tanpa izin tertulis dari pembuat dataset untuk:

  • —produk berbayar
  • —aplikasi berbayar
  • —API komersial
  • —layanan SaaS komersial
  • —layanan premium atau berbasis langganan
  • —aplikasi yang dimonetisasi
  • —produk komersial yang didukung oleh iklan
  • —produk freemium yang memiliki tingkatan berbayar
  • —melatih atau meningkatkan model yang menjadi bagian dari produk yang dijual atau dimonetisasi
  • —menjual kembali, mengemas ulang, atau mendistribusikan ulang dataset sebagai dataset komersial

Produk yang gratis bagi pengguna akhir tidak otomatis dianggap sebagai produk non-komersial.

Atribusi

Jika Anda menggunakan dataset ini, harap mencantumkan atribusi berikut:

Dataset: Eliana Indonesian Dialogue Dataset

Lisensi: CC BY-NC-SA 4.0

Pembuat: Viralina

Sumber: https://huggingface.co/datasets/Viralina/dialogue-indonesian

Izin Penggunaan Komersial

Penggunaan komersial tidak diperbolehkan berdasarkan rilis dataset ini.

Untuk penggunaan komersial, integrasi ke dalam produk berbayar, atau penggunaan dataset dalam layanan yang dimonetisasi, silakan hubungi pembuat dataset untuk mendapatkan izin tertulis atau lisensi komersial secara terpisah.

Kontribusi

Kami sangat menyambut kontribusi anda. Jika anda memiliki saran, perbaikan, atau ingin menambahkan lebih banyak data, silakan hubungi kami melalui [https://chat.whatsapp.com/CT2bYuDHYJv1I46Ce7CcSL].

Tautan

  • —GitHub: https://github.com/Viralina/Data-percakapan-bahasa-indonesia-nlp
  • —Kaggle: https://www.kaggle.com/datasets/angelamawar/dataset-percakapan-bahasa-indonesia
  • —Hugging Face: https://huggingface.co/datasets/Viralina/dialogue-indonesian/
  • —Email: airafredrik@gmail.com

Penafian

Dataset ini disediakan apa adanya tanpa jaminan apa pun

Pembuat dataset tidak bertanggung jawab atas:

  • —penyalahgunaan dataset
  • —perilaku model yang dilatih menggunakan dataset
  • —keluaran yang dihasilkan oleh model
  • —aplikasi atau sistem turunan
  • —penggunaan lebih lanjut dari model yang dilatih menggunakan dataset ini

Pengguna bertanggung jawab sepenuhnya atas penggunaan dataset dan hasil yang diperoleh darinya.