okgoo/Indonesia-dialog-eliana
Indonesian Dialogue Dataset Deskripsi Indonesian Dialogue-eliana adalah dataset percakapan kecil berbahasa Indonesia yang dibuat untuk penelitian, pembelajaran, dan eksperimen dengan model bahasa ringan, chatbot, serta sistem AI pribadi dengan satu persona. Dataset ini disusun dalam bentuk pasangan percakapan, di mana masukan pengguna dipetakan ke respons asisten. Contoh Format { "YOU": "halo", "ELIANA": "hai" } Saat digunakan untuk pelatihan… See the full description on the dataset page: https://huggingface.co/datasets/okgoo/Indonesia-dialog-eliana.
Indonesian Dialogue Dataset
Deskripsi
Indonesian Dialogue-eliana adalah dataset percakapan kecil berbahasa Indonesia yang dibuat untuk penelitian, pembelajaran, dan eksperimen dengan model bahasa ringan, chatbot, serta sistem AI pribadi dengan satu persona.
Dataset ini disusun dalam bentuk pasangan percakapan, di mana masukan pengguna dipetakan ke respons asisten.
Contoh Format
{
"YOU": "halo",
"ELIANA": "hai"
}Saat digunakan untuk pelatihan, data dapat diubah menjadi urutan bergaya GPT, misalnya:
{
"messages": [
{
"role": "user",
"content": "halo"
},
{
"role": "assistant",
"content": "hai"
}
]
}Lisensi
Dataset ini dirilis di bawah lisensi Creative Commons Attribution-NonCommercial-ShareAlike 4.0 International (CC BY-NC-SA 4.0).
Anda diperbolehkan menggunakan, membagikan, dan mengadaptasi dataset ini untuk tujuan non-komersial, dengan ketentuan memberikan atribusi yang sesuai dan mendistribusikan versi yang telah diadaptasi di bawah lisensi yang sama atau lisensi yang kompatibel.
Batasan Penggunaan Tambahan
Dataset ini dapat digunakan untuk:
- pembelajaran pribadi
- penelitian
- eksperimen non-komersial
- proyek gratis dan tidak dimonetisasi
- proyek pendidikan terbuka
Dataset ini tidak boleh digunakan tanpa izin tertulis dari pembuat dataset untuk:
- produk berbayar
- aplikasi berbayar
- API komersial
- layanan SaaS komersial
- layanan premium atau berbasis langganan
- aplikasi yang dimonetisasi
- produk komersial yang didukung oleh iklan
- produk freemium yang memiliki tingkatan berbayar
- melatih atau meningkatkan model yang menjadi bagian dari produk yang dijual atau dimonetisasi
- menjual kembali, mengemas ulang, atau mendistribusikan ulang dataset sebagai dataset komersial
Produk yang gratis bagi pengguna akhir tidak otomatis dianggap sebagai produk non-komersial.
Atribusi
Jika Anda menggunakan dataset ini, harap mencantumkan atribusi berikut:
Dataset: Eliana Indonesian Dialogue Dataset
Lisensi: CC BY-NC-SA 4.0
Pembuat: Viralina
Sumber: https://huggingface.co/datasets/Viralina/dialogue-indonesian
Izin Penggunaan Komersial
Penggunaan komersial tidak diperbolehkan berdasarkan rilis dataset ini.
Untuk penggunaan komersial, integrasi ke dalam produk berbayar, atau penggunaan dataset dalam layanan yang dimonetisasi, silakan hubungi pembuat dataset untuk mendapatkan izin tertulis atau lisensi komersial secara terpisah.
Kontribusi
Kami sangat menyambut kontribusi anda. Jika anda memiliki saran, perbaikan, atau ingin menambahkan lebih banyak data, silakan hubungi kami melalui [https://chat.whatsapp.com/CT2bYuDHYJv1I46Ce7CcSL].
Tautan
- GitHub: https://github.com/Viralina/Data-percakapan-bahasa-indonesia-nlp
- Kaggle: https://www.kaggle.com/datasets/angelamawar/dataset-percakapan-bahasa-indonesia
- Hugging Face: https://huggingface.co/datasets/Viralina/dialogue-indonesian/
- Email: airafredrik@gmail.com
Penafian
Dataset ini disediakan apa adanya tanpa jaminan apa pun
Pembuat dataset tidak bertanggung jawab atas:
- penyalahgunaan dataset
- perilaku model yang dilatih menggunakan dataset
- keluaran yang dihasilkan oleh model
- aplikasi atau sistem turunan
- penggunaan lebih lanjut dari model yang dilatih menggunakan dataset ini
Pengguna bertanggung jawab sepenuhnya atas penggunaan dataset dan hasil yang diperoleh darinya.
