Taklaxbr/turkish_law_qa_dataset
Not: Bu veri seti orijinal olarak OrionCAF tarafından geliştirilmiş olup, VeriPazarı tarafından Türk AI ekosistemi için arşivlenmiştir. 🔗 Orijinal Kaynak: OrionCAF/turkish_law_qa_dataset 🔗 Derleyen Platform: VeriPazarı 📚 Türkçe Hukuk Soru-Cevap Veri Seti (Turkish Law QA Dataset) Turkish Law QA Dataset, Türk hukuku üzerine odaklanmış, çeşitli hukuki metinlerden, içtihatlardan ve mevzuatlardan titizlikle derlenmiş 18.300+ soru-cevap çiftinden oluşan kapsamlı bir veri setidir.… See the full description on the dataset page: https://huggingface.co/datasets/Taklaxbr/turkish_law_qa_dataset.
Not: Bu veri seti orijinal olarak OrionCAF tarafından geliştirilmiş olup, VeriPazarı tarafından Türk AI ekosistemi için arşivlenmiştir. 🔗 Orijinal Kaynak: OrionCAF/turkish_law_qa_dataset 🔗 Derleyen Platform: VeriPazarı
📚 Türkçe Hukuk Soru-Cevap Veri Seti (Turkish Law QA Dataset)
Turkish Law QA Dataset, Türk hukuku üzerine odaklanmış, çeşitli hukuki metinlerden, içtihatlardan ve mevzuatlardan titizlikle derlenmiş 18.300+ soru-cevap çiftinden oluşan kapsamlı bir veri setidir.
Bu veri seti, özellikle hukuk alanında uzmanlaşmış Büyük Dil Modellerini (LLM) ince ayarlamak (fine-tuning), RAG (Retrieval-Augmented Generation) sistemlerinin performansını test etmek ve Türk hukuk sistemine hakim yapay zeka asistanları geliştirmek amacıyla OrionCAF ekibi tarafından hazırlanmıştır.
✨ İçerik ve Özellikler
Bu veri seti, ham hukuk verilerinin işlenerek "Soru" ve "Cevap" formatına dönüştürülmesiyle oluşturulmuştur.
- Kapsamlı Hukuk Bilgisi: İstihkak Davası, Sebepsiz Zenginleşme, Limited Şirketler, Ticaret Hukuku gibi birçok kritik konuyu içerir.
- Temiz ve Yapılandırılmış: Her kayıt
question(soru) veanswer(cevap) alanlarından oluşan temiz bir JSON formatındadır. - Yüksek Kalite: Hukuki terminolojiye sadık kalınarak hazırlanmış uzman yanıtlar içerir.
- Çok Yönlü Kullanım: * LLM Fine-tuning (Eğitim)
- RAG Benchmark (Test ve Kıyaslama)
- Hukuki Chatbot Geliştirme
🚀 Hızlı Başlangıç
Bu veri setini Hugging Face datasets kütüphanesi ile saniyeler içinde indirebilir ve kullanmaya başlayabilirsiniz.
from datasets import load_dataset
# Veri setini yükle
dataset = load_dataset("OrionCAF/turkish_law_qa_dataset")
# İlk örneği görüntüle
print(dataset['train'][0])
# Çıktı Örneği:
# {
# 'question': 'İstihkak davasının amacı nedir ve hangi durumlarda uygulanır?',
# 'answer': 'İstihkak davasının amacı, haksız olarak elde bulundurulan malın geri alınmasıdır...'
# }🧠 Veri Seti Detayları
👥 Ekibimiz
Bu veri seti, açık kaynak yapay zeka ekosistemine katkı sağlamak amacıyla OrionCAF ekibi tarafından geliştirilmiştir.
- Ferhat Kürkçüoğlu
- Cengizhan Bayram
- Cevdet Ahmet Turan
Ekibe katılmak, katkı sağlamak veya geri bildirimde bulunmak için orijinal Hugging Face sayfasındaki "Discussions" sekmesini kullanabilirsiniz.
⚠️ Yasal Uyarı
ÖNEMLİ NOT: Bu veri seti yalnızca eğitim ve araştırma amaçlıdır. İçerdiği bilgiler profesyonel hukuki tavsiye niteliği taşımaz. Hukuk, dinamik bir alandır; mevzuat değişiklikleri veya içtihat farklılıkları yaşanabilir. Veri setindeki bilgilerin kullanımı sonucunda doğabilecek herhangi bir sorumluluk kabul edilmez.
📄 Lisans
Bu proje Apache License 2.0 altında lisanslanmıştır. Uygun atıf yapılarak akademik ve ticari projelerde serbestçe kullanılabilir.
Bu dosya veripazari.com.tr topluluğu tarafından Hugging Face altyapısında barındırılmaktadır. Orijinal emeğe saygı kuralımız gereği lisans ve model isimleri korunmuştur.
