CoolFace
Datasetpublic

Taklaxbr/turkish_law_qa_dataset

Not: Bu veri seti orijinal olarak OrionCAF tarafından geliştirilmiş olup, VeriPazarı tarafından Türk AI ekosistemi için arşivlenmiştir. 🔗 Orijinal Kaynak: OrionCAF/turkish_law_qa_dataset 🔗 Derleyen Platform: VeriPazarı 📚 Türkçe Hukuk Soru-Cevap Veri Seti (Turkish Law QA Dataset) Turkish Law QA Dataset, Türk hukuku üzerine odaklanmış, çeşitli hukuki metinlerden, içtihatlardan ve mevzuatlardan titizlikle derlenmiş 18.300+ soru-cevap çiftinden oluşan kapsamlı bir veri setidir.… See the full description on the dataset page: https://huggingface.co/datasets/Taklaxbr/turkish_law_qa_dataset.

sourceHugging Faceapache-2.0updated 4mo agoView on Hugging Face
0likes88downloads
Dataset Card
Not: Bu veri seti orijinal olarak OrionCAF tarafından geliştirilmiş olup, VeriPazarı tarafından Türk AI ekosistemi için arşivlenmiştir. 🔗 Orijinal Kaynak: OrionCAF/turkish_law_qa_dataset 🔗 Derleyen Platform: VeriPazarı

📚 Türkçe Hukuk Soru-Cevap Veri Seti (Turkish Law QA Dataset)

Turkish Law QA Dataset, Türk hukuku üzerine odaklanmış, çeşitli hukuki metinlerden, içtihatlardan ve mevzuatlardan titizlikle derlenmiş 18.300+ soru-cevap çiftinden oluşan kapsamlı bir veri setidir.

Bu veri seti, özellikle hukuk alanında uzmanlaşmış Büyük Dil Modellerini (LLM) ince ayarlamak (fine-tuning), RAG (Retrieval-Augmented Generation) sistemlerinin performansını test etmek ve Türk hukuk sistemine hakim yapay zeka asistanları geliştirmek amacıyla OrionCAF ekibi tarafından hazırlanmıştır.

✨ İçerik ve Özellikler

Bu veri seti, ham hukuk verilerinin işlenerek "Soru" ve "Cevap" formatına dönüştürülmesiyle oluşturulmuştur.

  • —Kapsamlı Hukuk Bilgisi: İstihkak Davası, Sebepsiz Zenginleşme, Limited Şirketler, Ticaret Hukuku gibi birçok kritik konuyu içerir.
  • —Temiz ve Yapılandırılmış: Her kayıt question (soru) ve answer (cevap) alanlarından oluşan temiz bir JSON formatındadır.
  • —Yüksek Kalite: Hukuki terminolojiye sadık kalınarak hazırlanmış uzman yanıtlar içerir.
  • —Çok Yönlü Kullanım: * LLM Fine-tuning (Eğitim)
  • —RAG Benchmark (Test ve Kıyaslama)
  • —Hukuki Chatbot Geliştirme

🚀 Hızlı Başlangıç

Bu veri setini Hugging Face datasets kütüphanesi ile saniyeler içinde indirebilir ve kullanmaya başlayabilirsiniz.

python
from datasets import load_dataset

# Veri setini yükle
dataset = load_dataset("OrionCAF/turkish_law_qa_dataset")

# İlk örneği görüntüle
print(dataset['train'][0])

# Çıktı Örneği:
# {
#   'question': 'İstihkak davasının amacı nedir ve hangi durumlarda uygulanır?',
#   'answer': 'İstihkak davasının amacı, haksız olarak elde bulundurulan malın geri alınmasıdır...'
# }

🧠 Veri Seti Detayları

ÖzellikDeğer
Veri Seti AdıTurkish Law QA Dataset
YayınlayanOrionCAF
Toplam Veri Sayısı18.305 Çift
FormatJSON / Parquet
DilTürkçe (TR)
KaynaklarTürk Hukuk Mevzuatı, Yargıtay Kararları, Hukuki Makaleler
LisansApache 2.0

👥 Ekibimiz

Bu veri seti, açık kaynak yapay zeka ekosistemine katkı sağlamak amacıyla OrionCAF ekibi tarafından geliştirilmiştir.

  • —Ferhat Kürkçüoğlu
  • —Cengizhan Bayram
  • —Cevdet Ahmet Turan

Ekibe katılmak, katkı sağlamak veya geri bildirimde bulunmak için orijinal Hugging Face sayfasındaki "Discussions" sekmesini kullanabilirsiniz.

⚠️ Yasal Uyarı

ÖNEMLİ NOT: Bu veri seti yalnızca eğitim ve araştırma amaçlıdır. İçerdiği bilgiler profesyonel hukuki tavsiye niteliği taşımaz. Hukuk, dinamik bir alandır; mevzuat değişiklikleri veya içtihat farklılıkları yaşanabilir. Veri setindeki bilgilerin kullanımı sonucunda doğabilecek herhangi bir sorumluluk kabul edilmez.

📄 Lisans

Bu proje Apache License 2.0 altında lisanslanmıştır. Uygun atıf yapılarak akademik ve ticari projelerde serbestçe kullanılabilir.


Bu dosya veripazari.com.tr topluluğu tarafından Hugging Face altyapısında barındırılmaktadır. Orijinal emeğe saygı kuralımız gereği lisans ve model isimleri korunmuştur.