CoolFace
Datasetpublic

minhxthanh/Vietnam-History-200K-Vi

Bộ dữ liệu 200,000 mẫu (tiếng Việt) về lịch sử Việt Nam 905–2025, đúng định dạng messages cho mô hình tư duy (analysis) và mô hình thường (final-only). Thông tin chính Ngôn ngữ: Tiếng Việt Phạm vi: 905–2025 (các mốc, nhân vật, trận đánh, văn bản, cải cách, thời kỳ…) Định dạng: messages theo ShareGPT/ChatML Mẫu có reasoning (~78%): system → user → assistant (analysis) → assistant (final) Mẫu final-only (~22%): system → user → assistant (final) Tính đa dạng câu hỏi: theo năm, theo sự… See the full description on the dataset page: https://huggingface.co/datasets/minhxthanh/Vietnam-History-200K-Vi.

sourceHugging Facemitupdated 1y agoView on Hugging Face
0likes53downloads
Dataset Card

Bộ dữ liệu 200,000 mẫu (tiếng Việt) về lịch sử Việt Nam 905–2025, đúng định dạng messages cho mô hình tư duy (analysis) và mô hình thường (final-only).

Thông tin chính

  • —Ngôn ngữ: Tiếng Việt
  • —Phạm vi: 905–2025 (các mốc, nhân vật, trận đánh, văn bản, cải cách, thời kỳ…)
  • —Định dạng: messages theo ShareGPT/ChatML
  • —Mẫu có reasoning (~78%): system → user → assistant (analysis) → assistant (final)
  • —Mẫu final-only (~22%): system → user → assistant (final)
  • —Tính đa dạng câu hỏi: theo năm, theo sự kiện, theo nhân vật, vì sao/như thế nào, tóm tắt bối cảnh–diễn biến–kết quả.

Learn more on GitHub: https://github.com/MinhxThanh/Vietnam-History-Chat-Datasets