CoolFace
Datasetpublic

Hoppaaa/Vietnamese-Food-VQA

Vietnamese Food VQA Dataset Bộ dữ liệu Hỏi đáp Hình ảnh (VQA) chuyên biệt cho các món ăn Việt Nam. Được xây dựng phục vụ cho mục đích nghiên cứu và học tập trong lĩnh vực Deep Learning. Thông tin bộ dữ liệu Ngôn ngữ: Tiếng Việt Lĩnh vực: Ẩm thực Việt Nam (Phở, Bún bò, Bánh mì, Cơm tấm, v.v.) Số lượng mẫu: ~2500 - 10000 QA pairs (bao gồm dữ liệu đã augmented) Định dạng: Ảnh: .jpg Nhãn: .json (train, val, test) Cấu trúc thư mục trên Hugging Face… See the full description on the dataset page: https://huggingface.co/datasets/Hoppaaa/Vietnamese-Food-VQA.

sourceHugging Facecc-by-4.0updated 5mo agoView on Hugging Face
0likes4downloads
Dataset Card

language:

  • vi license: mit task_categories:
  • visual-question-answering tags:
  • food
  • vqa
  • vietnamese size_categories:
  • 1K<n<10K ---

Vietnamese Food VQA Dataset

Bộ dữ liệu Hỏi đáp Hình ảnh (VQA) chuyên biệt cho các món ăn Việt Nam. Được xây dựng phục vụ cho mục đích nghiên cứu và học tập trong lĩnh vực Deep Learning.

Thông tin bộ dữ liệu

  • Ngôn ngữ: Tiếng Việt
  • Lĩnh vực: Ẩm thực Việt Nam (Phở, Bún bò, Bánh mì, Cơm tấm, v.v.)
  • Số lượng mẫu: ~2500 - 10000 QA pairs (bao gồm dữ liệu đã augmented)
  • Định dạng:
  • Ảnh: .jpg
  • Nhãn: .json (train, val, test)

Cấu trúc thư mục trên Hugging Face

text
data/
├── annotations/
│   ├── train.json           # Dữ liệu huấn luyện gốc
│   ├── train_cot.json       # Dữ liệu huấn luyện có giải thích (Chain-of-Thought)
│   ├── val.json             # Dữ liệu kiểm định
│   └── test_final.json      # Dữ liệu kiểm tra cuối cùng
├── images/                  # Thư mục chứa toàn bộ ảnh món ăn
└── scripts/                 # Các mã nguồn dùng để tăng cường dữ liệu

Cách sử dụng

Bạn có thể tải bộ dữ liệu này bằng thư viện huggingface_hub:

python
from huggingface_hub import snapshot_download

snapshot_download(
    repo_id="Hoppaaa/Vietnamese-Food-VQA", 
    repo_type="dataset", 
    local_dir="./my_dataset"
)

Định dạng dữ liệu (JSON)

Mỗi mẫu trong file JSON có cấu trúc như sau:

json
{
  "image": "pho_01.jpg",
  "qa": [
    {
      "question": "Đây là món gì?",
      "answer": "Phở bò",
      "rationale": "Quan sát thấy có bánh phở trắng, lát thịt bò và nước dùng trong...",
      "cot_answer": "Quan sát thấy... Vì vậy, đáp án là: Phở bò"
    }
  ]
}