datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
pima-indians-diabetes-database
Pima Indians Diabetes Dataset Split
This directory contains split datasets of Pima Indians Diabetes Database.
For each splits, we have
Mock data: The mock data is a smaller dataset (10 rows for both train and test) that is used to test the model and data processing code.
Private data: Each private data contains 123-125 rows for training, and 32-33 rows for testing.
pima
pima
The pima dataset from the UCI ML repository.
Predict diabetes of a patient.
Configurations and tasks
Configuration
Task
Description
pima
Binary classification
Does the patient have diabetes?
Usage
from datasets import load_dataset
dataset = load_dataset("mstz/pima")["train"]
pima-indians-diabetes-database-partitions
Pima Indians Diabetes Dataset Split
This directory contains a dataset split for Pima Indians Diabetes Database.
Mock Data
The mock data is a smaller dataset (10 rows) that is used to test the model components.
Private Data
The private data is the remaining data that is used to train the model.
pi-mar-5PIMPIMA-Diabetes-PredictionPIMA-Diabetes-Prediction
