datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
liquidrandom-data
liquidrandom-data
Diverse seed data for ML/LLM training data generation pipelines.
Used by the liquidrandom Python package.
Dataset Summary
This dataset contains 520,080 seed data samples across 24 categories,
generated using a hierarchical taxonomy tree approach with LLM-based quality validation
and fuzzy deduplication. Data is stored as Parquet with zstd compression.
Categories
Category
Samples
File
Coding Tasks
30,069… See the full description on the dataset page: https://huggingface.co/datasets/mlech26l/liquidrandom-data.Infusion-Bottle-Liquid-Type-Classification-Image-Dataset
Infusion Bottle Liquid Type Classification Image Dataset
The current medical industry faces challenges in liquid infusion management, such as inaccurate classification and low processing efficiency. Traditional manual classification methods often rely on experience, which can lead to errors. Existing solutions lack sufficient training data, resulting in inadequate accuracy of intelligent classification models. This dataset aims to provide a rich collection of liquid type image data… See the full description on the dataset page: https://huggingface.co/datasets/Mobiusi/Infusion-Bottle-Liquid-Type-Classification-Image-Dataset.Cooling-Liquid-Reservoir-Detection-Dataset
Cooling Liquid Reservoir Detection Dataset
The Cooling Liquid Reservoir Detection Dataset was created to address the growing challenge in the industrial sector of monitoring and maintaining cooling systems. Current practices often rely on manual inspections, which are time-consuming and prone to human error. Existing automated solutions lack the required accuracy and adaptability to various environments. This dataset aims to improve the detection of liquid levels and anomalies in… See the full description on the dataset page: https://huggingface.co/datasets/Mobiusi/Cooling-Liquid-Reservoir-Detection-Dataset.
