datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
roadsign-judged-ensemble-agree1
Box-overlay preview
Auto-generated sample of the labelled boxes (with judge scores when available). Regenerated on every push.
openinterp-45-inference-ensemble
nb45 — Inference-Time Multi-Probe Ensemble (FG + RG fusion)
Headline result: combining FabricationGuard + ReasonGuard at inference time — applied to base Qwen3.6-27B with no retraining — produces +6.7 percentage points AUROC over the best single probe in detecting incorrect answers, at 0.18 ms total inference overhead per generation (Path A, vLLM streaming) or 148 ms (Path B, post-generation capture).
This validates the ProbePack product angle: ship probe ensembles as middleware… See the full description on the dataset page: https://huggingface.co/datasets/caiovicentino1/openinterp-45-inference-ensemble.docvqa-media-judged-ensemble
Box-overlay preview
Auto-generated sample of the labelled boxes (with judge scores when available). Regenerated on every push.
docvqa-media3-judged-ensemble-v2-agree1
Box-overlay preview
Auto-generated sample of the labelled boxes (with judge scores when available). Regenerated on every push.
roadsign-judged-ensemble-agree2
Box-overlay preview
Auto-generated sample of the labelled boxes (with judge scores when available). Regenerated on every push.
docvqa-media3-judged-ensemble-v2
Box-overlay preview
Auto-generated sample of the labelled boxes (with judge scores when available). Regenerated on every push.
roadsign-judged-ensemble-agree2-trainreadyroadsign-judged-ensemble-agree1-trainreadytest8k_ensembleRadiantCoils_Ensembletest8k_ensemble2
Dataset Card for fisheye8k_ensemble_mapped
This is a FiftyOne dataset with 8000 samples.
Installation
If you haven't already, install FiftyOne:
pip install -U fiftyone
Usage
import fiftyone as fo
from fiftyone.utils.huggingface import load_from_hub
# Load the dataset
# Note: other available arguments include 'max_samples', etc
dataset = load_from_hub("Abeyankar/test8k_ensemble2")
# Launch the App
session = fo.launch_app(dataset)
Dataset… See the full description on the dataset page: https://huggingface.co/datasets/Abeyankar/test8k_ensemble2.ensembleModelsInference_dls_dataset_sampleunet-ensemble-datasetensemble_outs
