ram-lexsi/auditkit-testrun-metrics-pairwise
auditkit-testrun-metrics-pairwise Built using AuditKIT — evaluate any model on any dataset and any task. Method evaluate Model <auditkit.model.vllm_gen.VLLMModel object at 0x7b06d84f8d70> Artifact run Published 2026-09-01 14:26 UTC Usage from datasets import load_dataset ds = load_dataset("ram-lexsi/auditkit-testrun-metrics-pairwise")
037
