datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
curatorkit-testrun-Secrets
curatorkit-testrun-Secrets
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
curation
Backend
—
Model
—
Formats
alpaca
Artifact
dataset
Published
2026-08-30 05:55 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Secrets", "alpaca")
curatorkit-testrun-Prompt-Template
curatorkit-testrun-Prompt-Template
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
qa
Backend
litellm
Model
openai/Qwen/Qwen2.5-0.5B-Instruct
Formats
alpaca
Artifact
dataset
Published
2026-08-30 09:29 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Prompt-Template", "alpaca")
curatorkit-testrun-PII
curatorkit-testrun-PII
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
curation
Backend
—
Model
—
Formats
alpaca
Artifact
dataset
Published
2026-08-30 05:57 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-PII", "alpaca")
curatorkit-testrun-Embedding-Dedup
curatorkit-testrun-Embedding-Dedup
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
curation
Backend
—
Model
—
Formats
alpaca
Artifact
dataset
Published
2026-08-30 06:06 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Embedding-Dedup", "alpaca")
curatorkit-testrun-Clean-Dedup
curatorkit-testrun-Clean-Dedup
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
curation
Backend
—
Model
—
Formats
alpaca, sharegpt
Artifact
dataset
Published
2026-08-30 06:25 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Clean-Dedup", "alpaca")
curatorkit-testrun-Reward
curatorkit-testrun-Reward
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
qa
Backend
litellm
Model
openai/Qwen/Qwen2.5-0.5B-Instruct
Formats
alpaca
Artifact
dataset
Published
2026-09-01 05:12 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Reward", "alpaca")
curatorkit-testrun-Toxicity
curatorkit-testrun-Toxicity
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
curation
Backend
—
Model
—
Formats
alpaca
Artifact
dataset
Published
2026-08-30 06:00 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Toxicity", "alpaca")
curatorkit-testrun-Reward-Refiner
curatorkit-testrun-Reward-Refiner
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
qa
Backend
litellm
Model
openai/Qwen/Qwen2.5-0.5B-Instruct
Formats
alpaca
Artifact
dataset
Published
2026-09-01 05:06 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Reward-Refiner", "alpaca")
curatorkit-testrun-Adversarial-Preference
curatorkit-testrun-Adversarial-Preference
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
adversarial_preference
Backend
litellm
Model
openai/Qwen/Qwen2.5-0.5B-Instruct
Formats
dpo
Artifact
dataset
Published
2026-08-28 10:47 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Adversarial-Preference"… See the full description on the dataset page: https://huggingface.co/datasets/ram-lexsi/curatorkit-testrun-Adversarial-Preference.curatorkit-testrun-Checkpoint
curatorkit-testrun-Checkpoint
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
qa
Backend
litellm
Model
openai/Qwen/Qwen2.5-0.5B-Instruct
Formats
alpaca, sharegpt
Artifact
dataset
Published
2026-09-01 06:08 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Checkpoint", "alpaca")
curatorkit-testrun-Ingest
curatorkit-testrun-Ingest
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
curation
Backend
—
Model
—
Formats
alpaca
Artifact
dataset
Published
2026-09-01 05:41 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Ingest", "alpaca")
curatorkit-testrun-PDF
curatorkit-testrun-PDF
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
qa
Backend
litellm
Model
openai/Qwen/Qwen2.5-0.5B-Instruct
Formats
alpaca, sharegpt
Artifact
dataset
Published
2026-09-01 06:27 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-PDF", "alpaca")
curatorkit-testrun-CSVJSONParquet
curatorkit-testrun-CSVJSONParquet
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
curation
Backend
—
Model
—
Formats
alpaca, sharegpt
Artifact
dataset
Published
2026-09-01 05:51 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-CSVJSONParquet", "alpaca")
curatorkit-testrun-Multiturn
curatorkit-testrun-Multiturn
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
multiturn
Backend
litellm
Model
openai/Qwen/Qwen2.5-0.5B-Instruct
Formats
alpaca, sharegpt
Artifact
dataset
Published
2026-08-28 10:04 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Multiturn", "alpaca")
curatorkit-testrun-Hallucination
curatorkit-testrun-Hallucination
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
qa
Backend
litellm
Model
openai/Qwen/Qwen2.5-0.5B-Instruct
Formats
alpaca
Artifact
dataset
Published
2026-08-28 10:47 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Hallucination", "alpaca")
curatorkit-testrun-Diversity
curatorkit-testrun-Diversity
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
qa
Backend
litellm
Model
openai/Qwen/Qwen2.5-0.5B-Instruct
Formats
alpaca
Artifact
dataset
Published
2026-08-30 05:54 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Diversity", "alpaca")
curatorkit-testrun-Probe
curatorkit-testrun-Probe
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
qa
Backend
litellm
Model
openai/Qwen/Qwen2.5-0.5B-Instruct
Formats
alpaca
Artifact
dataset
Published
2026-08-30 06:03 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Probe", "alpaca")
curatorkit-testrun-Injector
curatorkit-testrun-Injector
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
qa
Backend
litellm
Model
openai/Qwen/Qwen2.5-0.5B-Instruct
Formats
alpaca
Artifact
dataset
Published
2026-08-30 06:13 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Injector", "alpaca")
curatorkit-testrun-OutputSplit
curatorkit-testrun-OutputSplit
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
curation
Backend
—
Model
—
Formats
test-alpaca, test-sharegpt, train-alpaca, train-sharegpt, val-alpaca, val-sharegpt
Artifact
dataset
Published
2026-09-01 04:54 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-OutputSplit"… See the full description on the dataset page: https://huggingface.co/datasets/ram-lexsi/curatorkit-testrun-OutputSplit.curatorkit-testrun-Filtered-FT
curatorkit-testrun-Filtered-FT
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
qa
Backend
litellm
Model
openai/Qwen/Qwen2.5-0.5B-Instruct
Formats
alpaca
Artifact
dataset
Published
2026-09-01 05:49 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Filtered-FT", "alpaca")
curatorkit-testrun-FormatDetector
curatorkit-testrun-FormatDetector
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
curation
Backend
—
Model
—
Formats
alpaca, sharegpt
Artifact
dataset
Published
2026-09-01 05:43 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-FormatDetector", "alpaca")
auditkit-testrun-lmeval
auditkit-testrun-lmeval
Built using AuditKIT — evaluate any model on any dataset and any task.
Method
evaluate
Model
vllm:Qwen/Qwen2.5-0.5B-Instruct
Artifact
run
Published
2026-09-02 06:19 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/auditkit-testrun-lmeval")
curatorkit-testrun-Preference
curatorkit-testrun-Preference
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
preference
Backend
litellm
Model
openai/Qwen/Qwen2.5-0.5B-Instruct
Formats
dpo
Artifact
dataset
Published
2026-08-28 09:57 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Preference", "dpo")
curatorkit-testrun-Hygiene
curatorkit-testrun-Hygiene
Built using CuratorKIT — provenance-grounded curation and synthesis for LLM post-training.
Method
curation
Backend
—
Model
—
Formats
alpaca
Artifact
dataset
Published
2026-09-01 05:33 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/curatorkit-testrun-Hygiene", "alpaca")
auditkit-testrun-compare
auditkit-testrun-compare
Built using AuditKIT — evaluate any model on any dataset and any task.
Method
compare_models
Model
—
Artifact
compare
Published
2026-09-02 06:50 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/auditkit-testrun-compare")
auditkit-testrun-encoder-judge
auditkit-testrun-encoder-judge
Built using AuditKIT — evaluate any model on any dataset and any task.
Method
evaluate
Model
<auditkit.model.vllm_gen.VLLMModel object at 0x7a6694415010>
Artifact
run
Published
2026-09-01 14:16 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/auditkit-testrun-encoder-judge")
auditkit-testrun-cli
auditkit-testrun-cli
Built using AuditKIT — evaluate any model on any dataset and any task.
Method
evaluate
Model
<auditkit.model.vllm_gen.VLLMModel object at 0x7c042bdabb60>
Artifact
run
Published
2026-09-02 05:37 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/auditkit-testrun-cli")
auditkit-testrun-metrics-embedding
auditkit-testrun-metrics-embedding
Built using AuditKIT — evaluate any model on any dataset and any task.
Method
evaluate
Model
<auditkit.model.vllm_gen.VLLMModel object at 0x7a62da714980>
Artifact
run
Published
2026-09-01 14:41 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/auditkit-testrun-metrics-embedding")
auditkit-testrun-redteam
auditkit-testrun-redteam
Built using AuditKIT — evaluate any model on any dataset and any task.
Method
redteam
Model
<auditkit.model.EchoModel object at 0x781f13372e40>
Artifact
redteam
Published
2026-09-01 12:49 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/auditkit-testrun-redteam")
auditkit-testrun-annotators
auditkit-testrun-annotators
Built using AuditKIT — evaluate any model on any dataset and any task.
Method
evaluate
Model
<auditkit.model.vllm_gen.VLLMModel object at 0x79713e2dacf0>
Artifact
run
Published
2026-09-02 04:38 UTC
Usage
from datasets import load_dataset
ds = load_dataset("ram-lexsi/auditkit-testrun-annotators")
