acq
acquisition_student_AS_confidence_medmcqa_qwen7b_10000acquisition_student_random_omnimath_qwen14bacquisition_student_llama8bins_omnimath_confidenceacquisition_student_random_medmcqa_qwen7b_10000acquisition_generator_AS_gradient_omnimath_qwen14bacquisition_generator_AS_confidence_medmcqa_qwen7bacquisition_generator_AS_diversity_omnimath_qwen14bacquisition_llama8bins_omnimath_confidence
Datasets
All datasets matching “acq”cryoem-acquisition
Cryo-EM Autonomous Acquisition Dataset
Data for training agents that decide which grid square and foil hole to image next during a cryo-EM session, so a sample reaches its target in the fewest acquisitions and the least instrument time.
Four EPU sessions derived from public EMPIAR depositions. Every acquisition carries what a live cryoSPARC Live session reports about 70 s after the exposure (particles, CTF fit, ice, 2D-class orientation profile), plus pre-acquisition hole… See the full description on the dataset page: https://huggingface.co/datasets/xkronosx/cryoem-acquisition.auxiliary-views-knowledge-acquisition
Auxiliary Views Knowledge Acquisition
This repository contains the cleaned source documents and evaluation
probes used in Knowledge Acquisition During Pre-training? Large Language Models
Learn Better With Auxiliary Views (arXiv:2609.04180).
News
August 21, 2026: Our paper was accepted to Findings of EMNLP 2026.
Configurations
Configuration
Split
Rows
documents
train
30
factual_cloze
test
6,435
factual_mcqa_5shot
test
4,515… See the full description on the dataset page: https://huggingface.co/datasets/jiosephlee/auxiliary-views-knowledge-acquisition.assistive-ocr-data-acquisition
Assistive OCR Benchmark Data
Multilingual OCR benchmark for visually impaired assistance — Indian medicine labels, packaged goods, and signage in Bengali, Hindi, and English.
Dataset Summary
Property
Value
Total images
7,004 rows in manifest
Image sources
images/hf_medicines/, images/openfoodfacts/, images/synthetic/
Domains
medicine_packaging (6,588), packaged_goods (386), signage (30)
Languages
bn+en (5,337), hi+en (868), en (799)
Splits
dev… See the full description on the dataset page: https://huggingface.co/datasets/Arko007/assistive-ocr-data-acquisition.ai-acquisitions-2026
ai-acquisitions-2026
AI data collected daily by Legion API.
🔑 API Access — Updated Daily
Live data via Legion AI API
Free: 100 req/day · Pro €29/month: 50K req/day + full fields
curl "https://api.legion-api.com/incidents?limit=10" -H "X-API-Key: YOUR_PRO_KEY"
Premium archive (1,285 incidents, full analysis): AISI Intelligence Pack €299
📦 Install
pip install legion-intel
from legion_intel import LegionClient
c = LegionClient()… See the full description on the dataset page: https://huggingface.co/datasets/gemmozero/ai-acquisitions-2026.English-Age-of-Acquisition
English Age-of-Acquisition (AoA)
This is the dataset provided by Kuperman et. al (2012) https://link.springer.com/article/10.3758/s13428-012-0210-4.
Federal-Acquisition-Regulation
📚 Federal Acquisition Regulation
Maintainer: Terry Eppler
Ownership: US Federal Government
📋 Overview
Dataset Summary
The Federal Acquisition Regulation Dataset is a structured natural-language dataset
derived from the Federal Acquisition Regulation, commonly known as the FAR.
The FAR is the primary governmentwide regulation governing acquisition by executive
agencies. It provides uniform policies and procedures for federal procurement… See the full description on the dataset page: https://huggingface.co/datasets/leeroy-jankins/Federal-Acquisition-Regulation.
