CoolFace
Datasetpublic

jevonmao/gtow-llama-sft-v3

GTO Wizard — Heads-Up NL Hold'em 200BB — SFT dataset (v3) Supervised fine-tuning data for heads-up No-Limit Texas Hold'em, 200 big blinds deep. Each row is a single decision point: a natural-language description of the game state, paired with the game-theory-optimal action GTO Wizard chose in that spot. Intended for instruction-tuning a chat LLM to play HU 200BB poker (see the pokerbench agent it was built for). Schema Two flat columns: Column Description… See the full description on the dataset page: https://huggingface.co/datasets/jevonmao/gtow-llama-sft-v3.

sourceHugging Faceupdated 4mo agoView on Hugging Face
0likes76downloads
7 commits on main
ff93c3f4mo ago

Upload dataset

jevonmao
5cc93294mo ago

Upload dataset

jevonmao
4a96da94mo ago

Upload dataset

jevonmao
4d210af4mo ago

Add dataset card

jevonmao
da163524mo ago

Upload dataset

jevonmao
a1657a04mo ago

Upload dataset

jevonmao
7783c954mo ago

initial commit

jevonmao