qleap/Balanced_extended_dataset_by_NAGISA_V4
NAGISA_V4 balanced-extended teacher data 互角局面集を 37手目まで広げた将棋の局面に、NNUE エンジン (NAGISA_V4, HalfKA-2304) で depth 9・MultiPV 5 の評価値と候補手を付けた教師データ。 自己対局のコーパスではない。 対局は 1 局も指していない。1 行が 1 局面で、 局面同士に前後関係は無い。勝敗を持つデータが要るなら qleap/Knowledge_distilled_dataset_by_NAGISA_V4 のほう。 局面数: 25,075,766 シャード数: 26 (data/shard-00000.parquet … data/shard-00025.parquet) 合計: 1,606,525,370 B from datasets import load_dataset ds = load_dataset("qleap/Balanced_extended_dataset_by_NAGISA_V4", split="train")… See the full description on the dataset page: https://huggingface.co/datasets/qleap/Balanced_extended_dataset_by_NAGISA_V4.
docs: drop the train/val split prescription
Add the balanced-extended teacher corpus (25,075,766 positions, ply 32-37) (card)
Add the balanced-extended teacher corpus (25,075,766 positions, ply 32-37)
initial commit
