Myungkyu/RoboDojo-taco-visual-gemini
RoboDojo-taco-visual-gemini The visual-grounding variant of RoboDojo-taco-gemini: the same RoboDojo long-horizon episodes (8 tasks, 800 episodes, 25 fps) with the same dense high-level labels (Gemini 3.7 Flash under the task-specific context induced for each task), except that a target position leaves the label text and is drawn into the low-level policy's keyframe slot. In the source labels a target that words cannot identify is named by its image coordinates on the 0–1000… See the full description on the dataset page: https://huggingface.co/datasets/Myungkyu/RoboDojo-taco-visual-gemini.
dense-labelled episodes (TACOR release) part 10/10
dense-labelled episodes (TACOR release) part 9/10
dense-labelled episodes (TACOR release) part 8/10
dense-labelled episodes (TACOR release) part 7/10
dense-labelled episodes (TACOR release) part 6/10
dense-labelled episodes (TACOR release) part 5/10
dense-labelled episodes (TACOR release) part 4/10
dense-labelled episodes (TACOR release) part 3/10
dense-labelled episodes (TACOR release) part 2/10
dense-labelled episodes (TACOR release) part 1/10
initial commit
