dvilasuero/bfcl-kimi
bfcl-kimi Evaluation Results Eval created with evaljobs. This dataset contains evaluation results for the model hf-inference-providers/moonshotai/Kimi-K2-Thinking:fastest using the eval inspect_evals/bfcl from Inspect Evals. To browse the results interactively, visit this Space. How to Run This Eval pip install git+https://github.com/dvsrepo/evaljobs.git export HF_TOKEN=your_token_here evaljobs dvilasuero/bfcl-kimi \ --model <your-model> \ --name <your-name>… See the full description on the dataset page: https://huggingface.co/datasets/dvilasuero/bfcl-kimi.
Upload samples.parquet with huggingface_hub
Upload evals.parquet with huggingface_hub
Delete hf://datasets/dvilasuero/bfcl-kimi/logs/.buffer/2025-11-25T14-39-23+00-00_bfcl_8zkPY6DUv9oVhN3vbLa9x9/ recursively
Upload logs/2025-11-25T14-39-23+00-00_bfcl_8zkPY6DUv9oVhN3vbLa9x9.eval with huggingface_hub
Upload logs/2025-11-25T14-39-23+00-00_bfcl_8zkPY6DUv9oVhN3vbLa9x9.eval with huggingface_hub
Upload logs/.buffer/2025-11-25T14-39-23+00-00_bfcl_8zkPY6DUv9oVhN3vbLa9x9/manifest.json with huggingface_hub
Upload logs/.buffer/2025-11-25T14-39-23+00-00_bfcl_8zkPY6DUv9oVhN3vbLa9x9/segment.3.zip with huggingface_hub
Upload logs/.buffer/2025-11-25T14-39-23+00-00_bfcl_8zkPY6DUv9oVhN3vbLa9x9/manifest.json with huggingface_hub
Upload logs/.buffer/2025-11-25T14-39-23+00-00_bfcl_8zkPY6DUv9oVhN3vbLa9x9/segment.2.zip with huggingface_hub
Upload logs/.buffer/2025-11-25T14-39-23+00-00_bfcl_8zkPY6DUv9oVhN3vbLa9x9/manifest.json with huggingface_hub
Upload logs/.buffer/2025-11-25T14-39-23+00-00_bfcl_8zkPY6DUv9oVhN3vbLa9x9/segment.1.zip with huggingface_hub
Upload logs/2025-11-25T14-39-23+00-00_bfcl_8zkPY6DUv9oVhN3vbLa9x9.eval with huggingface_hub
Upload logs/.buffer/2025-11-25T14-39-23+00-00_bfcl_8zkPY6DUv9oVhN3vbLa9x9/.keep with huggingface_hub
Delete hf://datasets/dvilasuero/bfcl-kimi/logs/Djw33rNJE6xNwVgAqFkojR
Upload logs/Djw33rNJE6xNwVgAqFkojR with huggingface_hub
Upload README.md with huggingface_hub
Upload logs/.gitkeep with huggingface_hub
initial commit
