zhendongnvidia/qwen3-tool-calling-sft-dataset
Tool Calling Dataset for Fine-Tuning High-quality tool calling dataset with consistent schema for supervised fine-tuning. Dataset Description This dataset contains 11 high-quality single-turn tool calling conversations in standard OpenAI chat completion format. Features ✅ Schema Consistent: All parameter types normalized across records ✅ Quality Filtered: GPT-4o-mini evaluated (score ≥ 7.0/10) ✅ OpenAI Compatible: Ready for direct use with OpenAI… See the full description on the dataset page: https://huggingface.co/datasets/zhendongnvidia/qwen3-tool-calling-sft-dataset.
Tool Calling Dataset for Fine-Tuning
High-quality tool calling dataset with consistent schema for supervised fine-tuning.
Dataset Description
This dataset contains 11 high-quality single-turn tool calling conversations in standard OpenAI chat completion format.
Features
- ✅ Schema Consistent: All parameter types normalized across records
- ✅ Quality Filtered: GPT-4o-mini evaluated (score ≥ 7.0/10)
- ✅ OpenAI Compatible: Ready for direct use with OpenAI fine-tuning API
- ✅ JSONL Format: One conversation per line
Format
Each record contains:
tools: Complete tool definitions with parametersmessages: OpenAI-format conversation with tool_callsmetadata: Quality scores and processing info
Usage
import json
from datasets import load_dataset
# Load dataset
dataset = load_dataset('zhendongnvidia/qwen3-tool-calling-sft-dataset')
# Or load directly from file
with open('consolidated_tool_calling_dataset.jsonl', 'r') as f:
data = [json.loads(line) for line in f]
# Use for fine-tuning
for record in data:
tools = record['tools']
messages = record['messages']
# Ready for OpenAI fine-tuning!Stats
- Records: 11 high-quality conversations
- Format: JSONL (newline-delimited JSON)
- Schema: Fully consistent across all records
- Generated: 2025-09-16 10:56:11
License
MIT License - Free for research and commercial use.
