SanjanaMaria/deepvision-vlm-predictions
VLM Evaluation Predictions — Zeroshot-DeepVision-24k Model evaluation predictions and metrics from the Bengali Math VQA pipeline. Folder structure Baseline evaluation protocol Base model output is constrained via a system-level instruction to output only the Bengali MCQ option letter (ক/খ/গ/ঘ), ensuring format parity with the fine-tuned model.
Upload Qwen3-VL-4B-Instruct-ZS/baseline-testing/comparison_radar_chart.png with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/baseline-testing/comparison_bar_chart.png with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/baseline-testing/Qwen3-VL-4B-Instruct-ZS_comparison_table.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/Qwen3-VL-4B-Instruct-ZS_postfinetune_all_predictions.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/postfinetune_metrics_final.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/baseline-testing/comparison_radar_chart.png with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/baseline-testing/comparison_bar_chart.png with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/baseline-testing/Qwen3-VL-4B-Instruct-ZS_comparison_table.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/Qwen3-VL-4B-Instruct-ZS_postfinetune_all_predictions.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/postfinetune_metrics_final.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_1500.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_1400-1500.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_1400.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_1300-1400.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_1300.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_1200-1300.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_1200.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_1100-1200.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_1100.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_1000-1100.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_1000.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_0900-1000.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_0900.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_0800-0900.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_0800.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_0700-0800.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_0700.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_0600-0700.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_0600.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_0500-0600.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_0500.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_0400-0500.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_0400.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_0300-0400.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_0300.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_0200-0300.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_0200.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_0100-0200.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_0100.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/predictions_0000-0100.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/baseline-testing/baseline_radar_chart.png with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/baseline-testing/baseline_bar_chart.png with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/baseline-testing/Qwen3-VL-4B-Instruct-ZS_baseline_all_predictions.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/baseline-testing/baseline_metrics_final.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/baseline-testing/comparison_radar_chart.png with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/baseline-testing/comparison_bar_chart.png with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/baseline-testing/Qwen3-VL-4B-Instruct-ZS_comparison_table.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/Qwen3-VL-4B-Instruct-ZS_postfinetune_all_predictions.csv with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/postfinetune_metrics_final.json with huggingface_hub
Upload Qwen3-VL-4B-Instruct-ZS/post-finetune-testing/metrics_running_0200.json with huggingface_hub
