CoolFace
Modelpublic

PVIS2027-JT-6597/LLaVA-OneVision-2-8B-SciVisCap

sourceHugging Faceapache-2.0updated 15d agoView on Hugging Face
0likes30downloads
Model Card

LLaVA-OneVision-2-8B-SciVisCap

This repository contains a LoRA adapter for lmms-lab-encoder/LLaVA-OneVision-2-8B-Instruct, trained on SciVisCap for scientific visualization (SciVis) figure captioning.

Training Configuration

  • —Epochs: 3 (final checkpoint)
  • —LoRA rank: 8
  • —LoRA alpha: 32
  • —Batch size: 8
  • —Learning rate: 1e-4 (cosine schedule, warmup ratio 0.1)
  • —Max sequence length: 4,096 tokens