Mori-kamiyama/qwen3.5-4b-jp-v1
017
Mori-kamiyama/qwen3.5-4b-jp-v1
Qwen/Qwen3.5-4B をベースに、日本語データで追加学習したモデルです。
概要
- ベースモデル:
Qwen/Qwen3.5-4B - 学習データ:
DataPilot/Zero_SFT_Ja_v3.5 - 学習設定:
stable_fast-test1000 - 対応言語: 日本語
今回公開しているのは LoRA アダプタではなく、ベースモデルにアダプタをマージしたフルモデルです。
学習について
このモデルは DataPilot/Zero_SFT_Ja_v3.5 から抽出した1000件のデータを使って学習されています。
使い方
from transformers import AutoModelForImageTextToText, AutoProcessor
model_id = "Mori-kamiyama/qwen3.5-4b-jp-v1"
processor = AutoProcessor.from_pretrained(model_id)
model = AutoModelForImageTextToText.from_pretrained(model_id)環境によっては AutoTokenizer と AutoModelForCausalLM でも利用できます。
注意
- 日本語向けに調整していますが、品質は限定的です。
test1000ベースのため、本番用というより確認用のモデルです。- ライセンスや利用条件はベースモデル
Qwen/Qwen3.5-4Bに従います。
謝辞
ベースモデルを開発したQwenチームとデータセットを構築したHoly-foxさんに心から感謝します。
