CoolFace
Modelpublic

Aratako/c4ai-command-r-v01-japanese-instruct

sourceHugging Facecc-by-nc-sa-4.0updated 2y agoView on Hugging Face
4likes153downloads
Model Card

c4ai-command-r-v01-japanese-instruct

GGUF版はこちら/Click here for the GGUF version

概要

CohereForAI/c4ai-command-r-v01を、ichikara-instructionを使って追加で日本語インストラクションチューニングを施したモデルです。

学習の設定

RunpodでGPUサーバを借り、A6000x4で学習を行いました。主な学習パラメータは以下の通りです。

  • —lora_r: 64
  • —lisa_alpha: 128
  • —lora_dropout: 0.05
  • —loratargetmodules: ["qproj", "kproj", "vproj", "oproj", "gateproj", "upproj", "down_proj"]
  • —learning_rate: 2e-5
  • —numtrainepochs: 10epochs
  • —batch_size: 50
  • —maxseqlength: 2048

評価

jsquad(jsquad-1.1-0.3, 2-shots)、jcommonsenseqa(jcommonsenseqa-1.1-0.3, 3-shots)、jnli(jnli-1.3-0.3, 3-shots)、marcja(marcja-1.1-0.3, 3-shots)結果は以下の通りです。 (8ビット量子化/jsquadは100で割り、それぞれ小数点以下第4位を四捨五入)

平均スコアの向上が見受けられます。

Modeljsquad(exact_match)jcommonsenseqa(acc)jnli(acc)marc_ja(acc)average
c4ai-command-r-v010.8090.9020.4660.9540.783
c4ai-command-r-v01-japanese-instruct0.8360.9110.5370.9400.806

評価にはlm-evaluation-harnessを利用しました。

また、元モデルと本モデルのjapanese-mt-benchの結果は以下の通りです。(シングルターン、4ビット量子化)

スコア的にはあまり変わりませんでした。ただし、元モデルの出力の中には時々英語が混ざっていましたが、目視で確認した範囲だと混ざらなくなっていたので学習の効果は多少はありそうです。

ModelCodingExtractionHumanitiesMathReasoningRoleplaySTEMWritingavg_score
c4ai-command-r-v016.17.99.72.46.08.39.88.67.35
c4ai-command-r-v01-japanese-instruct5.68.38.13.46.17.99.28.67.15

[image]

余談ですが、英語ベンチマークであるOpen LLM Leaderboard)のスコアもなぜかわずかに向上していました。 詳細

Metricc4ai-command-r-v01**c4ai-command-r-v01-japanese-instruct**
Avg.68.5468.85
AI2 Reasoning Challenge (25-Shot)65.5365.87
HellaSwag (10-Shot)8785.62
MMLU (5-Shot)68.267.61
TruthfulQA (0-shot)52.3251.01
Winogrande (5-shot)81.5382.95
GSM8k (5-shot)56.6360.05

ライセンス

元モデルであるCohereForAI/c4ai-command-r-v01はCC-BY-NC 4.0とC4AI's Acceptable Use Policyのもとに配布されています。

また、ファインチューニングに利用したデータセットであるichikara-instructionはCC-BY-NC-SA 4.0の元配布されています。

そのため、このモデルのライセンスはCC-BY-NC-SA 4.0及びC4AI's Acceptable Use Policyとなります。(理解間違っていればご指摘ください)