CoolFace
Modelpublic

Aratako/Ninja-v1-RP-WIP

sourceHugging Faceapache-2.0updated 2y agoView on Hugging Face
2likes36downloads
Model Card

Ninja-v1-RP-WIP

概要

Local-Novel-LLM-project/Ninja-v1-NSFWをロールプレイ用にLoRAでファインチューニングしたモデルです。

Aratako/Ninja-v1-RPのベースとなるモデルとして利用しています。

プロンプトフォーマット

Vicunaのchat templateを利用してください。また、設定などを渡すシステムプロンプトは最初のUSER: より前に入力されることを想定しています。

また、マルチターンの対話を行う場合各ターンのアシスタントの応答の末尾にeos_tokenを必ずつけてください。

{ロールプレイの指示、世界観・あらすじの説明、キャラの設定など}
USER: {userの最初の入力}
ASSISTANT: 

学習データセット

GPTやLlama2等の出力の学習利用時に問題があるモデルを使って作成されたデータセットは一切使っていません。

日本語データセット

英語データセット

学習の設定

RunpodでGPUサーバを借り、A6000x4で学習を行いました。主な学習パラメータは以下の通りです。

  • —lora_r: 128
  • —lisa_alpha: 256
  • —lora_dropout: 0.05
  • —loratargetmodules: ["qproj", "kproj", "vproj", "oproj", "gateproj", "upproj", "downproj", "lmhead"]
  • —learning_rate: 2e-5
  • —numtrainepochs: 3 epochs
  • —batch_size: 64
  • —maxseqlength: 4096