tapiocaTakeshi/qubit-xlarge-litertlm
026
Qubit NeuroQuantum (xlarge) — LiteRT-LM bundle
NeuroQuantum / QBNN モデルを Google LiteRT-LM 互換のバンドル形式 (.litertlm) で配布しています。
ファイル
qubit-neuroquantum-xlarge.litertlm— モデルバンドル (800.60 MB)TFLITE_MODEL_OR_WEIGHTSセクション: モデル重み (fp16 NPZ archive)SP_MODELセクション: SentencePiece トークナイザLLM_METADATA_JSONセクション: モデル / ランタイム設定MODEL_CARD_MDセクション: モデルカード
モデル仕様
推奨ランタイム設定
{
"n_ctx": 4096,
"n_batch": 64,
"n_threads": 4,
"n_gpu_layers": 0,
"temperature": 0.8,
"top_p": 0.9,
"top_k": 40
}ロード例
import struct, json
from pathlib import Path
MAGIC = b"LITERTLM"
with open("qubit-neuroquantum-xlarge.litertlm", "rb") as f:
assert f.read(8) == MAGIC
version, count = struct.unpack("<II", f.read(8))
# ... see generate_litertlm_models.py:read_litertlm_header完全なパーサ実装と生成スクリプトは tapiocatakeshi/Qubit の generate_litertlm_models.py を参照してください。
License
MIT
