CoolFace
Modelpublic

MonumentalSystems/Ouroboros-1MContext-Gemma-270m

sourceHugging Faceapache-2.0updated 6mo agoView on Hugging Face
0likes27downloads
Model Card

Ouroboros-1MContext-Gemma-270m

1M-context extension of Google's Gemma 3 270M for episodic memory research.

Architecture

ParameterValue
Model typeGemma3ForCausalLM
Hidden size640
Intermediate size2048
Num layers18
Num attention heads4 (GQA, 1 KV head)
Head dim256
Vocab size262,144
Max position embeddings1,048,576 (1M context)
Total parameters268,098,176
VRAM (bfloat16)0.54 GB

LoRA Adapter Configuration (for episodic memory)

ParameterValue
Rank4
Alpha8
Target modulesgateproj, upproj, down_proj
Params per adapter580,608
Per LoRA pair (one layer, one module)10,752

Usage

python
from transformers import AutoModelForCausalLM, AutoTokenizer

model = AutoModelForCausalLM.from_pretrained("MonumentalSystems/Ouroboros-1MContext-Gemma-270m", torch_dtype="bfloat16")
tokenizer = AutoTokenizer.from_pretrained("MonumentalSystems/Ouroboros-1MContext-Gemma-270m")

Citation

Used in "Continuous Memory: Zero-Forgetting Episodic Memory via Per-Memory LoRA Adapters" (ICLR 2026 submission).

W&B runs: 41uzevnn, oa8xe89e, 2v01e4e9 (project: symbiogenesis)

License

Apache 2.0 (following Gemma 3 license)