CoolFace
Modelpublic

Clover-Hill/MemoryDecoder-Qwen-law

sourceHugging Faceapache-2.0updated 11mo agoView on Hugging Face
0likes9downloads
Model Card

Model Description

This Memory Decoder model is trained on the Law domain and can be adapted to enhance any model in the Qwen2 and Qwen2.5 families.

Paper: Memory Decoder: A Pretrained, Plug-and-Play Memory for Large Language Models

GitHub: https://github.com/LUMIA-Group/MemoryDecoder

Training & Evaluation Data

Law Domain Dataset: AsyLex

Test Split: MemoryDecoder-domain-data

Performance Results

Qwen2 Family

ModelBase ModelBase + MemDec
Qwen2-0.5B10.234.57
Qwen2-1.5B7.694.32
Qwen2-7B5.924.00
Qwen2-72B4.843.69

Qwen2.5 Family

ModelBase ModelBase + MemDec
Qwen2.5-0.5B9.864.57
Qwen2.5-1.5B7.424.29
Qwen2.5-3B6.684.16
Qwen2.5-7B5.944.01
Qwen2.5-14B5.353.86
Qwen2.5-32B5.183.81
Qwen2.5-72B4.843.70

Perplexity scores on Law domain test set. Lower is better.

Citation

bibtex
@article{cao2025memory,
  title={Memory decoder: A pretrained, plug-and-play memory for large language models},
  author={Cao, Jiaqi and Wang, Jiarui and Wei, Rubin and Guo, Qipeng and Chen, Kai and Zhou, Bowen and Lin, Zhouhan},
  journal={arXiv preprint arXiv:2508.09874},
  year={2025}
}

Contact

For questions and support: maximus.cao@outlook.com