CoolFace
Datasetpublic

KitaSan/mecrab-jawiki-word2vec

MeCrab Japanese Word2Vec Vectors High-quality Japanese word embeddings trained on Wikipedia using MeCrab morphological analyzer. 📊 Dataset Summary This dataset contains pre-trained Japanese word embeddings optimized for use with MeCrab, a high-performance morphological analyzer. Key Features: ✅ Trained on Japanese Wikipedia ✅ Zero-copy binary format (MCV1) for fast loading ✅ Compatible with MeCrab Python API ✅ 300-dimensional vectors ✅ ~100,000 vocabulary size… See the full description on the dataset page: https://huggingface.co/datasets/KitaSan/mecrab-jawiki-word2vec.

sourceHugging Faceapache-2.0updated 9mo agoView on Hugging Face
1likes40downloads
settings

This repository belongs to KitaSan on Hugging Face.

CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.

namemecrab-jawiki-word2vec
visibilitypublic
licenceapache-2.0
gatedno
ownerKitaSan
Account settings
KitaSan/mecrab-jawiki-word2vec · CoolFace