CoolFace
Datasetpublic

jbloom/openwebtext_tokenized_gemma-2-9b

Generated with SAELens. OpenWeb text pretokenized with Gemma-2 tokenizer. { "sae_lens_version": "3.11.0", "tokenizer_name": "google/gemma-2-9b", "original_dataset": "Skylion007/openwebtext", "original_split": "train", "original_data_files": null, "context_size": 1024, "shuffled": true, "seed": null, "begin_batch_token": "bos", "begin_sequence_token": null, "sequence_separator_token": "bos" }

sourceHugging Faceupdated 2y agoView on Hugging Face
0likes200downloads
Dataset Card

Generated with SAELens. OpenWeb text pretokenized with Gemma-2 tokenizer.

{
  "sae_lens_version": "3.11.0",
  "tokenizer_name": "google/gemma-2-9b",
  "original_dataset": "Skylion007/openwebtext",
  "original_split": "train",
  "original_data_files": null,
  "context_size": 1024,
  "shuffled": true,
  "seed": null,
  "begin_batch_token": "bos",
  "begin_sequence_token": null,
  "sequence_separator_token": "bos"
}