CoolFace
Datasetpublic

visual-memory/Synthetic-Persona-Chat-FLUX-enhanced-Qwen3.5-9B

Visual Memory Results: synthetic-persona-chat-flux-enhanced This dataset contains the scored output of a visual-memory perplexity experiment. Experiment metadata { "experiment": { "model_name": "Qwen/Qwen3.5-9B", "hf_results_repo": "visual-memory/Synthetic-Persona-Chat-FLUX-enhanced-Qwen3.5-9B", "results_jsonl": "results/Synthetic-Persona-Chat-FLUX-enhanced-Qwen3.5-9B.jsonl", "hf_dataset":… See the full description on the dataset page: https://huggingface.co/datasets/visual-memory/Synthetic-Persona-Chat-FLUX-enhanced-Qwen3.5-9B.

sourceHugging Faceupdated 8d agoView on Hugging Face
0likes50downloads
Dataset Card

Visual Memory Results: synthetic-persona-chat-flux-enhanced

This dataset contains the scored output of a visual-memory perplexity experiment.

Experiment metadata

json
{
  "experiment": {
    "model_name": "Qwen/Qwen3.5-9B",
    "hf_results_repo": "visual-memory/Synthetic-Persona-Chat-FLUX-enhanced-Qwen3.5-9B",
    "results_jsonl": "results/Synthetic-Persona-Chat-FLUX-enhanced-Qwen3.5-9B.jsonl",
    "hf_dataset": "visual-memory/Synthetic-Persona-Chat-With-Ids_1k-no-redundancy",
    "hf_mapping_dataset": "visual-memory/Synthetic-Persona-Chat-Mapping_1k-no-redundancy",
    "hf_image_dataset": "visual-memory/Synthetic-Persona-Chat-Mapping_1k-FLUX-enhanced-no-redundancy",
    "hf_split": "train",
    "num_samples": 0,
    "batch_size": 8,
    "preprocess_chunk_size": 8,
    "max_seq_len": 4096,
    "compile": false,
    "clear_hf_model_cache": false,
    "device": "cuda:0",
    "image_preprocessing_device": "cuda",
    "dtype": "bfloat16",
    "strategies": [
      "baseline",
      "see_only_you"
    ],
    "name": "synthetic-persona-chat-flux-enhanced"
  },
  "model_default_config": {
    "transformers_version": "5.17.0",
    "architectures": [
      "Qwen3_5ForConditionalGeneration"
    ],
    "output_hidden_states": false,
    "return_dict": true,
    "dtype": "bfloat16",
    "chunk_size_feed_forward": 0,
    "is_encoder_decoder": false,
    "id2label": {
      "0": "LABEL_0",
      "1": "LABEL_1"
    },
    "label2id": {
      "LABEL_0": 0,
      "LABEL_1": 1
    },
    "problem_type": null,
    "text_config": {
      "architectures": null,
      "output_hidden_states": false,
      "return_dict": true,
      "dtype": "bfloat16",
      "chunk_size_feed_forward": 0,
      "is_encoder_decoder": false,
      "id2label": {
        "0": "LABEL_0",
        "1": "LABEL_1"
      },
      "label2id": {
        "LABEL_0": 0,
        "LABEL_1": 1
      },
      "problem_type": null,
      "vocab_size": 248320,
      "hidden_size": 4096,
      "intermediate_size": 12288,
      "num_hidden_layers": 32,
      "num_attention_heads": 16,
      "num_key_value_heads": 4,
      "hidden_act": "silu",
      "max_position_embeddings": 262144,
      "initializer_range": 0.02,
      "rms_norm_eps": 1e-06,
      "use_cache": true,
      "tie_word_embeddings": false,
      "rope_parameters": {
        "mrope_interleaved": true,
        "mrope_section": [
          11,
          11,
          10
        ],
        "rope_type": "default",
        "rope_theta": 10000000,
        "partial_rotary_factor": 0.25
      },
      "attention_bias": false,
      "attention_dropout": 0.0,
      "head_dim": 256,
      "linear_conv_kernel_dim": 4,
      "linear_key_head_dim": 128,
      "linear_value_head_dim": 128,
      "linear_num_key_heads": 16,
      "linear_num_value_heads": 32,
      "layer_types": [
        "linear_attention",
        "linear_attention",
        "linear_attention",
        "full_attention",
        "linear_attention",
        "linear_attention",
        "linear_attention",
        "full_attention",
        "linear_attention",
        "linear_attention",
        "linear_attention",
        "full_attention",
        "linear_attention",
        "linear_attention",
        "linear_attention",
        "full_attention",
        "linear_attention",
        "linear_attention",
        "linear_attention",
        "full_attention",
        "linear_attention",
        "linear_attention",
        "linear_attention",
        "full_attention",
        "linear_attention",
        "linear_attention",
        "linear_attention",
        "full_attention",
        "linear_attention",
        "linear_attention",
        "linear_attention",
        "full_attention"
      ],
      "pad_token_id": null,
      "bos_token_id": null,
      "eos_token_id": 248044,
      "_name_or_path": "",
      "attn_output_gate": true,
      "full_attention_interval": 4,
      "mlp_only_layers": [],
      "model_type": "qwen3_5_text",
      "mtp_num_hidden_layers": 1,
      "mtp_use_dedicated_embeddings": false,
      "mamba_ssm_dtype": "float32",
      "partial_rotary_factor": 0.25,
      "output_attentions": false
    },
    "vision_config": {
      "architectures": null,
      "output_hidden_states": false,
      "return_dict": true,
      "dtype": "bfloat16",
      "chunk_size_feed_forward": 0,
      "is_encoder_decoder": false,
      "id2label": {
        "0": "LABEL_0",
        "1": "LABEL_1"
      },
      "label2id": {
        "LABEL_0": 0,
        "LABEL_1": 1
      },
      "problem_type": null,
      "depth": 27,
      "hidden_size": 1152,
      "hidden_act": "gelu_pytorch_tanh",
      "intermediate_size": 4304,
      "num_heads": 16,
      "in_channels": 3,
      "patch_size": 16,
      "spatial_merge_size": 2,
      "temporal_patch_size": 2,
      "out_hidden_size": 4096,
      "num_position_embeddings": 2304,
      "initializer_range": 0.02,
      "rope_parameters": {
        "rope_theta": 10000.0,
        "rope_type": "axial"
      },
      "_name_or_path": "",
      "deepstack_visual_indexes": [],
      "model_type": "qwen3_5_vision",
      "output_attentions": false
    },
    "image_token_id": 248056,
    "video_token_id": 248057,
    "vision_start_token_id": 248053,
    "vision_end_token_id": 248054,
    "tie_word_embeddings": false,
    "_name_or_path": "Qwen/Qwen3.5-9B",
    "model_type": "qwen3_5",
    "output_attentions": false
  },
  "preprocessing": {
    "chunk_size": 8,
    "requested_device": "cuda",
    "resolved_device": "cuda:0",
    "backend": "torchvision",
    "used_gpu": true,
    "fallback_reason": null
  }
}