CoolFace
Modelpublic

codefuse-ai/CodeFuse-CodeGeeX2-6B

sourceHugging Faceotherupdated 3y agoView on Hugging Face
4likes16downloads
pytorch_model.bin.index.json208 linesDownload Raw Back to root
1{2  "metadata": {3    "total_size": 124871680644  },5  "weight_map": {6    "transformer.embedding.word_embeddings.weight": "pytorch_model-00001-of-00002.bin",7    "transformer.encoder.final_layernorm.weight": "pytorch_model-00002-of-00002.bin",8    "transformer.encoder.layers.0.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",9    "transformer.encoder.layers.0.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",10    "transformer.encoder.layers.0.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",11    "transformer.encoder.layers.0.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",12    "transformer.encoder.layers.0.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",13    "transformer.encoder.layers.0.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",14    "transformer.encoder.layers.0.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",15    "transformer.encoder.layers.1.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",16    "transformer.encoder.layers.1.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",17    "transformer.encoder.layers.1.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",18    "transformer.encoder.layers.1.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",19    "transformer.encoder.layers.1.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",20    "transformer.encoder.layers.1.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",21    "transformer.encoder.layers.1.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",22    "transformer.encoder.layers.10.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",23    "transformer.encoder.layers.10.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",24    "transformer.encoder.layers.10.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",25    "transformer.encoder.layers.10.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",26    "transformer.encoder.layers.10.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",27    "transformer.encoder.layers.10.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",28    "transformer.encoder.layers.10.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",29    "transformer.encoder.layers.11.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",30    "transformer.encoder.layers.11.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",31    "transformer.encoder.layers.11.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",32    "transformer.encoder.layers.11.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",33    "transformer.encoder.layers.11.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",34    "transformer.encoder.layers.11.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",35    "transformer.encoder.layers.11.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",36    "transformer.encoder.layers.12.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",37    "transformer.encoder.layers.12.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",38    "transformer.encoder.layers.12.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",39    "transformer.encoder.layers.12.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",40    "transformer.encoder.layers.12.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",41    "transformer.encoder.layers.12.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",42    "transformer.encoder.layers.12.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",43    "transformer.encoder.layers.13.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",44    "transformer.encoder.layers.13.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",45    "transformer.encoder.layers.13.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",46    "transformer.encoder.layers.13.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",47    "transformer.encoder.layers.13.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",48    "transformer.encoder.layers.13.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",49    "transformer.encoder.layers.13.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",50    "transformer.encoder.layers.14.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",51    "transformer.encoder.layers.14.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",52    "transformer.encoder.layers.14.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",53    "transformer.encoder.layers.14.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",54    "transformer.encoder.layers.14.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",55    "transformer.encoder.layers.14.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",56    "transformer.encoder.layers.14.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",57    "transformer.encoder.layers.15.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",58    "transformer.encoder.layers.15.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",59    "transformer.encoder.layers.15.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",60    "transformer.encoder.layers.15.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",61    "transformer.encoder.layers.15.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",62    "transformer.encoder.layers.15.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",63    "transformer.encoder.layers.15.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",64    "transformer.encoder.layers.16.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",65    "transformer.encoder.layers.16.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",66    "transformer.encoder.layers.16.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",67    "transformer.encoder.layers.16.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",68    "transformer.encoder.layers.16.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",69    "transformer.encoder.layers.16.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",70    "transformer.encoder.layers.16.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",71    "transformer.encoder.layers.17.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",72    "transformer.encoder.layers.17.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",73    "transformer.encoder.layers.17.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",74    "transformer.encoder.layers.17.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",75    "transformer.encoder.layers.17.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",76    "transformer.encoder.layers.17.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",77    "transformer.encoder.layers.17.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",78    "transformer.encoder.layers.18.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",79    "transformer.encoder.layers.18.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",80    "transformer.encoder.layers.18.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",81    "transformer.encoder.layers.18.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",82    "transformer.encoder.layers.18.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",83    "transformer.encoder.layers.18.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",84    "transformer.encoder.layers.18.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",85    "transformer.encoder.layers.19.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",86    "transformer.encoder.layers.19.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",87    "transformer.encoder.layers.19.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",88    "transformer.encoder.layers.19.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",89    "transformer.encoder.layers.19.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",90    "transformer.encoder.layers.19.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",91    "transformer.encoder.layers.19.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",92    "transformer.encoder.layers.2.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",93    "transformer.encoder.layers.2.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",94    "transformer.encoder.layers.2.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",95    "transformer.encoder.layers.2.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",96    "transformer.encoder.layers.2.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",97    "transformer.encoder.layers.2.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",98    "transformer.encoder.layers.2.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",99    "transformer.encoder.layers.20.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",100    "transformer.encoder.layers.20.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",101    "transformer.encoder.layers.20.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",102    "transformer.encoder.layers.20.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",103    "transformer.encoder.layers.20.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",104    "transformer.encoder.layers.20.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",105    "transformer.encoder.layers.20.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",106    "transformer.encoder.layers.21.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",107    "transformer.encoder.layers.21.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",108    "transformer.encoder.layers.21.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",109    "transformer.encoder.layers.21.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",110    "transformer.encoder.layers.21.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",111    "transformer.encoder.layers.21.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",112    "transformer.encoder.layers.21.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",113    "transformer.encoder.layers.22.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",114    "transformer.encoder.layers.22.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",115    "transformer.encoder.layers.22.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",116    "transformer.encoder.layers.22.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",117    "transformer.encoder.layers.22.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",118    "transformer.encoder.layers.22.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",119    "transformer.encoder.layers.22.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",120    "transformer.encoder.layers.23.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",121    "transformer.encoder.layers.23.mlp.dense_4h_to_h.weight": "pytorch_model-00002-of-00002.bin",122    "transformer.encoder.layers.23.mlp.dense_h_to_4h.weight": "pytorch_model-00002-of-00002.bin",123    "transformer.encoder.layers.23.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",124    "transformer.encoder.layers.23.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",125    "transformer.encoder.layers.23.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",126    "transformer.encoder.layers.23.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",127    "transformer.encoder.layers.24.input_layernorm.weight": "pytorch_model-00002-of-00002.bin",128    "transformer.encoder.layers.24.mlp.dense_4h_to_h.weight": "pytorch_model-00002-of-00002.bin",129    "transformer.encoder.layers.24.mlp.dense_h_to_4h.weight": "pytorch_model-00002-of-00002.bin",130    "transformer.encoder.layers.24.post_attention_layernorm.weight": "pytorch_model-00002-of-00002.bin",131    "transformer.encoder.layers.24.self_attention.dense.weight": "pytorch_model-00002-of-00002.bin",132    "transformer.encoder.layers.24.self_attention.query_key_value.bias": "pytorch_model-00002-of-00002.bin",133    "transformer.encoder.layers.24.self_attention.query_key_value.weight": "pytorch_model-00002-of-00002.bin",134    "transformer.encoder.layers.25.input_layernorm.weight": "pytorch_model-00002-of-00002.bin",135    "transformer.encoder.layers.25.mlp.dense_4h_to_h.weight": "pytorch_model-00002-of-00002.bin",136    "transformer.encoder.layers.25.mlp.dense_h_to_4h.weight": "pytorch_model-00002-of-00002.bin",137    "transformer.encoder.layers.25.post_attention_layernorm.weight": "pytorch_model-00002-of-00002.bin",138    "transformer.encoder.layers.25.self_attention.dense.weight": "pytorch_model-00002-of-00002.bin",139    "transformer.encoder.layers.25.self_attention.query_key_value.bias": "pytorch_model-00002-of-00002.bin",140    "transformer.encoder.layers.25.self_attention.query_key_value.weight": "pytorch_model-00002-of-00002.bin",141    "transformer.encoder.layers.26.input_layernorm.weight": "pytorch_model-00002-of-00002.bin",142    "transformer.encoder.layers.26.mlp.dense_4h_to_h.weight": "pytorch_model-00002-of-00002.bin",143    "transformer.encoder.layers.26.mlp.dense_h_to_4h.weight": "pytorch_model-00002-of-00002.bin",144    "transformer.encoder.layers.26.post_attention_layernorm.weight": "pytorch_model-00002-of-00002.bin",145    "transformer.encoder.layers.26.self_attention.dense.weight": "pytorch_model-00002-of-00002.bin",146    "transformer.encoder.layers.26.self_attention.query_key_value.bias": "pytorch_model-00002-of-00002.bin",147    "transformer.encoder.layers.26.self_attention.query_key_value.weight": "pytorch_model-00002-of-00002.bin",148    "transformer.encoder.layers.27.input_layernorm.weight": "pytorch_model-00002-of-00002.bin",149    "transformer.encoder.layers.27.mlp.dense_4h_to_h.weight": "pytorch_model-00002-of-00002.bin",150    "transformer.encoder.layers.27.mlp.dense_h_to_4h.weight": "pytorch_model-00002-of-00002.bin",151    "transformer.encoder.layers.27.post_attention_layernorm.weight": "pytorch_model-00002-of-00002.bin",152    "transformer.encoder.layers.27.self_attention.dense.weight": "pytorch_model-00002-of-00002.bin",153    "transformer.encoder.layers.27.self_attention.query_key_value.bias": "pytorch_model-00002-of-00002.bin",154    "transformer.encoder.layers.27.self_attention.query_key_value.weight": "pytorch_model-00002-of-00002.bin",155    "transformer.encoder.layers.3.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",156    "transformer.encoder.layers.3.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",157    "transformer.encoder.layers.3.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",158    "transformer.encoder.layers.3.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",159    "transformer.encoder.layers.3.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",160    "transformer.encoder.layers.3.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",161    "transformer.encoder.layers.3.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",162    "transformer.encoder.layers.4.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",163    "transformer.encoder.layers.4.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",164    "transformer.encoder.layers.4.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",165    "transformer.encoder.layers.4.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",166    "transformer.encoder.layers.4.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",167    "transformer.encoder.layers.4.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",168    "transformer.encoder.layers.4.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",169    "transformer.encoder.layers.5.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",170    "transformer.encoder.layers.5.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",171    "transformer.encoder.layers.5.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",172    "transformer.encoder.layers.5.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",173    "transformer.encoder.layers.5.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",174    "transformer.encoder.layers.5.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",175    "transformer.encoder.layers.5.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",176    "transformer.encoder.layers.6.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",177    "transformer.encoder.layers.6.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",178    "transformer.encoder.layers.6.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",179    "transformer.encoder.layers.6.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",180    "transformer.encoder.layers.6.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",181    "transformer.encoder.layers.6.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",182    "transformer.encoder.layers.6.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",183    "transformer.encoder.layers.7.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",184    "transformer.encoder.layers.7.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",185    "transformer.encoder.layers.7.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",186    "transformer.encoder.layers.7.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",187    "transformer.encoder.layers.7.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",188    "transformer.encoder.layers.7.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",189    "transformer.encoder.layers.7.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",190    "transformer.encoder.layers.8.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",191    "transformer.encoder.layers.8.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",192    "transformer.encoder.layers.8.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",193    "transformer.encoder.layers.8.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",194    "transformer.encoder.layers.8.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",195    "transformer.encoder.layers.8.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",196    "transformer.encoder.layers.8.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",197    "transformer.encoder.layers.9.input_layernorm.weight": "pytorch_model-00001-of-00002.bin",198    "transformer.encoder.layers.9.mlp.dense_4h_to_h.weight": "pytorch_model-00001-of-00002.bin",199    "transformer.encoder.layers.9.mlp.dense_h_to_4h.weight": "pytorch_model-00001-of-00002.bin",200    "transformer.encoder.layers.9.post_attention_layernorm.weight": "pytorch_model-00001-of-00002.bin",201    "transformer.encoder.layers.9.self_attention.dense.weight": "pytorch_model-00001-of-00002.bin",202    "transformer.encoder.layers.9.self_attention.query_key_value.bias": "pytorch_model-00001-of-00002.bin",203    "transformer.encoder.layers.9.self_attention.query_key_value.weight": "pytorch_model-00001-of-00002.bin",204    "transformer.output_layer.weight": "pytorch_model-00002-of-00002.bin",205    "transformer.rotary_pos_emb.inv_freq": "pytorch_model-00001-of-00002.bin"206  }207}208