CoolFace
Datasetpublic

ChatterjeeLab/PeptiVerse_data

sourceHugging Faceupdated 5mo agoView on Hugging Face
0likes694downloads
README.md1240 linesDownload Raw Back to root
1---2dataset_info:3- config_name: binding_affinity__pair_wt_chemberta_pooled4  features:5  - name: target_sequence6    dtype: string7  - name: sequence8    dtype: string9  - name: label10    dtype: float6411  - name: target_embedding12    list: float3213  - name: binder_embedding14    list: float3215  - name: affinity16    dtype: float6417  - name: affinity_class18    dtype: string19  - name: smiles_iptm_score20    dtype: float6421  splits:22  - name: train23    num_bytes: 974242924    num_examples: 134925  - name: val26    num_bytes: 254696927    num_examples: 35328  download_size: 1440892929  dataset_size: 1228939830- config_name: binding_affinity__pair_wt_chemberta_unpooled31  features:32  - name: target_sequence33    dtype: string34  - name: sequence35    dtype: string36  - name: label37    dtype: float6438  - name: target_embedding39    list:40      list: float1641  - name: target_attention_mask42    list: int843  - name: target_length44    dtype: int6445  - name: binder_embedding46    list:47      list: float1648  - name: binder_attention_mask49    list: int850  - name: binder_length51    dtype: int6452  - name: affinity53    dtype: float6454  - name: affinity_class55    dtype: string56  - name: smiles_iptm_score57    dtype: float6458  splits:59  - name: train60    num_bytes: 101462911361    num_examples: 134962  - name: val63    num_bytes: 26455935364    num_examples: 35365  download_size: 125590938166  dataset_size: 127918846667- config_name: binding_affinity__pair_wt_peptideclm_pooled68  features:69  - name: target_sequence70    dtype: string71  - name: sequence72    dtype: string73  - name: label74    dtype: float6475  - name: target_embedding76    list: float3277  - name: binder_embedding78    list: float3279  - name: affinity80    dtype: float6481  - name: affinity_class82    dtype: string83  - name: smiles_iptm_score84    dtype: float6485  splits:86  - name: train87    num_bytes: 1181449388    num_examples: 134989  - name: val90    num_bytes: 308917791    num_examples: 35392  download_size: 1759959793  dataset_size: 1490367094- config_name: binding_affinity__pair_wt_peptideclm_unpooled95  features:96  - name: target_sequence97    dtype: string98  - name: sequence99    dtype: string100  - name: label101    dtype: float64102  - name: target_embedding103    list:104      list: float16105  - name: target_attention_mask106    list: int8107  - name: target_length108    dtype: int64109  - name: binder_embedding110    list:111      list: float16112  - name: binder_attention_mask113    list: int8114  - name: binder_length115    dtype: int64116  - name: affinity117    dtype: float64118  - name: affinity_class119    dtype: string120  - name: smiles_iptm_score121    dtype: float64122  splits:123  - name: train124    num_bytes: 1011601188125    num_examples: 1349126  - name: val127    num_bytes: 263340834128    num_examples: 353129  download_size: 1254910028130  dataset_size: 1274942022131- config_name: binding_affinity__pair_wt_wt_pooled132  features:133  - name: target_sequence134    dtype: string135  - name: sequence136    dtype: string137  - name: label138    dtype: float64139  - name: target_embedding140    list: float32141  - name: embedding142    list: float32143  - name: wt_iptm_score144    dtype: float64145  - name: affinity146    dtype: float64147  - name: affinity_class148    dtype: string149  splits:150  - name: train151    num_bytes: 11929307152    num_examples: 1133153  - name: val154    num_bytes: 3157075155    num_examples: 300156  download_size: 17866414157  dataset_size: 15086382158- config_name: binding_affinity__pair_wt_wt_unpooled159  features:160  - name: target_sequence161    dtype: string162  - name: sequence163    dtype: string164  - name: label165    dtype: float32166  - name: affinity167    dtype: float32168  - name: affinity_class169    dtype: string170  - name: target_embedding171    list:172      list: float16173      length: 1280174  - name: target_attention_mask175    list: int8176  - name: target_length177    dtype: int64178  - name: binder_embedding179    list:180      list: float16181      length: 1280182  - name: binder_attention_mask183    list: int8184  - name: binder_length185    dtype: int64186  - name: wt_iptm_score187    dtype: float32188  splits:189  - name: train190    num_bytes: 699020198191    num_examples: 1133192  - name: val193    num_bytes: 180495759194    num_examples: 300195  download_size: 874726669196  dataset_size: 879515957197- config_name: half_life__halflife_chemberta_with_embeddings198  features:199  - name: sequence200    dtype: string201  - name: labels202    dtype: float64203  - name: embedding204    list: float32205  splits:206  - name: train207    num_bytes: 498045208    num_examples: 245209  download_size: 414916210  dataset_size: 498045211- config_name: half_life__halflife_chemberta_with_embeddings_unpooled212  features:213  - name: sequence214    dtype: string215  - name: labels216    dtype: float64217  - name: embedding218    list:219      list: float16220  - name: attention_mask221    list: int8222  - name: length223    dtype: int64224  splits:225  - name: train226    num_bytes: 58826285227    num_examples: 245228  download_size: 54835770229  dataset_size: 58826285230- config_name: half_life__halflife_peptideclm_with_embeddings231  features:232  - name: sequence233    dtype: string234  - name: labels235    dtype: float64236  - name: embedding237    list: float64238  splits:239  - name: train240    num_bytes: 1627005241    num_examples: 245242  download_size: 1069460243  dataset_size: 1627005244- config_name: half_life__halflife_peptideclm_with_embeddings_unpooled245  features:246  - name: sequence247    dtype: string248  - name: labels249    dtype: float64250  - name: embedding251    list:252      list: float64253  - name: attention_mask254    list: int8255  splits:256  - name: train257    num_bytes: 269123008258    num_examples: 245259  download_size: 206725146260  dataset_size: 269123008261- config_name: half_life__halflife_wt_with_embeddings262  features:263  - name: sequence264    dtype: string265  - name: embedding266    list: float32267  - name: label268    dtype: float64269  - name: log_label270    dtype: float64271  splits:272  - name: train273    num_bytes: 675408274    num_examples: 130275  download_size: 1048850276  dataset_size: 675408277- config_name: half_life__halflife_wt_with_embeddings_unpooled278  features:279  - name: sequence280    dtype: string281  - name: label282    dtype: float16283  - name: log_label284    dtype: float16285  - name: embedding286    list:287      list: float16288      length: 1280289  - name: attention_mask290    list: int8291  - name: length292    dtype: int64293  splits:294  - name: train295    num_bytes: 17137776296    num_examples: 130297  download_size: 16367436298  dataset_size: 17137776299- config_name: hemolysis__hemo_chemberta_with_embeddings300  features:301  - name: sequence302    dtype: string303  - name: label304    dtype: int64305  - name: embedding306    list: float32307  splits:308  - name: train309    num_bytes: 9313925310    num_examples: 4860311  - name: val312    num_bytes: 2315927313    num_examples: 1216314  download_size: 13659048315  dataset_size: 11629852316- config_name: hemolysis__hemo_chemberta_with_embeddings_unpooled317  features:318  - name: sequence319    dtype: string320  - name: label321    dtype: int64322  - name: embedding323    list:324      list: float16325  - name: attention_mask326    list: int8327  - name: length328    dtype: int64329  splits:330  - name: train331    num_bytes: 1005995635332    num_examples: 4860333  - name: val334    num_bytes: 241800300335    num_examples: 1216336  download_size: 1162835740337  dataset_size: 1247795935338- config_name: hemolysis__hemo_peptideclm_with_embeddings339  features:340  - name: sequence341    dtype: string342  - name: label343    dtype: int64344  - name: embedding345    list: float32346    length: 768347  splits:348  - name: train349    num_bytes: 16813165350    num_examples: 4860351  - name: val352    num_bytes: 4192601353    num_examples: 1216354  download_size: 23113748355  dataset_size: 21005766356- config_name: hemolysis__hemo_peptideclm_with_embeddings_unpooled357  features:358  - name: sequence359    dtype: string360  - name: label361    dtype: int64362  - name: embedding363    list:364      list: float16365      length: 768366  - name: attention_mask367    list: int8368  - name: length369    dtype: int64370  splits:371  - name: train372    num_bytes: 1030507572373    num_examples: 4860374  - name: val375    num_bytes: 249120069376    num_examples: 1216377  download_size: 1246287856378  dataset_size: 1279627641379- config_name: hemolysis__hemo_wt_with_embeddings380  features:381  - name: sequence382    dtype: string383  - name: embedding384    list: float32385  - name: label386    dtype: int64387  splits:388  - name: train389    num_bytes: 25052725390    num_examples: 4860391  - name: val392    num_bytes: 6267719393    num_examples: 1216394  download_size: 35578600395  dataset_size: 31320444396- config_name: hemolysis__hemo_wt_with_embeddings_unpooled397  features:398  - name: sequence399    dtype: string400  - name: label401    dtype: int64402  - name: embedding403    list:404      list: float16405      length: 1280406  - name: attention_mask407    list: int8408  - name: length409    dtype: int64410  splits:411  - name: train412    num_bytes: 235238010413    num_examples: 4860414  - name: val415    num_bytes: 57276814416    num_examples: 1216417  download_size: 287021543418  dataset_size: 292514824419- config_name: nf__nf_chemberta_with_embeddings420  features:421  - name: sequence422    dtype: string423  - name: label424    dtype: int64425  - name: embedding426    list: float32427  splits:428  - name: train429    num_bytes: 43383422430    num_examples: 13744431  - name: val432    num_bytes: 10775203433    num_examples: 3436434  download_size: 43173256435  dataset_size: 54158625436- config_name: nf__nf_chemberta_with_embeddings_unpooled437  features:438  - name: sequence439    dtype: string440  - name: label441    dtype: int64442  - name: embedding443    list:444      list: float16445  - name: attention_mask446    list: int8447  - name: length448    dtype: int64449  splits:450  - name: train451    num_bytes: 3527868113452    num_examples: 13744453  - name: val454    num_bytes: 878940617455    num_examples: 3436456  download_size: 4092197290457  dataset_size: 4406808730458- config_name: nf__nf_peptideclm_with_embeddings459  features:460  - name: sequence461    dtype: string462  - name: label463    dtype: int64464  - name: embedding465    list: float32466    length: 768467  splits:468  - name: train469    num_bytes: 64955900470    num_examples: 13744471  - name: val472    num_bytes: 16168142473    num_examples: 3436474  download_size: 68905312475  dataset_size: 81124042476- config_name: nf__nf_peptideclm_with_embeddings_unpooled477  features:478  - name: sequence479    dtype: string480  - name: label481    dtype: int64482  - name: embedding483    list:484      list: float16485      length: 768486  - name: attention_mask487    list: int8488  - name: length489    dtype: int64490  splits:491  - name: train492    num_bytes: 9217534156493    num_examples: 13744494  - name: val495    num_bytes: 2294213079496    num_examples: 3436497  download_size: 11403076401498  dataset_size: 11511747235499- config_name: nf__nf_wt_with_embeddings500  features:501  - name: sequence502    dtype: string503  - name: embedding504    list: float32505  - name: label506    dtype: int64507  splits:508  - name: train509    num_bytes: 71727017510    num_examples: 13744511  - name: val512    num_bytes: 17928760513    num_examples: 3436514  download_size: 100685872515  dataset_size: 89655777516- config_name: nf__nf_wt_with_embeddings_unpooled517  features:518  - name: sequence519    dtype: string520  - name: label521    dtype: int64522  - name: embedding523    list:524      list: float16525      length: 1280526  - name: attention_mask527    list: int8528  - name: length529    dtype: int64530  splits:531  - name: train532    num_bytes: 2915512978533    num_examples: 13744534  - name: val535    num_bytes: 721206976536    num_examples: 3436537  download_size: 3622556016538  dataset_size: 3636719954539- config_name: permeability_caco2__caco2_chemberta_with_embeddings540  features:541  - name: sequence542    dtype: string543  - name: label544    dtype: float64545  - name: embedding546    list: float32547  splits:548  - name: train549    num_bytes: 848051550    num_examples: 484551  - name: val552    num_bytes: 204272553    num_examples: 122554  download_size: 1380111555  dataset_size: 1052323556- config_name: permeability_caco2__caco2_chemberta_with_embeddings_unpooled557  features:558  - name: sequence559    dtype: string560  - name: label561    dtype: float64562  - name: embedding563    list:564      list: float16565  - name: attention_mask566    list: int8567  - name: length568    dtype: int64569  splits:570  - name: train571    num_bytes: 58823650572    num_examples: 484573  - name: val574    num_bytes: 8887746575    num_examples: 122576  download_size: 63200062577  dataset_size: 67711396578- config_name: permeability_caco2__caco2_peptideclm_with_embeddings579  features:580  - name: sequence581    dtype: string582  - name: label583    dtype: float64584  - name: embedding585    list: float32586  splits:587  - name: train588    num_bytes: 1591475589    num_examples: 484590  - name: val591    num_bytes: 391664592    num_examples: 122593  download_size: 2713580594  dataset_size: 1983139595- config_name: permeability_caco2__caco2_peptideclm_with_embeddings_unpooled596  features:597  - name: sequence598    dtype: string599  - name: label600    dtype: float64601  - name: embedding602    list:603      list: float16604  - name: attention_mask605    list: int8606  - name: length607    dtype: int64608  splits:609  - name: train610    num_bytes: 61445317611    num_examples: 484612  - name: val613    num_bytes: 9324443614    num_examples: 122615  download_size: 66256461616  dataset_size: 70769760617- config_name: permeability_pampa__pampa_chemberta_with_embeddings618  features:619  - name: sequence620    dtype: string621  - name: label622    dtype: float64623  - name: embedding624    list: float32625  splits:626  - name: train627    num_bytes: 8868563628    num_examples: 5187629  - name: val630    num_bytes: 2828125631    num_examples: 1682632  download_size: 9073608633  dataset_size: 11696688634- config_name: permeability_pampa__pampa_chemberta_with_embeddings_unpooled635  features:636  - name: sequence637    dtype: string638  - name: label639    dtype: float64640  - name: embedding641    list:642      list: float16643  - name: attention_mask644    list: int8645  - name: length646    dtype: int64647  splits:648  - name: train649    num_bytes: 490350648650    num_examples: 5187651  - name: val652    num_bytes: 130727059653    num_examples: 1682654  download_size: 578947300655  dataset_size: 621077707656- config_name: permeability_pampa__pampa_peptideclm_with_embeddings657  features:658  - name: sequence659    dtype: string660  - name: label661    dtype: float64662  - name: embedding663    list: float32664  splits:665  - name: train666    num_bytes: 17796153667    num_examples: 5495668  - name: val669    num_bytes: 4451319670    num_examples: 1374671  download_size: 26288045672  dataset_size: 22247472673- config_name: permeability_pampa__pampa_peptideclm_with_embeddings_unpooled674  features:675  - name: sequence676    dtype: string677  - name: label678    dtype: float64679  - name: embedding680    list:681      list: float16682  - name: attention_mask683    list: int8684  - name: length685    dtype: int64686  splits:687  - name: train688    num_bytes: 510348216689    num_examples: 5495690  - name: val691    num_bytes: 128857198692    num_examples: 1374693  download_size: 607814832694  dataset_size: 639205414695- config_name: permeability_penetrance__perm_chemberta_with_embeddings696  features:697  - name: sequence698    dtype: string699  - name: smiles700    dtype: string701  - name: label702    dtype: int64703  - name: embedding704    list: float32705  splits:706  - name: train707    num_bytes: 3618682708    num_examples: 1859709  - name: val710    num_bytes: 902840711    num_examples: 465712  download_size: 5420642713  dataset_size: 4521522714- config_name: permeability_penetrance__perm_chemberta_with_embeddings_unpooled715  features:716  - name: sequence717    dtype: string718  - name: smiles719    dtype: string720  - name: label721    dtype: int64722  - name: embedding723    list:724      list: float16725  - name: attention_mask726    list: int8727  - name: length728    dtype: int64729  splits:730  - name: train731    num_bytes: 397023820732    num_examples: 1859733  - name: val734    num_bytes: 97707357735    num_examples: 465736  download_size: 461038632737  dataset_size: 494731177738- config_name: permeability_penetrance__perm_peptideclm_with_embeddings739  features:740  - name: sequence741    dtype: string742  - name: smiles743    dtype: string744  - name: label745    dtype: int64746  - name: embedding747    list: float32748  splits:749  - name: train750    num_bytes: 6474106751    num_examples: 1859752  - name: val753    num_bytes: 1617080754    num_examples: 465755  download_size: 9214278756  dataset_size: 8091186757- config_name: permeability_penetrance__perm_peptideclm_with_embeddings_unpooled758  features:759  - name: sequence760    dtype: string761  - name: smiles762    dtype: string763  - name: label764    dtype: int64765  - name: embedding766    list:767      list: float16768  - name: attention_mask769    list: int8770  - name: length771    dtype: int64772  splits:773  - name: train774    num_bytes: 392267370775    num_examples: 1859776  - name: val777    num_bytes: 96599140778    num_examples: 465779  download_size: 474514467780  dataset_size: 488866510781- config_name: permeability_penetrance__perm_wt_with_embeddings_pooled782  features:783  - name: sequence784    dtype: string785  - name: embedding786    list: float32787  - name: label788    dtype: int64789  splits:790  - name: train791    num_bytes: 9582422792    num_examples: 1859793  - name: val794    num_bytes: 2396825795    num_examples: 465796  download_size: 13821993797  dataset_size: 11979247798- config_name: permeability_penetrance__perm_wt_with_embeddings_unpooled799  features:800  - name: sequence801    dtype: string802  - name: label803    dtype: int64804  - name: embedding805    list:806      list: float16807      length: 1280808  - name: attention_mask809    list: int8810  - name: length811    dtype: int64812  splits:813  - name: train814    num_bytes: 88692128815    num_examples: 1859816  - name: val817    num_bytes: 22007790818    num_examples: 465819  download_size: 108203263820  dataset_size: 110699918821- config_name: solubility__sol_chemberta_with_embeddings822  features:823  - name: sequence824    dtype: string825  - name: embedding826    list: float32827  - name: label828    dtype: int64829  splits:830  - name: train831    num_bytes: 24964429832    num_examples: 14762833  - name: val834    num_bytes: 6241335835    num_examples: 3691836  download_size: 42838256837  dataset_size: 31205764838- config_name: solubility__sol_chemberta_with_embeddings_unpooled839  features:840  - name: sequence841    dtype: string842  - name: label843    dtype: int64844  - name: embedding845    list:846      list: float16847  - name: attention_mask848    list: int8849  - name: length850    dtype: int64851  splits:852  - name: train853    num_bytes: 5817417616854    num_examples: 14762855  - name: val856    num_bytes: 1455052082857    num_examples: 3691858  download_size: 6786270181859  dataset_size: 7272469698860- config_name: solubility__sol_peptideclm_with_embeddings861  features:862  - name: sequence863    dtype: string864  - name: embedding865    list: float32866  - name: label867    dtype: int64868  splits:869  - name: train870    num_bytes: 47638861871    num_examples: 14762872  - name: val873    num_bytes: 11910711874    num_examples: 3691875  download_size: 71188741876  dataset_size: 59549572877- config_name: solubility__sol_peptideclm_with_embeddings_unpooled878  features:879  - name: sequence880    dtype: string881  - name: label882    dtype: int64883  - name: embedding884    list:885      list: float16886  - name: attention_mask887    list: int8888  - name: length889    dtype: int64890  splits:891  - name: train892    num_bytes: 16541359052893    num_examples: 14762894  - name: val895    num_bytes: 4136293493896    num_examples: 3691897  download_size: 20431148156898  dataset_size: 20677652545899- config_name: solubility__sol_wt_with_embeddings900  features:901  - name: sequence902    dtype: string903  - name: embedding904    list: float32905  - name: label906    dtype: int64907  splits:908  - name: train909    num_bytes: 77871437910    num_examples: 14762911  - name: val912    num_bytes: 19469879913    num_examples: 3691914  download_size: 108993067915  dataset_size: 97341316916- config_name: solubility__sol_wt_with_embeddings_unpooled917  features:918  - name: sequence919    dtype: string920  - name: label921    dtype: int64922  - name: embedding923    list:924      list: float16925      length: 1280926  - name: attention_mask927    list: int8928  - name: length929    dtype: int64930  splits:931  - name: train932    num_bytes: 5262261746933    num_examples: 14762934  - name: val935    num_bytes: 1314160834936    num_examples: 3691937  download_size: 6559760458938  dataset_size: 6576422580939- config_name: toxicity__tox_chemberta_with_embeddings940  features:941  - name: sequence942    dtype: string943  - name: label944    dtype: int64945  - name: embedding946    list: float32947  splits:948  - name: train949    num_bytes: 17507994950    num_examples: 8838951  - name: val952    num_bytes: 4145375953    num_examples: 2198954  download_size: 25020002955  dataset_size: 21653369956- config_name: toxicity__tox_peptideclm_with_embeddings957  features:958  - name: sequence959    dtype: string960  - name: label961    dtype: int64962  - name: embedding963    list: float32964    length: 768965  splits:966  - name: train967    num_bytes: 31047810968    num_examples: 8838969  - name: val970    num_bytes: 7512711971    num_examples: 2198972  download_size: 42152745973  dataset_size: 38560521974configs:975- config_name: binding_affinity__pair_wt_chemberta_pooled976  data_files:977  - split: train978    path: binding_affinity__pair_wt_chemberta_pooled/train-*979  - split: val980    path: binding_affinity__pair_wt_chemberta_pooled/val-*981- config_name: binding_affinity__pair_wt_chemberta_unpooled982  data_files:983  - split: train984    path: binding_affinity__pair_wt_chemberta_unpooled/train-*985  - split: val986    path: binding_affinity__pair_wt_chemberta_unpooled/val-*987- config_name: binding_affinity__pair_wt_peptideclm_pooled988  data_files:989  - split: train990    path: binding_affinity__pair_wt_peptideclm_pooled/train-*991  - split: val992    path: binding_affinity__pair_wt_peptideclm_pooled/val-*993- config_name: binding_affinity__pair_wt_peptideclm_unpooled994  data_files:995  - split: train996    path: binding_affinity__pair_wt_peptideclm_unpooled/train-*997  - split: val998    path: binding_affinity__pair_wt_peptideclm_unpooled/val-*999- config_name: binding_affinity__pair_wt_wt_pooled1000  data_files:1001  - split: train1002    path: binding_affinity__pair_wt_wt_pooled/train-*1003  - split: val1004    path: binding_affinity__pair_wt_wt_pooled/val-*1005- config_name: binding_affinity__pair_wt_wt_unpooled1006  data_files:1007  - split: train1008    path: binding_affinity__pair_wt_wt_unpooled/train-*1009  - split: val1010    path: binding_affinity__pair_wt_wt_unpooled/val-*1011- config_name: half_life__halflife_chemberta_with_embeddings1012  data_files:1013  - split: train1014    path: half_life__halflife_chemberta_with_embeddings/train-*1015- config_name: half_life__halflife_chemberta_with_embeddings_unpooled1016  data_files:1017  - split: train1018    path: half_life__halflife_chemberta_with_embeddings_unpooled/train-*1019- config_name: half_life__halflife_peptideclm_with_embeddings1020  data_files:1021  - split: train1022    path: half_life__halflife_peptideclm_with_embeddings/train-*1023- config_name: half_life__halflife_peptideclm_with_embeddings_unpooled1024  data_files:1025  - split: train1026    path: half_life__halflife_peptideclm_with_embeddings_unpooled/train-*1027- config_name: half_life__halflife_wt_with_embeddings1028  data_files:1029  - split: train1030    path: half_life__halflife_wt_with_embeddings/train-*1031- config_name: half_life__halflife_wt_with_embeddings_unpooled1032  data_files:1033  - split: train1034    path: half_life__halflife_wt_with_embeddings_unpooled/train-*1035- config_name: hemolysis__hemo_chemberta_with_embeddings1036  data_files:1037  - split: train1038    path: hemolysis__hemo_chemberta_with_embeddings/train-*1039  - split: val1040    path: hemolysis__hemo_chemberta_with_embeddings/val-*1041- config_name: hemolysis__hemo_chemberta_with_embeddings_unpooled1042  data_files:1043  - split: train1044    path: hemolysis__hemo_chemberta_with_embeddings_unpooled/train-*1045  - split: val1046    path: hemolysis__hemo_chemberta_with_embeddings_unpooled/val-*1047- config_name: hemolysis__hemo_peptideclm_with_embeddings1048  data_files:1049  - split: train1050    path: hemolysis__hemo_peptideclm_with_embeddings/train-*1051  - split: val1052    path: hemolysis__hemo_peptideclm_with_embeddings/val-*1053- config_name: hemolysis__hemo_peptideclm_with_embeddings_unpooled1054  data_files:1055  - split: train1056    path: hemolysis__hemo_peptideclm_with_embeddings_unpooled/train-*1057  - split: val1058    path: hemolysis__hemo_peptideclm_with_embeddings_unpooled/val-*1059- config_name: hemolysis__hemo_wt_with_embeddings1060  data_files:1061  - split: train1062    path: hemolysis__hemo_wt_with_embeddings/train-*1063  - split: val1064    path: hemolysis__hemo_wt_with_embeddings/val-*1065- config_name: hemolysis__hemo_wt_with_embeddings_unpooled1066  data_files:1067  - split: train1068    path: hemolysis__hemo_wt_with_embeddings_unpooled/train-*1069  - split: val1070    path: hemolysis__hemo_wt_with_embeddings_unpooled/val-*1071- config_name: nf__nf_chemberta_with_embeddings1072  data_files:1073  - split: train1074    path: nf__nf_chemberta_with_embeddings/train-*1075  - split: val1076    path: nf__nf_chemberta_with_embeddings/val-*1077- config_name: nf__nf_chemberta_with_embeddings_unpooled1078  data_files:1079  - split: train1080    path: nf__nf_chemberta_with_embeddings_unpooled/train-*1081  - split: val1082    path: nf__nf_chemberta_with_embeddings_unpooled/val-*1083- config_name: nf__nf_peptideclm_with_embeddings1084  data_files:1085  - split: train1086    path: nf__nf_peptideclm_with_embeddings/train-*1087  - split: val1088    path: nf__nf_peptideclm_with_embeddings/val-*1089- config_name: nf__nf_peptideclm_with_embeddings_unpooled1090  data_files:1091  - split: train1092    path: nf__nf_peptideclm_with_embeddings_unpooled/train-*1093  - split: val1094    path: nf__nf_peptideclm_with_embeddings_unpooled/val-*1095- config_name: nf__nf_wt_with_embeddings1096  data_files:1097  - split: train1098    path: nf__nf_wt_with_embeddings/train-*1099  - split: val1100    path: nf__nf_wt_with_embeddings/val-*1101- config_name: nf__nf_wt_with_embeddings_unpooled1102  data_files:1103  - split: train1104    path: nf__nf_wt_with_embeddings_unpooled/train-*1105  - split: val1106    path: nf__nf_wt_with_embeddings_unpooled/val-*1107- config_name: permeability_caco2__caco2_chemberta_with_embeddings1108  data_files:1109  - split: train1110    path: permeability_caco2__caco2_chemberta_with_embeddings/train-*1111  - split: val1112    path: permeability_caco2__caco2_chemberta_with_embeddings/val-*1113- config_name: permeability_caco2__caco2_chemberta_with_embeddings_unpooled1114  data_files:1115  - split: train1116    path: permeability_caco2__caco2_chemberta_with_embeddings_unpooled/train-*1117  - split: val1118    path: permeability_caco2__caco2_chemberta_with_embeddings_unpooled/val-*1119- config_name: permeability_caco2__caco2_peptideclm_with_embeddings1120  data_files:1121  - split: train1122    path: permeability_caco2__caco2_peptideclm_with_embeddings/train-*1123  - split: val1124    path: permeability_caco2__caco2_peptideclm_with_embeddings/val-*1125- config_name: permeability_caco2__caco2_peptideclm_with_embeddings_unpooled1126  data_files:1127  - split: train1128    path: permeability_caco2__caco2_peptideclm_with_embeddings_unpooled/train-*1129  - split: val1130    path: permeability_caco2__caco2_peptideclm_with_embeddings_unpooled/val-*1131- config_name: permeability_pampa__pampa_chemberta_with_embeddings1132  data_files:1133  - split: train1134    path: permeability_pampa__pampa_chemberta_with_embeddings/train-*1135  - split: val1136    path: permeability_pampa__pampa_chemberta_with_embeddings/val-*1137- config_name: permeability_pampa__pampa_chemberta_with_embeddings_unpooled1138  data_files:1139  - split: train1140    path: permeability_pampa__pampa_chemberta_with_embeddings_unpooled/train-*1141  - split: val1142    path: permeability_pampa__pampa_chemberta_with_embeddings_unpooled/val-*1143- config_name: permeability_pampa__pampa_peptideclm_with_embeddings1144  data_files:1145  - split: train1146    path: permeability_pampa__pampa_peptideclm_with_embeddings/train-*1147  - split: val1148    path: permeability_pampa__pampa_peptideclm_with_embeddings/val-*1149- config_name: permeability_pampa__pampa_peptideclm_with_embeddings_unpooled1150  data_files:1151  - split: train1152    path: permeability_pampa__pampa_peptideclm_with_embeddings_unpooled/train-*1153  - split: val1154    path: permeability_pampa__pampa_peptideclm_with_embeddings_unpooled/val-*1155- config_name: permeability_penetrance__perm_chemberta_with_embeddings1156  data_files:1157  - split: train1158    path: permeability_penetrance__perm_chemberta_with_embeddings/train-*1159  - split: val1160    path: permeability_penetrance__perm_chemberta_with_embeddings/val-*1161- config_name: permeability_penetrance__perm_chemberta_with_embeddings_unpooled1162  data_files:1163  - split: train1164    path: permeability_penetrance__perm_chemberta_with_embeddings_unpooled/train-*1165  - split: val1166    path: permeability_penetrance__perm_chemberta_with_embeddings_unpooled/val-*1167- config_name: permeability_penetrance__perm_peptideclm_with_embeddings1168  data_files:1169  - split: train1170    path: permeability_penetrance__perm_peptideclm_with_embeddings/train-*1171  - split: val1172    path: permeability_penetrance__perm_peptideclm_with_embeddings/val-*1173- config_name: permeability_penetrance__perm_peptideclm_with_embeddings_unpooled1174  data_files:1175  - split: train1176    path: permeability_penetrance__perm_peptideclm_with_embeddings_unpooled/train-*1177  - split: val1178    path: permeability_penetrance__perm_peptideclm_with_embeddings_unpooled/val-*1179- config_name: permeability_penetrance__perm_wt_with_embeddings_pooled1180  data_files:1181  - split: train1182    path: permeability_penetrance__perm_wt_with_embeddings_pooled/train-*1183  - split: val1184    path: permeability_penetrance__perm_wt_with_embeddings_pooled/val-*1185- config_name: permeability_penetrance__perm_wt_with_embeddings_unpooled1186  data_files:1187  - split: train1188    path: permeability_penetrance__perm_wt_with_embeddings_unpooled/train-*1189  - split: val1190    path: permeability_penetrance__perm_wt_with_embeddings_unpooled/val-*1191- config_name: solubility__sol_chemberta_with_embeddings1192  data_files:1193  - split: train1194    path: solubility__sol_chemberta_with_embeddings/train-*1195  - split: val1196    path: solubility__sol_chemberta_with_embeddings/val-*1197- config_name: solubility__sol_chemberta_with_embeddings_unpooled1198  data_files:1199  - split: train1200    path: solubility__sol_chemberta_with_embeddings_unpooled/train-*

Showing the first 1,200 of 1240 lines. Download the file for the rest.