CoolFace
Datasetpublic

stallone/CommitPackFT

sourceHugging Faceupdated 2y agoView on Hugging Face
1likes181downloads
README.md5625 linesDownload Raw Back to root
1---2dataset_info:3- config_name: completion4  features:5  - name: doc_id6    dtype: string7  - name: metadata8    struct:9    - name: language10      dtype: string11  - name: input12    dtype: string13  - name: output14    dtype: string15  splits:16  - name: train17    num_bytes: 106363289418    num_examples: 70206219  download_size: 53213962320  dataset_size: 106363289421- config_name: conversation22  features:23  - name: doc_id24    dtype: string25  - name: metadata26    struct:27    - name: language28      dtype: string29  - name: messages30    list:31    - name: content32      dtype: string33    - name: role34      dtype: string35  splits:36  - name: train37    num_bytes: 108118444438    num_examples: 70206239  download_size: 37134097540  dataset_size: 108118444441- config_name: conversation[abap]42  features:43  - name: doc_id44    dtype: string45  - name: messages46    list:47    - name: content48      dtype: string49    - name: role50      dtype: string51  splits:52  - name: train53    num_bytes: 1529.050451384635654    num_examples: 155  download_size: 1123956  dataset_size: 1529.050451384635657- config_name: conversation[actionscript]58  features:59  - name: doc_id60    dtype: string61  - name: messages62    list:63    - name: content64      dtype: string65    - name: role66      dtype: string67  splits:68  - name: train69    num_bytes: 74923.4721178471470    num_examples: 4971  download_size: 3338372  dataset_size: 74923.4721178471473- config_name: conversation[ada]74  features:75  - name: doc_id76    dtype: string77  - name: messages78    list:79    - name: content80      dtype: string81    - name: role82      dtype: string83  splits:84  - name: train85    num_bytes: 405198.369616928486    num_examples: 26587  download_size: 13275588  dataset_size: 405198.369616928489- config_name: conversation[agda]90  features:91  - name: doc_id92    dtype: string93  - name: messages94    list:95    - name: content96      dtype: string97    - name: role98      dtype: string99  splits:100  - name: train101    num_bytes: 15290.504513846356102    num_examples: 10103  download_size: 6381104  dataset_size: 15290.504513846356105- config_name: conversation[antlr]106  features:107  - name: doc_id108    dtype: string109  - name: messages110    list:111    - name: content112      dtype: string113    - name: role114      dtype: string115  splits:116  - name: train117    num_bytes: 22935.756770769534118    num_examples: 15119  download_size: 11135120  dataset_size: 22935.756770769534121- config_name: conversation[apacheconf]122  features:123  - name: doc_id124    dtype: string125  - name: messages126    list:127    - name: content128      dtype: string129    - name: role130      dtype: string131  splits:132  - name: train133    num_bytes: 3058.100902769271134    num_examples: 2135  download_size: 9936136  dataset_size: 3058.100902769271137- config_name: conversation[apiblueprint]138  features:139  - name: doc_id140    dtype: string141  - name: messages142    list:143    - name: content144      dtype: string145    - name: role146      dtype: string147  splits:148  - name: train149    num_bytes: 35168.16038184662150    num_examples: 23151  download_size: 14221152  dataset_size: 35168.16038184662153- config_name: conversation[apl]154  features:155  - name: doc_id156    dtype: string157  - name: messages158    list:159    - name: content160      dtype: string161    - name: role162      dtype: string163  splits:164  - name: train165    num_bytes: 10703.35315969245166    num_examples: 7167  download_size: 8091168  dataset_size: 10703.35315969245169- config_name: conversation[applescript]170  features:171  - name: doc_id172    dtype: string173  - name: messages174    list:175    - name: content176      dtype: string177    - name: role178      dtype: string179  splits:180  - name: train181    num_bytes: 29051.958576308076182    num_examples: 19183  download_size: 15634184  dataset_size: 29051.958576308076185- config_name: conversation[arc]186  features:187  - name: doc_id188    dtype: string189  - name: messages190    list:191    - name: content192      dtype: string193    - name: role194      dtype: string195  splits:196  - name: train197    num_bytes: 3058.100902769271198    num_examples: 2199  download_size: 4605200  dataset_size: 3058.100902769271201- config_name: conversation[arduino]202  features:203  - name: doc_id204    dtype: string205  - name: messages206    list:207    - name: content208      dtype: string209    - name: role210      dtype: string211  splits:212  - name: train213    num_bytes: 344036.351561543214    num_examples: 225215  download_size: 144458216  dataset_size: 344036.351561543217- config_name: conversation[asciidoc]218  features:219  - name: doc_id220    dtype: string221  - name: messages222    list:223    - name: content224      dtype: string225    - name: role226      dtype: string227  splits:228  - name: train229    num_bytes: 799693.3860741644230    num_examples: 523231  download_size: 331290232  dataset_size: 799693.3860741644233- config_name: conversation[asp]234  features:235  - name: doc_id236    dtype: string237  - name: messages238    list:239    - name: content240      dtype: string241    - name: role242      dtype: string243  splits:244  - name: train245    num_bytes: 33639.10993046198246    num_examples: 22247  download_size: 17060248  dataset_size: 33639.10993046198249- config_name: conversation[aspectj]250  features:251  - name: doc_id252    dtype: string253  - name: messages254    list:255    - name: content256      dtype: string257    - name: role258      dtype: string259  splits:260  - name: train261    num_bytes: 12232.403611077085262    num_examples: 8263  download_size: 7552264  dataset_size: 12232.403611077085265- config_name: conversation[assembly]266  features:267  - name: doc_id268    dtype: string269  - name: messages270    list:271    - name: content272      dtype: string273    - name: role274      dtype: string275  splits:276  - name: train277    num_bytes: 160550.29739538673278    num_examples: 105279  download_size: 52379280  dataset_size: 160550.29739538673281- config_name: conversation[ats]282  features:283  - name: doc_id284    dtype: string285  - name: messages286    list:287    - name: content288      dtype: string289    - name: role290      dtype: string291  splits:292  - name: train293    num_bytes: 4587.151354153907294    num_examples: 3295  download_size: 3041296  dataset_size: 4587.151354153907297- config_name: conversation[augeas]298  features:299  - name: doc_id300    dtype: string301  - name: messages302    list:303    - name: content304      dtype: string305    - name: role306      dtype: string307  splits:308  - name: train309    num_bytes: 19877.655868000264310    num_examples: 13311  download_size: 11668312  dataset_size: 19877.655868000264313- config_name: conversation[autohotkey]314  features:315  - name: doc_id316    dtype: string317  - name: messages318    list:319    - name: content320      dtype: string321    - name: role322      dtype: string323  splits:324  - name: train325    num_bytes: 22935.756770769534326    num_examples: 15327  download_size: 9482328  dataset_size: 22935.756770769534329- config_name: conversation[awk]330  features:331  - name: doc_id332    dtype: string333  - name: messages334    list:335    - name: content336      dtype: string337    - name: role338      dtype: string339  splits:340  - name: train341    num_bytes: 79510.62347200105342    num_examples: 52343  download_size: 26361344  dataset_size: 79510.62347200105345- config_name: conversation[batchfile]346  features:347  - name: doc_id348    dtype: string349  - name: messages350    list:351    - name: content352      dtype: string353    - name: role354      dtype: string355  splits:356  - name: train357    num_bytes: 2241587.9617298758358    num_examples: 1466359  download_size: 602193360  dataset_size: 2241587.9617298758361- config_name: conversation[bitbake]362  features:363  - name: doc_id364    dtype: string365  - name: messages366    list:367    - name: content368      dtype: string369    - name: role370      dtype: string371  splits:372  - name: train373    num_bytes: 1999997.9904111032374    num_examples: 1308375  download_size: 631490376  dataset_size: 1999997.9904111032377- config_name: conversation[blitzmax]378  features:379  - name: doc_id380    dtype: string381  - name: messages382    list:383    - name: content384      dtype: string385    - name: role386      dtype: string387  splits:388  - name: train389    num_bytes: 1529.0504513846356390    num_examples: 1391  download_size: 6001392  dataset_size: 1529.0504513846356393- config_name: conversation[bluespec]394  features:395  - name: doc_id396    dtype: string397  - name: messages398    list:399    - name: content400      dtype: string401    - name: role402      dtype: string403  splits:404  - name: train405    num_bytes: 3058.100902769271406    num_examples: 2407  download_size: 7517408  dataset_size: 3058.100902769271409- config_name: conversation[boo]410  features:411  - name: doc_id412    dtype: string413  - name: messages414    list:415    - name: content416      dtype: string417    - name: role418      dtype: string419  splits:420  - name: train421    num_bytes: 3058.100902769271422    num_examples: 2423  download_size: 13471424  dataset_size: 3058.100902769271425- config_name: conversation[brainfuck]426  features:427  - name: doc_id428    dtype: string429  - name: messages430    list:431    - name: content432      dtype: string433    - name: role434      dtype: string435  splits:436  - name: train437    num_bytes: 3058.100902769271438    num_examples: 2439  download_size: 11654440  dataset_size: 3058.100902769271441- config_name: conversation[bro]442  features:443  - name: doc_id444    dtype: string445  - name: messages446    list:447    - name: content448      dtype: string449    - name: role450      dtype: string451  splits:452  - name: train453    num_bytes: 4587.151354153907454    num_examples: 3455  download_size: 5789456  dataset_size: 4587.151354153907457- config_name: conversation[c#]458  features:459  - name: doc_id460    dtype: string461  - name: messages462    list:463    - name: content464      dtype: string465    - name: role466      dtype: string467  splits:468  - name: train469    num_bytes: 14290505.518640803470    num_examples: 9346471  download_size: 6165804472  dataset_size: 14290505.518640803473- config_name: conversation[c++]474  features:475  - name: doc_id476    dtype: string477  - name: messages478    list:479    - name: content480      dtype: string481    - name: role482      dtype: string483  splits:484  - name: train485    num_bytes: 7633019.8533121486    num_examples: 4992487  download_size: 3008840488  dataset_size: 7633019.8533121489- config_name: conversation[c2hshaskell]490  features:491  - name: doc_id492    dtype: string493  - name: messages494    list:495    - name: content496      dtype: string497    - name: role498      dtype: string499  splits:500  - name: train501    num_bytes: 3058.100902769271502    num_examples: 2503  download_size: 8231504  dataset_size: 3058.100902769271505- config_name: conversation[c]506  features:507  - name: doc_id508    dtype: string509  - name: messages510    list:511    - name: content512      dtype: string513    - name: role514      dtype: string515  splits:516  - name: train517    num_bytes: 13006103.13947771518    num_examples: 8506519  download_size: 4783765520  dataset_size: 13006103.13947771521- config_name: conversation[cap'nproto]522  features:523  - name: doc_id524    dtype: string525  - name: messages526    list:527    - name: content528      dtype: string529    - name: role530      dtype: string531  splits:532  - name: train533    num_bytes: 18348.60541661563534    num_examples: 12535  download_size: 6860536  dataset_size: 18348.60541661563537- config_name: conversation[cartocss]538  features:539  - name: doc_id540    dtype: string541  - name: messages542    list:543    - name: content544      dtype: string545    - name: role546      dtype: string547  splits:548  - name: train549    num_bytes: 4587.151354153907550    num_examples: 3551  download_size: 9233552  dataset_size: 4587.151354153907553- config_name: conversation[ceylon]554  features:555  - name: doc_id556    dtype: string557  - name: messages558    list:559    - name: content560      dtype: string561    - name: role562      dtype: string563  splits:564  - name: train565    num_bytes: 74923.47211784714566    num_examples: 49567  download_size: 26249568  dataset_size: 74923.47211784714569- config_name: conversation[chapel]570  features:571  - name: doc_id572    dtype: string573  - name: messages574    list:575    - name: content576      dtype: string577    - name: role578      dtype: string579  splits:580  - name: train581    num_bytes: 30581.00902769271582    num_examples: 20583  download_size: 13703584  dataset_size: 30581.00902769271585- config_name: conversation[clean]586  features:587  - name: doc_id588    dtype: string589  - name: messages590    list:591    - name: content592      dtype: string593    - name: role594      dtype: string595  splits:596  - name: train597    num_bytes: 1529.0504513846356598    num_examples: 1599  download_size: 6993600  dataset_size: 1529.0504513846356601- config_name: conversation[clojure]602  features:603  - name: doc_id604    dtype: string605  - name: messages606    list:607    - name: content608      dtype: string609    - name: role610      dtype: string611  splits:612  - name: train613    num_bytes: 3674308.2346772794614    num_examples: 2403615  download_size: 1318886616  dataset_size: 3674308.2346772794617- config_name: conversation[cmake]618  features:619  - name: doc_id620    dtype: string621  - name: messages622    list:623    - name: content624      dtype: string625    - name: role626      dtype: string627  splits:628  - name: train629    num_bytes: 1499998.4928083275630    num_examples: 981631  download_size: 462464632  dataset_size: 1499998.4928083275633- config_name: conversation[coffeescript]634  features:635  - name: doc_id636    dtype: string637  - name: messages638    list:639    - name: content640      dtype: string641    - name: role642      dtype: string643  splits:644  - name: train645    num_bytes: 8429655.138483496646    num_examples: 5513647  download_size: 3402652648  dataset_size: 8429655.138483496649- config_name: conversation[coldfusion]650  features:651  - name: doc_id652    dtype: string653  - name: messages654    list:655    - name: content656      dtype: string657    - name: role658      dtype: string659  splits:660  - name: train661    num_bytes: 13761.45406246172662    num_examples: 9663  download_size: 13894664  dataset_size: 13761.45406246172665- config_name: conversation[coldfusioncfc]666  features:667  - name: doc_id668    dtype: string669  - name: messages670    list:671    - name: content672      dtype: string673    - name: role674      dtype: string675  splits:676  - name: train677    num_bytes: 30581.00902769271678    num_examples: 20679  download_size: 15721680  dataset_size: 30581.00902769271681- config_name: conversation[commonlisp]682  features:683  - name: doc_id684    dtype: string685  - name: messages686    list:687    - name: content688      dtype: string689    - name: role690      dtype: string691  splits:692  - name: train693    num_bytes: 1189601.2511772464694    num_examples: 778695  download_size: 370050696  dataset_size: 1189601.2511772464697- config_name: conversation[creole]698  features:699  - name: doc_id700    dtype: string701  - name: messages702    list:703    - name: content704      dtype: string705    - name: role706      dtype: string707  splits:708  - name: train709    num_bytes: 3058.100902769271710    num_examples: 2711  download_size: 12455712  dataset_size: 3058.100902769271713- config_name: conversation[crystal]714  features:715  - name: doc_id716    dtype: string717  - name: messages718    list:719    - name: content720      dtype: string721    - name: role722      dtype: string723  splits:724  - name: train725    num_bytes: 278287.1821520037726    num_examples: 182727  download_size: 89278728  dataset_size: 278287.1821520037729- config_name: conversation[csound]730  features:731  - name: doc_id732    dtype: string733  - name: messages734    list:735    - name: content736      dtype: string737    - name: role738      dtype: string739  splits:740  - name: train741    num_bytes: 6116.201805538542742    num_examples: 4743  download_size: 5021744  dataset_size: 6116.201805538542745- config_name: conversation[css]746  features:747  - name: doc_id748    dtype: string749  - name: messages750    list:751    - name: content752      dtype: string753    - name: role754      dtype: string755  splits:756  - name: train757    num_bytes: 7720175.729041025758    num_examples: 5049759  download_size: 1963859760  dataset_size: 7720175.729041025761- config_name: conversation[csv]762  features:763  - name: doc_id764    dtype: string765  - name: messages766    list:767    - name: content768      dtype: string769    - name: role770      dtype: string771  splits:772  - name: train773    num_bytes: 573393.9192692384774    num_examples: 375775  download_size: 137132776  dataset_size: 573393.9192692384777- config_name: conversation[cucumber]778  features:779  - name: doc_id780    dtype: string781  - name: messages782    list:783    - name: content784      dtype: string785    - name: role786      dtype: string787  splits:788  - name: train789    num_bytes: 1492353.2405514042790    num_examples: 976791  download_size: 532572792  dataset_size: 1492353.2405514042793- config_name: conversation[cuda]794  features:795  - name: doc_id796    dtype: string797  - name: messages798    list:799    - name: content800      dtype: string801    - name: role802      dtype: string803  splits:804  - name: train805    num_bytes: 38226.26128461589806    num_examples: 25807  download_size: 22442808  dataset_size: 38226.26128461589809- config_name: conversation[cython]810  features:811  - name: doc_id812    dtype: string813  - name: messages814    list:815    - name: content816      dtype: string817    - name: role818      dtype: string819  splits:820  - name: train821    num_bytes: 188073.20552031018822    num_examples: 123823  download_size: 65051824  dataset_size: 188073.20552031018825- config_name: conversation[dart]826  features:827  - name: doc_id828    dtype: string829  - name: messages830    list:831    - name: content832      dtype: string833    - name: role834      dtype: string835  splits:836  - name: train837    num_bytes: 1169723.595309246838    num_examples: 765839  download_size: 460046840  dataset_size: 1169723.595309246841- config_name: conversation[desktop]842  features:843  - name: doc_id844    dtype: string845  - name: messages846    list:847    - name: content848      dtype: string849    - name: role850      dtype: string851  splits:852  - name: train853    num_bytes: 284403.3839575422854    num_examples: 186855  download_size: 46475856  dataset_size: 284403.3839575422857- config_name: conversation[diff]858  features:859  - name: doc_id860    dtype: string861  - name: messages862    list:863    - name: content864      dtype: string865    - name: role866      dtype: string867  splits:868  - name: train869    num_bytes: 1039754.3069415522870    num_examples: 680871  download_size: 363721872  dataset_size: 1039754.3069415522873- config_name: conversation[digitalcommandlanguage]874  features:875  - name: doc_id876    dtype: string877  - name: messages878    list:879    - name: content880      dtype: string881    - name: role882      dtype: string883  splits:884  - name: train885    num_bytes: 29051.958576308076886    num_examples: 19887  download_size: 11230888  dataset_size: 29051.958576308076889- config_name: conversation[dm]890  features:891  - name: doc_id892    dtype: string893  - name: messages894    list:895    - name: content896      dtype: string897    - name: role898      dtype: string899  splits:900  - name: train901    num_bytes: 24464.80722215417902    num_examples: 16903  download_size: 12320904  dataset_size: 24464.80722215417905- config_name: conversation[dnszone]906  features:907  - name: doc_id908    dtype: string909  - name: messages910    list:911    - name: content912      dtype: string913    - name: role914      dtype: string915  splits:916  - name: train917    num_bytes: 3058.100902769271918    num_examples: 2919  download_size: 5135920  dataset_size: 3058.100902769271921- config_name: conversation[dockerfile]922  features:923  - name: doc_id924    dtype: string925  - name: messages926    list:927    - name: content928      dtype: string929    - name: role930      dtype: string931  splits:932  - name: train933    num_bytes: 59632.96760400078934    num_examples: 39935  download_size: 22429936  dataset_size: 59632.96760400078937- config_name: conversation[dylan]938  features:939  - name: doc_id940    dtype: string941  - name: messages942    list:943    - name: content944      dtype: string945    - name: role946      dtype: string947  splits:948  - name: train949    num_bytes: 3058.100902769271950    num_examples: 2951  download_size: 15100952  dataset_size: 3058.100902769271953- config_name: conversation[eagle]954  features:955  - name: doc_id956    dtype: string957  - name: messages958    list:959    - name: content960      dtype: string961    - name: role962      dtype: string963  splits:964  - name: train965    num_bytes: 6116.201805538542966    num_examples: 4967  download_size: 4043968  dataset_size: 6116.201805538542969- config_name: conversation[ecl]970  features:971  - name: doc_id972    dtype: string973  - name: messages974    list:975    - name: content976      dtype: string977    - name: role978      dtype: string979  splits:980  - name: train981    num_bytes: 6116.201805538542982    num_examples: 4983  download_size: 5158984  dataset_size: 6116.201805538542985- config_name: conversation[edn]986  features:987  - name: doc_id988    dtype: string989  - name: messages990    list:991    - name: content992      dtype: string993    - name: role994      dtype: string995  splits:996  - name: train997    num_bytes: 73394.42166646251998    num_examples: 48999  download_size: 210801000  dataset_size: 73394.421666462511001- config_name: conversation[eiffel]1002  features:1003  - name: doc_id1004    dtype: string1005  - name: messages1006    list:1007    - name: content1008      dtype: string1009    - name: role1010      dtype: string1011  splits:1012  - name: train1013    num_bytes: 3058.1009027692711014    num_examples: 21015  download_size: 103831016  dataset_size: 3058.1009027692711017- config_name: conversation[elixir]1018  features:1019  - name: doc_id1020    dtype: string1021  - name: messages1022    list:1023    - name: content1024      dtype: string1025    - name: role1026      dtype: string1027  splits:1028  - name: train1029    num_bytes: 1758408.0190923311030    num_examples: 11501031  download_size: 6225691032  dataset_size: 1758408.0190923311033- config_name: conversation[elm]1034  features:1035  - name: doc_id1036    dtype: string1037  - name: messages1038    list:1039    - name: content1040      dtype: string1041    - name: role1042      dtype: string1043  splits:1044  - name: train1045    num_bytes: 405198.36961692841046    num_examples: 2651047  download_size: 1661171048  dataset_size: 405198.36961692841049- config_name: conversation[emacslisp]1050  features:1051  - name: doc_id1052    dtype: string1053  - name: messages1054    list:1055    - name: content1056      dtype: string1057    - name: role1058      dtype: string1059  splits:1060  - name: train1061    num_bytes: 1551986.2081554051062    num_examples: 10151063  download_size: 5050431064  dataset_size: 1551986.2081554051065- config_name: conversation[emberscript]1066  features:1067  - name: doc_id1068    dtype: string1069  - name: messages1070    list:1071    - name: content1072      dtype: string1073    - name: role1074      dtype: string1075  splits:1076  - name: train1077    num_bytes: 10703.353159692451078    num_examples: 71079  download_size: 70761080  dataset_size: 10703.353159692451081- config_name: conversation[erlang]1082  features:1083  - name: doc_id1084    dtype: string1085  - name: messages1086    list:1087    - name: content1088      dtype: string1089    - name: role1090      dtype: string1091  splits:1092  - name: train1093    num_bytes: 733944.21666462511094    num_examples: 4801095  download_size: 2743081096  dataset_size: 733944.21666462511097- config_name: conversation[f#]1098  features:1099  - name: doc_id1100    dtype: string1101  - name: messages1102    list:1103    - name: content1104      dtype: string1105    - name: role1106      dtype: string1107  splits:1108  - name: train1109    num_bytes: 388378.81465169741110    num_examples: 2541111  download_size: 1676641112  dataset_size: 388378.81465169741113- config_name: conversation[factor]1114  features:1115  - name: doc_id1116    dtype: string1117  - name: messages1118    list:1119    - name: content1120      dtype: string1121    - name: role1122      dtype: string1123  splits:1124  - name: train1125    num_bytes: 172782.701006463821126    num_examples: 1131127  download_size: 523081128  dataset_size: 172782.701006463821129- config_name: conversation[fancy]1130  features:1131  - name: doc_id1132    dtype: string1133  - name: messages1134    list:1135    - name: content1136      dtype: string1137    - name: role1138      dtype: string1139  splits:1140  - name: train1141    num_bytes: 12232.4036110770851142    num_examples: 81143  download_size: 117151144  dataset_size: 12232.4036110770851145- config_name: conversation[fish]1146  features:1147  - name: doc_id1148    dtype: string1149  - name: messages1150    list:1151    - name: content1152      dtype: string1153    - name: role1154      dtype: string1155  splits:1156  - name: train1157    num_bytes: 1243118.01697570881158    num_examples: 8131159  download_size: 3489881160  dataset_size: 1243118.01697570881161- config_name: conversation[flux]1162  features:1163  - name: doc_id1164    dtype: string1165  - name: messages1166    list:1167    - name: content1168      dtype: string1169    - name: role1170      dtype: string1171  splits:1172  - name: train1173    num_bytes: 4587.1513541539071174    num_examples: 31175  download_size: 66671176  dataset_size: 4587.1513541539071177- config_name: conversation[forth]1178  features:1179  - name: doc_id1180    dtype: string1181  - name: messages1182    list:1183    - name: content1184      dtype: string1185    - name: role1186      dtype: string1187  splits:1188  - name: train1189    num_bytes: 3058.1009027692711190    num_examples: 21191  download_size: 67251192  dataset_size: 3058.1009027692711193- config_name: conversation[fortran]1194  features:1195  - name: doc_id1196    dtype: string1197  - name: messages1198    list:1199    - name: content1200      dtype: string

Showing the first 1,200 of 5625 lines. Download the file for the rest.