stallone/CommitPackFT
1181
1---2dataset_info:3- config_name: completion4 features:5 - name: doc_id6 dtype: string7 - name: metadata8 struct:9 - name: language10 dtype: string11 - name: input12 dtype: string13 - name: output14 dtype: string15 splits:16 - name: train17 num_bytes: 106363289418 num_examples: 70206219 download_size: 53213962320 dataset_size: 106363289421- config_name: conversation22 features:23 - name: doc_id24 dtype: string25 - name: metadata26 struct:27 - name: language28 dtype: string29 - name: messages30 list:31 - name: content32 dtype: string33 - name: role34 dtype: string35 splits:36 - name: train37 num_bytes: 108118444438 num_examples: 70206239 download_size: 37134097540 dataset_size: 108118444441- config_name: conversation[abap]42 features:43 - name: doc_id44 dtype: string45 - name: messages46 list:47 - name: content48 dtype: string49 - name: role50 dtype: string51 splits:52 - name: train53 num_bytes: 1529.050451384635654 num_examples: 155 download_size: 1123956 dataset_size: 1529.050451384635657- config_name: conversation[actionscript]58 features:59 - name: doc_id60 dtype: string61 - name: messages62 list:63 - name: content64 dtype: string65 - name: role66 dtype: string67 splits:68 - name: train69 num_bytes: 74923.4721178471470 num_examples: 4971 download_size: 3338372 dataset_size: 74923.4721178471473- config_name: conversation[ada]74 features:75 - name: doc_id76 dtype: string77 - name: messages78 list:79 - name: content80 dtype: string81 - name: role82 dtype: string83 splits:84 - name: train85 num_bytes: 405198.369616928486 num_examples: 26587 download_size: 13275588 dataset_size: 405198.369616928489- config_name: conversation[agda]90 features:91 - name: doc_id92 dtype: string93 - name: messages94 list:95 - name: content96 dtype: string97 - name: role98 dtype: string99 splits:100 - name: train101 num_bytes: 15290.504513846356102 num_examples: 10103 download_size: 6381104 dataset_size: 15290.504513846356105- config_name: conversation[antlr]106 features:107 - name: doc_id108 dtype: string109 - name: messages110 list:111 - name: content112 dtype: string113 - name: role114 dtype: string115 splits:116 - name: train117 num_bytes: 22935.756770769534118 num_examples: 15119 download_size: 11135120 dataset_size: 22935.756770769534121- config_name: conversation[apacheconf]122 features:123 - name: doc_id124 dtype: string125 - name: messages126 list:127 - name: content128 dtype: string129 - name: role130 dtype: string131 splits:132 - name: train133 num_bytes: 3058.100902769271134 num_examples: 2135 download_size: 9936136 dataset_size: 3058.100902769271137- config_name: conversation[apiblueprint]138 features:139 - name: doc_id140 dtype: string141 - name: messages142 list:143 - name: content144 dtype: string145 - name: role146 dtype: string147 splits:148 - name: train149 num_bytes: 35168.16038184662150 num_examples: 23151 download_size: 14221152 dataset_size: 35168.16038184662153- config_name: conversation[apl]154 features:155 - name: doc_id156 dtype: string157 - name: messages158 list:159 - name: content160 dtype: string161 - name: role162 dtype: string163 splits:164 - name: train165 num_bytes: 10703.35315969245166 num_examples: 7167 download_size: 8091168 dataset_size: 10703.35315969245169- config_name: conversation[applescript]170 features:171 - name: doc_id172 dtype: string173 - name: messages174 list:175 - name: content176 dtype: string177 - name: role178 dtype: string179 splits:180 - name: train181 num_bytes: 29051.958576308076182 num_examples: 19183 download_size: 15634184 dataset_size: 29051.958576308076185- config_name: conversation[arc]186 features:187 - name: doc_id188 dtype: string189 - name: messages190 list:191 - name: content192 dtype: string193 - name: role194 dtype: string195 splits:196 - name: train197 num_bytes: 3058.100902769271198 num_examples: 2199 download_size: 4605200 dataset_size: 3058.100902769271201- config_name: conversation[arduino]202 features:203 - name: doc_id204 dtype: string205 - name: messages206 list:207 - name: content208 dtype: string209 - name: role210 dtype: string211 splits:212 - name: train213 num_bytes: 344036.351561543214 num_examples: 225215 download_size: 144458216 dataset_size: 344036.351561543217- config_name: conversation[asciidoc]218 features:219 - name: doc_id220 dtype: string221 - name: messages222 list:223 - name: content224 dtype: string225 - name: role226 dtype: string227 splits:228 - name: train229 num_bytes: 799693.3860741644230 num_examples: 523231 download_size: 331290232 dataset_size: 799693.3860741644233- config_name: conversation[asp]234 features:235 - name: doc_id236 dtype: string237 - name: messages238 list:239 - name: content240 dtype: string241 - name: role242 dtype: string243 splits:244 - name: train245 num_bytes: 33639.10993046198246 num_examples: 22247 download_size: 17060248 dataset_size: 33639.10993046198249- config_name: conversation[aspectj]250 features:251 - name: doc_id252 dtype: string253 - name: messages254 list:255 - name: content256 dtype: string257 - name: role258 dtype: string259 splits:260 - name: train261 num_bytes: 12232.403611077085262 num_examples: 8263 download_size: 7552264 dataset_size: 12232.403611077085265- config_name: conversation[assembly]266 features:267 - name: doc_id268 dtype: string269 - name: messages270 list:271 - name: content272 dtype: string273 - name: role274 dtype: string275 splits:276 - name: train277 num_bytes: 160550.29739538673278 num_examples: 105279 download_size: 52379280 dataset_size: 160550.29739538673281- config_name: conversation[ats]282 features:283 - name: doc_id284 dtype: string285 - name: messages286 list:287 - name: content288 dtype: string289 - name: role290 dtype: string291 splits:292 - name: train293 num_bytes: 4587.151354153907294 num_examples: 3295 download_size: 3041296 dataset_size: 4587.151354153907297- config_name: conversation[augeas]298 features:299 - name: doc_id300 dtype: string301 - name: messages302 list:303 - name: content304 dtype: string305 - name: role306 dtype: string307 splits:308 - name: train309 num_bytes: 19877.655868000264310 num_examples: 13311 download_size: 11668312 dataset_size: 19877.655868000264313- config_name: conversation[autohotkey]314 features:315 - name: doc_id316 dtype: string317 - name: messages318 list:319 - name: content320 dtype: string321 - name: role322 dtype: string323 splits:324 - name: train325 num_bytes: 22935.756770769534326 num_examples: 15327 download_size: 9482328 dataset_size: 22935.756770769534329- config_name: conversation[awk]330 features:331 - name: doc_id332 dtype: string333 - name: messages334 list:335 - name: content336 dtype: string337 - name: role338 dtype: string339 splits:340 - name: train341 num_bytes: 79510.62347200105342 num_examples: 52343 download_size: 26361344 dataset_size: 79510.62347200105345- config_name: conversation[batchfile]346 features:347 - name: doc_id348 dtype: string349 - name: messages350 list:351 - name: content352 dtype: string353 - name: role354 dtype: string355 splits:356 - name: train357 num_bytes: 2241587.9617298758358 num_examples: 1466359 download_size: 602193360 dataset_size: 2241587.9617298758361- config_name: conversation[bitbake]362 features:363 - name: doc_id364 dtype: string365 - name: messages366 list:367 - name: content368 dtype: string369 - name: role370 dtype: string371 splits:372 - name: train373 num_bytes: 1999997.9904111032374 num_examples: 1308375 download_size: 631490376 dataset_size: 1999997.9904111032377- config_name: conversation[blitzmax]378 features:379 - name: doc_id380 dtype: string381 - name: messages382 list:383 - name: content384 dtype: string385 - name: role386 dtype: string387 splits:388 - name: train389 num_bytes: 1529.0504513846356390 num_examples: 1391 download_size: 6001392 dataset_size: 1529.0504513846356393- config_name: conversation[bluespec]394 features:395 - name: doc_id396 dtype: string397 - name: messages398 list:399 - name: content400 dtype: string401 - name: role402 dtype: string403 splits:404 - name: train405 num_bytes: 3058.100902769271406 num_examples: 2407 download_size: 7517408 dataset_size: 3058.100902769271409- config_name: conversation[boo]410 features:411 - name: doc_id412 dtype: string413 - name: messages414 list:415 - name: content416 dtype: string417 - name: role418 dtype: string419 splits:420 - name: train421 num_bytes: 3058.100902769271422 num_examples: 2423 download_size: 13471424 dataset_size: 3058.100902769271425- config_name: conversation[brainfuck]426 features:427 - name: doc_id428 dtype: string429 - name: messages430 list:431 - name: content432 dtype: string433 - name: role434 dtype: string435 splits:436 - name: train437 num_bytes: 3058.100902769271438 num_examples: 2439 download_size: 11654440 dataset_size: 3058.100902769271441- config_name: conversation[bro]442 features:443 - name: doc_id444 dtype: string445 - name: messages446 list:447 - name: content448 dtype: string449 - name: role450 dtype: string451 splits:452 - name: train453 num_bytes: 4587.151354153907454 num_examples: 3455 download_size: 5789456 dataset_size: 4587.151354153907457- config_name: conversation[c#]458 features:459 - name: doc_id460 dtype: string461 - name: messages462 list:463 - name: content464 dtype: string465 - name: role466 dtype: string467 splits:468 - name: train469 num_bytes: 14290505.518640803470 num_examples: 9346471 download_size: 6165804472 dataset_size: 14290505.518640803473- config_name: conversation[c++]474 features:475 - name: doc_id476 dtype: string477 - name: messages478 list:479 - name: content480 dtype: string481 - name: role482 dtype: string483 splits:484 - name: train485 num_bytes: 7633019.8533121486 num_examples: 4992487 download_size: 3008840488 dataset_size: 7633019.8533121489- config_name: conversation[c2hshaskell]490 features:491 - name: doc_id492 dtype: string493 - name: messages494 list:495 - name: content496 dtype: string497 - name: role498 dtype: string499 splits:500 - name: train501 num_bytes: 3058.100902769271502 num_examples: 2503 download_size: 8231504 dataset_size: 3058.100902769271505- config_name: conversation[c]506 features:507 - name: doc_id508 dtype: string509 - name: messages510 list:511 - name: content512 dtype: string513 - name: role514 dtype: string515 splits:516 - name: train517 num_bytes: 13006103.13947771518 num_examples: 8506519 download_size: 4783765520 dataset_size: 13006103.13947771521- config_name: conversation[cap'nproto]522 features:523 - name: doc_id524 dtype: string525 - name: messages526 list:527 - name: content528 dtype: string529 - name: role530 dtype: string531 splits:532 - name: train533 num_bytes: 18348.60541661563534 num_examples: 12535 download_size: 6860536 dataset_size: 18348.60541661563537- config_name: conversation[cartocss]538 features:539 - name: doc_id540 dtype: string541 - name: messages542 list:543 - name: content544 dtype: string545 - name: role546 dtype: string547 splits:548 - name: train549 num_bytes: 4587.151354153907550 num_examples: 3551 download_size: 9233552 dataset_size: 4587.151354153907553- config_name: conversation[ceylon]554 features:555 - name: doc_id556 dtype: string557 - name: messages558 list:559 - name: content560 dtype: string561 - name: role562 dtype: string563 splits:564 - name: train565 num_bytes: 74923.47211784714566 num_examples: 49567 download_size: 26249568 dataset_size: 74923.47211784714569- config_name: conversation[chapel]570 features:571 - name: doc_id572 dtype: string573 - name: messages574 list:575 - name: content576 dtype: string577 - name: role578 dtype: string579 splits:580 - name: train581 num_bytes: 30581.00902769271582 num_examples: 20583 download_size: 13703584 dataset_size: 30581.00902769271585- config_name: conversation[clean]586 features:587 - name: doc_id588 dtype: string589 - name: messages590 list:591 - name: content592 dtype: string593 - name: role594 dtype: string595 splits:596 - name: train597 num_bytes: 1529.0504513846356598 num_examples: 1599 download_size: 6993600 dataset_size: 1529.0504513846356601- config_name: conversation[clojure]602 features:603 - name: doc_id604 dtype: string605 - name: messages606 list:607 - name: content608 dtype: string609 - name: role610 dtype: string611 splits:612 - name: train613 num_bytes: 3674308.2346772794614 num_examples: 2403615 download_size: 1318886616 dataset_size: 3674308.2346772794617- config_name: conversation[cmake]618 features:619 - name: doc_id620 dtype: string621 - name: messages622 list:623 - name: content624 dtype: string625 - name: role626 dtype: string627 splits:628 - name: train629 num_bytes: 1499998.4928083275630 num_examples: 981631 download_size: 462464632 dataset_size: 1499998.4928083275633- config_name: conversation[coffeescript]634 features:635 - name: doc_id636 dtype: string637 - name: messages638 list:639 - name: content640 dtype: string641 - name: role642 dtype: string643 splits:644 - name: train645 num_bytes: 8429655.138483496646 num_examples: 5513647 download_size: 3402652648 dataset_size: 8429655.138483496649- config_name: conversation[coldfusion]650 features:651 - name: doc_id652 dtype: string653 - name: messages654 list:655 - name: content656 dtype: string657 - name: role658 dtype: string659 splits:660 - name: train661 num_bytes: 13761.45406246172662 num_examples: 9663 download_size: 13894664 dataset_size: 13761.45406246172665- config_name: conversation[coldfusioncfc]666 features:667 - name: doc_id668 dtype: string669 - name: messages670 list:671 - name: content672 dtype: string673 - name: role674 dtype: string675 splits:676 - name: train677 num_bytes: 30581.00902769271678 num_examples: 20679 download_size: 15721680 dataset_size: 30581.00902769271681- config_name: conversation[commonlisp]682 features:683 - name: doc_id684 dtype: string685 - name: messages686 list:687 - name: content688 dtype: string689 - name: role690 dtype: string691 splits:692 - name: train693 num_bytes: 1189601.2511772464694 num_examples: 778695 download_size: 370050696 dataset_size: 1189601.2511772464697- config_name: conversation[creole]698 features:699 - name: doc_id700 dtype: string701 - name: messages702 list:703 - name: content704 dtype: string705 - name: role706 dtype: string707 splits:708 - name: train709 num_bytes: 3058.100902769271710 num_examples: 2711 download_size: 12455712 dataset_size: 3058.100902769271713- config_name: conversation[crystal]714 features:715 - name: doc_id716 dtype: string717 - name: messages718 list:719 - name: content720 dtype: string721 - name: role722 dtype: string723 splits:724 - name: train725 num_bytes: 278287.1821520037726 num_examples: 182727 download_size: 89278728 dataset_size: 278287.1821520037729- config_name: conversation[csound]730 features:731 - name: doc_id732 dtype: string733 - name: messages734 list:735 - name: content736 dtype: string737 - name: role738 dtype: string739 splits:740 - name: train741 num_bytes: 6116.201805538542742 num_examples: 4743 download_size: 5021744 dataset_size: 6116.201805538542745- config_name: conversation[css]746 features:747 - name: doc_id748 dtype: string749 - name: messages750 list:751 - name: content752 dtype: string753 - name: role754 dtype: string755 splits:756 - name: train757 num_bytes: 7720175.729041025758 num_examples: 5049759 download_size: 1963859760 dataset_size: 7720175.729041025761- config_name: conversation[csv]762 features:763 - name: doc_id764 dtype: string765 - name: messages766 list:767 - name: content768 dtype: string769 - name: role770 dtype: string771 splits:772 - name: train773 num_bytes: 573393.9192692384774 num_examples: 375775 download_size: 137132776 dataset_size: 573393.9192692384777- config_name: conversation[cucumber]778 features:779 - name: doc_id780 dtype: string781 - name: messages782 list:783 - name: content784 dtype: string785 - name: role786 dtype: string787 splits:788 - name: train789 num_bytes: 1492353.2405514042790 num_examples: 976791 download_size: 532572792 dataset_size: 1492353.2405514042793- config_name: conversation[cuda]794 features:795 - name: doc_id796 dtype: string797 - name: messages798 list:799 - name: content800 dtype: string801 - name: role802 dtype: string803 splits:804 - name: train805 num_bytes: 38226.26128461589806 num_examples: 25807 download_size: 22442808 dataset_size: 38226.26128461589809- config_name: conversation[cython]810 features:811 - name: doc_id812 dtype: string813 - name: messages814 list:815 - name: content816 dtype: string817 - name: role818 dtype: string819 splits:820 - name: train821 num_bytes: 188073.20552031018822 num_examples: 123823 download_size: 65051824 dataset_size: 188073.20552031018825- config_name: conversation[dart]826 features:827 - name: doc_id828 dtype: string829 - name: messages830 list:831 - name: content832 dtype: string833 - name: role834 dtype: string835 splits:836 - name: train837 num_bytes: 1169723.595309246838 num_examples: 765839 download_size: 460046840 dataset_size: 1169723.595309246841- config_name: conversation[desktop]842 features:843 - name: doc_id844 dtype: string845 - name: messages846 list:847 - name: content848 dtype: string849 - name: role850 dtype: string851 splits:852 - name: train853 num_bytes: 284403.3839575422854 num_examples: 186855 download_size: 46475856 dataset_size: 284403.3839575422857- config_name: conversation[diff]858 features:859 - name: doc_id860 dtype: string861 - name: messages862 list:863 - name: content864 dtype: string865 - name: role866 dtype: string867 splits:868 - name: train869 num_bytes: 1039754.3069415522870 num_examples: 680871 download_size: 363721872 dataset_size: 1039754.3069415522873- config_name: conversation[digitalcommandlanguage]874 features:875 - name: doc_id876 dtype: string877 - name: messages878 list:879 - name: content880 dtype: string881 - name: role882 dtype: string883 splits:884 - name: train885 num_bytes: 29051.958576308076886 num_examples: 19887 download_size: 11230888 dataset_size: 29051.958576308076889- config_name: conversation[dm]890 features:891 - name: doc_id892 dtype: string893 - name: messages894 list:895 - name: content896 dtype: string897 - name: role898 dtype: string899 splits:900 - name: train901 num_bytes: 24464.80722215417902 num_examples: 16903 download_size: 12320904 dataset_size: 24464.80722215417905- config_name: conversation[dnszone]906 features:907 - name: doc_id908 dtype: string909 - name: messages910 list:911 - name: content912 dtype: string913 - name: role914 dtype: string915 splits:916 - name: train917 num_bytes: 3058.100902769271918 num_examples: 2919 download_size: 5135920 dataset_size: 3058.100902769271921- config_name: conversation[dockerfile]922 features:923 - name: doc_id924 dtype: string925 - name: messages926 list:927 - name: content928 dtype: string929 - name: role930 dtype: string931 splits:932 - name: train933 num_bytes: 59632.96760400078934 num_examples: 39935 download_size: 22429936 dataset_size: 59632.96760400078937- config_name: conversation[dylan]938 features:939 - name: doc_id940 dtype: string941 - name: messages942 list:943 - name: content944 dtype: string945 - name: role946 dtype: string947 splits:948 - name: train949 num_bytes: 3058.100902769271950 num_examples: 2951 download_size: 15100952 dataset_size: 3058.100902769271953- config_name: conversation[eagle]954 features:955 - name: doc_id956 dtype: string957 - name: messages958 list:959 - name: content960 dtype: string961 - name: role962 dtype: string963 splits:964 - name: train965 num_bytes: 6116.201805538542966 num_examples: 4967 download_size: 4043968 dataset_size: 6116.201805538542969- config_name: conversation[ecl]970 features:971 - name: doc_id972 dtype: string973 - name: messages974 list:975 - name: content976 dtype: string977 - name: role978 dtype: string979 splits:980 - name: train981 num_bytes: 6116.201805538542982 num_examples: 4983 download_size: 5158984 dataset_size: 6116.201805538542985- config_name: conversation[edn]986 features:987 - name: doc_id988 dtype: string989 - name: messages990 list:991 - name: content992 dtype: string993 - name: role994 dtype: string995 splits:996 - name: train997 num_bytes: 73394.42166646251998 num_examples: 48999 download_size: 210801000 dataset_size: 73394.421666462511001- config_name: conversation[eiffel]1002 features:1003 - name: doc_id1004 dtype: string1005 - name: messages1006 list:1007 - name: content1008 dtype: string1009 - name: role1010 dtype: string1011 splits:1012 - name: train1013 num_bytes: 3058.1009027692711014 num_examples: 21015 download_size: 103831016 dataset_size: 3058.1009027692711017- config_name: conversation[elixir]1018 features:1019 - name: doc_id1020 dtype: string1021 - name: messages1022 list:1023 - name: content1024 dtype: string1025 - name: role1026 dtype: string1027 splits:1028 - name: train1029 num_bytes: 1758408.0190923311030 num_examples: 11501031 download_size: 6225691032 dataset_size: 1758408.0190923311033- config_name: conversation[elm]1034 features:1035 - name: doc_id1036 dtype: string1037 - name: messages1038 list:1039 - name: content1040 dtype: string1041 - name: role1042 dtype: string1043 splits:1044 - name: train1045 num_bytes: 405198.36961692841046 num_examples: 2651047 download_size: 1661171048 dataset_size: 405198.36961692841049- config_name: conversation[emacslisp]1050 features:1051 - name: doc_id1052 dtype: string1053 - name: messages1054 list:1055 - name: content1056 dtype: string1057 - name: role1058 dtype: string1059 splits:1060 - name: train1061 num_bytes: 1551986.2081554051062 num_examples: 10151063 download_size: 5050431064 dataset_size: 1551986.2081554051065- config_name: conversation[emberscript]1066 features:1067 - name: doc_id1068 dtype: string1069 - name: messages1070 list:1071 - name: content1072 dtype: string1073 - name: role1074 dtype: string1075 splits:1076 - name: train1077 num_bytes: 10703.353159692451078 num_examples: 71079 download_size: 70761080 dataset_size: 10703.353159692451081- config_name: conversation[erlang]1082 features:1083 - name: doc_id1084 dtype: string1085 - name: messages1086 list:1087 - name: content1088 dtype: string1089 - name: role1090 dtype: string1091 splits:1092 - name: train1093 num_bytes: 733944.21666462511094 num_examples: 4801095 download_size: 2743081096 dataset_size: 733944.21666462511097- config_name: conversation[f#]1098 features:1099 - name: doc_id1100 dtype: string1101 - name: messages1102 list:1103 - name: content1104 dtype: string1105 - name: role1106 dtype: string1107 splits:1108 - name: train1109 num_bytes: 388378.81465169741110 num_examples: 2541111 download_size: 1676641112 dataset_size: 388378.81465169741113- config_name: conversation[factor]1114 features:1115 - name: doc_id1116 dtype: string1117 - name: messages1118 list:1119 - name: content1120 dtype: string1121 - name: role1122 dtype: string1123 splits:1124 - name: train1125 num_bytes: 172782.701006463821126 num_examples: 1131127 download_size: 523081128 dataset_size: 172782.701006463821129- config_name: conversation[fancy]1130 features:1131 - name: doc_id1132 dtype: string1133 - name: messages1134 list:1135 - name: content1136 dtype: string1137 - name: role1138 dtype: string1139 splits:1140 - name: train1141 num_bytes: 12232.4036110770851142 num_examples: 81143 download_size: 117151144 dataset_size: 12232.4036110770851145- config_name: conversation[fish]1146 features:1147 - name: doc_id1148 dtype: string1149 - name: messages1150 list:1151 - name: content1152 dtype: string1153 - name: role1154 dtype: string1155 splits:1156 - name: train1157 num_bytes: 1243118.01697570881158 num_examples: 8131159 download_size: 3489881160 dataset_size: 1243118.01697570881161- config_name: conversation[flux]1162 features:1163 - name: doc_id1164 dtype: string1165 - name: messages1166 list:1167 - name: content1168 dtype: string1169 - name: role1170 dtype: string1171 splits:1172 - name: train1173 num_bytes: 4587.1513541539071174 num_examples: 31175 download_size: 66671176 dataset_size: 4587.1513541539071177- config_name: conversation[forth]1178 features:1179 - name: doc_id1180 dtype: string1181 - name: messages1182 list:1183 - name: content1184 dtype: string1185 - name: role1186 dtype: string1187 splits:1188 - name: train1189 num_bytes: 3058.1009027692711190 num_examples: 21191 download_size: 67251192 dataset_size: 3058.1009027692711193- config_name: conversation[fortran]1194 features:1195 - name: doc_id1196 dtype: string1197 - name: messages1198 list:1199 - name: content1200 dtype: string