CoolFace
Modelpublic

Codeprocastinator/optimized-tinyllama-covalent

sourceHugging Faceapache-2.0updated 1y agoView on Hugging Face
0likes119downloads
CMakeLists.txt362 linesDownload Raw Back to ggml
1cmake_minimum_required(VERSION 3.14) # for add_link_options and implicit target directories.2project("ggml" C CXX)3include(CheckIncludeFileCXX)4 5set(CMAKE_EXPORT_COMPILE_COMMANDS ON)6 7if (NOT XCODE AND NOT MSVC AND NOT CMAKE_BUILD_TYPE)8    set(CMAKE_BUILD_TYPE Release CACHE STRING "Build type" FORCE)9    set_property(CACHE CMAKE_BUILD_TYPE PROPERTY STRINGS "Debug" "Release" "MinSizeRel" "RelWithDebInfo")10endif()11 12if (CMAKE_SOURCE_DIR STREQUAL CMAKE_CURRENT_SOURCE_DIR)13    set(GGML_STANDALONE ON)14 15    set(CMAKE_RUNTIME_OUTPUT_DIRECTORY ${CMAKE_BINARY_DIR}/bin)16 17    # configure project version18    # TODO19else()20    set(GGML_STANDALONE OFF)21endif()22 23if (EMSCRIPTEN)24    set(BUILD_SHARED_LIBS_DEFAULT OFF)25 26    option(GGML_WASM_SINGLE_FILE "ggml: embed WASM inside the generated ggml.js" ON)27else()28    if (MINGW)29        set(BUILD_SHARED_LIBS_DEFAULT OFF)30    else()31        set(BUILD_SHARED_LIBS_DEFAULT ON)32    endif()33endif()34 35# remove the lib prefix on win32 mingw36if (WIN32)37    set(CMAKE_STATIC_LIBRARY_PREFIX "")38    set(CMAKE_SHARED_LIBRARY_PREFIX "")39    set(CMAKE_SHARED_MODULE_PREFIX  "")40endif()41 42option(BUILD_SHARED_LIBS "ggml: build shared libraries" ${BUILD_SHARED_LIBS_DEFAULT})43option(GGML_BACKEND_DL   "ggml: build backends as dynamic libraries (requires BUILD_SHARED_LIBS)" OFF)44 45#46# option list47#48 49# TODO: mark all options as advanced when not GGML_STANDALONE50 51if (APPLE)52    set(GGML_METAL_DEFAULT ON)53    set(GGML_BLAS_DEFAULT ON)54    set(GGML_BLAS_VENDOR_DEFAULT "Apple")55else()56    set(GGML_METAL_DEFAULT OFF)57    set(GGML_BLAS_DEFAULT OFF)58    set(GGML_BLAS_VENDOR_DEFAULT "Generic")59endif()60 61if (CMAKE_CROSSCOMPILING OR DEFINED ENV{SOURCE_DATE_EPOCH})62    message(STATUS "Setting GGML_NATIVE_DEFAULT to OFF")63    set(GGML_NATIVE_DEFAULT OFF)64else()65    set(GGML_NATIVE_DEFAULT ON)66endif()67 68# defaults69if (NOT GGML_LLAMAFILE_DEFAULT)70    set(GGML_LLAMAFILE_DEFAULT OFF)71endif()72 73if (NOT GGML_CUDA_GRAPHS_DEFAULT)74    set(GGML_CUDA_GRAPHS_DEFAULT OFF)75endif()76 77# general78option(GGML_STATIC "ggml: static link libraries"                     OFF)79option(GGML_NATIVE "ggml: optimize the build for the current system" ${GGML_NATIVE_DEFAULT})80option(GGML_LTO    "ggml: enable link time optimization"             OFF)81option(GGML_CCACHE "ggml: use ccache if available"                   ON)82 83# debug84option(GGML_ALL_WARNINGS           "ggml: enable all compiler warnings"                   ON)85option(GGML_ALL_WARNINGS_3RD_PARTY "ggml: enable all compiler warnings in 3rd party libs" OFF)86option(GGML_GPROF                  "ggml: enable gprof"                                   OFF)87 88# build89option(GGML_FATAL_WARNINGS    "ggml: enable -Werror flag"    OFF)90 91# sanitizers92option(GGML_SANITIZE_THREAD    "ggml: enable thread sanitizer"    OFF)93option(GGML_SANITIZE_ADDRESS   "ggml: enable address sanitizer"   OFF)94option(GGML_SANITIZE_UNDEFINED "ggml: enable undefined sanitizer" OFF)95 96# instruction set specific97if (GGML_NATIVE OR NOT GGML_NATIVE_DEFAULT)98    set(INS_ENB OFF)99else()100    set(INS_ENB ON)101endif()102 103message(DEBUG "GGML_NATIVE         : ${GGML_NATIVE}")104message(DEBUG "GGML_NATIVE_DEFAULT : ${GGML_NATIVE_DEFAULT}")105message(DEBUG "INS_ENB             : ${INS_ENB}")106 107option(GGML_CPU_HBM          "ggml: use memkind for CPU HBM" OFF)108option(GGML_CPU_AARCH64      "ggml: use runtime weight conversion of Q4_0 to Q4_X_X" ON)109option(GGML_CPU_KLEIDIAI     "ggml: use KleidiAI optimized kernels if applicable" OFF)110option(GGML_AVX              "ggml: enable AVX"              ${INS_ENB})111option(GGML_AVX_VNNI         "ggml: enable AVX-VNNI"         OFF)112option(GGML_AVX2             "ggml: enable AVX2"             ${INS_ENB})113option(GGML_BMI2             "ggml: enable BMI2"             ${INS_ENB})114option(GGML_AVX512           "ggml: enable AVX512F"          OFF)115option(GGML_AVX512_VBMI      "ggml: enable AVX512-VBMI"      OFF)116option(GGML_AVX512_VNNI      "ggml: enable AVX512-VNNI"      OFF)117option(GGML_AVX512_BF16      "ggml: enable AVX512-BF16"      OFF)118if (NOT MSVC)119    # in MSVC F16C and FMA is implied with AVX2/AVX512120    option(GGML_FMA          "ggml: enable FMA"              ${INS_ENB})121    option(GGML_F16C         "ggml: enable F16C"             ${INS_ENB})122    # MSVC does not seem to support AMX123    option(GGML_AMX_TILE     "ggml: enable AMX-TILE"         OFF)124    option(GGML_AMX_INT8     "ggml: enable AMX-INT8"         OFF)125    option(GGML_AMX_BF16     "ggml: enable AMX-BF16"         OFF)126endif()127option(GGML_LASX             "ggml: enable lasx"             ON)128option(GGML_LSX              "ggml: enable lsx"              ON)129option(GGML_RVV              "ggml: enable rvv"              ON)130option(GGML_RV_ZFH           "ggml: enable riscv zfh"        OFF)131option(GGML_VXE              "ggml: enable vxe"              ON)132 133option(GGML_CPU_ALL_VARIANTS "ggml: build all variants of the CPU backend (requires GGML_BACKEND_DL)" OFF)134set(GGML_CPU_ARM_ARCH        "" CACHE STRING "ggml: CPU architecture for ARM")135set(GGML_CPU_POWERPC_CPUTYPE "" CACHE STRING "ggml: CPU type for PowerPC")136 137 138if (WIN32)139    set(GGML_WIN_VER "0x602" CACHE STRING   "ggml: Windows version")140endif()141 142# ggml core143set(GGML_SCHED_MAX_COPIES  "4" CACHE STRING "ggml: max input copies for pipeline parallelism")144option(GGML_CPU                             "ggml: enable CPU backend"                        ON)145 146# 3rd party libs / backends147option(GGML_ACCELERATE                      "ggml: enable Accelerate framework"               ON)148option(GGML_BLAS                            "ggml: use BLAS"                                  ${GGML_BLAS_DEFAULT})149set(GGML_BLAS_VENDOR ${GGML_BLAS_VENDOR_DEFAULT} CACHE STRING150                                            "ggml: BLAS library vendor")151option(GGML_LLAMAFILE                       "ggml: use LLAMAFILE"                             ${GGML_LLAMAFILE_DEFAULT})152 153option(GGML_CUDA                            "ggml: use CUDA"                                  OFF)154option(GGML_MUSA                            "ggml: use MUSA"                                  OFF)155option(GGML_CUDA_FORCE_MMQ                  "ggml: use mmq kernels instead of cuBLAS"         OFF)156option(GGML_CUDA_FORCE_CUBLAS               "ggml: always use cuBLAS instead of mmq kernels"  OFF)157option(GGML_CUDA_F16                        "ggml: use 16 bit floats for some calculations"   OFF)158set   (GGML_CUDA_PEER_MAX_BATCH_SIZE "128" CACHE STRING159                                            "ggml: max. batch size for using peer access")160option(GGML_CUDA_NO_PEER_COPY               "ggml: do not use peer to peer copies"            OFF)161option(GGML_CUDA_NO_VMM                     "ggml: do not try to use CUDA VMM"                OFF)162option(GGML_CUDA_FA                         "ggml: compile ggml FlashAttention CUDA kernels"  ON)163option(GGML_CUDA_FA_ALL_QUANTS              "ggml: compile all quants for FlashAttention"     OFF)164option(GGML_CUDA_GRAPHS                     "ggml: use CUDA graphs (llama.cpp only)"          ${GGML_CUDA_GRAPHS_DEFAULT})165set   (GGML_CUDA_COMPRESSION_MODE "size" CACHE STRING166                                            "ggml: cuda link binary compression mode; requires cuda 12.8+")167set_property(CACHE GGML_CUDA_COMPRESSION_MODE PROPERTY STRINGS "none;speed;balance;size")168 169option(GGML_HIP                             "ggml: use HIP"                                   OFF)170option(GGML_HIP_GRAPHS                      "ggml: use HIP graph, experimental, slow"         OFF)171option(GGML_HIP_NO_VMM                      "ggml: do not try to use HIP VMM"                 ON)172option(GGML_HIP_ROCWMMA_FATTN               "ggml: enable rocWMMA for FlashAttention"         OFF)173option(GGML_VULKAN                          "ggml: use Vulkan"                                OFF)174option(GGML_VULKAN_CHECK_RESULTS            "ggml: run Vulkan op checks"                      OFF)175option(GGML_VULKAN_DEBUG                    "ggml: enable Vulkan debug output"                OFF)176option(GGML_VULKAN_MEMORY_DEBUG             "ggml: enable Vulkan memory debug output"         OFF)177option(GGML_VULKAN_SHADER_DEBUG_INFO        "ggml: enable Vulkan shader debug info"           OFF)178option(GGML_VULKAN_PERF                     "ggml: enable Vulkan perf output"                 OFF)179option(GGML_VULKAN_VALIDATE                 "ggml: enable Vulkan validation"                  OFF)180option(GGML_VULKAN_RUN_TESTS                "ggml: run Vulkan tests"                          OFF)181option(GGML_KOMPUTE                         "ggml: use Kompute"                               OFF)182option(GGML_METAL                           "ggml: use Metal"                                 ${GGML_METAL_DEFAULT})183option(GGML_METAL_USE_BF16                  "ggml: use bfloat if available"                   OFF)184option(GGML_METAL_NDEBUG                    "ggml: disable Metal debugging"                   OFF)185option(GGML_METAL_SHADER_DEBUG              "ggml: compile Metal with -fno-fast-math"         OFF)186option(GGML_METAL_EMBED_LIBRARY             "ggml: embed Metal library"                       ${GGML_METAL})187set   (GGML_METAL_MACOSX_VERSION_MIN "" CACHE STRING188                                            "ggml: metal minimum macOS version")189set   (GGML_METAL_STD "" CACHE STRING       "ggml: metal standard version (-std flag)")190option(GGML_OPENMP                          "ggml: use OpenMP"                                ON)191option(GGML_RPC                             "ggml: use RPC"                                   OFF)192option(GGML_SYCL                            "ggml: use SYCL"                                  OFF)193option(GGML_SYCL_F16                        "ggml: use 16 bit floats for sycl calculations"   OFF)194option(GGML_SYCL_GRAPH                      "ggml: enable graphs in the SYCL backend"         ON)195set   (GGML_SYCL_TARGET "INTEL" CACHE STRING196                                            "ggml: sycl target device")197set   (GGML_SYCL_DEVICE_ARCH "" CACHE STRING198                                            "ggml: sycl device architecture")199 200option(GGML_OPENCL                          "ggml: use OpenCL"                                OFF)201option(GGML_OPENCL_PROFILING                "ggml: use OpenCL profiling (increases overhead)" OFF)202option(GGML_OPENCL_EMBED_KERNELS            "ggml: embed kernels"                             ON)203option(GGML_OPENCL_USE_ADRENO_KERNELS       "ggml: use optimized kernels for Adreno"          ON)204set   (GGML_OPENCL_TARGET_VERSION "300" CACHE STRING205                                            "gmml: OpenCL API version to target")206 207# toolchain for vulkan-shaders-gen208set   (GGML_VULKAN_SHADERS_GEN_TOOLCHAIN "" CACHE FILEPATH "ggml: toolchain file for vulkan-shaders-gen")209 210# extra artifacts211option(GGML_BUILD_TESTS    "ggml: build tests"    ${GGML_STANDALONE})212option(GGML_BUILD_EXAMPLES "ggml: build examples" ${GGML_STANDALONE})213 214#215# dependencies216#217 218set(CMAKE_C_STANDARD 11)219set(CMAKE_C_STANDARD_REQUIRED true)220 221set(CMAKE_CXX_STANDARD 17)222set(CMAKE_CXX_STANDARD_REQUIRED true)223 224set(THREADS_PREFER_PTHREAD_FLAG ON)225 226find_package(Threads REQUIRED)227 228include(GNUInstallDirs)229 230#231# build the library232#233 234add_subdirectory(src)235 236#237# tests and examples238#239 240if (GGML_BUILD_TESTS)241    enable_testing()242    add_subdirectory(tests)243endif ()244 245if (GGML_BUILD_EXAMPLES)246    add_subdirectory(examples)247endif ()248 249#250# install251#252 253include(CMakePackageConfigHelpers)254 255# all public headers256set(GGML_PUBLIC_HEADERS257    include/ggml.h258    include/ggml-cpu.h259    include/ggml-alloc.h260    include/ggml-backend.h261    include/ggml-blas.h262    include/ggml-cann.h263    include/ggml-cpp.h264    include/ggml-cuda.h265    include/ggml-kompute.h266    include/ggml-opt.h267    include/ggml-metal.h268    include/ggml-rpc.h269    include/ggml-sycl.h270    include/ggml-vulkan.h271    include/gguf.h)272 273set_target_properties(ggml PROPERTIES PUBLIC_HEADER "${GGML_PUBLIC_HEADERS}")274#if (GGML_METAL)275#    set_target_properties(ggml PROPERTIES RESOURCE "${CMAKE_CURRENT_SOURCE_DIR}/src/ggml-metal.metal")276#endif()277install(TARGETS ggml LIBRARY PUBLIC_HEADER)278install(TARGETS ggml-base LIBRARY)279 280if (GGML_STANDALONE)281    configure_file(${CMAKE_CURRENT_SOURCE_DIR}/ggml.pc.in282        ${CMAKE_CURRENT_BINARY_DIR}/ggml.pc283        @ONLY)284 285    install(FILES ${CMAKE_CURRENT_BINARY_DIR}/ggml.pc286        DESTINATION share/pkgconfig)287endif()288 289#290# Create CMake package291#292 293# Generate version info based on git commit.294 295if(NOT DEFINED GGML_BUILD_NUMBER)296    find_program(GIT_EXE NAMES git git.exe REQUIRED NO_CMAKE_FIND_ROOT_PATH)297    execute_process(COMMAND ${GIT_EXE} rev-list --count HEAD298        WORKING_DIRECTORY ${CMAKE_CURRENT_SOURCE_DIR}299        OUTPUT_VARIABLE GGML_BUILD_NUMBER300        OUTPUT_STRIP_TRAILING_WHITESPACE301    )302 303    if(GGML_BUILD_NUMBER EQUAL 1)304        message(WARNING "GGML build version fixed at 1 likely due to a shallow clone.")305    endif()306 307    execute_process(COMMAND ${GIT_EXE} rev-parse --short HEAD308        WORKING_DIRECTORY ${CMAKE_CURRENT_SOURCE_DIR}309        OUTPUT_VARIABLE GGML_BUILD_COMMIT310        OUTPUT_STRIP_TRAILING_WHITESPACE311    )312endif()313 314 315# Capture variables prefixed with GGML_.316 317set(variable_set_statements318"319####### Expanded from @GGML_VARIABLES_EXPANED@ by configure_package_config_file() #######320####### Any changes to this file will be overwritten by the next CMake run        #######321 322")323 324set(GGML_SHARED_LIB ${BUILD_SHARED_LIBS})325 326get_cmake_property(all_variables VARIABLES)327foreach(variable_name IN LISTS all_variables)328    if(variable_name MATCHES "^GGML_")329        string(REPLACE ";" "\\;"330               variable_value "${${variable_name}}")331 332        set(variable_set_statements333            "${variable_set_statements}set(${variable_name} \"${variable_value}\")\n")334    endif()335endforeach()336 337set(GGML_VARIABLES_EXPANDED ${variable_set_statements})338 339# Create the CMake package and set install location.340 341set(GGML_INSTALL_VERSION 0.0.${GGML_BUILD_NUMBER})342set(GGML_INCLUDE_INSTALL_DIR ${CMAKE_INSTALL_INCLUDEDIR} CACHE PATH "Location of header  files")343set(GGML_LIB_INSTALL_DIR     ${CMAKE_INSTALL_LIBDIR}     CACHE PATH "Location of library files")344set(GGML_BIN_INSTALL_DIR     ${CMAKE_INSTALL_BINDIR}     CACHE PATH "Location of binary  files")345 346configure_package_config_file(347        ${CMAKE_CURRENT_SOURCE_DIR}/cmake/ggml-config.cmake.in348        ${CMAKE_CURRENT_BINARY_DIR}/ggml-config.cmake349    INSTALL_DESTINATION ${CMAKE_INSTALL_LIBDIR}/cmake/ggml350    PATH_VARS GGML_INCLUDE_INSTALL_DIR351              GGML_LIB_INSTALL_DIR352              GGML_BIN_INSTALL_DIR)353 354write_basic_package_version_file(355        ${CMAKE_CURRENT_BINARY_DIR}/ggml-version.cmake356    VERSION ${GGML_INSTALL_VERSION}357    COMPATIBILITY SameMajorVersion)358 359install(FILES ${CMAKE_CURRENT_BINARY_DIR}/ggml-config.cmake360              ${CMAKE_CURRENT_BINARY_DIR}/ggml-version.cmake361        DESTINATION ${CMAKE_INSTALL_LIBDIR}/cmake/ggml)362