Team Ai
Datasetpublic

Brunobkr/llama.cpp_AlgMor24_github

ΩFFFΣLLIa • llama.cpp • AlgMor24 ██████╗ ███████╗███████╗███████╗██╗ ██╗ ██╗ █████╗ ██╔═══██╗██╔════╝██╔════╝██╔════╝██║ ██║ ██║██╔══██╗ ██║ ██║█████╗ █████╗ █████╗ ██║ ██║ ██║███████║ ██║ ██║██╔══╝ ██╔══╝ ██╔══╝ ██║ ██║ ██║██╔══██║ ╚██████╔╝██║ ██║ ███████╗███████╗███████╗██║██║ ██║ ╚═════╝ ╚═╝ ╚═╝ ╚══════╝╚══════╝╚══════╝╚═╝╚═╝ ╚═╝ High-Performance LLM / VLM Inference & Autonomous Agentic Ecosystem… See the full description on the dataset page: https://huggingface.co/datasets/Brunobkr/llama.cpp_AlgMor24_github.

sourceHugging Faceupdated 2mo agoView on Hugging Face
0likes3.1kdownloads
build-self-hosted.yml410 linesDownload Raw Back to workflows
1name: CI (self-hosted)2 3on:4  workflow_dispatch: # allows manual triggering5  push:6    branches:7      - master8    paths: [9      '.github/workflows/build-self-hosted.yml',10      '**/CMakeLists.txt',11      '**/.cmake',12      '**/*.h',13      '**/*.hpp',14      '**/*.c',15      '**/*.cpp',16      '**/*.cu',17      '**/*.cuh',18      '**/*.swift',19      '**/*.m',20      '**/*.metal',21      '**/*.comp',22      '**/*.glsl',23      '**/*.wgsl'24    ]25 26  pull_request:27    types: [opened, synchronize, reopened]28    paths: [29      '.github/workflows/build-self-hosted.yml',30      '**/CMakeLists.txt',31      '**/.cmake',32      '**/*.h',33      '**/*.hpp',34      '**/*.c',35      '**/*.cpp',36      '**/*.cu',37      '**/*.cuh',38      '**/*.swift',39      '**/*.m',40      '**/*.metal',41      '**/*.comp',42      '**/*.glsl',43      '**/*.wgsl'44    ]45 46concurrency:47  group: ${{ github.workflow }}-${{ github.head_ref && github.ref || github.run_id }}48  cancel-in-progress: true49 50env:51  # note: this is dud token to avoid rate limiting (https://github.com/ggml-org/llama.cpp/pull/25706#issuecomment-4979941302)52  HF_TOKEN: ${{ secrets.HF_TOKEN_CI }}53  GGML_NLOOP: 354  GGML_N_THREADS: 155  LLAMA_ARG_LOG_COLORS: 156  LLAMA_ARG_LOG_PREFIX: 157  LLAMA_ARG_LOG_TIMESTAMPS: 158 59jobs:60  gpu-cuda:61    runs-on: [self-hosted, Linux, NVIDIA]62 63    steps:64      - name: Clone65        id: checkout66        uses: actions/checkout@v667 68      - name: Test69        id: ggml-ci70        run: |71          nvidia-smi72          GG_BUILD_CUDA=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp73 74  gpu-rocm:75    runs-on: [self-hosted, Linux, AMD]76 77    steps:78      - name: Clone79        id: checkout80        uses: actions/checkout@v681 82      - name: Test83        id: ggml-ci84        # HIP_LAUNCH_BLOCKING=1: workaround for an async-execution correctness85        # issue on integrated RDNA3.5 (gfx1151) where batched inference returns86        # incorrect output (perplexity ~88 vs ~9.4). Serializing kernel launches87        # restores correctness. Remove once the underlying ROCm/HIP issue is fixed.88        env:89          HIP_LAUNCH_BLOCKING: "1"90        run: |91          rocminfo92          GG_BUILD_ROCM=1 GG_BUILD_AMDGPU_TARGETS=gfx1151 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp93 94  gpu-vulkan-nvidia-cm:95    runs-on: [self-hosted, Linux, NVIDIA]96 97    steps:98      - name: Clone99        id: checkout100        uses: actions/checkout@v6101 102      - name: Test103        id: ggml-ci104        run: |105          vulkaninfo --summary106          GG_BUILD_VULKAN=1 GGML_VK_DISABLE_COOPMAT2=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp107 108  gpu-vulkan-nvidia-cm2:109    runs-on: [self-hosted, Linux, NVIDIA, COOPMAT2]110 111    steps:112      - name: Clone113        id: checkout114        uses: actions/checkout@v6115 116      - name: Test117        id: ggml-ci118        run: |119          vulkaninfo --summary120          GG_BUILD_VULKAN=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp121 122  gpu-webgpu-nvidia:123    runs-on: [self-hosted, Linux, NVIDIA, X64]124 125    steps:126      - name: Clone127        id: checkout128        uses: actions/checkout@v6129 130      - name: Dawn Dependency131        id: dawn-depends132        run: |133          DAWN_VERSION="v20260317.182325"134          DAWN_OWNER="google"135          DAWN_REPO="dawn"136          DAWN_ASSET_NAME="Dawn-18eb229ef5f707c1464cc581252e7603c73a3ef0-ubuntu-latest-Release"137          echo "Fetching release asset from https://github.com/google/dawn/releases/download/${DAWN_VERSION}/${DAWN_ASSET_NAME}.tar.gz"138          curl -L -o artifact.tar.gz \139            "https://github.com/google/dawn/releases/download/${DAWN_VERSION}/${DAWN_ASSET_NAME}.tar.gz"140          mkdir dawn141          tar -xvf artifact.tar.gz -C dawn --strip-components=1142 143      - name: Test144        id: ggml-ci145        run: |146          GG_BUILD_WEBGPU=1 \147          GG_BUILD_WEBGPU_DAWN_PREFIX="$GITHUB_WORKSPACE/dawn" \148          GG_BUILD_WEBGPU_DAWN_DIR="$GITHUB_WORKSPACE/dawn/lib64/cmake/Dawn" \149            bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp150 151  # TODO: provision AMX-compatible machine152  #cpu-amx:153  #  runs-on: [self-hosted, Linux, CPU, AMX]154 155  #  steps:156  #    - name: Clone157  #      id: checkout158  #      uses: actions/checkout@v6159 160  #    - name: Test161  #      id: ggml-ci162  #      run: |163  #        bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp164 165  # TODO: provision AMD GPU machine166  # amd-vulkan:167  #   runs-on: [self-hosted, Linux, AMD]168 169  #   steps:170  #     - name: Clone171  #       id: checkout172  #       uses: actions/checkout@v6173 174  #     - name: Test175  #       id: ggml-ci176  #       run: |177  #         vulkaninfo --summary178  #         GG_BUILD_VULKAN=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp179 180  # TODO: provision AMD GPU machine181  # amd-rocm:182  #   runs-on: [self-hosted, Linux, AMD]183 184  #   steps:185  #     - name: Clone186  #       id: checkout187  #       uses: actions/checkout@v6188 189  #     - name: Test190  #       id: ggml-ci191  #       run: |192  #         amd-smi static193  #         GG_BUILD_ROCM=1 GG_BUILD_AMDGPU_TARGETS="gfx1101" bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp194 195  gpu-metal:196    runs-on: [self-hosted, macOS, ARM64]197 198    steps:199      - name: Clone200        id: checkout201        uses: actions/checkout@v6202 203      - name: Test204        id: ggml-ci205        run: |206          GG_BUILD_METAL=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp207 208  gpu-webgpu-apple:209    runs-on: [self-hosted, macOS, ARM64]210 211    steps:212      - name: Clone213        id: checkout214        uses: actions/checkout@v6215 216      - name: Dawn Dependency217        id: dawn-depends218        run: |219          DAWN_VERSION="v20260317.182325"220          DAWN_OWNER="google"221          DAWN_REPO="dawn"222          DAWN_ASSET_NAME="Dawn-18eb229ef5f707c1464cc581252e7603c73a3ef0-macos-latest-Release"223          echo "Fetching release asset from https://github.com/google/dawn/releases/download/${DAWN_VERSION}/${DAWN_ASSET_NAME}.tar.gz"224          curl -L -o artifact.tar.gz \225            "https://github.com/google/dawn/releases/download/${DAWN_VERSION}/${DAWN_ASSET_NAME}.tar.gz"226          mkdir dawn227          tar -xvf artifact.tar.gz -C dawn --strip-components=1228 229      - name: Test230        id: ggml-ci231        run: |232          GG_BUILD_WEBGPU=1 GG_BUILD_WEBGPU_DAWN_PREFIX="$GITHUB_WORKSPACE/dawn" \233            bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp234 235  gpu-vulkan-apple:236    runs-on: [self-hosted, macOS, ARM64]237 238    steps:239      - name: Clone240        id: checkout241        uses: actions/checkout@v6242 243      - name: Test244        id: ggml-ci245        run: |246          vulkaninfo --summary247          GG_BUILD_VULKAN=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp248 249  gpu-vulkan-intel-linux:250    runs-on: [self-hosted, Linux, Intel]251 252    steps:253      - name: Clone254        id: checkout255        uses: actions/checkout@v6256        with:257          persist-credentials: false258 259      - name: Test260        id: ggml-ci261        run: |262          vulkaninfo --summary263          GG_BUILD_VULKAN=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp264 265  gpu-vulkan-intel-windows:266    runs-on: [self-hosted, Windows, X64, Intel]267 268    steps:269      - name: Clone270        id: checkout271        uses: actions/checkout@v6272 273      - name: Test274        id: ggml-ci275        shell: C:\msys64\usr\bin\bash.exe --noprofile --norc -eo pipefail "{0}"276        env:277          MSYSTEM: UCRT64278          CHERE_INVOKING: 1279          PATH: C:\msys64\ucrt64\bin;C:\msys64\usr\bin;C:\Windows\System32;${{ env.PATH }}280        run: |281          vulkaninfo --summary282          # Skip python related tests with GG_BUILD_LOW_PERF=1 since Windows MSYS2 UCRT64 currently fails to create283          # a valid python environment for testing284          LLAMA_FATAL_WARNINGS=OFF GG_BUILD_NINJA=1 GG_BUILD_VULKAN=1 GG_BUILD_LOW_PERF=1 ./ci/run.sh ./results/llama.cpp ./mnt/llama.cpp285 286  gpu-openvino-low-perf:287    runs-on: [self-hosted, Linux, Intel, OpenVINO]288 289    env:290      # Sync versions in build.yml, build-self-hosted.yml, release.yml, build-cache.yml, .devops/openvino.Dockerfile291      OPENVINO_VERSION_MAJOR: "2026.2.1"292      OPENVINO_VERSION_FULL: "2026.2.1.21919.ede283a88e3"293 294    steps:295      - name: Clone296        id: checkout297        uses: actions/checkout@v6298 299      - name: Setup OpenVINO Toolkit300        uses: ./.github/actions/linux-setup-openvino301        with:302          path: ./openvino_toolkit303          version_major: ${{ env.OPENVINO_VERSION_MAJOR }}304          version_full: ${{ env.OPENVINO_VERSION_FULL }}305 306      - name: Install OpenVINO dependencies307        run: |308          cd ./openvino_toolkit309          chmod +x ./install_dependencies/install_openvino_dependencies.sh310          echo "Y" | sudo -E ./install_dependencies/install_openvino_dependencies.sh311 312      - name: Test313        id: ggml-ci314        run: |315          source ./openvino_toolkit/setupvars.sh316          GG_BUILD_OPENVINO=1 GGML_OPENVINO_DEVICE=GPU GG_BUILD_LOW_PERF=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp317 318  cpu-x64-high-perf:319    runs-on: [self-hosted, Linux, X64]320 321    steps:322      - name: Clone323        id: checkout324        uses: actions/checkout@v6325 326      - name: Test327        id: ggml-ci328        run: |329          LLAMA_ARG_THREADS=$(nproc) GG_BUILD_HIGH_PERF=1 GG_BUILD_EXTRA_TESTS_0=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp330 331  cpu-arm64-high-perf-graviton4:332    runs-on: ah-ubuntu_22_04-c8g_8x333 334    steps:335      - name: Clone336        id: checkout337        uses: actions/checkout@v6338 339      - name: Dependencies340        id: depends341        run: |342          set -euxo pipefail343          sudo apt-get update344          sudo DEBIAN_FRONTEND=noninteractive NEEDRESTART_MODE=a \345          apt-get install -y \346          build-essential \347          python3-venv \348          gpg \349          wget \350          time \351          git-lfs352 353          git lfs install354 355          # install the latest cmake356          sudo install -d /usr/share/keyrings357          wget -O - https://apt.kitware.com/keys/kitware-archive-latest.asc \358            | gpg --dearmor \359            | sudo tee /usr/share/keyrings/kitware-archive-keyring.gpg >/dev/null360          echo 'deb [signed-by=/usr/share/keyrings/kitware-archive-keyring.gpg] https://apt.kitware.com/ubuntu/ jammy main' \361            | sudo tee /etc/apt/sources.list.d/kitware.list362          sudo apt-get update363          sudo apt-get install -y cmake364 365      - name: Test366        id: ggml-ci367        run: |368          LLAMA_ARG_THREADS=$(nproc) GG_BUILD_HIGH_PERF=1 GG_BUILD_NO_BF16=1 GG_BUILD_EXTRA_TESTS_0=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp369 370  cpu-arm64-graviton4-kleidiai:371    runs-on: ah-ubuntu_22_04-c8g_8x372 373    steps:374      - name: Clone375        id: checkout376        uses: actions/checkout@v6377 378      - name: Dependencies379        id: depends380        run: |381          set -euxo pipefail382          sudo apt-get update383          sudo DEBIAN_FRONTEND=noninteractive NEEDRESTART_MODE=a \384          apt-get install -y \385          build-essential \386          python3-venv \387          gpg \388          wget \389          time \390          git-lfs391 392          git lfs install393 394          # install the latest cmake395          sudo install -d /usr/share/keyrings396          wget -O - https://apt.kitware.com/keys/kitware-archive-latest.asc \397            | gpg --dearmor \398            | sudo tee /usr/share/keyrings/kitware-archive-keyring.gpg >/dev/null399          echo 'deb [signed-by=/usr/share/keyrings/kitware-archive-keyring.gpg] https://apt.kitware.com/ubuntu/ jammy main' \400            | sudo tee /etc/apt/sources.list.d/kitware.list401          sudo apt-get update402          sudo apt-get install -y cmake403 404      - name: Test405        id: ggml-ci406        run: |407          GG_BUILD_KLEIDIAI=1 \408          GG_BUILD_EXTRA_TESTS_0=1 \409          bash ./ci/run.sh ./tmp/results ./tmp/mnt410