Brunobkr/llama.cpp_AlgMor24_github
ΩFFFΣLLIa • llama.cpp • AlgMor24 ██████╗ ███████╗███████╗███████╗██╗ ██╗ ██╗ █████╗ ██╔═══██╗██╔════╝██╔════╝██╔════╝██║ ██║ ██║██╔══██╗ ██║ ██║█████╗ █████╗ █████╗ ██║ ██║ ██║███████║ ██║ ██║██╔══╝ ██╔══╝ ██╔══╝ ██║ ██║ ██║██╔══██║ ╚██████╔╝██║ ██║ ███████╗███████╗███████╗██║██║ ██║ ╚═════╝ ╚═╝ ╚═╝ ╚══════╝╚══════╝╚══════╝╚═╝╚═╝ ╚═╝ High-Performance LLM / VLM Inference & Autonomous Agentic Ecosystem… See the full description on the dataset page: https://huggingface.co/datasets/Brunobkr/llama.cpp_AlgMor24_github.
03.1k
1name: CI (self-hosted)2 3on:4 workflow_dispatch: # allows manual triggering5 push:6 branches:7 - master8 paths: [9 '.github/workflows/build-self-hosted.yml',10 '**/CMakeLists.txt',11 '**/.cmake',12 '**/*.h',13 '**/*.hpp',14 '**/*.c',15 '**/*.cpp',16 '**/*.cu',17 '**/*.cuh',18 '**/*.swift',19 '**/*.m',20 '**/*.metal',21 '**/*.comp',22 '**/*.glsl',23 '**/*.wgsl'24 ]25 26 pull_request:27 types: [opened, synchronize, reopened]28 paths: [29 '.github/workflows/build-self-hosted.yml',30 '**/CMakeLists.txt',31 '**/.cmake',32 '**/*.h',33 '**/*.hpp',34 '**/*.c',35 '**/*.cpp',36 '**/*.cu',37 '**/*.cuh',38 '**/*.swift',39 '**/*.m',40 '**/*.metal',41 '**/*.comp',42 '**/*.glsl',43 '**/*.wgsl'44 ]45 46concurrency:47 group: ${{ github.workflow }}-${{ github.head_ref && github.ref || github.run_id }}48 cancel-in-progress: true49 50env:51 # note: this is dud token to avoid rate limiting (https://github.com/ggml-org/llama.cpp/pull/25706#issuecomment-4979941302)52 HF_TOKEN: ${{ secrets.HF_TOKEN_CI }}53 GGML_NLOOP: 354 GGML_N_THREADS: 155 LLAMA_ARG_LOG_COLORS: 156 LLAMA_ARG_LOG_PREFIX: 157 LLAMA_ARG_LOG_TIMESTAMPS: 158 59jobs:60 gpu-cuda:61 runs-on: [self-hosted, Linux, NVIDIA]62 63 steps:64 - name: Clone65 id: checkout66 uses: actions/checkout@v667 68 - name: Test69 id: ggml-ci70 run: |71 nvidia-smi72 GG_BUILD_CUDA=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp73 74 gpu-rocm:75 runs-on: [self-hosted, Linux, AMD]76 77 steps:78 - name: Clone79 id: checkout80 uses: actions/checkout@v681 82 - name: Test83 id: ggml-ci84 # HIP_LAUNCH_BLOCKING=1: workaround for an async-execution correctness85 # issue on integrated RDNA3.5 (gfx1151) where batched inference returns86 # incorrect output (perplexity ~88 vs ~9.4). Serializing kernel launches87 # restores correctness. Remove once the underlying ROCm/HIP issue is fixed.88 env:89 HIP_LAUNCH_BLOCKING: "1"90 run: |91 rocminfo92 GG_BUILD_ROCM=1 GG_BUILD_AMDGPU_TARGETS=gfx1151 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp93 94 gpu-vulkan-nvidia-cm:95 runs-on: [self-hosted, Linux, NVIDIA]96 97 steps:98 - name: Clone99 id: checkout100 uses: actions/checkout@v6101 102 - name: Test103 id: ggml-ci104 run: |105 vulkaninfo --summary106 GG_BUILD_VULKAN=1 GGML_VK_DISABLE_COOPMAT2=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp107 108 gpu-vulkan-nvidia-cm2:109 runs-on: [self-hosted, Linux, NVIDIA, COOPMAT2]110 111 steps:112 - name: Clone113 id: checkout114 uses: actions/checkout@v6115 116 - name: Test117 id: ggml-ci118 run: |119 vulkaninfo --summary120 GG_BUILD_VULKAN=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp121 122 gpu-webgpu-nvidia:123 runs-on: [self-hosted, Linux, NVIDIA, X64]124 125 steps:126 - name: Clone127 id: checkout128 uses: actions/checkout@v6129 130 - name: Dawn Dependency131 id: dawn-depends132 run: |133 DAWN_VERSION="v20260317.182325"134 DAWN_OWNER="google"135 DAWN_REPO="dawn"136 DAWN_ASSET_NAME="Dawn-18eb229ef5f707c1464cc581252e7603c73a3ef0-ubuntu-latest-Release"137 echo "Fetching release asset from https://github.com/google/dawn/releases/download/${DAWN_VERSION}/${DAWN_ASSET_NAME}.tar.gz"138 curl -L -o artifact.tar.gz \139 "https://github.com/google/dawn/releases/download/${DAWN_VERSION}/${DAWN_ASSET_NAME}.tar.gz"140 mkdir dawn141 tar -xvf artifact.tar.gz -C dawn --strip-components=1142 143 - name: Test144 id: ggml-ci145 run: |146 GG_BUILD_WEBGPU=1 \147 GG_BUILD_WEBGPU_DAWN_PREFIX="$GITHUB_WORKSPACE/dawn" \148 GG_BUILD_WEBGPU_DAWN_DIR="$GITHUB_WORKSPACE/dawn/lib64/cmake/Dawn" \149 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp150 151 # TODO: provision AMX-compatible machine152 #cpu-amx:153 # runs-on: [self-hosted, Linux, CPU, AMX]154 155 # steps:156 # - name: Clone157 # id: checkout158 # uses: actions/checkout@v6159 160 # - name: Test161 # id: ggml-ci162 # run: |163 # bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp164 165 # TODO: provision AMD GPU machine166 # amd-vulkan:167 # runs-on: [self-hosted, Linux, AMD]168 169 # steps:170 # - name: Clone171 # id: checkout172 # uses: actions/checkout@v6173 174 # - name: Test175 # id: ggml-ci176 # run: |177 # vulkaninfo --summary178 # GG_BUILD_VULKAN=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp179 180 # TODO: provision AMD GPU machine181 # amd-rocm:182 # runs-on: [self-hosted, Linux, AMD]183 184 # steps:185 # - name: Clone186 # id: checkout187 # uses: actions/checkout@v6188 189 # - name: Test190 # id: ggml-ci191 # run: |192 # amd-smi static193 # GG_BUILD_ROCM=1 GG_BUILD_AMDGPU_TARGETS="gfx1101" bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp194 195 gpu-metal:196 runs-on: [self-hosted, macOS, ARM64]197 198 steps:199 - name: Clone200 id: checkout201 uses: actions/checkout@v6202 203 - name: Test204 id: ggml-ci205 run: |206 GG_BUILD_METAL=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp207 208 gpu-webgpu-apple:209 runs-on: [self-hosted, macOS, ARM64]210 211 steps:212 - name: Clone213 id: checkout214 uses: actions/checkout@v6215 216 - name: Dawn Dependency217 id: dawn-depends218 run: |219 DAWN_VERSION="v20260317.182325"220 DAWN_OWNER="google"221 DAWN_REPO="dawn"222 DAWN_ASSET_NAME="Dawn-18eb229ef5f707c1464cc581252e7603c73a3ef0-macos-latest-Release"223 echo "Fetching release asset from https://github.com/google/dawn/releases/download/${DAWN_VERSION}/${DAWN_ASSET_NAME}.tar.gz"224 curl -L -o artifact.tar.gz \225 "https://github.com/google/dawn/releases/download/${DAWN_VERSION}/${DAWN_ASSET_NAME}.tar.gz"226 mkdir dawn227 tar -xvf artifact.tar.gz -C dawn --strip-components=1228 229 - name: Test230 id: ggml-ci231 run: |232 GG_BUILD_WEBGPU=1 GG_BUILD_WEBGPU_DAWN_PREFIX="$GITHUB_WORKSPACE/dawn" \233 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp234 235 gpu-vulkan-apple:236 runs-on: [self-hosted, macOS, ARM64]237 238 steps:239 - name: Clone240 id: checkout241 uses: actions/checkout@v6242 243 - name: Test244 id: ggml-ci245 run: |246 vulkaninfo --summary247 GG_BUILD_VULKAN=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp248 249 gpu-vulkan-intel-linux:250 runs-on: [self-hosted, Linux, Intel]251 252 steps:253 - name: Clone254 id: checkout255 uses: actions/checkout@v6256 with:257 persist-credentials: false258 259 - name: Test260 id: ggml-ci261 run: |262 vulkaninfo --summary263 GG_BUILD_VULKAN=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp264 265 gpu-vulkan-intel-windows:266 runs-on: [self-hosted, Windows, X64, Intel]267 268 steps:269 - name: Clone270 id: checkout271 uses: actions/checkout@v6272 273 - name: Test274 id: ggml-ci275 shell: C:\msys64\usr\bin\bash.exe --noprofile --norc -eo pipefail "{0}"276 env:277 MSYSTEM: UCRT64278 CHERE_INVOKING: 1279 PATH: C:\msys64\ucrt64\bin;C:\msys64\usr\bin;C:\Windows\System32;${{ env.PATH }}280 run: |281 vulkaninfo --summary282 # Skip python related tests with GG_BUILD_LOW_PERF=1 since Windows MSYS2 UCRT64 currently fails to create283 # a valid python environment for testing284 LLAMA_FATAL_WARNINGS=OFF GG_BUILD_NINJA=1 GG_BUILD_VULKAN=1 GG_BUILD_LOW_PERF=1 ./ci/run.sh ./results/llama.cpp ./mnt/llama.cpp285 286 gpu-openvino-low-perf:287 runs-on: [self-hosted, Linux, Intel, OpenVINO]288 289 env:290 # Sync versions in build.yml, build-self-hosted.yml, release.yml, build-cache.yml, .devops/openvino.Dockerfile291 OPENVINO_VERSION_MAJOR: "2026.2.1"292 OPENVINO_VERSION_FULL: "2026.2.1.21919.ede283a88e3"293 294 steps:295 - name: Clone296 id: checkout297 uses: actions/checkout@v6298 299 - name: Setup OpenVINO Toolkit300 uses: ./.github/actions/linux-setup-openvino301 with:302 path: ./openvino_toolkit303 version_major: ${{ env.OPENVINO_VERSION_MAJOR }}304 version_full: ${{ env.OPENVINO_VERSION_FULL }}305 306 - name: Install OpenVINO dependencies307 run: |308 cd ./openvino_toolkit309 chmod +x ./install_dependencies/install_openvino_dependencies.sh310 echo "Y" | sudo -E ./install_dependencies/install_openvino_dependencies.sh311 312 - name: Test313 id: ggml-ci314 run: |315 source ./openvino_toolkit/setupvars.sh316 GG_BUILD_OPENVINO=1 GGML_OPENVINO_DEVICE=GPU GG_BUILD_LOW_PERF=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp317 318 cpu-x64-high-perf:319 runs-on: [self-hosted, Linux, X64]320 321 steps:322 - name: Clone323 id: checkout324 uses: actions/checkout@v6325 326 - name: Test327 id: ggml-ci328 run: |329 LLAMA_ARG_THREADS=$(nproc) GG_BUILD_HIGH_PERF=1 GG_BUILD_EXTRA_TESTS_0=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp330 331 cpu-arm64-high-perf-graviton4:332 runs-on: ah-ubuntu_22_04-c8g_8x333 334 steps:335 - name: Clone336 id: checkout337 uses: actions/checkout@v6338 339 - name: Dependencies340 id: depends341 run: |342 set -euxo pipefail343 sudo apt-get update344 sudo DEBIAN_FRONTEND=noninteractive NEEDRESTART_MODE=a \345 apt-get install -y \346 build-essential \347 python3-venv \348 gpg \349 wget \350 time \351 git-lfs352 353 git lfs install354 355 # install the latest cmake356 sudo install -d /usr/share/keyrings357 wget -O - https://apt.kitware.com/keys/kitware-archive-latest.asc \358 | gpg --dearmor \359 | sudo tee /usr/share/keyrings/kitware-archive-keyring.gpg >/dev/null360 echo 'deb [signed-by=/usr/share/keyrings/kitware-archive-keyring.gpg] https://apt.kitware.com/ubuntu/ jammy main' \361 | sudo tee /etc/apt/sources.list.d/kitware.list362 sudo apt-get update363 sudo apt-get install -y cmake364 365 - name: Test366 id: ggml-ci367 run: |368 LLAMA_ARG_THREADS=$(nproc) GG_BUILD_HIGH_PERF=1 GG_BUILD_NO_BF16=1 GG_BUILD_EXTRA_TESTS_0=1 bash ./ci/run.sh ~/results/llama.cpp ~/mnt/llama.cpp369 370 cpu-arm64-graviton4-kleidiai:371 runs-on: ah-ubuntu_22_04-c8g_8x372 373 steps:374 - name: Clone375 id: checkout376 uses: actions/checkout@v6377 378 - name: Dependencies379 id: depends380 run: |381 set -euxo pipefail382 sudo apt-get update383 sudo DEBIAN_FRONTEND=noninteractive NEEDRESTART_MODE=a \384 apt-get install -y \385 build-essential \386 python3-venv \387 gpg \388 wget \389 time \390 git-lfs391 392 git lfs install393 394 # install the latest cmake395 sudo install -d /usr/share/keyrings396 wget -O - https://apt.kitware.com/keys/kitware-archive-latest.asc \397 | gpg --dearmor \398 | sudo tee /usr/share/keyrings/kitware-archive-keyring.gpg >/dev/null399 echo 'deb [signed-by=/usr/share/keyrings/kitware-archive-keyring.gpg] https://apt.kitware.com/ubuntu/ jammy main' \400 | sudo tee /etc/apt/sources.list.d/kitware.list401 sudo apt-get update402 sudo apt-get install -y cmake403 404 - name: Test405 id: ggml-ci406 run: |407 GG_BUILD_KLEIDIAI=1 \408 GG_BUILD_EXTRA_TESTS_0=1 \409 bash ./ci/run.sh ./tmp/results ./tmp/mnt410 