Brunobkr/llama.cpp_KAOS777
ΩFFFΣLLIα llama.cpp KAOS777 Fork local de llama.cpp para o llama-server desta máquina. A interface embutida é o tema Kaos, compilada da fonte com Vite. A próxima compilação, a partir da raiz deste repositório, liga o Vulkan, gera a interface e embute os arquivos no servidor sem baixar pacote pronto e sem rejeitar o dist por SHA-256. git clone https://github.com/brunoconta1980-tech/llama.cpp_KAOS777.git cd llama.cpp_KAOS777 cmake -B build cmake --build build -j A capa acima… See the full description on the dataset page: https://huggingface.co/datasets/Brunobkr/llama.cpp_KAOS777.
<p align="center"> <img src="capa.png" alt="ΩFFFΣLLIα llama.cpp KAOS777" width="100%"> </p>
ΩFFFΣLLIα llama.cpp KAOS777
Fork local de llama.cpp para o llama-server desta máquina. A interface embutida é o tema Kaos, compilada da fonte com Vite. A próxima compilação, a partir da raiz deste repositório, liga o Vulkan, gera a interface e embute os arquivos no servidor sem baixar pacote pronto e sem rejeitar o dist por SHA-256.
git clone https://github.com/brunoconta1980-tech/llama.cppKAOS777.git cd llama.cppKAOS777 cmake -B build cmake --build build -j
A capa acima é capa.png, ao lado deste arquivo. O caminho relativo vale no GitHub e no Hugging Face.
Compilar
Na raiz do fork:
cmake -B build
cmake --build build -jO binário fica em build/bin/llama-server. A interface vai dentro de build/bin/libllama-server-impl.so.
O tipo padrão já é Release. GGML_NATIVE continua ligado. Vulkan entra ligado numa configuração nova. Para um build só de CPU:
cmake -B build -DGGML_VULKAN=OFFNode.js e npm precisam estar no PATH. O alvo llama-server roda npm ci quando o lock muda e depois vite build. Se o npm ou o Vite falhar, a compilação para. Não há download de dist.tar.gz, não há comparação com dist.tar.gz.sha256, e tools/ui/dist não substitui um build da fonte.
LLAMA_BUILD_UI fica ON e LLAMA_USE_PREBUILT_UI fica OFF, os dois com CACHE FORCE. Um cache antigo não desliga a interface nem religa o pacote do Hugging Face.
Rode o CMake dentro de llama.cpp_KAOS777. Um cmake -B build lançado em /home/userk21 procura /home/userk21/build e falha.
Um processo que já estava no ar continua com a biblioteca antiga. Depois de recompilar, encerre esse llama-server e suba o binário novo.
O que mudou
Interface Kaos
O tema padrão é Kaos: fundo quase preto, ouro antigo, carmesim, vela embaixo à esquerda, heptagrama, estrela de oito setas embaixo à direita e o nome Ω KAOS 777 α na barra lateral. System, Light e Dark continuam na tela de ajustes.
ColorMode.KAOS vale kaos. Tema vazio ou ausente também abre Kaos. A classe html.kaos fica no documento, e o mode-watcher permanece em escuro para as cores de código.
A migração theme-kaos-default-v1 grava Kaos uma vez quando o LlamaUi.config salvo ainda não é kaos. Uma escolha feita depois em Ajustes permanece.
O efeito do tema chama applyUiTheme dentro de untrack. Sem isso, o setMode do mode-watcher reexecuta o efeito até o Svelte abortar com effect_update_depth_exceeded, e o chat fica em "Connecting to Server".
Marcas em tools/ui/src/lib/assets/: kaos-star.svg, kaos-sigil.svg, kaos-seal.svg. Favicons do Kaos em tools/ui/static/. Os outros temas usam os favicons do llama.
Sem PWA e sem UI pronta
O vite build não gera ícones de PWA e não registra service worker. build-pwa-assets só sai com código 0. O Vite não carrega SvelteKitPWA. usePwa desregistra um worker que tenha sobrado, apaga caches e não consulta versão. A interface não busca _app/version.json.
Todo llama-server responde /sw.js com um worker que se remove, limpa os caches e recarrega as abas. O arquivo vem com Cache-Control: no-cache. Um sw.js deixado em --path continua sendo servido pelo diretório montado antes dessa rota.
Na origem http://127.0.0.1:5173/ o Chromium pode ainda ter um Workbox antigo. Um carregamento dessa origem pega o /sw.js novo e solta o worker. A porta 8080 não tem esse registro.
CMake
O carimbo .ui-embed.sha256 não recusa um dist modificado. Ele só pula a regravação de ui.cpp quando o conteúdo não mudou.
gguf-py
gguf-py/gguf/quants.py aplica HelicoidalZetaCore em cada bloco na quantização e na desquantização feitas por Python. A escala do bloco é tanh da média de um vetor com φ, seno ao quadrado e a assinatura zeta. gguf/__init__.py exporta essa classe. Isso não cria um tipo GGML novo no runtime C++. O llama-quantize compilado não passa por esse caminho.
Modelo
Exemplo, na mesma linha de comando já usada aqui:
"/home/userk21/llama.cpp_KAOS777/build/bin/llama-server" \
-m "/home/userk21/Área de trabalho/userk21/LLMS/ΩFFFΣLLIα_Q4_1_Vortex5_Gemma-4-26B-A4B-Animus-V14.1-FFT-heretic.gguf" \
-ngl 99 --n-cpu-moe 99 \
-c 50000 \
-ctk f16 \
-ctv f16 \
-t 5 \
-tb 5 \
-fa on \
--cpu-strict 1 \
--agent \
--tools all \
--reasoning auto \
--kv-unified \
--load-mode mmap \
--cors-origins "*" \
--webui-mcp-proxy \
--threads-http -1 \
--port 5173 \
--host 127.0.0.1Licença
O código herdado do llama.cpp permanece sob a licença MIT em LICENSE. A capa capa.png é arquivo local deste fork.
