Team Ai
Apppublic

commitcopilot/infer-001

sourceHugging Faceupdated 6mo agoView on Hugging Face
0likes
24 commits on main
6532d126mo ago

chore(config): update llama server arguments

JeremySu0818
22683a86mo ago

chore(config): switch default model to Gemma

JeremySu0818
29a06dd6mo ago

perf(config): increase model batch size

JeremySu0818
89680576mo ago

docs(readme): remove default Spaces reference

JeremySu0818
99298e26mo ago

chore(config): update default model artifact

JeremySu0818
32753056mo ago

feat(llama): add parallel server configuration

JeremySu0818
dbe47e66mo ago

feat(generation): disable model reasoning by default

JeremySu0818
f90cb4d6mo ago

feat(config): enable prompt caching by default

JeremySu0818
803b5b36mo ago

chore(config): tune model validation and llama defaults

JeremySu0818
b0417296mo ago

refactor(api): structure app config and lifecycle

JeremySu0818
d741b126mo ago

feat(api): support Qwen tool calls

JeremySu0818
f8c7fc56mo ago

fix(api): use configurable readiness wait settings

JeremySu0818
2c2dcf56mo ago

chore(config): switch default model to Gemma E2B

JeremySu0818
83f573f6mo ago

chore(config): tune llama runtime defaults

JeremySu0818
62fea1a6mo ago

feat(config): increase llama context window

JeremySu0818
9f008796mo ago

fix(api): return requested model in generate response

JeremySu0818
b9669a06mo ago

fix(api): allow non-integer usage values

JeremySu0818
63a17d46mo ago

fix(model): validate downloaded GGUF files

JeremySu0818
0c079926mo ago

feat(inference): run generation through llama-server

JeremySu0818
31546cf6mo ago

build(docker): add musl runtime dependencies

JeremySu0818
a7fb8866mo ago

build(docker): use prebuilt llama.cpp wheels

JeremySu0818
ab4be596mo ago

build(docker): add pkg-config dependency

JeremySu0818
d2d403f6mo ago

feat(inference): add cloud inference worker

JeremySu0818
1289b6c6mo ago

initial commit

commitcopilot