ZEBRA PIPE
Local LLM Orchestrator
SETTINGS :8081
...
Model
Main GGUF model
Vision projector / mmproj
RESCAN MODELS
LOAD / RELOAD
STOP
Runtime
Context
GPU layers
Threads (0=auto)
Parallel slots
Batch
UBatch
Flash Attention
Jinja templates
Auto-load selected model on container start
Generation Defaults
Temperature
Top P
Top K
Additional llama-server arguments
SAVE WITHOUT RELOAD
Discovered models
llama-server log