pwd, ls, git, curl, pip etc. werden direkt lokal ausgeführt,
nicht ans LLM geschickt. Erkennung wie in VSCode-Extension
(shellFirstWords-Liste, kein ?/. am Ende = nat. Sprache).
- CLI startet llama-server automatisch bei fehlender Verbindung
- Modellauswahl per Ziffer (Default=3=kleinstes)
- Live-Logs während Server-Start
- Timeout 120s für große Modelle vom USB-Stick
- Kein interaktives start-server.sh mehr nötig
llama.cpp b9936 binaries for x86_64 (Linux Ubuntu + Windows CPU)
Dynamic model selection from models/ dir
GGUF models: Gemma-4-E2B, Qwen2.5-1.5B, Qwen3.5-4B
Cross-platform start.sh / start.bat scripts
Deploy script for USB stick export