pwd, ls, git, curl, pip etc. werden direkt lokal ausgeführt,
nicht ans LLM geschickt. Erkennung wie in VSCode-Extension
(shellFirstWords-Liste, kein ?/. am Ende = nat. Sprache).
- CLI startet llama-server automatisch bei fehlender Verbindung
- Modellauswahl per Ziffer (Default=3=kleinstes)
- Live-Logs während Server-Start
- Timeout 120s für große Modelle vom USB-Stick
- Kein interaktives start-server.sh mehr nötig