Im interaktiven Chat wurde fullResponse nie zugewiesen (Return-Value
von chatComplete ignoriert, Callback akkumuliert nicht). Folge:
executeActions('') fand keine FILE:/DIR:/EDIT:-Aktionen und history.push
bekam leere Assistant-Turns. Beides silent kaputt; nur :wiki funktionierte.
Fix: fullResponse += token im Content-Zweig (Reasoning bewusst draußen).
Live getestet gegen llama-server (LFM2-8B-A1B Testsieger): FILE/DIR-Aktionen
und Multi-Turn-History (assistant len 0→55) verifiziert.
pwd, ls, git, curl, pip etc. werden direkt lokal ausgeführt,
nicht ans LLM geschickt. Erkennung wie in VSCode-Extension
(shellFirstWords-Liste, kein ?/. am Ende = nat. Sprache).
- CLI startet llama-server automatisch bei fehlender Verbindung
- Modellauswahl per Ziffer (Default=3=kleinstes)
- Live-Logs während Server-Start
- Timeout 120s für große Modelle vom USB-Stick
- Kein interaktives start-server.sh mehr nötig