Im interaktiven Chat wurde fullResponse nie zugewiesen (Return-Value
von chatComplete ignoriert, Callback akkumuliert nicht). Folge:
executeActions('') fand keine FILE:/DIR:/EDIT:-Aktionen und history.push
bekam leere Assistant-Turns. Beides silent kaputt; nur :wiki funktionierte.
Fix: fullResponse += token im Content-Zweig (Reasoning bewusst draußen).
Live getestet gegen llama-server (LFM2-8B-A1B Testsieger): FILE/DIR-Aktionen
und Multi-Turn-History (assistant len 0→55) verifiziert.
- Modelle: Gemma 3 4B IT (2.4 GB), Phi-4-mini (2.5 GB),
MiniCPM5-1B (688 MB) — als Symlinks auf Stick
- README: Vollständig überarbeitet mit allen Features
- Startup-Zeiten und IFEval-Scores dokumentiert
- CrowdCode CLI Features dokumentiert
- Shell-Kommando-Erkennung im CLI
pwd, ls, git, curl, pip etc. werden direkt lokal ausgeführt,
nicht ans LLM geschickt. Erkennung wie in VSCode-Extension
(shellFirstWords-Liste, kein ?/. am Ende = nat. Sprache).
- CLI startet llama-server automatisch bei fehlender Verbindung
- Modellauswahl per Ziffer (Default=3=kleinstes)
- Live-Logs während Server-Start
- Timeout 120s für große Modelle vom USB-Stick
- Kein interaktives start-server.sh mehr nötig
llama.cpp b9936 binaries for x86_64 (Linux Ubuntu + Windows CPU)
Dynamic model selection from models/ dir
GGUF models: Gemma-4-E2B, Qwen2.5-1.5B, Qwen3.5-4B
Cross-platform start.sh / start.bat scripts
Deploy script for USB stick export