- start-server.sh: llama-server mit Modellauswahl starten - Port 8080, OpenAI-kompatibler Endpoint - README aktualisiert mit Server-Hinweisen