diff --git a/README.md b/README.md index 940ad69..259cdba 100644 --- a/README.md +++ b/README.md @@ -33,6 +33,12 @@ npm-Workspace mit zwei Paketen: - Piper als **Python-Modul** — der Server ruft `python3 -m piper` auf, nicht das gleichnamige Homebrew-Binary +**RAM-Hinweis (Apple Silicon):** Qwen3.5 belegt ~7 GB im Speicher — mit +weniger als 16 GB RAM wird es eng. Dann lieber das kleinere +[`qwen3:8b`](https://ollama.com/library/qwen3) (`ollama pull qwen3:8b`, +~5 GB) laden und in den Einstellungen unter „Lokales Modell“ wählen bzw. +`MODEL=qwen3:8b` in die `.env` schreiben. + ## Schnellstart (Mac) Ein Befehl von null bis zur lauffähigen App — das Skript prüft alle diff --git a/setup.sh b/setup.sh index 54bff1a..095c3fa 100755 --- a/setup.sh +++ b/setup.sh @@ -198,6 +198,10 @@ else fi sect "9/9 Sprachmodell ($MODEL)" +RAM_GB=$(( $(sysctl -n hw.memsize 2>/dev/null || echo 0) / 1024 / 1024 / 1024 )) +if [ "$RAM_GB" -gt 0 ] && [ "$RAM_GB" -lt 16 ]; then + warn "Nur ${RAM_GB} GB RAM — $MODEL belegt ~7 GB. Leichtere Alternative: qwen3:8b (ollama pull qwen3:8b, dann in .env: MODEL=qwen3:8b)." +fi MODEL_OK=0 if [ "$OLLAMA_SVC" -eq 1 ]; then if ollama list 2>/dev/null | awk '{print $1}' | grep -qx "$MODEL"; then