mirror of
https://github.com/Jeuners/Logpy-AgentOne.git
synced 2026-09-12 16:32:33 +02:00
Zweites Kategorisierungs-Backend neben Ollama (pipe/categorize.py), fuer Vergleichstests mit staerkeren Cloud-Modellen. Umschaltbar per Dropdown oben rechts im Leitstand (pipe/modellwahl.py, geteilte telefon/modell.json) - der laufende Watcher braucht dafuer keinen Neustart, die Auswahl wird bei jedem Anruf frisch gelesen. Jede Kategorisierung loggt jetzt Backend/Modell/Dauer/Tokens/Kosten mit ins Leitstand-Verlauf (protokoll.schreibe), nicht nur versteckt in meta.json. Testergebnis (Nemotron ueber OpenRouter, :free-Tier): stark schwankende Latenz (8,5s bis 80s je nach Modell/Auslastung), einmal 502 "temporarily overloaded" - :free-Modelle sind fuer spaeter geplanten Echtzeit-Dialog ungeeignet, dafuer braucht es ein bezahltes/dediziertes Tier. telefon/modell.json ist Laufzeit-Zustand, kein Quellcode - neu ignoriert. Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_015vtvcyNkapuDh583643hNs
16 lines
357 B
Text
16 lines
357 B
Text
__pycache__/
|
|
*.pyc
|
|
.env
|
|
/ablage/
|
|
/test/*.wav
|
|
/test/*.aiff
|
|
/dashboard.html
|
|
# Telefonie: Aufnahmen sind Patientendaten, Ansage ist erzeugt
|
|
/telefon/eingang/
|
|
/telefon/verarbeitet/
|
|
/telefon/fehler/
|
|
/telefon/ansage.wav
|
|
/telefon/verlauf.log
|
|
/telefon/*.log
|
|
# Laufzeit-Zustand (aktive Modell-Auswahl aus dem Leitstand-Dropdown), kein Quellcode
|
|
/telefon/modell.json
|