Simplify Athena operator maintenance workflow

This commit is contained in:
Mikei386
2026-08-25 08:42:30 +02:00
parent fa9911eb3b
commit ac725416b8
11 changed files with 126 additions and 33 deletions
+16
View File
@@ -89,6 +89,22 @@ Der Router übernimmt:
## Hermes Agent
- Kontextkompression läuft frühzeitig bei 65 Prozent des jeweiligen
Profilfensters. Alte große Werkzeugausgaben werden ab 50.000 Token zunächst
ohne Modellaufruf bereinigt; `tail_mode: lean` hält nach der Kompression einen
kleinen, zusammenhängenden jüngsten Abschnitt. Dadurch sollen keine
mehrfachen minutenlangen Zusammenfassungen eines bereits weit überfüllten
Threads mehr nötig werden.
- Die Kompressionszusammenfassung nutzt weiterhin dasselbe aktive Modell. Ein
kleineres Fast-Modell wäre zwar schneller, besitzt aber nicht genug Kontext,
um die vollständige Mitte einer Medium-, Large- oder Ultra-Sitzung sicher zu
verarbeiten. `reasoning_effort: none` vermeidet unnötiges Nachdenken beim
reinen Zusammenfassen.
- `Summarizing thread` ist eine echte zusätzliche Modellanfrage. Bei sehr alten
Sitzungen kann die Desktop-Anzeige nach abgeschlossener Kompression außerdem
veraltet stehen bleiben. Maßgeblich sind dann Sitzungsfortschritt und
Backend-Log, nicht das Label allein.
- Container: `mike-ai-hermes`
- Standardsprache: Deutsch (`display.language`, deutsches `SOUL.md`)
- Spracheingabe: lokales Faster-Whisper, Modell `base`, Sprachhinweis `de`