Simplify Athena operator maintenance workflow
This commit is contained in:
@@ -89,6 +89,22 @@ Der Router übernimmt:
|
||||
|
||||
## Hermes Agent
|
||||
|
||||
- Kontextkompression läuft frühzeitig bei 65 Prozent des jeweiligen
|
||||
Profilfensters. Alte große Werkzeugausgaben werden ab 50.000 Token zunächst
|
||||
ohne Modellaufruf bereinigt; `tail_mode: lean` hält nach der Kompression einen
|
||||
kleinen, zusammenhängenden jüngsten Abschnitt. Dadurch sollen keine
|
||||
mehrfachen minutenlangen Zusammenfassungen eines bereits weit überfüllten
|
||||
Threads mehr nötig werden.
|
||||
- Die Kompressionszusammenfassung nutzt weiterhin dasselbe aktive Modell. Ein
|
||||
kleineres Fast-Modell wäre zwar schneller, besitzt aber nicht genug Kontext,
|
||||
um die vollständige Mitte einer Medium-, Large- oder Ultra-Sitzung sicher zu
|
||||
verarbeiten. `reasoning_effort: none` vermeidet unnötiges Nachdenken beim
|
||||
reinen Zusammenfassen.
|
||||
- `Summarizing thread` ist eine echte zusätzliche Modellanfrage. Bei sehr alten
|
||||
Sitzungen kann die Desktop-Anzeige nach abgeschlossener Kompression außerdem
|
||||
veraltet stehen bleiben. Maßgeblich sind dann Sitzungsfortschritt und
|
||||
Backend-Log, nicht das Label allein.
|
||||
|
||||
- Container: `mike-ai-hermes`
|
||||
- Standardsprache: Deutsch (`display.language`, deutsches `SOUL.md`)
|
||||
- Spracheingabe: lokales Faster-Whisper, Modell `base`, Sprachhinweis `de`
|
||||
|
||||
Reference in New Issue
Block a user