Use minimal reasoning for responsive Hermes chats

This commit is contained in:
Mikei386
2026-08-25 18:26:31 +02:00
parent a9bd832c71
commit 57afdd4f15
3 changed files with 3 additions and 3 deletions
+1 -1
View File
@@ -140,7 +140,7 @@ Der Router übernimmt:
80K; alle verwenden dieselben MCPs, Skills, Sprach- und Sicherheitsvorgaben
- Profilübergreifende Latenzgrenzen: höchstens 8.192 Ausgabetoken je
Modellaufruf (sichtbare Antwort, Tool-Aufruf und verborgenes Denken
zusammen), Standard-Reasoning `low`; höhere Denkstufen bleiben pro Sitzung
zusammen), Standard-Reasoning `minimal`; höhere Denkstufen bleiben pro Sitzung
über `/reasoning` wählbar.
- Automatische Sitzungstitel sind deaktiviert. Sie sind kosmetisch, erzeugten
aber auf dem einzelnen llama.cpp-Slot nach dem ersten Turn konkurrierende