Add automatic per-request MCP selection

This commit is contained in:
Mikei386
2026-08-23 19:04:42 +02:00
parent ddde433224
commit e9b647e579
7 changed files with 344 additions and 20 deletions
+8
View File
@@ -166,6 +166,14 @@ Aktuell existieren funktionale Adapter für:
- Unraid read-only
- eigener Unraid-Administrationsserver
OpenWebUI bindet diese Kataloge nicht pauschal an jedes Modellprofil. Der
lokale `MikeAI Auto Tool Selector` ergänzt anhand der jüngsten Nutzernachricht
höchstens zwei passende MCP-Verbindungen pro Anfrage. Dadurch bleiben normale
Chats schemafrei und kurze Profile verlieren keinen unnötigen Kontext. MUA
mit erweiterten Verwaltungsrechten bleibt von der Automatik ausgeschlossen;
eine automatisch bereitgestellte Verbindung erteilt niemals Schreibrechte
oder eine Änderungsfreigabe.
Der GitHub-Container läuft produktiv. Token-Datei, interner
Streamable-HTTP-Handshake, fehlende Host-Portfreigabe und exakt vier
read-only Werkzeuge wurden am 23. August 2026 verifiziert.
+5 -1
View File
@@ -55,6 +55,9 @@ laufen, sondern alle fachlichen Funktionen geprüft wurden.
- [ ] rohe `qwen-*`-Routermodelle sind ausgeblendet
- [ ] Medium ist die gespeicherte Standardauswahl
- [ ] Filter und Quick Actions sind allen fünf Presets zugeordnet
- [ ] Auto Tool Selector wählt bei harmlosen Testfragen Web, GitHub, Home
Assistant, ARR, Navidrome, Unraid read-only und Athena korrekt
- [ ] normale Unterhaltung erhält kein MCP; MUA wird niemals automatisch gewählt
- [ ] SearXNG und TinySearch gesund
- [ ] Websuche liefert kompakte, quellengebundene Ergebnisse
@@ -67,7 +70,8 @@ laufen, sondern alle fachlichen Funktionen geprüft wurden.
- [ ] offizieller GitHub-MCP gesund; exakt vier read-only Repository-Werkzeuge
- [ ] GitHub-Token liegt nur in `/etc/mike-ai/github-mcp.env` (0600), nicht in OpenWebUI
- [ ] Unraid read-only Diagnose geprüft
- [ ] schreibende Werkzeuge standardmäßig nicht geladen
- [ ] schreibende Werkzeuge standardmäßig nicht geladen; automatische Auswahl
gilt nicht als Änderungsfreigabe
- [ ] Tool-Schemas bleiben innerhalb des festgelegten Kontextbudgets
- [ ] kein Secret erscheint in Toolantworten oder Logs
- [ ] `PLATFORM_OVERVIEW.md`, `QWEN_OPERATOR_CONTEXT.md` und der Operator-
+22 -7
View File
@@ -9,14 +9,21 @@ Reihenfolge ist absichtlich festgelegt:
`reasoning_effort=none`.
2. `Thinking`, Priorität 20: läuft nur bei aktiviertem Brain-Schalter und
überschreibt den Standard mit Low, Medium oder High.
3. `MikeAI Stability Guard`, Priorität 30: begrenzt einzelne und gesamte
3. `MikeAI Auto Tool Selector`, Priorität 25: betrachtet ausschließlich die
jüngste Nutzernachricht und stellt pro Anfrage höchstens zwei passende MCPs
bereit. Er erkennt Web, GitHub, Home Assistant, Sonarr/Radarr, Navidrome,
Unraid-Diagnose und Athena-Plattformwissen. Manuell gewählte Werkzeuge
bleiben erhalten. MUA mit erweiterten Verwaltungsrechten wird nie
automatisch zugeschaltet. Die Auswahl eines MCP ist ausdrücklich keine
Freigabe für eine Zustandsänderung.
4. `MikeAI Stability Guard`, Priorität 30: begrenzt einzelne und gesamte
Werkzeugresultate, verdichtet bei Bedarf zuerst alte Tool-Ausgaben und
Dialogteile und stoppt identische beziehungsweise ausufernde Tool-Schleifen.
4. `MikeAI Secret Redaction`, Priorität 40: entfernt übliche API-Keys, Tokens,
5. `MikeAI Secret Redaction`, Priorität 40: entfernt übliche API-Keys, Tokens,
Passwörter, JWTs und private Schlüssel aus Tool-Ergebnissen, bevor sie das
Modell erreichen, sowie aus fertigen Modellantworten. Nutzereingaben und
Authentifizierungswege werden nicht verändert.
5. `MikeAI Spoken Tool Status`, Priorität 80: erkennt den ersten echten
6. `MikeAI Spoken Tool Status`, Priorität 80: erkennt den ersten echten
Werkzeugaufruf eines Antwortlaufs und löst im Browser genau eine kurze,
passende Ansage für Web, Unraid, Home Assistant, Medienverwaltung oder
sonstige Werkzeuge aus. Die fünf MP3-Clips sind vorgerendert und liegen
@@ -24,7 +31,7 @@ Reihenfolge ist absichtlich festgelegt:
weder XTTS noch das Werkzeug. Sie wird nur abgespielt, wenn der Benutzer in
OpenWebUI die automatische Sprachausgabe aktiviert hat. Endet ein sehr
schneller Lauf innerhalb der kurzen Wartezeit, wird die Ansage verworfen.
6. `MikeAI Local Performance Metrics`, Priorität 90: erfasst nach Abschluss
7. `MikeAI Local Performance Metrics`, Priorität 90: erfasst nach Abschluss
ausschließlich technische Zahlen wie Laufzeit, Tokenzähler, Token/s und
Tool-Anzahl. Nutzer-, Chat- und Nachrichten-IDs sowie sämtliche Textinhalte
werden weder geschrieben noch gehasht gespeichert.
@@ -49,9 +56,17 @@ Dadurch erscheinen ausschließlich `MikeAI · Fast`, `MikeAI · Medium`,
fünf erhalten die geprüften Filter und Quick Actions sowie Piper-Stimme
`alloy`. Vision ist bei Fast, Medium, Large und Uncensored aktiviert; Ultra bleibt
bewusst text-only. Bildgenerierung wird erst als Fähigkeit freigeschaltet,
wenn ein echter Generator-Worker im Stack aktiv ist. Websuche und Codewerkzeuge
bleiben verfügbar, werden aber nicht automatisch jeder Nachricht beigelegt,
damit Werkzeugschemas den Kontext nicht unnötig füllen.
wenn ein echter Generator-Worker im Stack aktiv ist. Kein MCP ist statisch an
jedes Profil gebunden. Der Auto Tool Selector stellt nur die zur jüngsten
Anfrage passenden Werkzeuge bereit, damit irrelevante Schemas weder Kontext
verbrauchen noch die Werkzeugwahl des Modells verschlechtern. Eine manuelle
Auswahl im Chat bleibt zusätzlich möglich.
Die Auswahl arbeitet bewusst regelbasiert und lokal. Sie sendet keine Texte an
einen Klassifizierungsdienst, speichert keine Prompts und führt selbst keine
Werkzeugaktion aus. Erkennt sie keine eindeutige Absicht, wird kein MCP
automatisch ergänzt. Schreibende oder kritische Rechte werden weiterhin durch
das jeweilige MCP, Bestätigungsregeln und die manuelle MUA-Auswahl begrenzt.
Alle fünf Modelle erhalten außerdem dieselbe Evidenzregel: Aussagen über
aktuelle externe oder Systemzustände benötigen im aktuellen Turn einen