feat: open Athena tool architecture

This commit is contained in:
Mikei386
2026-08-24 12:46:33 +02:00
parent 5528f3ab22
commit 5db73d0a92
26 changed files with 430 additions and 212 deletions
+13 -14
View File
@@ -12,8 +12,8 @@ benötigte deshalb kleinere, klarere Werkzeuge und harte Abbruchgrenzen.
## Verbindliche Lösung
1. Allgemeine öffentliche Recherche verwendet Open WebUIs native
`search_web`- und `fetch_url`-Werkzeuge. Der eigene Web-MCP bleibt nur als
manuell zugeschalteter Spezialadapter für YouTube und Hugging Face.
`search_web`- und `fetch_url`-Werkzeuge. Für Hermes/Pi steht TinySearch
direkt auf VPN-Port 8203 bereit; der eigene Web-MCP ist nur Rollback.
2. Der offizielle GitHub-MCP bietet genau drei read-only Werkzeuge:
`search_repositories`, `search_code` und `get_file_contents`. Rekursive
Komplettbäume sind ausgeschlossen.
@@ -27,10 +27,10 @@ benötigte deshalb kleinere, klarere Werkzeuge und harte Abbruchgrenzen.
damit führen deutsche Bankexporte nicht mehr unnötig zuerst zu einem
ParserError wegen einer falschen Spaltenzahl. Tabellenanalysen sollen im
Regelfall mit einer Erkennungs- und einer Auswertungsrunde auskommen.
4. Pro Antwort sind höchstens 16 interne Werkzeugrunden und zwölf tatsächlich
ausgeführte Einzelaufrufe erlaubt. Pro konkretem Werkzeug sind höchstens
vier unterschiedliche Aufrufe zulässig; identische Argumente werden kein
zweites Mal ausgeführt. Die zusätzlichen vier internen Runden sind nur
4. Pro Antwort sind höchstens 48 interne Werkzeugrunden und 40 tatsächlich
ausgeführte Einzelaufrufe erlaubt. Pro Werkzeugname sind höchstens zwölf
Aufrufe zulässig; identische Argumente dürfen einmal wiederholt werden und
werden beim dritten Versuch unterdrückt. Die zusätzlichen internen Runden sind
Synthesepuffer und erhöhen nicht das Ausführungsbudget. Das abgeleitete,
reproduzierbar gebaute OpenWebUI-Image verwendet die letzte Runde zwingend
als werkzeugfreie Synthese. Erzeugt das Modell trotz entfernter Schemata
@@ -39,24 +39,23 @@ benötigte deshalb kleinere, klarere Werkzeuge und harte Abbruchgrenzen.
erhält der Benutzer deshalb eine sichtbare Antwort aus den vorhandenen
Befunden samt ehrlicher Angabe fehlender Belege. Inlet-Filter allein können
dies nicht erzwingen, weil sie zwischen OpenWebUIs internen Werkzeugrunden
nicht erneut ausgeführt werden. Der zweite
identische Aufruf wird gestoppt. Ein einzelnes Resultat ist auf 10.000, alle
Resultate zusammen auf 36.000 Zeichen begrenzt.
nicht erneut ausgeführt werden. Ein einzelnes Resultat ist auf 12.000, alle
Resultate zusammen auf 64.000 Zeichen begrenzt.
Die Basis ist unveränderlich auf OpenWebUI-Revision
`01f4282f1ffe0d6212f58d3afbeae21fffd0c4be` beziehungsweise Image-Digest
`sha256:6a773e5c3a246b65cbe74ce942b294292c0e5f81c138f703d111bc162f7d7c3d`
gepinnt. Das zuvor dokumentierte `v0.9.5` war nicht der tatsächlich
migrierte Datenbankstand und darf für diese Datenbank nicht verwendet werden.
5. Repository-Prüfungen beginnen mit README/Wurzel, verwenden anschließend
höchstens drei gezielte Code-Suchen und öffnen nur relevante Treffer. Eine
gezielte Code-Suchen und öffnen nur relevante Treffer. Eine
konkrete Laufzeitinstanz wird genau einmal über ihr Fachwerkzeug geprüft.
6. Der Home-Assistant-MCP behält den TLS-Namen `ha.casaderoll.de`, routet ihn
im Container aber auf `HOME_LAN_PROXY_IP` im Heimnetz. Dadurch funktioniert
er auch vom Außenstandort über WireGuard.
7. Task-Management ist keine Faktenquelle und wird nicht für einzelne Fragen,
Nachschlageaufgaben oder Dateianalysen verwendet.
8. Mehrdomänen-Aufgaben erhalten automatisch höchstens drei passende
Fachkataloge und ein begrenztes Qwen-Reasoning-Budget. Einfache Ein-Domänen-
8. Mehrdomänen-Aufgaben erhalten automatisch die passenden Fachkataloge und
ein begrenztes Qwen-Reasoning-Budget. Einfache Ein-Domänen-
Aufgaben bleiben im schnellen Non-Thinking-Modus. Alle llama.cpp-Profile
bewahren Reasoning-Zustand zwischen Werkzeugrunden (`--reasoning-preserve`).
9. Wiederkehrende Fachsuchen werden serverseitig gebündelt: Home Assistant
@@ -66,9 +65,9 @@ benötigte deshalb kleinere, klarere Werkzeuge und harte Abbruchgrenzen.
## Abnahme
- OpenWebUI-Filtertests: 28
- OpenWebUI-Filtertests: 34
- Web-MCP-Tests: 9
- Athena-Operator-Sicherheitstests: 11
- Athena-Operator-Tests: 13
- Platform-Context-Test: bestanden
- MCP-Katalog-TÜV: Handshake, Toolanzahl, Schema-Größe, Regex-Muster und
verbotene Tools; keinerlei fachliche Toolaufrufe