Add final Qwen3.8 runtime and uncensored profile
This commit is contained in:
@@ -25,6 +25,7 @@ laufen, sondern alle fachlichen Funktionen geprüft wurden.
|
||||
- [ ] Medium startet mit 160.000 Kontext und ist Standard
|
||||
- [ ] Large startet mit 192.000 Kontext
|
||||
- [ ] Ultra startet mit 262.144 Kontext und bleibt text-only
|
||||
- [ ] Uncensored startet mit 80.000 Kontext, 90:10 und MTP2
|
||||
- [ ] GPU-/CPU-Verteilung entspricht den Profilen
|
||||
- [ ] Fast erreicht den festgelegten Geschwindigkeitstoleranzbereich
|
||||
- [ ] MTP funktioniert und verursacht keine Qualitätsregression
|
||||
@@ -37,8 +38,8 @@ laufen, sondern alle fachlichen Funktionen geprüft wurden.
|
||||
- [ ] geschützte Endpunkte liefern ohne Key 401
|
||||
- [ ] Router-Key erscheint weder im Upstream noch im Journal
|
||||
- [ ] `/status` meldet den richtigen Upstream
|
||||
- [ ] `/v1/models` liefert vier virtuelle Modelle
|
||||
- [ ] `/fast`, `/medium`, `/large` und `/ultra` wechseln zuverlässig
|
||||
- [ ] `/v1/models` liefert fünf virtuelle Modelle
|
||||
- [ ] `/fast`, `/medium`, `/large`, `/ultra` und `/uncensored` wechseln zuverlässig
|
||||
- [ ] automatischer Wechsel über virtuellen Modellnamen funktioniert
|
||||
- [ ] paralleler Wechsel wird sauber gesperrt
|
||||
- [ ] Streaming funktioniert
|
||||
@@ -50,10 +51,10 @@ laufen, sondern alle fachlichen Funktionen geprüft wurden.
|
||||
|
||||
## Phase D – Web und MCP
|
||||
|
||||
- [ ] OpenWebUI zeigt nur die vier MikeAI-Arbeitsbereichsmodelle
|
||||
- [ ] OpenWebUI zeigt nur die fünf MikeAI-Arbeitsbereichsmodelle
|
||||
- [ ] rohe `qwen-*`-Routermodelle sind ausgeblendet
|
||||
- [ ] Medium ist die gespeicherte Standardauswahl
|
||||
- [ ] Filter und Quick Actions sind allen vier Presets zugeordnet
|
||||
- [ ] Filter und Quick Actions sind allen fünf Presets zugeordnet
|
||||
|
||||
- [ ] SearXNG und TinySearch gesund
|
||||
- [ ] Websuche liefert kompakte, quellengebundene Ergebnisse
|
||||
@@ -95,7 +96,8 @@ laufen, sondern alle fachlichen Funktionen geprüft wurden.
|
||||
## Phase G – Fachlicher Benchmark
|
||||
|
||||
Der gespeicherte Standardbenchmark wird mindestens mit Fast und Medium sowie
|
||||
für Kontextgrenzen zusätzlich mit Large und Ultra ausgeführt:
|
||||
für Kontextgrenzen zusätzlich mit Large und Ultra sowie mit dem gesonderten
|
||||
Uncensored-Sicherheitslauf ausgeführt:
|
||||
|
||||
- Home-Assistant-Automatisierung analysieren
|
||||
- Logs lesen und Fehlerursache begründen
|
||||
|
||||
Reference in New Issue
Block a user