Files
AI-Profile-Router/docs/LIVE_STATE.md
T

5.0 KiB
Raw Blame History

Geprüfter Live-Stand auf Athena

Stand: 16. September 2026. Quelle: lesender SSH-Abgleich von Docker, Compose-Dateien, Git-Inhalten, Images, Health-Endpunkten und Backup-Timern. Containerzustände sind Momentaufnahmen; der Controller darf Profile danach umschalten. Es wurde für diesen Abgleich kein Dienst neu gestartet.

Laufzeit und Profile

Athena: Debian 13, RTX 5080 (16 GB) und RTX 3060 (12 GB). Die fünf Textprofil-Images tragen alle com.mike-ai.llama-cpp-commit=b29c606 (llama.cpp 0.4.1). Sie verwenden --load-mode none, --parallel 1 und --batch-size 2048. Die ubatch-size wurde pro Profil auf einen getesteten Wert gesetzt; sie ist nicht überall identisch.

Profil Qwen3.8-27B-Variante Kontext Tensor-Split 5080:3060 Vision-Projektor MTP Draft ubatch
Fast IQ4-MIX 76.800 nur 5080 3060 2 64
Medium IQ4_XS Pure 160.000 85:15 3060 3 512
Large IQ4_XS Pure 192.000 86:14 3060 3 256
Ultra IQ4_XS Pure 262.144 80:20 keiner 2 128
Uncensored Abliterated Q4_K_M 80.000 90:10 3060 2 256

Tensor-Splits sind Startparameter, keine gemessenen VRAM-Anteile. Der Vision-Projektor liegt bei den vier Vision-Profilen auf GPU 1 (3060). beta1 steht in der Repository-Matrix, ist aber nicht installiert. Der Router bietet nur die fünf installierten Profile an. Beim ersten Abgleich war Medium aktiv und der Router im LLM-Modus; beim späteren Containerabgleich war mike-ai-llama-medium mit Exit-Code 139 beendet. Dieser Laufzeitfehler wurde bei der Dokumentationsarbeit nicht behoben oder durch einen Neustart verdeckt. Der aktuelle Zustand ist über Dashboard/Controller zu prüfen.

Weitere Dienste

  • FLUX.2 Klein 9B FP8 Beta: Transformer/VAE auf 5080, Qwen3-8B-NF4- Textencoder auf 3060. Produktiv freigegeben sind höchstens 1024 × 1024, vier Schritte, Guidance 1, vier Referenzbilder und 128 Encoder-Tokens. 1280 × 1280 lief im Test in CUDA-OOM.
  • Qwen3-TTS 1.7B auf 3060 hinter dem TTS-Gateway; kein Piper-Fallback.
  • Whisper.cpp ggml-small auf CPU über /v1/audio/transcriptions.
  • Der gesunde Dienst mike-ai-realtime-voice vermittelt OpenClaw Talk über WebRTC zwischen Whisper, dem normalen OpenClaw-Agenten und Qwen3-TTS. Er braucht keine GPU und keinen Profilwechsel. Das Plugin liegt in integrations/openclaw-athena-talk und läuft auf Unraid, nicht auf Athena. Diktat und hochgeladene M4A-Sprachnachrichten nutzen den separaten Transkriptionspfad des Plugins. OpenClaw liefert den fertigen Agententext an die Brücke; das Sprechen beginnt daher erst nach Abschluss der Agentenantwort. Details und Grenzen stehen in der Voice-Doku.
  • mike-ai-mikes-applio-ui läuft gesund und ohne GPU. Die Quelle liegt im eigenen Repository Mikes-Applio-UI. Der Applio-GPU-Container war beim Abgleich nicht gestartet. Die UI kann trotzdem Status, Modelle und vorbereitende Aufgaben anzeigen; eine echte Konvertierung verlangt den Applio-Modus.

Der vollständige Bestand der 27 angelegten Docker-Container steht im Container-Inventar. Created oder Exited bei Spezialworkern bedeutet nicht automatisch einen zu entfernenden Testrest.

Git und reproduzierbarer Stand

Der laufende Stack liegt unter /opt/mike-ai/stack. Sein Git-HEAD war 276df0e und damit älter als der aktuelle Git-Stand; compose.yaml und services/athena-realtime-voice/ sind im Live-Checkout nicht committed. Die geprüften Nutzdaten dieser Dateien stimmen aber bytegenau mit dem neueren Git-Stand überein. Ein frischer Clone liefert damit den Quellcode und die Compose-Definitionen; er liefert weder lokale Secrets noch Modellgewichte oder persistente Nutzerdaten. Vor einem Deploy ist die Live-Konfiguration zu sichern und mit dem Checkout abzugleichen, statt den laufenden Host blind zurückzusetzen.

Die Applio-UI hat einen eigenen Checkout /opt/mike-ai/Mikes-Applio-UI. Sein Git-HEAD 3a06139 ist älter als Doggo eadbc15. Die laufende Anwendungsquelle stimmt bis auf Versionsmetadaten und den später korrigierten Dokumentationsstand mit Doggo überein. Siehe Applio-Integrationsdoku.

Backup und Prüfumfang

mike-ai-backup lief; der jüngste geprüfte manuelle Archivlauf schloss Compose und Voice-Bridge ein. Der Fünf-Stunden-Export-Timer war aktiv, der externe Restic-Timer zwar ebenfalls aktiviert, aber ohne seine erforderliche /etc/mike-ai/disaster-backup.env nicht als funktionierende externe Sicherung zu werten. Details und Restore-Grenzen: Backup.

Geprüft wurden aktuelle Container- und Quellenstände sowie ausgewählte Health-Endpunkte. Keine erneuten Bild-, Langkontext-, Trainings- oder Restore-Tests; ältere Ergebnisse sind im Update-Audit und FLUX-Auflösungstest dokumentiert.