Files
AI-Profile-Router/docs/LIVE_STATE.md
T

5.5 KiB
Raw Blame History

Geprüfter Live-Stand auf Athena

Stand: 20. September 2026. Quelle: lesender SSH-Abgleich von Docker, Compose-Dateien, Git-Inhalten, Images, Health-Endpunkten und Backup-Timern. Containerzustände sind Momentaufnahmen; der Controller darf Profile danach umschalten. Es wurde für diesen Abgleich kein Dienst neu gestartet.

Laufzeit und Profile

Athena: Debian 13, RTX 5080 (16 GB) und RTX 3060 (12 GB). Die fünf Textprofil-Images tragen alle com.mike-ai.llama-cpp-commit=b29c606 (llama.cpp 0.4.1). Sie verwenden --load-mode none und --batch-size 2048. Fast, Large, Ultra und Uncensored verwenden einen Slot. Medium läuft seit dem 19. September kontrolliert mit --parallel 2 und --kv-unified. Seine beiden Slots teilen sich den einzigen 160.000-Token-KV-Pool. Die ubatch-size wurde pro Profil auf einen getesteten Wert gesetzt; sie ist nicht überall identisch.

Profil Qwen3.8-27B-Variante Kontext Slots Tensor-Split 5080:3060 Vision-Projektor MTP Draft ubatch
Fast IQ4-MIX 76.800 1 nur 5080 3060 2 64
Medium IQ4_XS Pure 160.000 gemeinsam 2 85:15 3060 3 512
Large IQ4_XS Pure 192.000 1 86:14 3060 3 256
Ultra IQ4_XS Pure 262.144 1 80:20 keiner 2 128
Uncensored Abliterated Q4_K_M 80.000 1 90:10 3060 2 256

Tensor-Splits sind Startparameter, keine gemessenen VRAM-Anteile. Der Vision-Projektor liegt bei den vier Vision-Profilen auf GPU 1 (3060). beta1 steht in der Repository-Matrix, ist aber nicht installiert. Der Router bietet nur die fünf installierten Profile an. Beim Abgleich am 20. September lief Medium seit rund 21 Stunden gesund mit zwei Slots; die vier anderen Textprofile waren planmäßig gestoppt. Dashboard, Router, Controller, Whisper, TTS und Realtime-Voice waren ebenfalls gesund. Der frühere Vision-/CLIP-Absturz ist als historischer Befund erhalten, beschreibt aber nicht mehr den aktuellen Containerzustand.

Weitere Dienste

  • FLUX.2 Klein 9B FP8 Beta: Transformer/VAE auf 5080, Qwen3-8B-NF4- Textencoder auf 3060. Produktiv freigegeben sind höchstens 1024 × 1024, vier Schritte, Guidance 1, vier Referenzbilder und 128 Encoder-Tokens. 1280 × 1280 lief im Test in CUDA-OOM.
  • Qwen3-TTS 1.7B auf 3060 hinter dem TTS-Gateway; kein Piper-Fallback.
  • Whisper.cpp ggml-small auf CPU über /v1/audio/transcriptions.
  • Der gesunde Dienst mike-ai-realtime-voice vermittelt OpenClaw Talk über WebRTC zwischen Whisper, dem normalen OpenClaw-Agenten und Qwen3-TTS. Er braucht keine GPU und keinen Profilwechsel. Das Plugin liegt in integrations/openclaw-athena-talk und läuft auf Unraid, nicht auf Athena. Diktat und hochgeladene M4A-Sprachnachrichten nutzen den separaten Transkriptionspfad des Plugins. OpenClaw liefert den fertigen Agententext an die Brücke; das Sprechen beginnt daher erst nach Abschluss der Agentenantwort. Details und Grenzen stehen in der Voice-Doku.
  • mike-ai-mikes-applio-ui läuft gesund und ohne GPU. Die Quelle liegt im eigenen Repository Mikes-Applio-UI. Der Applio-GPU-Container war beim Abgleich nicht gestartet. Die UI kann trotzdem Status, Modelle und vorbereitende Aufgaben anzeigen; eine echte Konvertierung verlangt den Applio-Modus.

Der vollständige Bestand der 30 angelegten Docker-Container steht im Container-Inventar. Created oder Exited bei Spezialworkern bedeutet nicht automatisch einen zu entfernenden Testrest.

Git und reproduzierbarer Stand

Der laufende Stack liegt unter /opt/mike-ai/stack. Beim Router-Audit am 20. September wurde er auf den veröffentlichten Quellstand synchronisiert. Die Funktionsänderungen sind in Commit 6071b1a enthalten; anschließende Dokumentationskorrekturen ändern keine Container. Die früheren Live-Anpassungen an Compose, Dashboard und Voice-Bridge wurden bytegenau verglichen und in einem lokalen Sicherungscommit erhalten. Controller und Router wurden gezielt ersetzt; Medium und Gateway behielten ihre ursprünglichen Startzeiten. Messwerte, Prüfungen und Rückfallstand stehen im Router-Audit.

Ein frischer Clone enthält Quellcode und Compose-Definitionen, aber keine lokalen Secrets, Modellgewichte oder persistenten Nutzerdaten. Lokale Konfiguration vor jedem Deploy sichern; keinen laufenden Host blind zurücksetzen.

Die Applio-UI hat einen eigenen Checkout /opt/mike-ai/Mikes-Applio-UI. Sein Git-HEAD 3a06139 ist älter als Doggo eadbc15. Die laufende Anwendungsquelle stimmt bis auf Versionsmetadaten und den später korrigierten Dokumentationsstand mit Doggo überein. Siehe Applio-Integrationsdoku.

Backup und Prüfumfang

mike-ai-backup lief; der jüngste geprüfte manuelle Archivlauf schloss Compose und Voice-Bridge ein. Der Fünf-Stunden-Export-Timer war aktiv, der externe Restic-Timer zwar ebenfalls aktiviert, aber ohne seine erforderliche /etc/mike-ai/disaster-backup.env nicht als funktionierende externe Sicherung zu werten. Details und Restore-Grenzen: Backup.

Geprüft wurden aktuelle Container- und Quellenstände sowie ausgewählte Health-Endpunkte. Keine erneuten Bild-, Langkontext-, Trainings- oder Restore-Tests; ältere Ergebnisse sind im Update-Audit und FLUX-Auflösungstest dokumentiert.