# Geprüfter Live-Stand auf Athena Stand: **16. September 2026**. Quelle: lesender SSH-Abgleich von Docker, Compose-Dateien, Git-Inhalten, Images, Health-Endpunkten und Backup-Timern. Containerzustände sind Momentaufnahmen; der Controller darf Profile danach umschalten. Es wurde für diesen Abgleich kein Dienst neu gestartet. ## Laufzeit und Profile Athena: Debian 13, RTX 5080 (16 GB) und RTX 3060 (12 GB). Die fünf Textprofil-Images tragen alle `com.mike-ai.llama-cpp-commit=b29c606` (llama.cpp 0.4.1). Sie verwenden `--load-mode none`, `--parallel 1` und `--batch-size 2048`. Die `ubatch-size` wurde pro Profil auf einen getesteten Wert gesetzt; sie ist **nicht** überall identisch. | Profil | Qwen3.8-27B-Variante | Kontext | Tensor-Split 5080:3060 | Vision-Projektor | MTP Draft | ubatch | |---|---|---:|---|---|---:|---:| | Fast | IQ4-MIX | 76.800 | nur 5080 | 3060 | 2 | 64 | | Medium | IQ4_XS Pure | 160.000 | 85:15 | 3060 | 3 | 512 | | Large | IQ4_XS Pure | 192.000 | 86:14 | 3060 | 3 | 256 | | Ultra | IQ4_XS Pure | 262.144 | 80:20 | keiner | 2 | 128 | | Uncensored | Abliterated Q4_K_M | 80.000 | 90:10 | 3060 | 2 | 256 | Tensor-Splits sind Startparameter, keine gemessenen VRAM-Anteile. Der Vision-Projektor liegt bei den vier Vision-Profilen auf GPU 1 (3060). `beta1` steht in der Repository-Matrix, ist aber nicht installiert. Der Router bietet nur die fünf installierten Profile an. Beim ersten Abgleich war Medium aktiv und der Router im LLM-Modus; beim späteren Containerabgleich war `mike-ai-llama-medium` mit Exit-Code 139 beendet. Das Log endet mit einem CUDA-Stacktrace im Vision-/CLIP-Encoding (`libmtmd`/`libggml-cuda`); eine eindeutige Ursache wurde nicht ermittelt. Dieser Laufzeitfehler wurde bei der Dokumentationsarbeit nicht behoben oder durch einen Neustart verdeckt. Der aktuelle Zustand ist über Dashboard/Controller zu prüfen. ## Weitere Dienste - FLUX.2 Klein 9B FP8 Beta: Transformer/VAE auf 5080, Qwen3-8B-NF4- Textencoder auf 3060. Produktiv freigegeben sind höchstens 1024 × 1024, vier Schritte, Guidance 1, vier Referenzbilder und 128 Encoder-Tokens. 1280 × 1280 lief im Test in CUDA-OOM. - Qwen3-TTS 1.7B auf 3060 hinter dem TTS-Gateway; kein Piper-Fallback. - Whisper.cpp `ggml-small` auf CPU über `/v1/audio/transcriptions`. - Der gesunde Dienst `mike-ai-realtime-voice` vermittelt OpenClaw Talk über WebRTC zwischen Whisper, dem normalen OpenClaw-Agenten und Qwen3-TTS. Er braucht keine GPU und keinen Profilwechsel. Das Plugin liegt in `integrations/openclaw-athena-talk` und läuft auf Unraid, nicht auf Athena. Diktat und hochgeladene M4A-Sprachnachrichten nutzen den separaten Transkriptionspfad des Plugins. OpenClaw liefert den fertigen Agententext an die Brücke; das Sprechen beginnt daher erst nach Abschluss der Agentenantwort. Details und Grenzen stehen in der [Voice-Doku](../services/athena-realtime-voice/README.md). - `mike-ai-mikes-applio-ui` läuft gesund und ohne GPU. Die Quelle liegt im eigenen Repository [Mikes-Applio-UI](https://git.casaderoll.de/michael/Mikes-applio-ui). Der Applio-GPU-Container war beim Abgleich nicht gestartet. Die UI kann trotzdem Status, Modelle und vorbereitende Aufgaben anzeigen; eine echte Konvertierung verlangt den Applio-Modus. Der vollständige Bestand der **27** angelegten Docker-Container steht im [Container-Inventar](CONTAINER_INVENTORY.md). `Created` oder `Exited` bei Spezialworkern bedeutet nicht automatisch einen zu entfernenden Testrest. ## Git und reproduzierbarer Stand Der laufende Stack liegt unter `/opt/mike-ai/stack`. Sein Git-HEAD war `276df0e` und damit älter als der aktuelle Git-Stand; `compose.yaml` und `services/athena-realtime-voice/` sind im Live-Checkout nicht committed. **Die geprüften Nutzdaten dieser Dateien stimmen aber bytegenau mit dem neueren Git-Stand überein.** Ein frischer Clone liefert damit den Quellcode und die Compose-Definitionen; er liefert weder lokale Secrets noch Modellgewichte oder persistente Nutzerdaten. Vor einem Deploy ist die Live-Konfiguration zu sichern und mit dem Checkout abzugleichen, statt den laufenden Host blind zurückzusetzen. Die Applio-UI hat einen eigenen Checkout `/opt/mike-ai/Mikes-Applio-UI`. Sein Git-HEAD `3a06139` ist älter als Doggo `eadbc15`. Die laufende Anwendungsquelle stimmt bis auf Versionsmetadaten und den später korrigierten Dokumentationsstand mit Doggo überein. Siehe [Applio-Integrationsdoku](https://git.casaderoll.de/michael/Mikes-applio-ui/src/branch/main/docs/ATHENA-INTEGRATION.md). ## Backup und Prüfumfang `mike-ai-backup` lief; der jüngste geprüfte manuelle Archivlauf schloss Compose und Voice-Bridge ein. Der Fünf-Stunden-Export-Timer war aktiv, der externe Restic-Timer zwar ebenfalls aktiviert, aber ohne seine erforderliche `/etc/mike-ai/disaster-backup.env` **nicht** als funktionierende externe Sicherung zu werten. Details und Restore-Grenzen: [Backup](RECOVERY.md). Geprüft wurden aktuelle Container- und Quellenstände sowie ausgewählte Health-Endpunkte. Keine erneuten Bild-, Langkontext-, Trainings- oder Restore-Tests; ältere Ergebnisse sind im [Update-Audit](UPDATE_AUDIT_20260915.md) und [FLUX-Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md) dokumentiert.