# Geprüfter Live-Stand auf Athena Stand: **20. September 2026**. Quelle: lesender SSH-Abgleich von Docker, Compose-Dateien, Git-Inhalten, Images, Health-Endpunkten und Backup-Timern. Containerzustände sind Momentaufnahmen; der Controller darf Profile danach umschalten. Es wurde für diesen Abgleich kein Dienst neu gestartet. ## Laufzeit und Profile Athena: Debian 13, RTX 5080 (16 GB) und RTX 3060 (12 GB). Die fünf Textprofil-Images tragen alle `com.mike-ai.llama-cpp-commit=b29c606` (llama.cpp 0.4.1). Sie verwenden `--load-mode none` und `--batch-size 2048`. Fast, Large, Ultra und Uncensored verwenden einen Slot. Medium läuft seit dem 19. September kontrolliert mit `--parallel 2` und `--kv-unified`. Seine beiden Slots teilen sich den einzigen 160.000-Token-KV-Pool. Die `ubatch-size` wurde pro Profil auf einen getesteten Wert gesetzt; sie ist **nicht** überall identisch. | Profil | Qwen3.8-27B-Variante | Kontext | Slots | Tensor-Split 5080:3060 | Vision-Projektor | MTP Draft | ubatch | |---|---|---:|---:|---|---|---:|---:| | Fast | IQ4-MIX | 76.800 | 1 | nur 5080 | 3060 | 2 | 64 | | Medium | IQ4_XS Pure | 160.000 gemeinsam | 2 | 85:15 | 3060 | 3 | 512 | | Large | IQ4_XS Pure | 192.000 | 1 | 86:14 | 3060 | 3 | 256 | | Ultra | IQ4_XS Pure | 262.144 | 1 | 80:20 | keiner | 2 | 128 | | Uncensored | Abliterated Q4_K_M | 80.000 | 1 | 90:10 | 3060 | 2 | 256 | Tensor-Splits sind Startparameter, keine gemessenen VRAM-Anteile. Der Vision-Projektor liegt bei den vier Vision-Profilen auf GPU 1 (3060). `beta1` steht in der Repository-Matrix, ist aber nicht installiert. Der Router bietet nur die fünf installierten Profile an. Beim Abgleich am 20. September lief Medium seit rund 21 Stunden gesund mit zwei Slots; die vier anderen Textprofile waren planmäßig gestoppt. Dashboard, Router, Controller, Whisper, TTS und Realtime-Voice waren ebenfalls gesund. Der frühere Vision-/CLIP-Absturz ist als historischer Befund erhalten, beschreibt aber nicht mehr den aktuellen Containerzustand. ## Weitere Dienste - FLUX.2 Klein 9B FP8 Beta: Transformer/VAE auf 5080, Qwen3-8B-NF4- Textencoder auf 3060. Produktiv freigegeben sind höchstens 1024 × 1024, vier Schritte, Guidance 1, vier Referenzbilder und 128 Encoder-Tokens. 1280 × 1280 lief im Test in CUDA-OOM. - Qwen3-TTS 1.7B auf 3060 hinter dem TTS-Gateway; kein Piper-Fallback. - Whisper.cpp `ggml-small` auf CPU über `/v1/audio/transcriptions`. - Der gesunde Dienst `mike-ai-realtime-voice` vermittelt OpenClaw Talk über WebRTC zwischen Whisper, dem normalen OpenClaw-Agenten und Qwen3-TTS. Er braucht keine GPU und keinen Profilwechsel. Das Plugin liegt in `integrations/openclaw-athena-talk` und läuft auf Unraid, nicht auf Athena. Diktat und hochgeladene M4A-Sprachnachrichten nutzen den separaten Transkriptionspfad des Plugins. OpenClaw liefert den fertigen Agententext an die Brücke; das Sprechen beginnt daher erst nach Abschluss der Agentenantwort. Details und Grenzen stehen in der [Voice-Doku](../services/athena-realtime-voice/README.md). - `mike-ai-mikes-applio-ui` läuft gesund und ohne GPU. Die Quelle liegt im eigenen Repository [Mikes-Applio-UI](https://git.casaderoll.de/michael/Mikes-applio-ui). Der Applio-GPU-Container war beim Abgleich nicht gestartet. Die UI kann trotzdem Status, Modelle und vorbereitende Aufgaben anzeigen; eine echte Konvertierung verlangt den Applio-Modus. Der vollständige Bestand der **30** angelegten Docker-Container steht im [Container-Inventar](CONTAINER_INVENTORY.md). `Created` oder `Exited` bei Spezialworkern bedeutet nicht automatisch einen zu entfernenden Testrest. ## Git und reproduzierbarer Stand Der laufende Stack liegt unter `/opt/mike-ai/stack`. Sein Git-HEAD ist weiterhin `276df0e` und damit älter als Doggo; `compose.yaml`, Dashboard und `services/athena-realtime-voice/` liegen dort als Live-Änderungen. Die am 20. September geprüften Hashes von Compose, Dashboard, Dashboard-Test und Voice-Bridge stimmen bytegenau mit diesem veröffentlichten Repository-Stand überein. Ein frischer Clone liefert damit den Quellcode und die Compose-Definitionen; er liefert weder lokale Secrets noch Modellgewichte oder persistente Nutzerdaten. Vor einem Deploy ist die Live-Konfiguration zu sichern und mit dem Checkout abzugleichen, statt den laufenden Host blind zurückzusetzen. Die Applio-UI hat einen eigenen Checkout `/opt/mike-ai/Mikes-Applio-UI`. Sein Git-HEAD `3a06139` ist älter als Doggo `eadbc15`. Die laufende Anwendungsquelle stimmt bis auf Versionsmetadaten und den später korrigierten Dokumentationsstand mit Doggo überein. Siehe [Applio-Integrationsdoku](https://git.casaderoll.de/michael/Mikes-applio-ui/src/branch/main/docs/ATHENA-INTEGRATION.md). ## Backup und Prüfumfang `mike-ai-backup` lief; der jüngste geprüfte manuelle Archivlauf schloss Compose und Voice-Bridge ein. Der Fünf-Stunden-Export-Timer war aktiv, der externe Restic-Timer zwar ebenfalls aktiviert, aber ohne seine erforderliche `/etc/mike-ai/disaster-backup.env` **nicht** als funktionierende externe Sicherung zu werten. Details und Restore-Grenzen: [Backup](RECOVERY.md). Geprüft wurden aktuelle Container- und Quellenstände sowie ausgewählte Health-Endpunkte. Keine erneuten Bild-, Langkontext-, Trainings- oder Restore-Tests; ältere Ergebnisse sind im [Update-Audit](UPDATE_AUDIT_20260915.md) und [FLUX-Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md) dokumentiert.