5.0 KiB
Geprüfter Live-Stand auf Athena
Stand: 16. September 2026. Quelle: lesender SSH-Abgleich von Docker, Compose-Dateien, Git-Inhalten, Images, Health-Endpunkten und Backup-Timern. Containerzustände sind Momentaufnahmen; der Controller darf Profile danach umschalten. Es wurde für diesen Abgleich kein Dienst neu gestartet.
Laufzeit und Profile
Athena: Debian 13, RTX 5080 (16 GB) und RTX 3060 (12 GB). Die fünf
Textprofil-Images tragen alle com.mike-ai.llama-cpp-commit=b29c606
(llama.cpp 0.4.1). Sie verwenden --load-mode none, --parallel 1 und
--batch-size 2048. Die ubatch-size wurde pro Profil auf einen getesteten
Wert gesetzt; sie ist nicht überall identisch.
| Profil | Qwen3.8-27B-Variante | Kontext | Tensor-Split 5080:3060 | Vision-Projektor | MTP Draft | ubatch |
|---|---|---|---|---|---|---|
| Fast | IQ4-MIX | 76.800 | nur 5080 | 3060 | 2 | 64 |
| Medium | IQ4_XS Pure | 160.000 | 85:15 | 3060 | 3 | 512 |
| Large | IQ4_XS Pure | 192.000 | 86:14 | 3060 | 3 | 256 |
| Ultra | IQ4_XS Pure | 262.144 | 80:20 | keiner | 2 | 128 |
| Uncensored | Abliterated Q4_K_M | 80.000 | 90:10 | 3060 | 2 | 256 |
Tensor-Splits sind Startparameter, keine gemessenen VRAM-Anteile. Der
Vision-Projektor liegt bei den vier Vision-Profilen auf GPU 1 (3060).
beta1 steht in der Repository-Matrix, ist aber nicht installiert. Der
Router bietet nur die fünf installierten Profile an. Beim ersten Abgleich
war Medium aktiv und der Router im LLM-Modus; beim späteren Containerabgleich
war mike-ai-llama-medium mit Exit-Code 139 beendet. Dieser Laufzeitfehler
wurde bei der Dokumentationsarbeit nicht behoben oder durch einen Neustart
verdeckt. Der aktuelle Zustand ist über Dashboard/Controller zu prüfen.
Weitere Dienste
- FLUX.2 Klein 9B FP8 Beta: Transformer/VAE auf 5080, Qwen3-8B-NF4- Textencoder auf 3060. Produktiv freigegeben sind höchstens 1024 × 1024, vier Schritte, Guidance 1, vier Referenzbilder und 128 Encoder-Tokens. 1280 × 1280 lief im Test in CUDA-OOM.
- Qwen3-TTS 1.7B auf 3060 hinter dem TTS-Gateway; kein Piper-Fallback.
- Whisper.cpp
ggml-smallauf CPU über/v1/audio/transcriptions. - Der gesunde Dienst
mike-ai-realtime-voicevermittelt OpenClaw Talk über WebRTC zwischen Whisper, dem normalen OpenClaw-Agenten und Qwen3-TTS. Er braucht keine GPU und keinen Profilwechsel. Das Plugin liegt inintegrations/openclaw-athena-talkund läuft auf Unraid, nicht auf Athena. Diktat und hochgeladene M4A-Sprachnachrichten nutzen den separaten Transkriptionspfad des Plugins. OpenClaw liefert den fertigen Agententext an die Brücke; das Sprechen beginnt daher erst nach Abschluss der Agentenantwort. Details und Grenzen stehen in der Voice-Doku. mike-ai-mikes-applio-uiläuft gesund und ohne GPU. Die Quelle liegt im eigenen Repository Mikes-Applio-UI. Der Applio-GPU-Container war beim Abgleich nicht gestartet. Die UI kann trotzdem Status, Modelle und vorbereitende Aufgaben anzeigen; eine echte Konvertierung verlangt den Applio-Modus.
Der vollständige Bestand der 27 angelegten Docker-Container steht im
Container-Inventar. Created oder Exited bei
Spezialworkern bedeutet nicht automatisch einen zu entfernenden Testrest.
Git und reproduzierbarer Stand
Der laufende Stack liegt unter /opt/mike-ai/stack. Sein Git-HEAD war
276df0e und damit älter als der aktuelle Git-Stand; compose.yaml und
services/athena-realtime-voice/ sind im Live-Checkout nicht committed.
Die geprüften Nutzdaten dieser Dateien stimmen aber bytegenau mit dem
neueren Git-Stand überein. Ein frischer Clone liefert damit den Quellcode
und die Compose-Definitionen; er liefert weder lokale Secrets noch
Modellgewichte oder persistente Nutzerdaten. Vor einem Deploy ist die
Live-Konfiguration zu sichern und mit dem Checkout abzugleichen, statt den
laufenden Host blind zurückzusetzen.
Die Applio-UI hat einen eigenen Checkout /opt/mike-ai/Mikes-Applio-UI.
Sein Git-HEAD 3a06139 ist älter als Doggo eadbc15. Die laufende
Anwendungsquelle stimmt bis auf Versionsmetadaten und den später
korrigierten Dokumentationsstand mit Doggo überein. Siehe
Applio-Integrationsdoku.
Backup und Prüfumfang
mike-ai-backup lief; der jüngste geprüfte manuelle Archivlauf schloss
Compose und Voice-Bridge ein. Der Fünf-Stunden-Export-Timer war aktiv, der
externe Restic-Timer zwar ebenfalls aktiviert, aber ohne seine erforderliche
/etc/mike-ai/disaster-backup.env nicht als funktionierende externe
Sicherung zu werten. Details und Restore-Grenzen: Backup.
Geprüft wurden aktuelle Container- und Quellenstände sowie ausgewählte Health-Endpunkte. Keine erneuten Bild-, Langkontext-, Trainings- oder Restore-Tests; ältere Ergebnisse sind im Update-Audit und FLUX-Auflösungstest dokumentiert.