5.3 KiB
Geprüfter Live-Stand auf Athena
Stand: 20. September 2026. Quelle: lesender SSH-Abgleich von Docker, Compose-Dateien, Git-Inhalten, Images, Health-Endpunkten und Backup-Timern. Containerzustände sind Momentaufnahmen; der Controller darf Profile danach umschalten. Es wurde für diesen Abgleich kein Dienst neu gestartet.
Laufzeit und Profile
Athena: Debian 13, RTX 5080 (16 GB) und RTX 3060 (12 GB). Die fünf
Textprofil-Images tragen alle com.mike-ai.llama-cpp-commit=b29c606
(llama.cpp 0.4.1). Sie verwenden --load-mode none und --batch-size 2048.
Fast, Large, Ultra und Uncensored verwenden einen Slot. Medium läuft seit dem
19. September kontrolliert mit --parallel 2 und --kv-unified. Seine beiden
Slots teilen sich den einzigen 160.000-Token-KV-Pool. Die ubatch-size wurde
pro Profil auf einen getesteten Wert gesetzt; sie ist nicht überall
identisch.
| Profil | Qwen3.8-27B-Variante | Kontext | Slots | Tensor-Split 5080:3060 | Vision-Projektor | MTP Draft | ubatch |
|---|---|---|---|---|---|---|---|
| Fast | IQ4-MIX | 76.800 | 1 | nur 5080 | 3060 | 2 | 64 |
| Medium | IQ4_XS Pure | 160.000 gemeinsam | 2 | 85:15 | 3060 | 3 | 512 |
| Large | IQ4_XS Pure | 192.000 | 1 | 86:14 | 3060 | 3 | 256 |
| Ultra | IQ4_XS Pure | 262.144 | 1 | 80:20 | keiner | 2 | 128 |
| Uncensored | Abliterated Q4_K_M | 80.000 | 1 | 90:10 | 3060 | 2 | 256 |
Tensor-Splits sind Startparameter, keine gemessenen VRAM-Anteile. Der
Vision-Projektor liegt bei den vier Vision-Profilen auf GPU 1 (3060).
beta1 steht in der Repository-Matrix, ist aber nicht installiert. Der
Router bietet nur die fünf installierten Profile an. Beim Abgleich am
20. September lief Medium seit rund 21 Stunden gesund mit zwei Slots; die vier
anderen Textprofile waren planmäßig gestoppt. Dashboard, Router, Controller,
Whisper, TTS und Realtime-Voice waren ebenfalls gesund. Der frühere
Vision-/CLIP-Absturz ist als historischer Befund erhalten, beschreibt aber
nicht mehr den aktuellen Containerzustand.
Weitere Dienste
- FLUX.2 Klein 9B FP8 Beta: Transformer/VAE auf 5080, Qwen3-8B-NF4- Textencoder auf 3060. Produktiv freigegeben sind höchstens 1024 × 1024, vier Schritte, Guidance 1, vier Referenzbilder und 128 Encoder-Tokens. 1280 × 1280 lief im Test in CUDA-OOM.
- Qwen3-TTS 1.7B auf 3060 hinter dem TTS-Gateway; kein Piper-Fallback.
- Whisper.cpp
ggml-smallauf CPU über/v1/audio/transcriptions. - Der gesunde Dienst
mike-ai-realtime-voicevermittelt OpenClaw Talk über WebRTC zwischen Whisper, dem normalen OpenClaw-Agenten und Qwen3-TTS. Er braucht keine GPU und keinen Profilwechsel. Das Plugin liegt inintegrations/openclaw-athena-talkund läuft auf Unraid, nicht auf Athena. Diktat und hochgeladene M4A-Sprachnachrichten nutzen den separaten Transkriptionspfad des Plugins. OpenClaw liefert den fertigen Agententext an die Brücke; das Sprechen beginnt daher erst nach Abschluss der Agentenantwort. Details und Grenzen stehen in der Voice-Doku. mike-ai-mikes-applio-uiläuft gesund und ohne GPU. Die Quelle liegt im eigenen Repository Mikes-Applio-UI. Der Applio-GPU-Container war beim Abgleich nicht gestartet. Die UI kann trotzdem Status, Modelle und vorbereitende Aufgaben anzeigen; eine echte Konvertierung verlangt den Applio-Modus.
Der vollständige Bestand der 30 angelegten Docker-Container steht im
Container-Inventar. Created oder Exited bei
Spezialworkern bedeutet nicht automatisch einen zu entfernenden Testrest.
Git und reproduzierbarer Stand
Der laufende Stack liegt unter /opt/mike-ai/stack. Sein Git-HEAD ist weiterhin
276df0e und damit älter als Doggo; compose.yaml, Dashboard und
services/athena-realtime-voice/ liegen dort als Live-Änderungen. Die am
20. September geprüften Hashes von Compose, Dashboard, Dashboard-Test und
Voice-Bridge stimmen bytegenau mit diesem veröffentlichten Repository-Stand
überein. Ein frischer Clone liefert damit den Quellcode
und die Compose-Definitionen; er liefert weder lokale Secrets noch
Modellgewichte oder persistente Nutzerdaten. Vor einem Deploy ist die
Live-Konfiguration zu sichern und mit dem Checkout abzugleichen, statt den
laufenden Host blind zurückzusetzen.
Die Applio-UI hat einen eigenen Checkout /opt/mike-ai/Mikes-Applio-UI.
Sein Git-HEAD 3a06139 ist älter als Doggo eadbc15. Die laufende
Anwendungsquelle stimmt bis auf Versionsmetadaten und den später
korrigierten Dokumentationsstand mit Doggo überein. Siehe
Applio-Integrationsdoku.
Backup und Prüfumfang
mike-ai-backup lief; der jüngste geprüfte manuelle Archivlauf schloss
Compose und Voice-Bridge ein. Der Fünf-Stunden-Export-Timer war aktiv, der
externe Restic-Timer zwar ebenfalls aktiviert, aber ohne seine erforderliche
/etc/mike-ai/disaster-backup.env nicht als funktionierende externe
Sicherung zu werten. Details und Restore-Grenzen: Backup.
Geprüft wurden aktuelle Container- und Quellenstände sowie ausgewählte Health-Endpunkte. Keine erneuten Bild-, Langkontext-, Trainings- oder Restore-Tests; ältere Ergebnisse sind im Update-Audit und FLUX-Auflösungstest dokumentiert.