Files
AI-Profile-Router/docs/LIVE_STATE.md
T

89 lines
5.0 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# Geprüfter Live-Stand auf Athena
Stand: **16. September 2026**. Quelle: lesender SSH-Abgleich von Docker,
Compose-Dateien, Git-Inhalten, Images, Health-Endpunkten und Backup-Timern.
Containerzustände sind Momentaufnahmen; der Controller darf Profile danach
umschalten. Es wurde für diesen Abgleich kein Dienst neu gestartet.
## Laufzeit und Profile
Athena: Debian 13, RTX 5080 (16 GB) und RTX 3060 (12 GB). Die fünf
Textprofil-Images tragen alle `com.mike-ai.llama-cpp-commit=b29c606`
(llama.cpp 0.4.1). Sie verwenden `--load-mode none`, `--parallel 1` und
`--batch-size 2048`. Die `ubatch-size` wurde pro Profil auf einen getesteten
Wert gesetzt; sie ist **nicht** überall identisch.
| Profil | Qwen3.8-27B-Variante | Kontext | Tensor-Split 5080:3060 | Vision-Projektor | MTP Draft | ubatch |
|---|---|---:|---|---|---:|---:|
| Fast | IQ4-MIX | 76.800 | nur 5080 | 3060 | 2 | 64 |
| Medium | IQ4_XS Pure | 160.000 | 85:15 | 3060 | 3 | 512 |
| Large | IQ4_XS Pure | 192.000 | 86:14 | 3060 | 3 | 256 |
| Ultra | IQ4_XS Pure | 262.144 | 80:20 | keiner | 2 | 128 |
| Uncensored | Abliterated Q4_K_M | 80.000 | 90:10 | 3060 | 2 | 256 |
Tensor-Splits sind Startparameter, keine gemessenen VRAM-Anteile. Der
Vision-Projektor liegt bei den vier Vision-Profilen auf GPU 1 (3060).
`beta1` steht in der Repository-Matrix, ist aber nicht installiert. Der
Router bietet nur die fünf installierten Profile an. Beim ersten Abgleich
war Medium aktiv und der Router im LLM-Modus; beim späteren Containerabgleich
war `mike-ai-llama-medium` mit Exit-Code 139 beendet. Dieser Laufzeitfehler
wurde bei der Dokumentationsarbeit nicht behoben oder durch einen Neustart
verdeckt. Der aktuelle Zustand ist über Dashboard/Controller zu prüfen.
## Weitere Dienste
- FLUX.2 Klein 9B FP8 Beta: Transformer/VAE auf 5080, Qwen3-8B-NF4-
Textencoder auf 3060. Produktiv freigegeben sind höchstens 1024 × 1024,
vier Schritte, Guidance 1, vier Referenzbilder und 128 Encoder-Tokens.
1280 × 1280 lief im Test in CUDA-OOM.
- Qwen3-TTS 1.7B auf 3060 hinter dem TTS-Gateway; kein Piper-Fallback.
- Whisper.cpp `ggml-small` auf CPU über `/v1/audio/transcriptions`.
- Der gesunde Dienst `mike-ai-realtime-voice` vermittelt OpenClaw Talk über
WebRTC zwischen Whisper, dem normalen OpenClaw-Agenten und Qwen3-TTS.
Er braucht keine GPU und keinen Profilwechsel. Das Plugin liegt in
`integrations/openclaw-athena-talk` und läuft auf Unraid, nicht auf Athena.
Diktat und hochgeladene M4A-Sprachnachrichten nutzen den separaten
Transkriptionspfad des Plugins. OpenClaw liefert den fertigen Agententext
an die Brücke; das Sprechen beginnt daher erst nach Abschluss der
Agentenantwort. Details und Grenzen stehen in der [Voice-Doku](../services/athena-realtime-voice/README.md).
- `mike-ai-mikes-applio-ui` läuft gesund und ohne GPU. Die Quelle liegt im
eigenen Repository [Mikes-Applio-UI](https://git.casaderoll.de/michael/Mikes-applio-ui).
Der Applio-GPU-Container war beim Abgleich nicht gestartet. Die UI kann
trotzdem Status, Modelle und vorbereitende Aufgaben anzeigen; eine echte
Konvertierung verlangt den Applio-Modus.
Der vollständige Bestand der **27** angelegten Docker-Container steht im
[Container-Inventar](CONTAINER_INVENTORY.md). `Created` oder `Exited` bei
Spezialworkern bedeutet nicht automatisch einen zu entfernenden Testrest.
## Git und reproduzierbarer Stand
Der laufende Stack liegt unter `/opt/mike-ai/stack`. Sein Git-HEAD war
`276df0e` und damit älter als der aktuelle Git-Stand; `compose.yaml` und
`services/athena-realtime-voice/` sind im Live-Checkout nicht committed.
**Die geprüften Nutzdaten dieser Dateien stimmen aber bytegenau mit dem
neueren Git-Stand überein.** Ein frischer Clone liefert damit den Quellcode
und die Compose-Definitionen; er liefert weder lokale Secrets noch
Modellgewichte oder persistente Nutzerdaten. Vor einem Deploy ist die
Live-Konfiguration zu sichern und mit dem Checkout abzugleichen, statt den
laufenden Host blind zurückzusetzen.
Die Applio-UI hat einen eigenen Checkout `/opt/mike-ai/Mikes-Applio-UI`.
Sein Git-HEAD `3a06139` ist älter als Doggo `eadbc15`. Die laufende
Anwendungsquelle stimmt bis auf Versionsmetadaten und den später
korrigierten Dokumentationsstand mit Doggo überein. Siehe
[Applio-Integrationsdoku](https://git.casaderoll.de/michael/Mikes-applio-ui/src/branch/main/docs/ATHENA-INTEGRATION.md).
## Backup und Prüfumfang
`mike-ai-backup` lief; der jüngste geprüfte manuelle Archivlauf schloss
Compose und Voice-Bridge ein. Der Fünf-Stunden-Export-Timer war aktiv, der
externe Restic-Timer zwar ebenfalls aktiviert, aber ohne seine erforderliche
`/etc/mike-ai/disaster-backup.env` **nicht** als funktionierende externe
Sicherung zu werten. Details und Restore-Grenzen: [Backup](RECOVERY.md).
Geprüft wurden aktuelle Container- und Quellenstände sowie ausgewählte
Health-Endpunkte. Keine erneuten Bild-, Langkontext-, Trainings- oder
Restore-Tests; ältere Ergebnisse sind im [Update-Audit](UPDATE_AUDIT_20260915.md)
und [FLUX-Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md) dokumentiert.