89 lines
5.0 KiB
Markdown
89 lines
5.0 KiB
Markdown
# Geprüfter Live-Stand auf Athena
|
||
|
||
Stand: **16. September 2026**. Quelle: lesender SSH-Abgleich von Docker,
|
||
Compose-Dateien, Git-Inhalten, Images, Health-Endpunkten und Backup-Timern.
|
||
Containerzustände sind Momentaufnahmen; der Controller darf Profile danach
|
||
umschalten. Es wurde für diesen Abgleich kein Dienst neu gestartet.
|
||
|
||
## Laufzeit und Profile
|
||
|
||
Athena: Debian 13, RTX 5080 (16 GB) und RTX 3060 (12 GB). Die fünf
|
||
Textprofil-Images tragen alle `com.mike-ai.llama-cpp-commit=b29c606`
|
||
(llama.cpp 0.4.1). Sie verwenden `--load-mode none`, `--parallel 1` und
|
||
`--batch-size 2048`. Die `ubatch-size` wurde pro Profil auf einen getesteten
|
||
Wert gesetzt; sie ist **nicht** überall identisch.
|
||
|
||
| Profil | Qwen3.8-27B-Variante | Kontext | Tensor-Split 5080:3060 | Vision-Projektor | MTP Draft | ubatch |
|
||
|---|---|---:|---|---|---:|---:|
|
||
| Fast | IQ4-MIX | 76.800 | nur 5080 | 3060 | 2 | 64 |
|
||
| Medium | IQ4_XS Pure | 160.000 | 85:15 | 3060 | 3 | 512 |
|
||
| Large | IQ4_XS Pure | 192.000 | 86:14 | 3060 | 3 | 256 |
|
||
| Ultra | IQ4_XS Pure | 262.144 | 80:20 | keiner | 2 | 128 |
|
||
| Uncensored | Abliterated Q4_K_M | 80.000 | 90:10 | 3060 | 2 | 256 |
|
||
|
||
Tensor-Splits sind Startparameter, keine gemessenen VRAM-Anteile. Der
|
||
Vision-Projektor liegt bei den vier Vision-Profilen auf GPU 1 (3060).
|
||
`beta1` steht in der Repository-Matrix, ist aber nicht installiert. Der
|
||
Router bietet nur die fünf installierten Profile an. Beim ersten Abgleich
|
||
war Medium aktiv und der Router im LLM-Modus; beim späteren Containerabgleich
|
||
war `mike-ai-llama-medium` mit Exit-Code 139 beendet. Dieser Laufzeitfehler
|
||
wurde bei der Dokumentationsarbeit nicht behoben oder durch einen Neustart
|
||
verdeckt. Der aktuelle Zustand ist über Dashboard/Controller zu prüfen.
|
||
|
||
## Weitere Dienste
|
||
|
||
- FLUX.2 Klein 9B FP8 Beta: Transformer/VAE auf 5080, Qwen3-8B-NF4-
|
||
Textencoder auf 3060. Produktiv freigegeben sind höchstens 1024 × 1024,
|
||
vier Schritte, Guidance 1, vier Referenzbilder und 128 Encoder-Tokens.
|
||
1280 × 1280 lief im Test in CUDA-OOM.
|
||
- Qwen3-TTS 1.7B auf 3060 hinter dem TTS-Gateway; kein Piper-Fallback.
|
||
- Whisper.cpp `ggml-small` auf CPU über `/v1/audio/transcriptions`.
|
||
- Der gesunde Dienst `mike-ai-realtime-voice` vermittelt OpenClaw Talk über
|
||
WebRTC zwischen Whisper, dem normalen OpenClaw-Agenten und Qwen3-TTS.
|
||
Er braucht keine GPU und keinen Profilwechsel. Das Plugin liegt in
|
||
`integrations/openclaw-athena-talk` und läuft auf Unraid, nicht auf Athena.
|
||
Diktat und hochgeladene M4A-Sprachnachrichten nutzen den separaten
|
||
Transkriptionspfad des Plugins. OpenClaw liefert den fertigen Agententext
|
||
an die Brücke; das Sprechen beginnt daher erst nach Abschluss der
|
||
Agentenantwort. Details und Grenzen stehen in der [Voice-Doku](../services/athena-realtime-voice/README.md).
|
||
- `mike-ai-mikes-applio-ui` läuft gesund und ohne GPU. Die Quelle liegt im
|
||
eigenen Repository [Mikes-Applio-UI](https://git.casaderoll.de/michael/Mikes-applio-ui).
|
||
Der Applio-GPU-Container war beim Abgleich nicht gestartet. Die UI kann
|
||
trotzdem Status, Modelle und vorbereitende Aufgaben anzeigen; eine echte
|
||
Konvertierung verlangt den Applio-Modus.
|
||
|
||
Der vollständige Bestand der **27** angelegten Docker-Container steht im
|
||
[Container-Inventar](CONTAINER_INVENTORY.md). `Created` oder `Exited` bei
|
||
Spezialworkern bedeutet nicht automatisch einen zu entfernenden Testrest.
|
||
|
||
## Git und reproduzierbarer Stand
|
||
|
||
Der laufende Stack liegt unter `/opt/mike-ai/stack`. Sein Git-HEAD war
|
||
`276df0e` und damit älter als der aktuelle Git-Stand; `compose.yaml` und
|
||
`services/athena-realtime-voice/` sind im Live-Checkout nicht committed.
|
||
**Die geprüften Nutzdaten dieser Dateien stimmen aber bytegenau mit dem
|
||
neueren Git-Stand überein.** Ein frischer Clone liefert damit den Quellcode
|
||
und die Compose-Definitionen; er liefert weder lokale Secrets noch
|
||
Modellgewichte oder persistente Nutzerdaten. Vor einem Deploy ist die
|
||
Live-Konfiguration zu sichern und mit dem Checkout abzugleichen, statt den
|
||
laufenden Host blind zurückzusetzen.
|
||
|
||
Die Applio-UI hat einen eigenen Checkout `/opt/mike-ai/Mikes-Applio-UI`.
|
||
Sein Git-HEAD `3a06139` ist älter als Doggo `eadbc15`. Die laufende
|
||
Anwendungsquelle stimmt bis auf Versionsmetadaten und den später
|
||
korrigierten Dokumentationsstand mit Doggo überein. Siehe
|
||
[Applio-Integrationsdoku](https://git.casaderoll.de/michael/Mikes-applio-ui/src/branch/main/docs/ATHENA-INTEGRATION.md).
|
||
|
||
## Backup und Prüfumfang
|
||
|
||
`mike-ai-backup` lief; der jüngste geprüfte manuelle Archivlauf schloss
|
||
Compose und Voice-Bridge ein. Der Fünf-Stunden-Export-Timer war aktiv, der
|
||
externe Restic-Timer zwar ebenfalls aktiviert, aber ohne seine erforderliche
|
||
`/etc/mike-ai/disaster-backup.env` **nicht** als funktionierende externe
|
||
Sicherung zu werten. Details und Restore-Grenzen: [Backup](RECOVERY.md).
|
||
|
||
Geprüft wurden aktuelle Container- und Quellenstände sowie ausgewählte
|
||
Health-Endpunkte. Keine erneuten Bild-, Langkontext-, Trainings- oder
|
||
Restore-Tests; ältere Ergebnisse sind im [Update-Audit](UPDATE_AUDIT_20260915.md)
|
||
und [FLUX-Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md) dokumentiert.
|