94 lines
5.3 KiB
Markdown
94 lines
5.3 KiB
Markdown
# Geprüfter Live-Stand auf Athena
|
||
|
||
Stand: **20. September 2026**. Quelle: lesender SSH-Abgleich von Docker,
|
||
Compose-Dateien, Git-Inhalten, Images, Health-Endpunkten und Backup-Timern.
|
||
Containerzustände sind Momentaufnahmen; der Controller darf Profile danach
|
||
umschalten. Es wurde für diesen Abgleich kein Dienst neu gestartet.
|
||
|
||
## Laufzeit und Profile
|
||
|
||
Athena: Debian 13, RTX 5080 (16 GB) und RTX 3060 (12 GB). Die fünf
|
||
Textprofil-Images tragen alle `com.mike-ai.llama-cpp-commit=b29c606`
|
||
(llama.cpp 0.4.1). Sie verwenden `--load-mode none` und `--batch-size 2048`.
|
||
Fast, Large, Ultra und Uncensored verwenden einen Slot. Medium läuft seit dem
|
||
19. September kontrolliert mit `--parallel 2` und `--kv-unified`. Seine beiden
|
||
Slots teilen sich den einzigen 160.000-Token-KV-Pool. Die `ubatch-size` wurde
|
||
pro Profil auf einen getesteten Wert gesetzt; sie ist **nicht** überall
|
||
identisch.
|
||
|
||
| Profil | Qwen3.8-27B-Variante | Kontext | Slots | Tensor-Split 5080:3060 | Vision-Projektor | MTP Draft | ubatch |
|
||
|---|---|---:|---:|---|---|---:|---:|
|
||
| Fast | IQ4-MIX | 76.800 | 1 | nur 5080 | 3060 | 2 | 64 |
|
||
| Medium | IQ4_XS Pure | 160.000 gemeinsam | 2 | 85:15 | 3060 | 3 | 512 |
|
||
| Large | IQ4_XS Pure | 192.000 | 1 | 86:14 | 3060 | 3 | 256 |
|
||
| Ultra | IQ4_XS Pure | 262.144 | 1 | 80:20 | keiner | 2 | 128 |
|
||
| Uncensored | Abliterated Q4_K_M | 80.000 | 1 | 90:10 | 3060 | 2 | 256 |
|
||
|
||
Tensor-Splits sind Startparameter, keine gemessenen VRAM-Anteile. Der
|
||
Vision-Projektor liegt bei den vier Vision-Profilen auf GPU 1 (3060).
|
||
`beta1` steht in der Repository-Matrix, ist aber nicht installiert. Der
|
||
Router bietet nur die fünf installierten Profile an. Beim Abgleich am
|
||
20. September lief Medium seit rund 21 Stunden gesund mit zwei Slots; die vier
|
||
anderen Textprofile waren planmäßig gestoppt. Dashboard, Router, Controller,
|
||
Whisper, TTS und Realtime-Voice waren ebenfalls gesund. Der frühere
|
||
Vision-/CLIP-Absturz ist als historischer Befund erhalten, beschreibt aber
|
||
nicht mehr den aktuellen Containerzustand.
|
||
|
||
## Weitere Dienste
|
||
|
||
- FLUX.2 Klein 9B FP8 Beta: Transformer/VAE auf 5080, Qwen3-8B-NF4-
|
||
Textencoder auf 3060. Produktiv freigegeben sind höchstens 1024 × 1024,
|
||
vier Schritte, Guidance 1, vier Referenzbilder und 128 Encoder-Tokens.
|
||
1280 × 1280 lief im Test in CUDA-OOM.
|
||
- Qwen3-TTS 1.7B auf 3060 hinter dem TTS-Gateway; kein Piper-Fallback.
|
||
- Whisper.cpp `ggml-small` auf CPU über `/v1/audio/transcriptions`.
|
||
- Der gesunde Dienst `mike-ai-realtime-voice` vermittelt OpenClaw Talk über
|
||
WebRTC zwischen Whisper, dem normalen OpenClaw-Agenten und Qwen3-TTS.
|
||
Er braucht keine GPU und keinen Profilwechsel. Das Plugin liegt in
|
||
`integrations/openclaw-athena-talk` und läuft auf Unraid, nicht auf Athena.
|
||
Diktat und hochgeladene M4A-Sprachnachrichten nutzen den separaten
|
||
Transkriptionspfad des Plugins. OpenClaw liefert den fertigen Agententext
|
||
an die Brücke; das Sprechen beginnt daher erst nach Abschluss der
|
||
Agentenantwort. Details und Grenzen stehen in der [Voice-Doku](../services/athena-realtime-voice/README.md).
|
||
- `mike-ai-mikes-applio-ui` läuft gesund und ohne GPU. Die Quelle liegt im
|
||
eigenen Repository [Mikes-Applio-UI](https://git.casaderoll.de/michael/Mikes-applio-ui).
|
||
Der Applio-GPU-Container war beim Abgleich nicht gestartet. Die UI kann
|
||
trotzdem Status, Modelle und vorbereitende Aufgaben anzeigen; eine echte
|
||
Konvertierung verlangt den Applio-Modus.
|
||
|
||
Der vollständige Bestand der **30** angelegten Docker-Container steht im
|
||
[Container-Inventar](CONTAINER_INVENTORY.md). `Created` oder `Exited` bei
|
||
Spezialworkern bedeutet nicht automatisch einen zu entfernenden Testrest.
|
||
|
||
## Git und reproduzierbarer Stand
|
||
|
||
Der laufende Stack liegt unter `/opt/mike-ai/stack`. Sein Git-HEAD ist weiterhin
|
||
`276df0e` und damit älter als Doggo; `compose.yaml`, Dashboard und
|
||
`services/athena-realtime-voice/` liegen dort als Live-Änderungen. Die am
|
||
20. September geprüften Hashes von Compose, Dashboard, Dashboard-Test und
|
||
Voice-Bridge stimmen bytegenau mit diesem veröffentlichten Repository-Stand
|
||
überein. Ein frischer Clone liefert damit den Quellcode
|
||
und die Compose-Definitionen; er liefert weder lokale Secrets noch
|
||
Modellgewichte oder persistente Nutzerdaten. Vor einem Deploy ist die
|
||
Live-Konfiguration zu sichern und mit dem Checkout abzugleichen, statt den
|
||
laufenden Host blind zurückzusetzen.
|
||
|
||
Die Applio-UI hat einen eigenen Checkout `/opt/mike-ai/Mikes-Applio-UI`.
|
||
Sein Git-HEAD `3a06139` ist älter als Doggo `eadbc15`. Die laufende
|
||
Anwendungsquelle stimmt bis auf Versionsmetadaten und den später
|
||
korrigierten Dokumentationsstand mit Doggo überein. Siehe
|
||
[Applio-Integrationsdoku](https://git.casaderoll.de/michael/Mikes-applio-ui/src/branch/main/docs/ATHENA-INTEGRATION.md).
|
||
|
||
## Backup und Prüfumfang
|
||
|
||
`mike-ai-backup` lief; der jüngste geprüfte manuelle Archivlauf schloss
|
||
Compose und Voice-Bridge ein. Der Fünf-Stunden-Export-Timer war aktiv, der
|
||
externe Restic-Timer zwar ebenfalls aktiviert, aber ohne seine erforderliche
|
||
`/etc/mike-ai/disaster-backup.env` **nicht** als funktionierende externe
|
||
Sicherung zu werten. Details und Restore-Grenzen: [Backup](RECOVERY.md).
|
||
|
||
Geprüft wurden aktuelle Container- und Quellenstände sowie ausgewählte
|
||
Health-Endpunkte. Keine erneuten Bild-, Langkontext-, Trainings- oder
|
||
Restore-Tests; ältere Ergebnisse sind im [Update-Audit](UPDATE_AUDIT_20260915.md)
|
||
und [FLUX-Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md) dokumentiert.
|