Document verified Athena live state and recovery boundaries

This commit is contained in:
Mikei386
2026-09-16 16:16:53 +02:00
parent 7514b858f5
commit a75aea4b7e
7 changed files with 129 additions and 81 deletions
+9 -4
View File
@@ -1,10 +1,13 @@
# Athena – Betriebsanleitung # Athena – Betriebsanleitung
Stand: **12. September 2026**, auf Athena geprüft. Produktiv läuft Stand: **16. September 2026**, auf Athena geprüft. Die fünf Textprofil-Images
**llama.cpp b10930** (`56381e407c0ccfb3a6f71e668a27a901001d22ce`). tragen **llama.cpp b29c606** (0.4.1).
Der [geprüfte Live-Stand](docs/LIVE_STATE.md) beschreibt Profile, GPUs und die Der [geprüfte Live-Stand](docs/LIVE_STATE.md) beschreibt Profile, GPUs und die
Abweichung zwischen dem bereitgestellten Stack und dem Git-Checkout. Abweichung zwischen dem bereitgestellten Stack und dem Git-Checkout.
Der [Updatebericht](docs/LLAMA_B10930_UPDATE_20260912.md) enthält Tests und Rückfallstand. Der [Updatebericht vom 15. September](docs/UPDATE_AUDIT_20260915.md)
enthält die aktuellen Build- und Testbelege. Der ältere
[b10930-Bericht](docs/LLAMA_B10930_UPDATE_20260912.md) dokumentiert einen
früheren Stand und ist keine aktuelle Startanleitung.
Diese Datei ist der kurze, verbindliche Einstieg für Menschen und Agenten. Diese Datei ist der kurze, verbindliche Einstieg für Menschen und Agenten.
@@ -19,12 +22,14 @@ Sie betreibt:
- den OpenAI-kompatiblen Profile Router, - den OpenAI-kompatiblen Profile Router,
- FLUX.2 Klein 9B FP8 Beta für Textbilder und Referenzbild-Bearbeitung, - FLUX.2 Klein 9B FP8 Beta für Textbilder und Referenzbild-Bearbeitung,
- Qwen3-TTS und TTS-Gateway für Sprache, - Qwen3-TTS und TTS-Gateway für Sprache,
- Whisper.cpp und die WebRTC-Brücke für OpenClaw Talk,
- die GPU-lose Mikes-Applio-UI als gesonderten Checkout,
- das Athena-Dashboard, - das Athena-Dashboard,
- Portainer CE als optionale Ansicht auf die laufenden Docker-Container, - Portainer CE als optionale Ansicht auf die laufenden Docker-Container,
- WireGuard-Gateway und Datenbackup, - WireGuard-Gateway und Datenbackup,
- den hostgebundenen Athena-Operator. - den hostgebundenen Athena-Operator.
Hermes, Benutzeroberfläche und portable Fach-MCPs laufen auf Unraid. Auf Athena Hermes, OpenClaw und portable Fach-MCPs laufen auf Unraid. Auf Athena
werden keine zweiten Instanzen dieser Dienste angelegt. werden keine zweiten Instanzen dieser Dienste angelegt.
## Pfade ## Pfade
+2 -2
View File
@@ -1,6 +1,6 @@
# Athena AI # Athena AI
Stand: **15. September 2026**, auf Athena geprüft. Produktiv läuft Stand: **16. September 2026**, auf Athena geprüft. Die Textprofil-Images verwenden
**llama.cpp 0.4.1** (`b29c606`). **llama.cpp 0.4.1** (`b29c606`).
Der [geprüfte Live-Stand](docs/LIVE_STATE.md) beschreibt Profile, GPUs und die Der [geprüfte Live-Stand](docs/LIVE_STATE.md) beschreibt Profile, GPUs und die
Abweichung zwischen dem bereitgestellten Stack und dem Git-Checkout. Abweichung zwischen dem bereitgestellten Stack und dem Git-Checkout.
@@ -10,7 +10,7 @@ enthält Versionsvergleich, Tests und Rückfallstand.
Athena ist die lokale Inferenzmaschine. Der Docker-Stack stellt Athena ist die lokale Inferenzmaschine. Der Docker-Stack stellt
Qwen über eine kleine OpenAI-kompatible Router-API bereit und übernimmt lokale Qwen über eine kleine OpenAI-kompatible Router-API bereit und übernimmt lokale
Bild- und Sprachausgabe. **Hermes und die Fach-MCPs laufen auf Unraid.** Bild- und Sprachausgabe. **Hermes, OpenClaw und die Fach-MCPs laufen auf Unraid.**
## Aktueller Aufbau ## Aktueller Aufbau
+8 -1
View File
@@ -3,6 +3,12 @@
```mermaid ```mermaid
flowchart LR flowchart LR
C[Hermes Desktop / Web / Mobil] --> H[Hermes Agent<br/>Unraid] C[Hermes Desktop / Web / Mobil] --> H[Hermes Agent<br/>Unraid]
OC[OpenClaw Web / Mac<br/>Unraid-Gateway] -->|OpenAI API| R
OC --> V[Athena-Talk-Plugin<br/>Unraid]
V --> RV[Realtime-Voice-Brücke<br/>Athena, WebRTC]
RV --> STT
RV --> T
RV -->|Agentenantwort| OC
H -->|OpenAI API| R[Profile Router<br/>Athena :8081] H -->|OpenAI API| R[Profile Router<br/>Athena :8081]
R --> P[Profile Controller] R --> P[Profile Controller]
P --> Q[genau ein llama.cpp-Profil<br/>Qwen Fast / Medium / Large / Ultra / Uncensored] P --> Q[genau ein llama.cpp-Profil<br/>Qwen Fast / Medium / Large / Ultra / Uncensored]
@@ -22,10 +28,11 @@ flowchart LR
W --- B[Athena Dashboard :8099] W --- B[Athena Dashboard :8099]
W --- PRT[Portainer :9443<br/>optionale Docker-Ansicht] W --- PRT[Portainer :9443<br/>optionale Docker-Ansicht]
W --- O[Athena Operator] W --- O[Athena Operator]
W --- AP[Mikes-Applio-UI<br/>eigener Checkout, GPU-los]
K[Backup alle 5 Stunden] --> DATA[/data und /etc/mike-ai] K[Backup alle 5 Stunden] --> DATA[/data und /etc/mike-ai]
``` ```
Stand: 12. September 2026. Versionen und Abweichungen: [Live-Stand](LIVE_STATE.md). Stand: 16. September 2026. Versionen und Abweichungen: [Live-Stand](LIVE_STATE.md).
FLUX nutzt beide GPUs und pausiert dafür LLM und Qwen3-TTS. Dashboard und FLUX nutzt beide GPUs und pausiert dafür LLM und Qwen3-TTS. Dashboard und
Portainer besitzen eigene Netzwerk-Namespaces in `mike-ai_frontend`; der Router Portainer besitzen eigene Netzwerk-Namespaces in `mike-ai_frontend`; der Router
läuft in `mike-ai_control`. Der Gateway vermittelt den privaten Zugriff. läuft in `mike-ai_control`. Der Gateway vermittelt den privaten Zugriff.
+10 -7
View File
@@ -1,8 +1,8 @@
# Container-Inventar auf Athena # Container-Inventar auf Athena
Stand: 15. September 2026 Stand: 16. September 2026 (lesender Docker-Abgleich)
Athena besteht beim lesenden Abgleich aus 25 Docker-Containern. Nicht jeder Container enthält Athena hatte beim lesenden Abgleich 27 Docker-Container. Nicht jeder Container enthält
ein KI-Modell: Router, Oberflächen, Netzwerk, Steuerung und Sicherung sind ein KI-Modell: Router, Oberflächen, Netzwerk, Steuerung und Sicherung sind
gewöhnliche Dienste. Die rechenintensiven GPU-Worker werden absichtlich nur bei gewöhnliche Dienste. Die rechenintensiven GPU-Worker werden absichtlich nur bei
Bedarf gestartet. Ein Container im Zustand `Created` oder `Exited (0)` ist daher Bedarf gestartet. Ein Container im Zustand `Created` oder `Exited (0)` ist daher
@@ -19,12 +19,13 @@ nicht automatisch ein ungenutzter Rest.
| `mike-ai-llama-medium` | Qwen3.8-27B `IQ4_XS-pure`, Qwen-MMProj BF16 | Standard-Q4-Text-/Vision-Profil mit 160.000 Token Kontext und Verteilung auf beide GPUs. | | `mike-ai-llama-medium` | Qwen3.8-27B `IQ4_XS-pure`, Qwen-MMProj BF16 | Standard-Q4-Text-/Vision-Profil mit 160.000 Token Kontext und Verteilung auf beide GPUs. |
| `mike-ai-llama-ultra` | Qwen3.8-27B `IQ4_XS-pure`, ohne Vision-Projektor | Maximales Langkontextprofil mit 262.144 Token Kontext und Verteilung auf beide GPUs. | | `mike-ai-llama-ultra` | Qwen3.8-27B `IQ4_XS-pure`, ohne Vision-Projektor | Maximales Langkontextprofil mit 262.144 Token Kontext und Verteilung auf beide GPUs. |
| `mike-ai-llama-uncensored` | Qwen3.8-27B Abliterated `Q4_K_M`, eigener MMProj F16 | Spezialprofil mit 80.000 Token Kontext und gelockerten Modellgrenzen. | | `mike-ai-llama-uncensored` | Qwen3.8-27B Abliterated `Q4_K_M`, eigener MMProj F16 | Spezialprofil mit 80.000 Token Kontext und gelockerten Modellgrenzen. |
| `mike-ai-ltx2-studio` | LTX-Video-Backend | GPU-Worker für lokale Videogenerierung; beim Abgleich gestoppt. |
| `mike-ai-mcp-athena-operator` | kein Modell | Stellt Hermes begrenzte Werkzeuge zum Prüfen, Ändern, Testen, Sichern und Versionieren von Athena bereit. | | `mike-ai-mcp-athena-operator` | kein Modell | Stellt Hermes begrenzte Werkzeuge zum Prüfen, Ändern, Testen, Sichern und Versionieren von Athena bereit. |
| `mike-ai-music-acestep-test` | ACE-Step 1.5 XL-SFT und `acestep-5Hz-lm-1.7B` | Generiert Musik im exklusiven Musikmodus auf der RTX 5080. | | `mike-ai-music-acestep-test` | ACE-Step 1.5 XL-SFT und `acestep-5Hz-lm-1.7B` | Generiert Musik im exklusiven Musikmodus auf der RTX 5080. |
| `mike-ai-music-ui` | kein Modell; `fspecii/ace-step-ui` | Community-Oberfläche für ACE-Step; bleibt als leichte UI verfügbar, während der GPU-Worker bedarfsgesteuert läuft. | | `mike-ai-music-ui` | kein Modell; `fspecii/ace-step-ui` | Community-Oberfläche für ACE-Step; bleibt als leichte UI verfügbar, während der GPU-Worker bedarfsgesteuert läuft. |
| `mike-ai-portainer` | kein Modell; Portainer CE | Optionale Docker-Verwaltungsoberfläche. | | `mike-ai-portainer` | kein Modell; Portainer CE | Optionale Docker-Verwaltungsoberfläche. |
| `mike-ai-profile-controller` | kein Modell | Startet und stoppt ausschließlich freigegebene Modellprofile und Spezialworker in einer sicheren Reihenfolge. | | `mike-ai-profile-controller` | kein Modell | Startet und stoppt ausschließlich freigegebene Modellprofile und Spezialworker in einer sicheren Reihenfolge. |
| `mike-ai-realtime-voice` | kein Modell | Experimentelle WebRTC-Brücke für OpenClaw Talk; verbindet über den privaten WireGuard-Pfad Athena Whisper, OpenClaw-Agent und Qwen3-TTS ohne Profilwechsel. | | `mike-ai-realtime-voice` | kein Modell | Laufende, gesunde WebRTC-Brücke für OpenClaw Talk; verbindet über den privaten WireGuard-Pfad Athena Whisper, OpenClaw-Agent und Qwen3-TTS ohne Profilwechsel. |
| `mike-ai-qwen3-tts` | `Qwen/Qwen3-TTS-12Hz-1.7B-Base`, Stimme Serena | Hochwertige deutsche Sprachausgabe auf der RTX 3060 im LLM-Betrieb. | | `mike-ai-qwen3-tts` | `Qwen/Qwen3-TTS-12Hz-1.7B-Base`, Stimme Serena | Hochwertige deutsche Sprachausgabe auf der RTX 3060 im LLM-Betrieb. |
| `mike-ai-router` | kein eigenes Modell | Einzige OpenAI-kompatible Modelladresse; koordiniert Profile, Bildaufträge, Sprache und Betriebsarten. | | `mike-ai-router` | kein eigenes Modell | Einzige OpenAI-kompatible Modelladresse; koordiniert Profile, Bildaufträge, Sprache und Betriebsarten. |
| `mike-ai-stem-separator` | BS-RoFormer Viperx 1297, `htdemucs_ft`, `htdemucs_6s`, `MossFormer2_SE_48K` | Trennt Gesang, Instrumente oder Sprache/Hintergrundgeräusche im exklusiven Separationsmodus. | | `mike-ai-stem-separator` | BS-RoFormer Viperx 1297, `htdemucs_ft`, `htdemucs_6s`, `MossFormer2_SE_48K` | Trennt Gesang, Instrumente oder Sprache/Hintergrundgeräusche im exklusiven Separationsmodus. |
@@ -37,10 +38,12 @@ nicht automatisch ein ungenutzter Rest.
| `mike-ai-trellis-studio` | Image `mike-ai/trellis-studio:0.6.0-q8` | Vorhandener, gestoppter 3D-Worker; in diesem Abgleich nicht funktional getestet. | | `mike-ai-trellis-studio` | Image `mike-ai/trellis-studio:0.6.0-q8` | Vorhandener, gestoppter 3D-Worker; in diesem Abgleich nicht funktional getestet. |
| `mike-ai-mikes-applio-ui` | Image `mike-ai/mikes-applio-ui:latest` | Laufende zusätzliche Applio-Oberfläche. | | `mike-ai-mikes-applio-ui` | Image `mike-ai/mikes-applio-ui:latest` | Laufende zusätzliche Applio-Oberfläche. |
Alle fünf llama-Container verwenden llama.cpp 0.4.1 (`b29c606`). Beim Abgleich lief Medium; Alle fünf llama-Container verwenden llama.cpp 0.4.1 (`b29c606`). Medium
die anderen vier waren gestoppt. Der Image-Worker stand auf Created. lief beim ersten Abgleich, war später aber mit Exit-Code 139 beendet; die
Die übrigen GPU-Spezialworker waren gestoppt, die Infrastruktur und die anderen vier waren nicht aktiv. Dieser Laufzeitfehler wurde im Zuge der
Musik-/Applio-Oberflächen liefen. Diese Zustände ändern sich mit der Nutzung. Dokumentationsarbeit nicht behoben. Der Image-Worker war ebenfalls gestoppt.
Die Infrastruktur und die Musik-/Applio-Oberflächen liefen. Diese Zustände
ändern sich mit der Nutzung.
Die Detailbeschreibungen der Spezialmodelle stammen aus der bestehenden Die Detailbeschreibungen der Spezialmodelle stammen aus der bestehenden
Betriebsdokumentation; dieses Update prüfte deren Containerbestand, nicht Betriebsdokumentation; dieses Update prüfte deren Containerbestand, nicht
sämtliche Modellgewichte oder Funktionen neu. sämtliche Modellgewichte oder Funktionen neu.
+73 -53
View File
@@ -1,68 +1,88 @@
# Geprüfter Live-Stand auf Athena # Geprüfter Live-Stand auf Athena
Stand: 12. September 2026. Quelle: SSH-Abgleich von Containerbestand, Stand: **16. September 2026**. Quelle: lesender SSH-Abgleich von Docker,
Startkonfiguration und den dokumentierten Laufzeittests auf Athena. Compose-Dateien, Git-Inhalten, Images, Health-Endpunkten und Backup-Timern.
Containerzustände sind Momentaufnahmen; der Controller darf Profile danach
umschalten. Es wurde für diesen Abgleich kein Dienst neu gestartet.
## Laufzeit und Profile ## Laufzeit und Profile
Debian 13, RTX 5080 mit 16 GB und RTX 3060 mit 12 GB. Athena: Debian 13, RTX 5080 (16 GB) und RTX 3060 (12 GB). Die fünf
Alle fünf Textprofilcontainer verwenden llama.cpp **b10930**, Commit Textprofil-Images tragen alle `com.mike-ai.llama-cpp-commit=b29c606`
`56381e407c0ccfb3a6f71e668a27a901001d22ce`, Image `mike-ai/llama.cpp:local` (llama.cpp 0.4.1). Sie verwenden `--load-mode none`, `--parallel 1` und
beziehungsweise `mike-ai/llama.cpp:b10930`. `--batch-size 2048`. Die `ubatch-size` wurde pro Profil auf einen getesteten
Image-ID: `sha256:c9d78a9375143877574f3d7c6e0dea94ecfebb264e8dd9f57ac4e03f1c96044e`. Wert gesetzt; sie ist **nicht** überall identisch.
Die Startoption lautet `--load-mode none`; `--no-mmap` ist entfernt.
| Profil | Qwen3.8-27B-Variante | Kontext | GPU-Konfiguration 5080:3060 | Vision | MTP Draft | | Profil | Qwen3.8-27B-Variante | Kontext | Tensor-Split 5080:3060 | Vision-Projektor | MTP Draft | ubatch |
|---|---|---:|---|---|---:| |---|---|---:|---|---|---:|---:|
| Fast | IQ4-MIX | 76.800 | Textmodell nur 5080 | ja | 2 | | Fast | IQ4-MIX | 76.800 | nur 5080 | 3060 | 2 | 64 |
| Medium | IQ4_XS Pure | 160.000 | 85:15 | ja | 3 | | Medium | IQ4_XS Pure | 160.000 | 85:15 | 3060 | 3 | 512 |
| Large | IQ4_XS Pure | 192.000 | 86:14 | ja | 3 | | Large | IQ4_XS Pure | 192.000 | 86:14 | 3060 | 3 | 256 |
| Ultra | IQ4_XS Pure | 262.144 | 80:20 | nein | 2 | | Ultra | IQ4_XS Pure | 262.144 | 80:20 | keiner | 2 | 128 |
| Uncensored | Abliterated Q4_K_M | 80.000 | 90:10 | ja | 2 | | Uncensored | Abliterated Q4_K_M | 80.000 | 90:10 | 3060 | 2 | 256 |
Alle Profile nutzen einen Slot. Die GPU-Verhältnisse sind konfigurierte Tensor-Splits sind Startparameter, keine gemessenen VRAM-Anteile. Der
Tensor-Splits, keine gemessenen VRAM-Prozentsätze; KV-Cache, Projektor und Vision-Projektor liegt bei den vier Vision-Profilen auf GPU 1 (3060).
weitere Dienste benötigen zusätzlich Speicher. Uncensored nutzt beide Karten, `beta1` steht in der Repository-Matrix, ist aber nicht installiert. Der
der Vision-Projektor liegt auf der 3060. Router bietet nur die fünf installierten Profile an. Beim ersten Abgleich
war Medium aktiv und der Router im LLM-Modus; beim späteren Containerabgleich
war `mike-ai-llama-medium` mit Exit-Code 139 beendet. Dieser Laufzeitfehler
wurde bei der Dokumentationsarbeit nicht behoben oder durch einen Neustart
verdeckt. Der aktuelle Zustand ist über Dashboard/Controller zu prüfen.
Im LLM-Modus läuft genau ein Textprofil. Zum Abschluss des Buildtests war ## Weitere Dienste
Uncensored aktiv; beim späteren Dokumentationsabgleich war Medium aktiv.
Das aktive Profil ist ein veränderlicher Betriebszustand.
`beta1` steht zusätzlich in der Repository-Matrix, ist auf Athena aber nicht
installiert und wurde beim Update nicht getestet.
## Bild und Sprache - FLUX.2 Klein 9B FP8 Beta: Transformer/VAE auf 5080, Qwen3-8B-NF4-
Textencoder auf 3060. Produktiv freigegeben sind höchstens 1024 × 1024,
vier Schritte, Guidance 1, vier Referenzbilder und 128 Encoder-Tokens.
1280 × 1280 lief im Test in CUDA-OOM.
- Qwen3-TTS 1.7B auf 3060 hinter dem TTS-Gateway; kein Piper-Fallback.
- Whisper.cpp `ggml-small` auf CPU über `/v1/audio/transcriptions`.
- Der gesunde Dienst `mike-ai-realtime-voice` vermittelt OpenClaw Talk über
WebRTC zwischen Whisper, dem normalen OpenClaw-Agenten und Qwen3-TTS.
Er braucht keine GPU und keinen Profilwechsel. Das Plugin liegt in
`integrations/openclaw-athena-talk` und läuft auf Unraid, nicht auf Athena.
Diktat und hochgeladene M4A-Sprachnachrichten nutzen den separaten
Transkriptionspfad des Plugins. OpenClaw liefert den fertigen Agententext
an die Brücke; das Sprechen beginnt daher erst nach Abschluss der
Agentenantwort. Details und Grenzen stehen in der [Voice-Doku](../services/athena-realtime-voice/README.md).
- `mike-ai-mikes-applio-ui` läuft gesund und ohne GPU. Die Quelle liegt im
eigenen Repository [Mikes-Applio-UI](https://git.casaderoll.de/michael/Mikes-applio-ui).
Der Applio-GPU-Container war beim Abgleich nicht gestartet. Die UI kann
trotzdem Status, Modelle und vorbereitende Aufgaben anzeigen; eine echte
Konvertierung verlangt den Applio-Modus.
- FLUX.2 Klein **9B FP8 Beta**, Transformer und VAE auf 5080, Der vollständige Bestand der **27** angelegten Docker-Container steht im
Qwen3-8B-Textencoder in NF4 auf 3060. [Container-Inventar](CONTAINER_INVENTORY.md). `Created` oder `Exited` bei
- Bildaufträge pausieren LLM und Qwen3-TTS und stellen sie danach wieder her. Spezialworkern bedeutet nicht automatisch einen zu entfernenden Testrest.
Produktiv maximal 1024 × 1024, vier Schritte, Guidance 1,
höchstens vier Referenzbilder und 128 Textencoder-Tokens.
- 1024 × 1024 erfolgreich; 1280 × 1280 CUDA-OOM. Zwischenwerte und höhere
Größen nicht geprüft. Keine Freigabe oberhalb 1024.
- Qwen3-TTS 1.7B auf 3060 hinter TTS-Gateway. Kein Piper-Container/Fallback.
- Whisper.cpp small (`/models/ggml-small.bin`) auf CPU, persistentes Whisper-Volume.
## Git und bereitgestellte Dateien ## Git und reproduzierbarer Stand
Der Live-Checkout `/opt/mike-ai/stack` zeigt beim Abgleich Git-HEAD `5d8abd4`. Der laufende Stack liegt unter `/opt/mike-ai/stack`. Sein Git-HEAD war
Seine Arbeitsdateien enthalten jedoch neuere Änderungen und zusätzliche `276df0e` und damit älter als der aktuelle Git-Stand; `compose.yaml` und
Spezialdienste. Der HEAD ist daher **kein Nachweis der laufenden Buildversion**. `services/athena-realtime-voice/` sind im Live-Checkout nicht committed.
Das b10930-Update wurde in Gitea mit Commit `2415b27` dokumentiert und gepinnt. **Die geprüften Nutzdaten dieser Dateien stimmen aber bytegenau mit dem
Dieses Dokumentationsupdate gleicht die zentralen Markdown-Dateien zwischen neueren Git-Stand überein.** Ein frischer Clone liefert damit den Quellcode
Git und Athena ab; es setzt den Live-Checkout nicht zurück und übernimmt und die Compose-Definitionen; er liefert weder lokale Secrets noch
nicht pauschal seine übrigen uncommitteten Änderungen. Modellgewichte oder persistente Nutzerdaten. Vor einem Deploy ist die
Ein frischer Clone ist deshalb noch kein vollständiges Abbild aller Live-Dienste. Live-Konfiguration zu sichern und mit dem Checkout abzugleichen, statt den
laufenden Host blind zurückzusetzen.
## Prüfumfang und Belege Die Applio-UI hat einen eigenen Checkout `/opt/mike-ai/Mikes-Applio-UI`.
Sein Git-HEAD `3a06139` ist älter als Doggo `eadbc15`. Die laufende
Anwendungsquelle stimmt bis auf Versionsmetadaten und den später
korrigierten Dokumentationsstand mit Doggo überein. Siehe
[Applio-Integrationsdoku](https://git.casaderoll.de/michael/Mikes-applio-ui/src/branch/main/docs/ATHENA-INTEGRATION.md).
Alle fünf Textprofile bestanden kurze Textproben. Für Uncensored und Medium ## Backup und Prüfumfang
wurden zusätzlich Tools und Vision geprüft; Uncensored bestand einen
72.802-Token-Kontexttest. Kein Vollkontext- oder Langzeittest aller Profile.
Die übrigen Spezialcontainer wurden bei diesem Abgleich nur inventarisiert.
- [Build, Tests und Rückfall](LLAMA_B10930_UPDATE_20260912.md) `mike-ai-backup` lief; der jüngste geprüfte manuelle Archivlauf schloss
- [FLUX-Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md) Compose und Voice-Bridge ein. Der Fünf-Stunden-Export-Timer war aktiv, der
- [Container-Inventar](CONTAINER_INVENTORY.md) externe Restic-Timer zwar ebenfalls aktiviert, aber ohne seine erforderliche
- [Backup-Stand](RECOVERY.md) `/etc/mike-ai/disaster-backup.env` **nicht** als funktionierende externe
- [Verbindliche Host-Regeln](REMOTE_HOST_RULES.md) Sicherung zu werten. Details und Restore-Grenzen: [Backup](RECOVERY.md).
Geprüft wurden aktuelle Container- und Quellenstände sowie ausgewählte
Health-Endpunkte. Keine erneuten Bild-, Langkontext-, Trainings- oder
Restore-Tests; ältere Ergebnisse sind im [Update-Audit](UPDATE_AUDIT_20260915.md)
und [FLUX-Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md) dokumentiert.
+17 -9
View File
@@ -6,7 +6,7 @@
`/data/docker-backups` (14 Tage Aufbewahrung). Die aktuell geprüften Mounts sichern: `/data/docker-backups` (14 Tage Aufbewahrung). Die aktuell geprüften Mounts sichern:
- `/etc/mike-ai` einschließlich lokaler Konfiguration und Secrets, - `/etc/mike-ai` einschließlich lokaler Konfiguration und Secrets,
- `/opt/mike-ai` einschließlich des bereitgestellten, teilweise uncommitteten Stacks, - `/opt/mike-ai` einschließlich der bereitgestellten Checkouts,
- die Volumes `router-images`, `router-state` und `portainer_data`. - die Volumes `router-images`, `router-state` und `portainer_data`.
Der neue WebRTC-Sprachadapter liegt unter Der neue WebRTC-Sprachadapter liegt unter
@@ -22,13 +22,15 @@ Piper-Daten sind kein aktueller Sicherungsbestand. Modellgewichte unter
Backup-Mounts. Ein Backup ausschließlich auf `/data` schützt nicht vor deren Ausfall. Backup-Mounts. Ein Backup ausschließlich auf `/data` schützt nicht vor deren Ausfall.
Die verschlüsselten Notfallpakete über `athena-export-backup.timer` laufen Die verschlüsselten Notfallpakete über `athena-export-backup.timer` laufen
ebenfalls im Fünf-Stunden-Takt; der letzte geprüfte Lauf war erfolgreich. Sie ebenfalls im Fünf-Stunden-Takt; beim Abgleich war der Timer aktiv und der
letzte Lauf am 16. September 2026 um 13:50 Uhr verzeichnet. Sie
liegen unter `/data/emergency-backups`. Schutz vor Datenplattenausfall setzt liegen unter `/data/emergency-backups`. Schutz vor Datenplattenausfall setzt
eine außerhalb Athenas aufbewahrte Kopie voraus. eine außerhalb Athenas aufbewahrte Kopie voraus.
Die externe Restic-Sicherung über `athena-disaster-backup.timer` ist derzeit Die externe Restic-Sicherung über `athena-disaster-backup.timer` ist derzeit
nicht eingerichtet: `/etc/mike-ai/disaster-backup.env` fehlt. Bis ein externes nicht eingerichtet: Der Timer ist zwar aktiviert, aber
Ziel konfiguriert und die Sicherung aktiviert wurde, darf diese Ebene nicht als `/etc/mike-ai/disaster-backup.env` fehlt. Bis ein externes
Ziel konfiguriert und ein erfolgreicher Lauf geprüft wurde, darf diese Ebene nicht als
vorhandener Schutz eingeplant werden. Ein vollständiger Restore wurde in vorhandener Schutz eingeplant werden. Ein vollständiger Restore wurde in
diesem Auftrag nicht ausgeführt. diesem Auftrag nicht ausgeführt.
@@ -51,17 +53,23 @@ konfiguriert und aktiviert ist, ohnehin das gesamte Verzeichnis
### Wiederherstellung und Versionsgrenze ### Wiederherstellung und Versionsgrenze
Der bereitgestellte Quellstand muss aus der Sicherung erhalten bleiben: Die geprüften Quell- und Compose-Dateien liegen im Git; ein frischer Clone
Ein frischer Git-Clone enthält noch nicht sämtliche Live-Anpassungen und enthält jedoch keine Secrets, Modellgewichte, Trainingsdaten oder sonstigen
Spezialdienste, siehe [Live-Stand](LIVE_STATE.md). Vor einem Restore sind persistenten Nutzerdaten. Die lokalen `/etc/mike-ai`-Werte und die
Backup-Archive bleiben daher für eine vollständige Wiederherstellung nötig.
Die alten Live-Checkouts zeigen zudem ältere Commits als Doggo, obwohl die
geprüften Quelldateien inhaltlich übereinstimmen; siehe [Live-Stand](LIVE_STATE.md).
Vor einem Restore sind
Archivinhalt, Aktualität und Kompatibilität der zugehörigen Restore-Skripte Archivinhalt, Aktualität und Kompatibilität der zugehörigen Restore-Skripte
zu prüfen. Bestehende lokale Änderungen niemals blind überschreiben. zu prüfen. Bestehende lokale Änderungen niemals blind überschreiben.
Die Host-Regel gilt unverändert: **Athena niemals herunterfahren oder neu Die Host-Regel gilt unverändert: **Athena niemals herunterfahren oder neu
starten und ihre Erreichbarkeit nicht gefährden.** Eine Neuinstallation ist starten und ihre Erreichbarkeit nicht gefährden.** Eine Neuinstallation ist
keine normale Wartungsmaßnahme am erreichbaren Remote-Host. keine normale Wartungsmaßnahme am erreichbaren Remote-Host.
Für den begrenzten Rückfall des Modellservers stehen altes Image und gesicherte Für einen begrenzten Rückfall des Modellservers den aktuellen
Startkonfiguration im [b10930-Updatebericht](LLAMA_B10930_UPDATE_20260912.md). [Updatebericht](UPDATE_AUDIT_20260915.md) und die tatsächlich vorhandenen
lokalen Images prüfen. Der [b10930-Bericht](LLAMA_B10930_UPDATE_20260912.md)
beschreibt nur einen älteren Stand.
## Unraid ## Unraid
+10 -5
View File
@@ -1,4 +1,4 @@
# Athena realtime voice bridge (experimental) # Athena realtime voice bridge
This independent service lets OpenClaw's existing browser Talk UI use Athena This independent service lets OpenClaw's existing browser Talk UI use Athena
Whisper, OpenClaw's agent, and Athena Qwen3-TTS through the browser's supported Whisper, OpenClaw's agent, and Athena Qwen3-TTS through the browser's supported
@@ -69,7 +69,7 @@ cd /opt/mike-ai/stack
docker compose --env-file /etc/mike-ai/stack.env up -d --no-deps --build realtime-voice docker compose --env-file /etc/mike-ai/stack.env up -d --no-deps --build realtime-voice
``` ```
OpenClaw 2026.9.4 uses the `athena-talk` plugin version 1.1.0 with OpenClaw 2026.9.4 uses the `athena-talk` plugin version 1.2.1 with
`talk.realtime.transport` set to `webrtc` and `talk.realtime.transport` set to `webrtc` and
`talk.realtime.providers.athena-talk.realtimeUpstreamUrl` set to `talk.realtime.providers.athena-talk.realtimeUpstreamUrl` set to
`http://192.168.1.212:8090/v1/realtime/calls`. On the Mac, turn off `http://192.168.1.212:8090/v1/realtime/calls`. On the Mac, turn off
@@ -91,8 +91,13 @@ python3.11 -m venv .venv
The synthetic microphone test passed over the actual OpenClaw HTTPS offer The synthetic microphone test passed over the actual OpenClaw HTTPS offer
route and WireGuard media path with production Whisper and Qwen3-TTS on route and WireGuard media path with production Whisper and Qwen3-TTS on
2026-09-16. It supplied a fake agent result; it does not prove that the Mac 2026-09-16. Subsequent real browser Talk sessions successfully transcribed
or browser UI completes a real agent-consult turn. Keep this integration and answered multiple user turns. Browser dictation through the same plugin
experimental until that UI round trip has been observed. also produced text after a correction to its separate transcription path.
The first user report of a second turn becoming stuck was addressed by
matching conversation item and predecessor IDs; the later two-turn test
passed. This is still half-duplex and needs a private route for WebRTC media.
The plugin's additional support for uploaded M4A voice notes is documented
in `integrations/openclaw-athena-talk/README.md`.
For isolated tests, `ATHENA_TALK_REALTIME_SECRET` can replace For isolated tests, `ATHENA_TALK_REALTIME_SECRET` can replace
`OPENCLAW_PUBLIC_KEY_URL`; do not use that test mode in the deployed setup. `OPENCLAW_PUBLIC_KEY_URL`; do not use that test mode in the deployed setup.