diff --git a/ATHENA.md b/ATHENA.md
index 4c4f433..b560d51 100644
--- a/ATHENA.md
+++ b/ATHENA.md
@@ -1,10 +1,13 @@
# Athena – Betriebsanleitung
-Stand: **12. September 2026**, auf Athena geprüft. Produktiv läuft
-**llama.cpp b10930** (`56381e407c0ccfb3a6f71e668a27a901001d22ce`).
+Stand: **16. September 2026**, auf Athena geprüft. Die fünf Textprofil-Images
+tragen **llama.cpp b29c606** (0.4.1).
Der [geprüfte Live-Stand](docs/LIVE_STATE.md) beschreibt Profile, GPUs und die
Abweichung zwischen dem bereitgestellten Stack und dem Git-Checkout.
-Der [Updatebericht](docs/LLAMA_B10930_UPDATE_20260912.md) enthält Tests und Rückfallstand.
+Der [Updatebericht vom 15. September](docs/UPDATE_AUDIT_20260915.md)
+enthält die aktuellen Build- und Testbelege. Der ältere
+[b10930-Bericht](docs/LLAMA_B10930_UPDATE_20260912.md) dokumentiert einen
+früheren Stand und ist keine aktuelle Startanleitung.
Diese Datei ist der kurze, verbindliche Einstieg für Menschen und Agenten.
@@ -19,12 +22,14 @@ Sie betreibt:
- den OpenAI-kompatiblen Profile Router,
- FLUX.2 Klein 9B FP8 Beta für Textbilder und Referenzbild-Bearbeitung,
- Qwen3-TTS und TTS-Gateway für Sprache,
+- Whisper.cpp und die WebRTC-Brücke für OpenClaw Talk,
+- die GPU-lose Mikes-Applio-UI als gesonderten Checkout,
- das Athena-Dashboard,
- Portainer CE als optionale Ansicht auf die laufenden Docker-Container,
- WireGuard-Gateway und Datenbackup,
- den hostgebundenen Athena-Operator.
-Hermes, Benutzeroberfläche und portable Fach-MCPs laufen auf Unraid. Auf Athena
+Hermes, OpenClaw und portable Fach-MCPs laufen auf Unraid. Auf Athena
werden keine zweiten Instanzen dieser Dienste angelegt.
## Pfade
diff --git a/README.md b/README.md
index 5980432..b351c6a 100644
--- a/README.md
+++ b/README.md
@@ -1,6 +1,6 @@
# Athena AI
-Stand: **15. September 2026**, auf Athena geprüft. Produktiv läuft
+Stand: **16. September 2026**, auf Athena geprüft. Die Textprofil-Images verwenden
**llama.cpp 0.4.1** (`b29c606`).
Der [geprüfte Live-Stand](docs/LIVE_STATE.md) beschreibt Profile, GPUs und die
Abweichung zwischen dem bereitgestellten Stack und dem Git-Checkout.
@@ -10,7 +10,7 @@ enthält Versionsvergleich, Tests und Rückfallstand.
Athena ist die lokale Inferenzmaschine. Der Docker-Stack stellt
Qwen über eine kleine OpenAI-kompatible Router-API bereit und übernimmt lokale
-Bild- und Sprachausgabe. **Hermes und die Fach-MCPs laufen auf Unraid.**
+Bild- und Sprachausgabe. **Hermes, OpenClaw und die Fach-MCPs laufen auf Unraid.**
## Aktueller Aufbau
diff --git a/docs/ARCHITECTURE.md b/docs/ARCHITECTURE.md
index 578b3f4..5983ed6 100644
--- a/docs/ARCHITECTURE.md
+++ b/docs/ARCHITECTURE.md
@@ -3,6 +3,12 @@
```mermaid
flowchart LR
C[Hermes Desktop / Web / Mobil] --> H[Hermes Agent
Unraid]
+ OC[OpenClaw Web / Mac
Unraid-Gateway] -->|OpenAI API| R
+ OC --> V[Athena-Talk-Plugin
Unraid]
+ V --> RV[Realtime-Voice-Brücke
Athena, WebRTC]
+ RV --> STT
+ RV --> T
+ RV -->|Agentenantwort| OC
H -->|OpenAI API| R[Profile Router
Athena :8081]
R --> P[Profile Controller]
P --> Q[genau ein llama.cpp-Profil
Qwen Fast / Medium / Large / Ultra / Uncensored]
@@ -22,10 +28,11 @@ flowchart LR
W --- B[Athena Dashboard :8099]
W --- PRT[Portainer :9443
optionale Docker-Ansicht]
W --- O[Athena Operator]
+ W --- AP[Mikes-Applio-UI
eigener Checkout, GPU-los]
K[Backup alle 5 Stunden] --> DATA[/data und /etc/mike-ai]
```
-Stand: 12. September 2026. Versionen und Abweichungen: [Live-Stand](LIVE_STATE.md).
+Stand: 16. September 2026. Versionen und Abweichungen: [Live-Stand](LIVE_STATE.md).
FLUX nutzt beide GPUs und pausiert dafür LLM und Qwen3-TTS. Dashboard und
Portainer besitzen eigene Netzwerk-Namespaces in `mike-ai_frontend`; der Router
läuft in `mike-ai_control`. Der Gateway vermittelt den privaten Zugriff.
diff --git a/docs/CONTAINER_INVENTORY.md b/docs/CONTAINER_INVENTORY.md
index 23b3e0d..cb356c9 100644
--- a/docs/CONTAINER_INVENTORY.md
+++ b/docs/CONTAINER_INVENTORY.md
@@ -1,8 +1,8 @@
# Container-Inventar auf Athena
-Stand: 15. September 2026
+Stand: 16. September 2026 (lesender Docker-Abgleich)
-Athena besteht beim lesenden Abgleich aus 25 Docker-Containern. Nicht jeder Container enthält
+Athena hatte beim lesenden Abgleich 27 Docker-Container. Nicht jeder Container enthält
ein KI-Modell: Router, Oberflächen, Netzwerk, Steuerung und Sicherung sind
gewöhnliche Dienste. Die rechenintensiven GPU-Worker werden absichtlich nur bei
Bedarf gestartet. Ein Container im Zustand `Created` oder `Exited (0)` ist daher
@@ -19,12 +19,13 @@ nicht automatisch ein ungenutzter Rest.
| `mike-ai-llama-medium` | Qwen3.8-27B `IQ4_XS-pure`, Qwen-MMProj BF16 | Standard-Q4-Text-/Vision-Profil mit 160.000 Token Kontext und Verteilung auf beide GPUs. |
| `mike-ai-llama-ultra` | Qwen3.8-27B `IQ4_XS-pure`, ohne Vision-Projektor | Maximales Langkontextprofil mit 262.144 Token Kontext und Verteilung auf beide GPUs. |
| `mike-ai-llama-uncensored` | Qwen3.8-27B Abliterated `Q4_K_M`, eigener MMProj F16 | Spezialprofil mit 80.000 Token Kontext und gelockerten Modellgrenzen. |
+| `mike-ai-ltx2-studio` | LTX-Video-Backend | GPU-Worker für lokale Videogenerierung; beim Abgleich gestoppt. |
| `mike-ai-mcp-athena-operator` | kein Modell | Stellt Hermes begrenzte Werkzeuge zum Prüfen, Ändern, Testen, Sichern und Versionieren von Athena bereit. |
| `mike-ai-music-acestep-test` | ACE-Step 1.5 XL-SFT und `acestep-5Hz-lm-1.7B` | Generiert Musik im exklusiven Musikmodus auf der RTX 5080. |
| `mike-ai-music-ui` | kein Modell; `fspecii/ace-step-ui` | Community-Oberfläche für ACE-Step; bleibt als leichte UI verfügbar, während der GPU-Worker bedarfsgesteuert läuft. |
| `mike-ai-portainer` | kein Modell; Portainer CE | Optionale Docker-Verwaltungsoberfläche. |
| `mike-ai-profile-controller` | kein Modell | Startet und stoppt ausschließlich freigegebene Modellprofile und Spezialworker in einer sicheren Reihenfolge. |
-| `mike-ai-realtime-voice` | kein Modell | Experimentelle WebRTC-Brücke für OpenClaw Talk; verbindet über den privaten WireGuard-Pfad Athena Whisper, OpenClaw-Agent und Qwen3-TTS ohne Profilwechsel. |
+| `mike-ai-realtime-voice` | kein Modell | Laufende, gesunde WebRTC-Brücke für OpenClaw Talk; verbindet über den privaten WireGuard-Pfad Athena Whisper, OpenClaw-Agent und Qwen3-TTS ohne Profilwechsel. |
| `mike-ai-qwen3-tts` | `Qwen/Qwen3-TTS-12Hz-1.7B-Base`, Stimme Serena | Hochwertige deutsche Sprachausgabe auf der RTX 3060 im LLM-Betrieb. |
| `mike-ai-router` | kein eigenes Modell | Einzige OpenAI-kompatible Modelladresse; koordiniert Profile, Bildaufträge, Sprache und Betriebsarten. |
| `mike-ai-stem-separator` | BS-RoFormer Viperx 1297, `htdemucs_ft`, `htdemucs_6s`, `MossFormer2_SE_48K` | Trennt Gesang, Instrumente oder Sprache/Hintergrundgeräusche im exklusiven Separationsmodus. |
@@ -37,10 +38,12 @@ nicht automatisch ein ungenutzter Rest.
| `mike-ai-trellis-studio` | Image `mike-ai/trellis-studio:0.6.0-q8` | Vorhandener, gestoppter 3D-Worker; in diesem Abgleich nicht funktional getestet. |
| `mike-ai-mikes-applio-ui` | Image `mike-ai/mikes-applio-ui:latest` | Laufende zusätzliche Applio-Oberfläche. |
-Alle fünf llama-Container verwenden llama.cpp 0.4.1 (`b29c606`). Beim Abgleich lief Medium;
-die anderen vier waren gestoppt. Der Image-Worker stand auf Created.
-Die übrigen GPU-Spezialworker waren gestoppt, die Infrastruktur und die
-Musik-/Applio-Oberflächen liefen. Diese Zustände ändern sich mit der Nutzung.
+Alle fünf llama-Container verwenden llama.cpp 0.4.1 (`b29c606`). Medium
+lief beim ersten Abgleich, war später aber mit Exit-Code 139 beendet; die
+anderen vier waren nicht aktiv. Dieser Laufzeitfehler wurde im Zuge der
+Dokumentationsarbeit nicht behoben. Der Image-Worker war ebenfalls gestoppt.
+Die Infrastruktur und die Musik-/Applio-Oberflächen liefen. Diese Zustände
+ändern sich mit der Nutzung.
Die Detailbeschreibungen der Spezialmodelle stammen aus der bestehenden
Betriebsdokumentation; dieses Update prüfte deren Containerbestand, nicht
sämtliche Modellgewichte oder Funktionen neu.
diff --git a/docs/LIVE_STATE.md b/docs/LIVE_STATE.md
index 01e87cd..06bd24c 100644
--- a/docs/LIVE_STATE.md
+++ b/docs/LIVE_STATE.md
@@ -1,68 +1,88 @@
# Geprüfter Live-Stand auf Athena
-Stand: 12. September 2026. Quelle: SSH-Abgleich von Containerbestand,
-Startkonfiguration und den dokumentierten Laufzeittests auf Athena.
+Stand: **16. September 2026**. Quelle: lesender SSH-Abgleich von Docker,
+Compose-Dateien, Git-Inhalten, Images, Health-Endpunkten und Backup-Timern.
+Containerzustände sind Momentaufnahmen; der Controller darf Profile danach
+umschalten. Es wurde für diesen Abgleich kein Dienst neu gestartet.
## Laufzeit und Profile
-Debian 13, RTX 5080 mit 16 GB und RTX 3060 mit 12 GB.
-Alle fünf Textprofilcontainer verwenden llama.cpp **b10930**, Commit
-`56381e407c0ccfb3a6f71e668a27a901001d22ce`, Image `mike-ai/llama.cpp:local`
-beziehungsweise `mike-ai/llama.cpp:b10930`.
-Image-ID: `sha256:c9d78a9375143877574f3d7c6e0dea94ecfebb264e8dd9f57ac4e03f1c96044e`.
-Die Startoption lautet `--load-mode none`; `--no-mmap` ist entfernt.
+Athena: Debian 13, RTX 5080 (16 GB) und RTX 3060 (12 GB). Die fünf
+Textprofil-Images tragen alle `com.mike-ai.llama-cpp-commit=b29c606`
+(llama.cpp 0.4.1). Sie verwenden `--load-mode none`, `--parallel 1` und
+`--batch-size 2048`. Die `ubatch-size` wurde pro Profil auf einen getesteten
+Wert gesetzt; sie ist **nicht** überall identisch.
-| Profil | Qwen3.8-27B-Variante | Kontext | GPU-Konfiguration 5080:3060 | Vision | MTP Draft |
-|---|---|---:|---|---|---:|
-| Fast | IQ4-MIX | 76.800 | Textmodell nur 5080 | ja | 2 |
-| Medium | IQ4_XS Pure | 160.000 | 85:15 | ja | 3 |
-| Large | IQ4_XS Pure | 192.000 | 86:14 | ja | 3 |
-| Ultra | IQ4_XS Pure | 262.144 | 80:20 | nein | 2 |
-| Uncensored | Abliterated Q4_K_M | 80.000 | 90:10 | ja | 2 |
+| Profil | Qwen3.8-27B-Variante | Kontext | Tensor-Split 5080:3060 | Vision-Projektor | MTP Draft | ubatch |
+|---|---|---:|---|---|---:|---:|
+| Fast | IQ4-MIX | 76.800 | nur 5080 | 3060 | 2 | 64 |
+| Medium | IQ4_XS Pure | 160.000 | 85:15 | 3060 | 3 | 512 |
+| Large | IQ4_XS Pure | 192.000 | 86:14 | 3060 | 3 | 256 |
+| Ultra | IQ4_XS Pure | 262.144 | 80:20 | keiner | 2 | 128 |
+| Uncensored | Abliterated Q4_K_M | 80.000 | 90:10 | 3060 | 2 | 256 |
-Alle Profile nutzen einen Slot. Die GPU-Verhältnisse sind konfigurierte
-Tensor-Splits, keine gemessenen VRAM-Prozentsätze; KV-Cache, Projektor und
-weitere Dienste benötigen zusätzlich Speicher. Uncensored nutzt beide Karten,
-der Vision-Projektor liegt auf der 3060.
+Tensor-Splits sind Startparameter, keine gemessenen VRAM-Anteile. Der
+Vision-Projektor liegt bei den vier Vision-Profilen auf GPU 1 (3060).
+`beta1` steht in der Repository-Matrix, ist aber nicht installiert. Der
+Router bietet nur die fünf installierten Profile an. Beim ersten Abgleich
+war Medium aktiv und der Router im LLM-Modus; beim späteren Containerabgleich
+war `mike-ai-llama-medium` mit Exit-Code 139 beendet. Dieser Laufzeitfehler
+wurde bei der Dokumentationsarbeit nicht behoben oder durch einen Neustart
+verdeckt. Der aktuelle Zustand ist über Dashboard/Controller zu prüfen.
-Im LLM-Modus läuft genau ein Textprofil. Zum Abschluss des Buildtests war
-Uncensored aktiv; beim späteren Dokumentationsabgleich war Medium aktiv.
-Das aktive Profil ist ein veränderlicher Betriebszustand.
-`beta1` steht zusätzlich in der Repository-Matrix, ist auf Athena aber nicht
-installiert und wurde beim Update nicht getestet.
+## Weitere Dienste
-## Bild und Sprache
+- FLUX.2 Klein 9B FP8 Beta: Transformer/VAE auf 5080, Qwen3-8B-NF4-
+ Textencoder auf 3060. Produktiv freigegeben sind höchstens 1024 × 1024,
+ vier Schritte, Guidance 1, vier Referenzbilder und 128 Encoder-Tokens.
+ 1280 × 1280 lief im Test in CUDA-OOM.
+- Qwen3-TTS 1.7B auf 3060 hinter dem TTS-Gateway; kein Piper-Fallback.
+- Whisper.cpp `ggml-small` auf CPU über `/v1/audio/transcriptions`.
+- Der gesunde Dienst `mike-ai-realtime-voice` vermittelt OpenClaw Talk über
+ WebRTC zwischen Whisper, dem normalen OpenClaw-Agenten und Qwen3-TTS.
+ Er braucht keine GPU und keinen Profilwechsel. Das Plugin liegt in
+ `integrations/openclaw-athena-talk` und läuft auf Unraid, nicht auf Athena.
+ Diktat und hochgeladene M4A-Sprachnachrichten nutzen den separaten
+ Transkriptionspfad des Plugins. OpenClaw liefert den fertigen Agententext
+ an die Brücke; das Sprechen beginnt daher erst nach Abschluss der
+ Agentenantwort. Details und Grenzen stehen in der [Voice-Doku](../services/athena-realtime-voice/README.md).
+- `mike-ai-mikes-applio-ui` läuft gesund und ohne GPU. Die Quelle liegt im
+ eigenen Repository [Mikes-Applio-UI](https://git.casaderoll.de/michael/Mikes-applio-ui).
+ Der Applio-GPU-Container war beim Abgleich nicht gestartet. Die UI kann
+ trotzdem Status, Modelle und vorbereitende Aufgaben anzeigen; eine echte
+ Konvertierung verlangt den Applio-Modus.
-- FLUX.2 Klein **9B FP8 Beta**, Transformer und VAE auf 5080,
- Qwen3-8B-Textencoder in NF4 auf 3060.
-- Bildaufträge pausieren LLM und Qwen3-TTS und stellen sie danach wieder her.
- Produktiv maximal 1024 × 1024, vier Schritte, Guidance 1,
- höchstens vier Referenzbilder und 128 Textencoder-Tokens.
-- 1024 × 1024 erfolgreich; 1280 × 1280 CUDA-OOM. Zwischenwerte und höhere
- Größen nicht geprüft. Keine Freigabe oberhalb 1024.
-- Qwen3-TTS 1.7B auf 3060 hinter TTS-Gateway. Kein Piper-Container/Fallback.
-- Whisper.cpp small (`/models/ggml-small.bin`) auf CPU, persistentes Whisper-Volume.
+Der vollständige Bestand der **27** angelegten Docker-Container steht im
+[Container-Inventar](CONTAINER_INVENTORY.md). `Created` oder `Exited` bei
+Spezialworkern bedeutet nicht automatisch einen zu entfernenden Testrest.
-## Git und bereitgestellte Dateien
+## Git und reproduzierbarer Stand
-Der Live-Checkout `/opt/mike-ai/stack` zeigt beim Abgleich Git-HEAD `5d8abd4`.
-Seine Arbeitsdateien enthalten jedoch neuere Änderungen und zusätzliche
-Spezialdienste. Der HEAD ist daher **kein Nachweis der laufenden Buildversion**.
-Das b10930-Update wurde in Gitea mit Commit `2415b27` dokumentiert und gepinnt.
-Dieses Dokumentationsupdate gleicht die zentralen Markdown-Dateien zwischen
-Git und Athena ab; es setzt den Live-Checkout nicht zurück und übernimmt
-nicht pauschal seine übrigen uncommitteten Änderungen.
-Ein frischer Clone ist deshalb noch kein vollständiges Abbild aller Live-Dienste.
+Der laufende Stack liegt unter `/opt/mike-ai/stack`. Sein Git-HEAD war
+`276df0e` und damit älter als der aktuelle Git-Stand; `compose.yaml` und
+`services/athena-realtime-voice/` sind im Live-Checkout nicht committed.
+**Die geprüften Nutzdaten dieser Dateien stimmen aber bytegenau mit dem
+neueren Git-Stand überein.** Ein frischer Clone liefert damit den Quellcode
+und die Compose-Definitionen; er liefert weder lokale Secrets noch
+Modellgewichte oder persistente Nutzerdaten. Vor einem Deploy ist die
+Live-Konfiguration zu sichern und mit dem Checkout abzugleichen, statt den
+laufenden Host blind zurückzusetzen.
-## Prüfumfang und Belege
+Die Applio-UI hat einen eigenen Checkout `/opt/mike-ai/Mikes-Applio-UI`.
+Sein Git-HEAD `3a06139` ist älter als Doggo `eadbc15`. Die laufende
+Anwendungsquelle stimmt bis auf Versionsmetadaten und den später
+korrigierten Dokumentationsstand mit Doggo überein. Siehe
+[Applio-Integrationsdoku](https://git.casaderoll.de/michael/Mikes-applio-ui/src/branch/main/docs/ATHENA-INTEGRATION.md).
-Alle fünf Textprofile bestanden kurze Textproben. Für Uncensored und Medium
-wurden zusätzlich Tools und Vision geprüft; Uncensored bestand einen
-72.802-Token-Kontexttest. Kein Vollkontext- oder Langzeittest aller Profile.
-Die übrigen Spezialcontainer wurden bei diesem Abgleich nur inventarisiert.
+## Backup und Prüfumfang
-- [Build, Tests und Rückfall](LLAMA_B10930_UPDATE_20260912.md)
-- [FLUX-Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md)
-- [Container-Inventar](CONTAINER_INVENTORY.md)
-- [Backup-Stand](RECOVERY.md)
-- [Verbindliche Host-Regeln](REMOTE_HOST_RULES.md)
+`mike-ai-backup` lief; der jüngste geprüfte manuelle Archivlauf schloss
+Compose und Voice-Bridge ein. Der Fünf-Stunden-Export-Timer war aktiv, der
+externe Restic-Timer zwar ebenfalls aktiviert, aber ohne seine erforderliche
+`/etc/mike-ai/disaster-backup.env` **nicht** als funktionierende externe
+Sicherung zu werten. Details und Restore-Grenzen: [Backup](RECOVERY.md).
+
+Geprüft wurden aktuelle Container- und Quellenstände sowie ausgewählte
+Health-Endpunkte. Keine erneuten Bild-, Langkontext-, Trainings- oder
+Restore-Tests; ältere Ergebnisse sind im [Update-Audit](UPDATE_AUDIT_20260915.md)
+und [FLUX-Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md) dokumentiert.
diff --git a/docs/RECOVERY.md b/docs/RECOVERY.md
index ce7d50d..4e51e98 100644
--- a/docs/RECOVERY.md
+++ b/docs/RECOVERY.md
@@ -6,7 +6,7 @@
`/data/docker-backups` (14 Tage Aufbewahrung). Die aktuell geprüften Mounts sichern:
- `/etc/mike-ai` einschließlich lokaler Konfiguration und Secrets,
-- `/opt/mike-ai` einschließlich des bereitgestellten, teilweise uncommitteten Stacks,
+- `/opt/mike-ai` einschließlich der bereitgestellten Checkouts,
- die Volumes `router-images`, `router-state` und `portainer_data`.
Der neue WebRTC-Sprachadapter liegt unter
@@ -22,13 +22,15 @@ Piper-Daten sind kein aktueller Sicherungsbestand. Modellgewichte unter
Backup-Mounts. Ein Backup ausschließlich auf `/data` schützt nicht vor deren Ausfall.
Die verschlüsselten Notfallpakete über `athena-export-backup.timer` laufen
-ebenfalls im Fünf-Stunden-Takt; der letzte geprüfte Lauf war erfolgreich. Sie
+ebenfalls im Fünf-Stunden-Takt; beim Abgleich war der Timer aktiv und der
+letzte Lauf am 16. September 2026 um 13:50 Uhr verzeichnet. Sie
liegen unter `/data/emergency-backups`. Schutz vor Datenplattenausfall setzt
eine außerhalb Athenas aufbewahrte Kopie voraus.
Die externe Restic-Sicherung über `athena-disaster-backup.timer` ist derzeit
-nicht eingerichtet: `/etc/mike-ai/disaster-backup.env` fehlt. Bis ein externes
-Ziel konfiguriert und die Sicherung aktiviert wurde, darf diese Ebene nicht als
+nicht eingerichtet: Der Timer ist zwar aktiviert, aber
+`/etc/mike-ai/disaster-backup.env` fehlt. Bis ein externes
+Ziel konfiguriert und ein erfolgreicher Lauf geprüft wurde, darf diese Ebene nicht als
vorhandener Schutz eingeplant werden. Ein vollständiger Restore wurde in
diesem Auftrag nicht ausgeführt.
@@ -51,17 +53,23 @@ konfiguriert und aktiviert ist, ohnehin das gesamte Verzeichnis
### Wiederherstellung und Versionsgrenze
-Der bereitgestellte Quellstand muss aus der Sicherung erhalten bleiben:
-Ein frischer Git-Clone enthält noch nicht sämtliche Live-Anpassungen und
-Spezialdienste, siehe [Live-Stand](LIVE_STATE.md). Vor einem Restore sind
+Die geprüften Quell- und Compose-Dateien liegen im Git; ein frischer Clone
+enthält jedoch keine Secrets, Modellgewichte, Trainingsdaten oder sonstigen
+persistenten Nutzerdaten. Die lokalen `/etc/mike-ai`-Werte und die
+Backup-Archive bleiben daher für eine vollständige Wiederherstellung nötig.
+Die alten Live-Checkouts zeigen zudem ältere Commits als Doggo, obwohl die
+geprüften Quelldateien inhaltlich übereinstimmen; siehe [Live-Stand](LIVE_STATE.md).
+Vor einem Restore sind
Archivinhalt, Aktualität und Kompatibilität der zugehörigen Restore-Skripte
zu prüfen. Bestehende lokale Änderungen niemals blind überschreiben.
Die Host-Regel gilt unverändert: **Athena niemals herunterfahren oder neu
starten und ihre Erreichbarkeit nicht gefährden.** Eine Neuinstallation ist
keine normale Wartungsmaßnahme am erreichbaren Remote-Host.
-Für den begrenzten Rückfall des Modellservers stehen altes Image und gesicherte
-Startkonfiguration im [b10930-Updatebericht](LLAMA_B10930_UPDATE_20260912.md).
+Für einen begrenzten Rückfall des Modellservers den aktuellen
+[Updatebericht](UPDATE_AUDIT_20260915.md) und die tatsächlich vorhandenen
+lokalen Images prüfen. Der [b10930-Bericht](LLAMA_B10930_UPDATE_20260912.md)
+beschreibt nur einen älteren Stand.
## Unraid
diff --git a/services/athena-realtime-voice/README.md b/services/athena-realtime-voice/README.md
index 37d29e7..464970a 100644
--- a/services/athena-realtime-voice/README.md
+++ b/services/athena-realtime-voice/README.md
@@ -1,4 +1,4 @@
-# Athena realtime voice bridge (experimental)
+# Athena realtime voice bridge
This independent service lets OpenClaw's existing browser Talk UI use Athena
Whisper, OpenClaw's agent, and Athena Qwen3-TTS through the browser's supported
@@ -69,7 +69,7 @@ cd /opt/mike-ai/stack
docker compose --env-file /etc/mike-ai/stack.env up -d --no-deps --build realtime-voice
```
-OpenClaw 2026.9.4 uses the `athena-talk` plugin version 1.1.0 with
+OpenClaw 2026.9.4 uses the `athena-talk` plugin version 1.2.1 with
`talk.realtime.transport` set to `webrtc` and
`talk.realtime.providers.athena-talk.realtimeUpstreamUrl` set to
`http://192.168.1.212:8090/v1/realtime/calls`. On the Mac, turn off
@@ -91,8 +91,13 @@ python3.11 -m venv .venv
The synthetic microphone test passed over the actual OpenClaw HTTPS offer
route and WireGuard media path with production Whisper and Qwen3-TTS on
-2026-09-16. It supplied a fake agent result; it does not prove that the Mac
-or browser UI completes a real agent-consult turn. Keep this integration
-experimental until that UI round trip has been observed.
+2026-09-16. Subsequent real browser Talk sessions successfully transcribed
+and answered multiple user turns. Browser dictation through the same plugin
+also produced text after a correction to its separate transcription path.
+The first user report of a second turn becoming stuck was addressed by
+matching conversation item and predecessor IDs; the later two-turn test
+passed. This is still half-duplex and needs a private route for WebRTC media.
+The plugin's additional support for uploaded M4A voice notes is documented
+in `integrations/openclaw-athena-talk/README.md`.
For isolated tests, `ATHENA_TALK_REALTIME_SECRET` can replace
`OPENCLAW_PUBLIC_KEY_URL`; do not use that test mode in the deployed setup.