Update Athena runtimes and sync live extensions

This commit is contained in:
Mikei386
2026-09-15 08:01:40 +02:00
parent aaa96bbed5
commit 2b727a4d7f
14 changed files with 728 additions and 33 deletions
+4 -4
View File
@@ -1,6 +1,6 @@
# Container-Inventar auf Athena
Stand: 12. September 2026
Stand: 15. September 2026
Athena besteht beim lesenden Abgleich aus 25 Docker-Containern. Nicht jeder Container enthält
ein KI-Modell: Router, Oberflächen, Netzwerk, Steuerung und Sicherung sind
@@ -10,7 +10,7 @@ nicht automatisch ein ungenutzter Rest.
| Container | Modell oder wesentliche Komponente | Aufgabe |
|---|---|---|
| `mike-ai-backup` | kein Modell; Offen Docker Volume Backup | Sichert `/data`, `/etc/mike-ai`, den Stack und die persistenten Docker-Volumes im Fünf-Stunden-Takt. |
| `mike-ai-backup` | kein Modell; Offen Docker Volume Backup `v2` (Digest vom 15. September 2026) | Sichert `/data`, `/etc/mike-ai`, den Stack und die persistenten Docker-Volumes im Fünf-Stunden-Takt. |
| `mike-ai-applio-studio` | Applio/RVC; Stimmenmodelle werden nutzerseitig ergänzt | Vollständige RVC-Oberfläche für Inferenz, Modellverwaltung und Training auf der RTX 5080. Für eine Konvertierung ist ein importiertes oder trainiertes `.pth`-Modell nötig; eine Referenzaufnahme allein reicht nicht. |
| `mike-ai-image-worker` | FLUX.2 Klein 9B FP8, Qwen3-8B NF4 Textencoder und VAE | Erzeugt und bearbeitet Bilder transaktional; nutzt während eines Auftrags RTX 5080 und RTX 3060. |
| `mike-ai-llama-dashboard` | kein Modell | Zeigt Telemetrie, Profile, GPU-Nutzung und Betriebsarten an und bietet die Modusumschaltung. |
@@ -29,14 +29,14 @@ nicht automatisch ein ungenutzter Rest.
| `mike-ai-stem-separator` | BS-RoFormer Viperx 1297, `htdemucs_ft`, `htdemucs_6s`, `MossFormer2_SE_48K` | Trennt Gesang, Instrumente oder Sprache/Hintergrundgeräusche im exklusiven Separationsmodus. |
| `mike-ai-tts-gateway` | kein eigenes Modell | Normalisiert Text, konvertiert Ausgabeformate und stellt Qwen3-TTS sowie natives PCM-Streaming über eine stabile interne API bereit. |
| `mike-ai-voice-studio` | `k2-fsa/OmniVoice` 0.2.1 mit Whisper-ASR | Erzeugt Text-to-Speech mit einer Referenzstimme; kein Audio-to-Audio-Voice-Changer. |
| `mike-ai-whisper` | Whisper.cpp `ggml-small` | Lokale deutsche Spracherkennung auf der CPU über `/v1/audio/transcriptions`. |
| `mike-ai-whisper` | Whisper.cpp 1.9.4, `ggml-small` | Lokale deutsche Spracherkennung auf der CPU über `/v1/audio/transcriptions`. |
| `mike-ai-wireguard-gateway` | kein Modell | Veröffentlicht Dashboard und Fachoberflächen ausschließlich über den privaten WireGuard-Pfad. |
| `mike-ai-xvc-studio` | `chenxie95/X-VC`, GLM-4-Voice-Tokenizer und optional Resemble Enhance | Wandelt eine vorhandene Sprachaufnahme anhand einer Referenzstimme in Audio zu Audio um; gibt das native 16-kHz-Ergebnis und optional eine neural restaurierte 44,1-kHz-Fassung aus. |
| `mike-ai-yue2-playground` | Image `mike-ai/yue2:3b-0.1.6` | Vorhandener, gestoppter Playground; in diesem Abgleich nicht funktional getestet. |
| `mike-ai-trellis-studio` | Image `mike-ai/trellis-studio:0.6.0-q8` | Vorhandener, gestoppter 3D-Worker; in diesem Abgleich nicht funktional getestet. |
| `mike-ai-mikes-applio-ui` | Image `mike-ai/mikes-applio-ui:latest` | Laufende zusätzliche Applio-Oberfläche. |
Alle fünf llama-Container verwenden b10930. Beim Abgleich lief Medium;
Alle fünf llama-Container verwenden llama.cpp 0.4.1 (`b29c606`). Beim Abgleich lief Medium;
die anderen vier waren gestoppt. Der Image-Worker stand auf Created.
Die übrigen GPU-Spezialworker waren gestoppt, die Infrastruktur und die
Musik-/Applio-Oberflächen liefen. Diese Zustände ändern sich mit der Nutzung.
+9 -5
View File
@@ -1,19 +1,23 @@
# Aktuelle Laufzeitnotizen
Stand: 12. September 2026.
Stand: 15. September 2026.
Der verbindliche Abgleich steht im [geprüften Live-Stand](LIVE_STATE.md).
Produktiv läuft **llama.cpp b10930**, zuvor b10872. Die frühere Angabe b10781
war veraltet. Alle fünf installierten Profile wurden aktualisiert; die
Startoption wurde auf `--load-mode none` migriert.
Produktiv läuft **llama.cpp 0.4.1** auf Commit `b29c606`, zuvor b10930.
Alle fünf installierten Profile verwenden dasselbe CUDA-Image. Die Startoption
bleibt `--load-mode none`.
[B10930-Updatebericht](LLAMA_B10930_UPDATE_20260912.md): Version, Image-ID,
Funktionsproben, Vergleichsmessungen und gesicherter Rückfallstand.
[Update-Audit vom 15. September](UPDATE_AUDIT_20260915.md): aktualisierte
Komponenten, unveränderte aktuelle Komponenten, Aufräumarbeiten und Rollback.
FLUX verwendet **9B FP8 Beta** mit Textencoder auf der RTX 3060.
[Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md): 1024 erfolgreich,
1280 CUDA-OOM; produktive Begrenzung weiterhin 1024.
Sprachausgabe: Qwen3-TTS 1.7B ohne Piper. Spracherkennung: Whisper.cpp small auf CPU.
Sprachausgabe: Qwen3-TTS 1.7B ohne Piper. Spracherkennung: Whisper.cpp 1.9.4
mit dem Modell `small` auf der CPU. Applio basiert auf dem stabilen Release 3.6.4.
Datierte ältere Testberichte beschreiben ihre damaligen Versuchsbedingungen,
keine automatische Freigabe für den heutigen Betrieb. Die Repository-Matrix
+48
View File
@@ -0,0 +1,48 @@
# Update-Audit und Aufräumarbeiten vom 15. September 2026
Der Abgleich wurde zunächst ohne Zustandsänderung gegen die offiziellen Git-Repositories
und Container-Registries durchgeführt. Danach wurden ausschließlich bestätigte veraltete
Komponenten aktualisiert. Athena wurde weder neu gestartet noch heruntergefahren.
## Aktualisiert
| Komponente | Vorher | Nachher |
|---|---|---|
| llama.cpp | b10930 / `56381e4` | Release 0.4.1 / `b29c606` |
| whisper.cpp | 1.9.1 | 1.9.4 |
| Applio | Commit `7fa68ec` | stabiles Release 3.6.4 / `45f2dcb` |
| Offen Docker Volume Backup | Image-Digest `19102d…` | aktueller `v2`-Digest `ca882e…` |
Das llama.cpp-Update enthält unter anderem Korrekturen für Qwen-Modelle,
Chat- und Tool-Parsing, multimodale Eingaben sowie den Serverbetrieb.
## Bereits aktuell
LTX Desktop 1.2.7, ACE-Step 1.5 0.1.8, Portainer CE 2.45.0 LTS,
Qwen3-TTS-Server, TRELLIS.cpp 0.6.0, X-VC und YuE2 0.1.6 waren beim
Abgleich bereits auf dem aktuellen stabilen beziehungsweise festgelegten Stand.
## Konsolidierter Quellstand
Die produktiven Erweiterungen für LTX, den lokalen Prompt Enhancer, das rollierende
Video-Extend sowie das Schlafen und Aufwecken der VNC-Oberfläche wurden aus dem
Live-Stack in Git übernommen. AppleDouble-Dateien (`._*`), Python-Caches,
temporäre Sicherungskopien und überholte Zweit-Checkouts gehören nicht zum
Produktionsquellstand.
Vor der Bereinigung wurde auf Athena ein vollständiges Archiv der Konfiguration und
Arbeitskopien unter `/root/athena-pre-update-20260915-073740.tar.zst` abgelegt.
SHA-256: `c15aa831908bed36ba9de2c7f80ae4aa7b3a9bb49d0d4ec579737e506f0aa4cc`.
## Update-Regel
Ein Update-Audit vergleicht getrennt:
1. den in Dockerfile oder Compose festgelegten Upstream-Stand,
2. den Git-Stand des Repositories,
3. das gebaute lokale Image und
4. das Image des tatsächlich vorhandenen Containers.
Floating Tags allein gelten nicht als Nachweis eines Updates. Produktionsstände
werden auf Commit, Release oder Registry-Digest festgelegt und erst nach Build,
Healthcheck und Funktionsprobe dokumentiert.