306 lines
19 KiB
Plaintext
306 lines
19 KiB
Plaintext
ATHENA – AUFBAU VON UNTEN NACH OBEN
|
||
====================================
|
||
|
||
Stand: 10.09.2026 nach Entfernung von Beta 1 und Piper.
|
||
Athena besitzt derzeit 23 Container, fünf auswählbare LLM-Profile und vier
|
||
verwendete Docker-Volumes. Verwaiste Docker-Volumes gibt es nicht.
|
||
|
||
|
||
+--------------------------------------+
|
||
| PHYSISCHER RECHNER: ATHENA |
|
||
| |
|
||
| CPU, RAM, Systemplatte, Netzwerk |
|
||
| NVIDIA RTX 5080 + NVIDIA RTX 3060 |
|
||
+------------------+-------------------+
|
||
|
|
||
v
|
||
+--------------------------------------+
|
||
| DEBIAN-HOSTSYSTEM |
|
||
| |
|
||
| - startet den Rechner |
|
||
| - verwaltet Netzwerk und Datenträger |
|
||
| - stellt NVIDIA-Treiber bereit |
|
||
| - führt Docker aus |
|
||
+------------------+-------------------+
|
||
|
|
||
+-------------------+-------------------+
|
||
| |
|
||
v v
|
||
+----------------------------------+ +----------------------------------+
|
||
| DOCKER-STACK | | DAUERHAFTE DATEN AUF DEM HOST |
|
||
| | | |
|
||
| - Router und Profilsteuerung | | - Modelle und Modellgewichte |
|
||
| - llama.cpp-Modellserver | | - Trainingsdatensätze |
|
||
| - Athena-Dashboard | | - trainierte Stimmen |
|
||
| - Bild-, Musik- und Audiodienste | | - Checkpoints und Ergebnisse |
|
||
| - Applio und Mikes Applio UI | | - Konfigurationen und Logs |
|
||
| - Hilfs- und Netzwerkdienste | | |
|
||
+----------------+-----------------+ | Hauptpfade: |
|
||
| | /data |
|
||
| liest und schreibt | /etc/mike-ai |
|
||
+-------------------->| |
|
||
+----------------+-----------------+
|
||
|
|
||
v
|
||
+----------------------------------+
|
||
| BACKUP |
|
||
| |
|
||
| Sichert ausgewählte dauerhafte |
|
||
| Daten und Konfigurationen. |
|
||
+----------------------------------+
|
||
|
||
|
||
DOCKER-STACK: CONTAINER-INVENTAR
|
||
================================
|
||
|
||
Bestandsaufnahme vom 10.09.2026. "Gestoppt/bereit" bedeutet hier nicht
|
||
automatisch defekt: GPU-intensive Dienste werden absichtlich nur im passenden
|
||
Betriebsmodus gestartet. Zum Zeitpunkt der Aufnahme war Applio/RVC aktiv.
|
||
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| Container | Zustand | Aufgabe |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-router | läuft | Zentrale API; leitet Text-, Bild-, Audio- |
|
||
| | | und Profilanfragen an den passenden Dienst. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-profile-controller | läuft | Schaltet Profile und Betriebsmodi und sorgt |
|
||
| | | dafür, dass sich GPU-Dienste nicht stören. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-llama-fast | gestoppt/bereit | llama.cpp-Textmodell mit kleinem Kontext und |
|
||
| | | hoher Geschwindigkeit. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-llama-medium | gestoppt/bereit | llama.cpp-Textmodell mit mittlerem Kontext. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-llama-large | gestoppt/bereit | llama.cpp-Textmodell mit großem Kontext. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-llama-ultra | gestoppt/bereit | llama.cpp-Textmodell mit maximalem Kontext. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-llama-uncensored | gestoppt/bereit | Separates ungefiltertes llama.cpp-Profil. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-image-worker | gestoppt/bereit | Lokale Bildgenerierung und Bildbearbeitung; |
|
||
| | | wird nur für Bildaufträge geladen. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-qwen3-tts | gestoppt/bereit | Hochwertige GPU-Sprachausgabe mit Qwen3-TTS. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-tts-gateway | läuft | Normalisiert Text, wandelt Audioformate und |
|
||
| | | streamt die Ausgabe von Qwen3-TTS. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-whisper | läuft | Lokale Spracherkennung: Sprache zu Text. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-music-acestep-test | gestoppt/bereit | ACE-Step 1.5: erzeugt und bearbeitet Musik. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-music-ui | läuft | Community-Weboberfläche für ACE-Step; das |
|
||
| | | eigentliche Musikmodell wird separat geladen.|
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-stem-separator | gestoppt/bereit | Trennt Gesang, Begleitung und Instrumente |
|
||
| | | mit BS-RoFormer und Demucs. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-voice-studio | gestoppt/bereit | Voice Studio für Text-zu-Stimme und |
|
||
| | | referenzbasierte Stimmerzeugung. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-xvc-studio | gestoppt/bereit | X-VC für direkte Stimme-zu-Stimme-Umwandlung |
|
||
| | | ohne vorheriges RVC-Training. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-applio-studio | läuft | Applio/RVC-Backend: Training, Modelle, |
|
||
| | | Sprachumwandlung und Original-Weboberfläche. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-mikes-applio-ui | läuft | Eigene geführte Oberfläche für das Applio- |
|
||
| | | Backend; enthält selbst kein RVC-Modell. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-llama-dashboard | läuft | Athena-Dashboard: Zustand, Telemetrie und |
|
||
| | | Umschaltung der Betriebsmodi. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-portainer | läuft | Allgemeine Webverwaltung und Einsicht für |
|
||
| | | Docker-Container, Images, Netze und Volumes. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-wireguard-gateway | läuft | Stellt die Athena-Webdienste ausschließlich |
|
||
| | | über den privaten WireGuard-Zugang bereit. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-mcp-athena-operator | läuft | Kontrollierte Verwaltungswerkzeuge für |
|
||
| | | Athena, unter anderem für Hermes. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
| mike-ai-backup | läuft | Sichert regelmäßig die dauerhaften Daten und |
|
||
| | | Konfigurationen von Athena. |
|
||
+-----------------------------------+-------------------+----------------------------------------------+
|
||
|
||
Die Container gehören technisch zu mehreren Compose-Projekten, werden hier
|
||
aber gemeinsam als Athena-Docker-Stack betrachtet:
|
||
|
||
- Kernsystem: /opt/mike-ai/stack
|
||
- Applio/RVC: /opt/mike-ai/stack/experiments/applio-rvc
|
||
- Mikes Applio UI: /opt/mike-ai/Mikes-Applio-UI
|
||
- ACE-Step-Musik: /opt/mike-ai/acestep-test
|
||
- Spurentrennung: /opt/mike-ai/stem-separator
|
||
- Voice Studio: /opt/mike-ai/omnivoice-studio
|
||
- X-VC: /opt/mike-ai/xvc-studio
|
||
|
||
|
||
LLM-PROFILE
|
||
===========
|
||
|
||
Es läuft immer höchstens eines dieser Profile. Fast, Medium, Large und
|
||
Uncensored können zusätzlich den Vision-Projektor verwenden. Ultra reserviert
|
||
den verfügbaren Speicher für den maximalen Textkontext und läuft ohne Vision.
|
||
|
||
+------------+-------------------+----------------+-----------------------------+
|
||
| Profil | API-Modell | Kontext | Zweck |
|
||
+------------+-------------------+----------------+-----------------------------+
|
||
| Fast | qwen-fast | 76.800 Token | Hohe Geschwindigkeit und |
|
||
| | | | kurze bis mittlere Aufgaben.|
|
||
+------------+-------------------+----------------+-----------------------------+
|
||
| Medium | qwen-medium | 160.000 Token | Ausgewogenes Standardprofil.|
|
||
+------------+-------------------+----------------+-----------------------------+
|
||
| Large | qwen-large | 192.000 Token | Umfangreiche Dokumente und |
|
||
| | | | lange technische Arbeiten. |
|
||
+------------+-------------------+----------------+-----------------------------+
|
||
| Ultra | qwen-ultra | 262.144 Token | Maximaler Textkontext; ohne |
|
||
| | | | Vision-Projektor. |
|
||
+------------+-------------------+----------------+-----------------------------+
|
||
| Uncensored | qwen-uncensored | 80.000 Token | Weniger restriktives |
|
||
| | | | Spezialprofil. |
|
||
+------------+-------------------+----------------+-----------------------------+
|
||
|
||
Die produktiven Standardprofile verwenden Qwen3.8-27B in Q4-Quantisierung.
|
||
Das frühere Beta-1-Profil mit GSQ-RCO IQ3_S wurde entfernt: Es benötigte zwar
|
||
weniger Speicher, war im gemessenen Betrieb aber überwiegend langsamer und
|
||
brachte keinen belastbaren Qualitäts- oder Geschwindigkeitsvorteil.
|
||
|
||
|
||
BETRIEBSMODI UND GPU-UMSCHALTUNG
|
||
===============================
|
||
|
||
Die großen GPU-Dienste laufen gegenseitig exklusiv. Der Router speichert den
|
||
gewählten Zustand und die Profilsteuerung entlädt vor einem Wechsel die nicht
|
||
benötigten Modelle.
|
||
|
||
+---------------+------------------------------------------------------------+
|
||
| Modus | Geladener Hauptdienst |
|
||
+---------------+------------------------------------------------------------+
|
||
| LLM | Ein Qwen-LLM-Profil und Qwen3-TTS. |
|
||
+---------------+------------------------------------------------------------+
|
||
| Musik | ACE-Step 1.5 für Musikgenerierung. |
|
||
+---------------+------------------------------------------------------------+
|
||
| Audio trennen | BS-RoFormer, Demucs oder MossFormer2. |
|
||
+---------------+------------------------------------------------------------+
|
||
| Voice Studio | OmniVoice für referenzbasierte Text-zu-Sprache-Ausgabe. |
|
||
+---------------+------------------------------------------------------------+
|
||
| X-VC | Direkte Stimme-zu-Stimme-Umwandlung. |
|
||
+---------------+------------------------------------------------------------+
|
||
| Applio / RVC | RVC-Inferenz, Modellverwaltung und Stimmtraining. |
|
||
+---------------+------------------------------------------------------------+
|
||
|
||
Qwen3-TTS läuft nur im LLM-Modus. In einem exklusiven Spezialmodus bleibt das
|
||
leichte TTS-Gateway als API-Dienst gesund, meldet aber "ready: false", weil das
|
||
eigentliche Qwen3-TTS-Modell absichtlich entladen ist.
|
||
|
||
|
||
TTS-AUFBAU
|
||
===========
|
||
|
||
+-----------------------------+
|
||
| Router / OpenAI-TTS-Endpunkt|
|
||
+--------------+--------------+
|
||
|
|
||
v
|
||
+-----------------------------+
|
||
| mike-ai-tts-gateway |
|
||
| - Text normalisieren |
|
||
| - Ausgabeformat umwandeln |
|
||
| - PCM-Streaming |
|
||
+--------------+--------------+
|
||
|
|
||
v
|
||
+-----------------------------+
|
||
| mike-ai-qwen3-tts |
|
||
| Qwen3-TTS 1.7B / Serena |
|
||
+-----------------------------+
|
||
|
||
Piper und sein CPU-Fallback wurden vollständig entfernt. Das TTS-Gateway
|
||
bleibt notwendig, weil es die stabile Schnittstelle und die Verarbeitung um
|
||
Qwen3-TTS herum bereitstellt. Wenn Qwen3-TTS nicht geladen ist, steht keine
|
||
Sprachausgabe zur Verfügung; es wird nicht mehr auf ein zweites Modell
|
||
zurückgegriffen.
|
||
|
||
|
||
DAUERHAFTE DOCKER-VOLUMES
|
||
=========================
|
||
|
||
Bestandsprüfung vom 10.09.2026: Alle vier Volumes sind einem vorhandenen
|
||
Container zugeordnet. "docker volume ls -f dangling=true" liefert keine
|
||
Treffer.
|
||
|
||
+-------------------------+-----------------------------------------------+
|
||
| Volume | Verwendung |
|
||
+-------------------------+-----------------------------------------------+
|
||
| mike-ai_router-state | Persistenter Routerzustand und Betriebsmodus. |
|
||
+-------------------------+-----------------------------------------------+
|
||
| mike-ai_router-images | Vom Router und Bilddienst erzeugte Bilder. |
|
||
+-------------------------+-----------------------------------------------+
|
||
| mike-ai_whisper-data | Lokales Whisper-Modell für Sprache-zu-Text. |
|
||
+-------------------------+-----------------------------------------------+
|
||
| portainer_data | Einstellungen und Daten von Portainer. |
|
||
+-------------------------+-----------------------------------------------+
|
||
|
||
Das frühere Volume "mike-ai_piper-data" wurde zusammen mit Piper gelöscht.
|
||
Beta 1 besaß kein eigenes Docker-Volume; seine rund 12 GB Modellgewichte lagen
|
||
als Hostverzeichnis unter /data/models und wurden ebenfalls gelöscht.
|
||
|
||
Viele Fachdienste verwenden statt Docker-Volumes direkte Hostverzeichnisse.
|
||
Die wichtigsten davon sind:
|
||
|
||
- /data/models Modellgewichte und Modell-Caches
|
||
- /data/voice/applio Applio-Datensätze, Logs und Stimmenmodelle
|
||
- /data/music Musikprojekte und generierte Titel
|
||
- /data/audio/separation Ergebnisse der Audio- und Spurentrennung
|
||
- /data/llama-dashboard Verlauf und Zustandsdaten des Dashboards
|
||
- /etc/mike-ai betriebliche Konfiguration und Geheimnisse
|
||
- /data/docker-backups erzeugte Sicherungsarchive
|
||
|
||
Diese Verzeichnisse sind keine Docker-Volumes. Ein leerer Docker-Volume-Check
|
||
beweist deshalb nicht automatisch, dass unter /data keine alten Experiment-
|
||
oder Modelldateien mehr liegen.
|
||
|
||
|
||
AKTUELLER UMFANG DES BACKUP-CONTAINERS
|
||
======================================
|
||
|
||
Der Container mike-ai-backup sichert derzeit im Fünf-Stunden-Takt:
|
||
|
||
- /etc/mike-ai
|
||
- /opt/mike-ai/stack
|
||
- mike-ai_router-state
|
||
- mike-ai_router-images
|
||
- portainer_data
|
||
|
||
Das Volume mike-ai_whisper-data wird nicht archiviert. Das Whisper-Modell wird
|
||
bei einem leeren Volume automatisch erneut heruntergeladen. Die großen
|
||
Hostverzeichnisse unter /data/models, /data/voice, /data/music und
|
||
/data/audio sind ebenfalls nicht automatisch Bestandteil dieses
|
||
Docker-Volume-Backups. Besonders eigene Trainingsdaten und trainierte
|
||
Stimmenmodelle benötigen deshalb eine zusätzliche Datensicherung, wenn sie
|
||
nicht reproduzierbar sind.
|
||
|
||
|
||
ENTFERNTE KOMPONENTEN
|
||
=====================
|
||
|
||
- Beta 1 / qwen-beta-1: Profil, Containerdefinition, Container und
|
||
GSQ-RCO-IQ3_S-Modellgewichte entfernt. Der historische Testbericht bleibt
|
||
erhalten, damit das Modell nicht versehentlich erneut getestet wird.
|
||
- Piper: Containerdefinition, Container, Image, Datenvolume, Konfiguration und
|
||
WireGuard-Port 8091 entfernt.
|
||
|
||
|
||
WICHTIGES GRUNDPRINZIP
|
||
======================
|
||
|
||
Die Anwendungen laufen überwiegend in Docker-Containern. Container selbst
|
||
sind austauschbar und können aus den versionierten Stack-Dateien neu gebaut
|
||
werden. Modelle, Trainingsmaterial, Ergebnisse und betriebliche Einstellungen
|
||
liegen dagegen dauerhaft auf dem Debian-Host und werden in die Container
|
||
eingebunden.
|
||
|
||
Ein neu gebauter Container darf deshalb keine Nutzdaten vernichten. Für eine
|
||
vollständige Wiederherstellung werden jedoch sowohl das Git-Repository mit dem
|
||
Stack als auch eine Sicherung der dauerhaften Hostdaten benötigt.
|