Files
AI-Profile-Router/docs/CONTAINER_INVENTORY.md
T

7.0 KiB

Container-Inventar auf Athena

Stand: 21. September 2026

Athena hat 33 reguläre Docker-Container. Nicht jeder Container enthält ein KI-Modell: Router, Oberflächen, Netzwerk, Steuerung und Sicherung sind gewöhnliche Dienste. Die rechenintensiven GPU-Worker werden absichtlich nur bei Bedarf gestartet. Ein Container im Zustand Created oder Exited (0) ist daher nicht automatisch ein ungenutzter Rest.

Container Modell oder wesentliche Komponente Aufgabe
mike-ai-backup kein Modell; Offen Docker Volume Backup v2 (Digest vom 15. September 2026) Sichert /data, /etc/mike-ai, den Stack und die persistenten Docker-Volumes im Fünf-Stunden-Takt.
mike-ai-embedding EmbeddingGemma 300M QAT Q8 Dauerhafter CPU-only-Endpunkt für OpenClaws semantische und hybride Memory-Suche; teilt ausschließlich den privaten Netzwerk-Namespace des WireGuard-Gateways.
mike-ai-bonsai2-ab Bonsai-2-Vergleichsmodell Gestoppter, reproduzierbar dokumentierter A/B-Testcontainer; kein Produktivprofil.
mike-ai-applio-studio Applio/RVC; Stimmenmodelle werden nutzerseitig ergänzt Vollständige RVC-Oberfläche für Inferenz, Modellverwaltung und Training auf der RTX 5080. Für eine Konvertierung ist ein importiertes oder trainiertes .pth-Modell nötig; eine Referenzaufnahme allein reicht nicht.
mike-ai-image-worker Qwen-Image-2.1 INT8, Qwen3-VL-8B INT8 und VAE Produktiver Bildworker; erzeugt und bearbeitet Bilder transaktional auf der RTX 5080.
mike-ai-image-prompt-enhancer-t2i Qwen-Image-2.1 PE-T2I Q5_K_M Kurzlebiger offizieller Prompt-Aufbereiter für reine Textaufträge auf der RTX 3060; außerhalb eines Bildauftrags gestoppt.
mike-ai-image-prompt-enhancer-i2i Qwen-Image-2.1 PE-I2I Q5_K_M mit BF16-MMProj Kurzlebiger offizieller Prompt-Aufbereiter für bis zu vier Referenzbilder auf der RTX 3060; außerhalb eines Bildauftrags gestoppt.
mike-ai-flux-image-worker FLUX.2 Klein 9B FP8, Qwen3-8B NF4 Textencoder und VAE Gestoppter Rückfallworker; wird vom normalen Router-Bildpfad nicht gestartet.
mike-ai-llama-dashboard kein Modell Zeigt Telemetrie, Profile, GPU-Nutzung, Slot-Kontextbelegung mit Verlauf und Betriebsarten an und bietet die Modusumschaltung.
mike-ai-llama-fast Qwen3.8-27B IQ4-MIX, Qwen-MMProj BF16 Schnelles Q4-Text-/Vision-Profil mit 76.800 Token Kontext.
mike-ai-llama-large Qwen3.8-27B IQ4_XS-pure, Qwen-MMProj BF16 Q4-Text-/Vision-Profil mit 192.000 Token Kontext und Verteilung auf beide GPUs.
mike-ai-llama-medium Qwen3.8-27B IQ4_XS-pure, Qwen-MMProj BF16 Standard-Q4-Text-/Vision-Profil mit gemeinsamem 160.000-Token-KV-Pool, aktuell zwei Slots und Verteilung auf beide GPUs.
mike-ai-llama-ultra Qwen3.8-27B IQ4_XS-pure, Qwen-MMProj BF16 auf CPU Text-/Vision-Profil mit 262.144 Token Kontext und Verteilung des Textmodells auf beide GPUs.
mike-ai-llama-uncensored Qwen3.8-27B Abliterated Q4_K_M, eigener MMProj F16 Spezialprofil mit 80.000 Token Kontext und gelockerten Modellgrenzen.
mike-ai-ltx2-studio LTX-Video-Backend GPU-Worker für lokale Videogenerierung; beim Abgleich gestoppt.
mike-ai-mcp-athena-operator kein Modell Stellt Hermes begrenzte Werkzeuge zum Prüfen, Ändern, Testen, Sichern und Versionieren von Athena bereit.
mike-ai-music-acestep-test ACE-Step 1.5 XL-SFT und acestep-5Hz-lm-1.7B Generiert Musik im exklusiven Musikmodus auf der RTX 5080.
mike-ai-music-ui kein Modell; fspecii/ace-step-ui Community-Oberfläche für ACE-Step; bleibt als leichte UI verfügbar, während der GPU-Worker bedarfsgesteuert läuft.
mike-ai-ornith15-ab Ornith 1.5 35B-A3B Gestoppter, reproduzierbar dokumentierter A/B-Testcontainer; kein Produktivprofil.
mike-ai-portainer kein Modell; Portainer CE Optionale Docker-Verwaltungsoberfläche.
mike-ai-profile-controller kein Modell Startet und stoppt ausschließlich freigegebene Modellprofile und Spezialworker in einer sicheren Reihenfolge.
mike-ai-qwen-cron-test kleines Qwen-Testmodell Gestoppter CPU-/Cron-Worker-Versuch; nicht produktiv eingesetzt.
mike-ai-realtime-voice kein Modell Laufende, gesunde WebRTC-Brücke für OpenClaw Talk; verbindet über den privaten WireGuard-Pfad Athena Qwen3-ASR, OpenClaw-Agent und Qwen3-TTS ohne Profilwechsel.
mike-ai-qwen3-tts Qwen/Qwen3-TTS-12Hz-1.7B-Base, Stimme Serena Hochwertige deutsche Sprachausgabe auf der RTX 3060 im LLM-Betrieb.
mike-ai-router kein eigenes Modell Einzige OpenAI-kompatible Modelladresse; koordiniert Profile, Bildaufträge, Sprache und Betriebsarten.
mike-ai-stem-separator BS-RoFormer Viperx 1297, htdemucs_ft, htdemucs_6s, MossFormer2_SE_48K Trennt Gesang, Instrumente oder Sprache/Hintergrundgeräusche im exklusiven Separationsmodus.
mike-ai-tts-gateway kein eigenes Modell Normalisiert Text, konvertiert Ausgabeformate und stellt Qwen3-TTS sowie natives PCM-Streaming über eine stabile interne API bereit.
mike-ai-voice-studio k2-fsa/OmniVoice 0.2.1 mit Whisper-ASR Erzeugt Text-to-Speech mit einer Referenzstimme; kein Audio-to-Audio-Voice-Changer.
mike-ai-qwen-asr Qwen3-ASR 0.6B Q8 CPU-Inferenz für lokale deutsche Spracherkennung.
mike-ai-qwen-asr-worker kein eigenes Modell Audio-Adapter für /v1/audio/transcriptions; whisper-1 ist nur ein API-Kompatibilitätsname.
mike-ai-wireguard-gateway kein Modell Veröffentlicht Dashboard und Fachoberflächen ausschließlich über den privaten WireGuard-Pfad.
mike-ai-xvc-studio chenxie95/X-VC, GLM-4-Voice-Tokenizer und optional Resemble Enhance Wandelt eine vorhandene Sprachaufnahme anhand einer Referenzstimme in Audio zu Audio um; gibt das native 16-kHz-Ergebnis und optional eine neural restaurierte 44,1-kHz-Fassung aus.
mike-ai-yue2-playground Image mike-ai/yue2:3b-0.1.6 Vorhandener, gestoppter Playground; in diesem Abgleich nicht funktional getestet.
mike-ai-trellis-studio Image mike-ai/trellis-studio:0.6.0-q8 Vorhandener, gestoppter 3D-Worker; in diesem Abgleich nicht funktional getestet.
mike-ai-mikes-applio-ui Image mike-ai/mikes-applio-ui:latest Laufende zusätzliche Applio-Oberfläche.

Alle fünf llama-Container verwenden llama.cpp 0.4.1 (b29c606). Medium lief beim Abgleich gesund mit zwei Slots; die anderen vier Textprofile waren planmäßig nicht aktiv. Der Image-Worker und beide Prompt-Enhancer waren ebenfalls gestoppt. Die Infrastruktur und die Musik-/Applio-Oberflächen liefen. Diese Zustände ändern sich mit der Nutzung. Die Detailbeschreibungen der Spezialmodelle stammen aus der bestehenden Betriebsdokumentation; dieses Update prüfte deren Containerbestand, nicht sämtliche Modellgewichte oder Funktionen neu.

Aufräumregel

Gestoppte Container sind nicht automatisch Testreste. Vor einer Entfernung Compose-Zuordnung, Mounts und Controller-Verweise prüfen. Die vorhandenen Die historischen FLUX-Tests sind keine Aussage über den produktiven Qwen-Pfad.