6.4 KiB
Container-Inventar auf Athena
Stand: 21. September 2026
Athena hat 31 reguläre Docker-Container. Nicht jeder Container enthält
ein KI-Modell: Router, Oberflächen, Netzwerk, Steuerung und Sicherung sind
gewöhnliche Dienste. Die rechenintensiven GPU-Worker werden absichtlich nur bei
Bedarf gestartet. Ein Container im Zustand Created oder Exited (0) ist daher
nicht automatisch ein ungenutzter Rest.
| Container | Modell oder wesentliche Komponente | Aufgabe |
|---|---|---|
mike-ai-backup |
kein Modell; Offen Docker Volume Backup v2 (Digest vom 15. September 2026) |
Sichert /data, /etc/mike-ai, den Stack und die persistenten Docker-Volumes im Fünf-Stunden-Takt. |
mike-ai-embedding |
EmbeddingGemma 300M QAT Q8 | Dauerhafter CPU-only-Endpunkt für OpenClaws semantische und hybride Memory-Suche; teilt ausschließlich den privaten Netzwerk-Namespace des WireGuard-Gateways. |
mike-ai-bonsai2-ab |
Bonsai-2-Vergleichsmodell | Gestoppter, reproduzierbar dokumentierter A/B-Testcontainer; kein Produktivprofil. |
mike-ai-applio-studio |
Applio/RVC; Stimmenmodelle werden nutzerseitig ergänzt | Vollständige RVC-Oberfläche für Inferenz, Modellverwaltung und Training auf der RTX 5080. Für eine Konvertierung ist ein importiertes oder trainiertes .pth-Modell nötig; eine Referenzaufnahme allein reicht nicht. |
mike-ai-image-worker |
Qwen-Image-2.1 INT8, Qwen3-VL-8B INT8 und VAE | Produktiver Bildworker; erzeugt und bearbeitet Bilder transaktional auf der RTX 5080. |
mike-ai-flux-image-worker |
FLUX.2 Klein 9B FP8, Qwen3-8B NF4 Textencoder und VAE | Gestoppter Rückfallworker; wird vom normalen Router-Bildpfad nicht gestartet. |
mike-ai-llama-dashboard |
kein Modell | Zeigt Telemetrie, Profile, GPU-Nutzung, Slot-Kontextbelegung mit Verlauf und Betriebsarten an und bietet die Modusumschaltung. |
mike-ai-llama-fast |
Qwen3.8-27B IQ4-MIX, Qwen-MMProj BF16 |
Schnelles Q4-Text-/Vision-Profil mit 76.800 Token Kontext. |
mike-ai-llama-large |
Qwen3.8-27B IQ4_XS-pure, Qwen-MMProj BF16 |
Q4-Text-/Vision-Profil mit 192.000 Token Kontext und Verteilung auf beide GPUs. |
mike-ai-llama-medium |
Qwen3.8-27B IQ4_XS-pure, Qwen-MMProj BF16 |
Standard-Q4-Text-/Vision-Profil mit gemeinsamem 160.000-Token-KV-Pool, aktuell zwei Slots und Verteilung auf beide GPUs. |
mike-ai-llama-ultra |
Qwen3.8-27B IQ4_XS-pure, ohne Vision-Projektor |
Maximales Langkontextprofil mit 262.144 Token Kontext und Verteilung auf beide GPUs. |
mike-ai-llama-uncensored |
Qwen3.8-27B Abliterated Q4_K_M, eigener MMProj F16 |
Spezialprofil mit 80.000 Token Kontext und gelockerten Modellgrenzen. |
mike-ai-ltx2-studio |
LTX-Video-Backend | GPU-Worker für lokale Videogenerierung; beim Abgleich gestoppt. |
mike-ai-mcp-athena-operator |
kein Modell | Stellt Hermes begrenzte Werkzeuge zum Prüfen, Ändern, Testen, Sichern und Versionieren von Athena bereit. |
mike-ai-music-acestep-test |
ACE-Step 1.5 XL-SFT und acestep-5Hz-lm-1.7B |
Generiert Musik im exklusiven Musikmodus auf der RTX 5080. |
mike-ai-music-ui |
kein Modell; fspecii/ace-step-ui |
Community-Oberfläche für ACE-Step; bleibt als leichte UI verfügbar, während der GPU-Worker bedarfsgesteuert läuft. |
mike-ai-ornith15-ab |
Ornith 1.5 35B-A3B | Gestoppter, reproduzierbar dokumentierter A/B-Testcontainer; kein Produktivprofil. |
mike-ai-portainer |
kein Modell; Portainer CE | Optionale Docker-Verwaltungsoberfläche. |
mike-ai-profile-controller |
kein Modell | Startet und stoppt ausschließlich freigegebene Modellprofile und Spezialworker in einer sicheren Reihenfolge. |
mike-ai-qwen-cron-test |
kleines Qwen-Testmodell | Gestoppter CPU-/Cron-Worker-Versuch; nicht produktiv eingesetzt. |
mike-ai-realtime-voice |
kein Modell | Laufende, gesunde WebRTC-Brücke für OpenClaw Talk; verbindet über den privaten WireGuard-Pfad Athena Whisper, OpenClaw-Agent und Qwen3-TTS ohne Profilwechsel. |
mike-ai-qwen3-tts |
Qwen/Qwen3-TTS-12Hz-1.7B-Base, Stimme Serena |
Hochwertige deutsche Sprachausgabe auf der RTX 3060 im LLM-Betrieb. |
mike-ai-router |
kein eigenes Modell | Einzige OpenAI-kompatible Modelladresse; koordiniert Profile, Bildaufträge, Sprache und Betriebsarten. |
mike-ai-stem-separator |
BS-RoFormer Viperx 1297, htdemucs_ft, htdemucs_6s, MossFormer2_SE_48K |
Trennt Gesang, Instrumente oder Sprache/Hintergrundgeräusche im exklusiven Separationsmodus. |
mike-ai-tts-gateway |
kein eigenes Modell | Normalisiert Text, konvertiert Ausgabeformate und stellt Qwen3-TTS sowie natives PCM-Streaming über eine stabile interne API bereit. |
mike-ai-voice-studio |
k2-fsa/OmniVoice 0.2.1 mit Whisper-ASR |
Erzeugt Text-to-Speech mit einer Referenzstimme; kein Audio-to-Audio-Voice-Changer. |
mike-ai-whisper |
Whisper.cpp 1.9.4, ggml-small |
Lokale deutsche Spracherkennung auf der CPU über /v1/audio/transcriptions. |
mike-ai-wireguard-gateway |
kein Modell | Veröffentlicht Dashboard und Fachoberflächen ausschließlich über den privaten WireGuard-Pfad. |
mike-ai-xvc-studio |
chenxie95/X-VC, GLM-4-Voice-Tokenizer und optional Resemble Enhance |
Wandelt eine vorhandene Sprachaufnahme anhand einer Referenzstimme in Audio zu Audio um; gibt das native 16-kHz-Ergebnis und optional eine neural restaurierte 44,1-kHz-Fassung aus. |
mike-ai-yue2-playground |
Image mike-ai/yue2:3b-0.1.6 |
Vorhandener, gestoppter Playground; in diesem Abgleich nicht funktional getestet. |
mike-ai-trellis-studio |
Image mike-ai/trellis-studio:0.6.0-q8 |
Vorhandener, gestoppter 3D-Worker; in diesem Abgleich nicht funktional getestet. |
mike-ai-mikes-applio-ui |
Image mike-ai/mikes-applio-ui:latest |
Laufende zusätzliche Applio-Oberfläche. |
Alle fünf llama-Container verwenden llama.cpp 0.4.1 (b29c606). Medium lief
beim Abgleich gesund mit zwei Slots; die anderen vier Textprofile waren
planmäßig nicht aktiv. Der Image-Worker war ebenfalls gestoppt. Die
Infrastruktur und die Musik-/Applio-Oberflächen liefen. Diese Zustände ändern
sich mit der Nutzung.
Die Detailbeschreibungen der Spezialmodelle stammen aus der bestehenden
Betriebsdokumentation; dieses Update prüfte deren Containerbestand, nicht
sämtliche Modellgewichte oder Funktionen neu.
Aufräumregel
Gestoppte Container sind nicht automatisch Testreste. Vor einer Entfernung Compose-Zuordnung, Mounts und Controller-Verweise prüfen. Die vorhandenen Die historischen FLUX-Tests sind keine Aussage über den produktiven Qwen-Pfad.