feat: add target-and-remainder stem extraction

This commit is contained in:
Mikei386
2026-09-09 01:00:01 +02:00
parent 0f0e77928a
commit 2342495d24
4 changed files with 85 additions and 26 deletions
+7 -6
View File
@@ -36,12 +36,13 @@ Docker-Netz `mike-ai-music` auf `http://music-worker:7860` zu.
Im Trennmodus öffnet das Dashboard die private Athena-Oberfläche unter
`http://192.168.1.212:8007`. Sie nimmt WAV, FLAC, MP3, M4A und weitere
übliche Formate an und liefert verlustfreie FLAC-Spuren als ZIP. Verfügbar sind
die spezialisierte Gesangstrennung (`vocals`, `instrumental`), vier Spuren
(`vocals`, `drums`, `bass`, `other`) und experimentell sechs Spuren
(`vocals`, `drums`, `bass`, `guitar`, `piano`, `other`). Grundlage ist
`audio-separator` 0.47.0 mit BS-RoFormer Viperx 1297, `htdemucs_ft` und
`htdemucs_6s`.
übliche Formate an. Gewählt wird die herauszulösende Quelle: Gesang,
Schlagzeug, Bass, Gitarre oder Piano. Das ZIP enthält genau diese Zielspur und
eine zweite FLAC-Datei mit dem vollständigen Rest ohne die Zielspur. Gesang
nutzt BS-RoFormer Viperx 1297, Schlagzeug/Bass `htdemucs_ft` und
Gitarre/Piano experimentell `htdemucs_6s`. Grundlage ist `audio-separator`
0.47.0. Die ältere API-Auswahl kompletter 2-/4-/6-Stem-Sätze bleibt
rückwärtskompatibel.
Hermes benötigt dafür kein Plugin. Exakt eingegebene Steuerbefehle werden vom
Router lokal beantwortet, auch wenn gerade kein LLM geladen ist: