Remove Beta 1 and Piper fallback
This commit is contained in:
@@ -12,7 +12,7 @@ Bild- und Sprachausgabe. **Hermes und die Fach-MCPs laufen auf Unraid.**
|
||||
- Profile Router auf Port 8081
|
||||
- FLUX.2 Klein 9B FP8 Beta für Textbilder und Referenzbild-Bearbeitung:
|
||||
Transformer auf RTX 5080, Qwen3-8B-NF4-Textencoder auf RTX 3060
|
||||
- Qwen3-TTS 1.7B auf der RTX 3060 mit Piper als CPU-Fallback
|
||||
- Qwen3-TTS 1.7B auf der RTX 3060 hinter einem Normalisierungs- und Streaming-Gateway
|
||||
- Whisper.cpp `ggml-small` auf der CPU für lokale deutsche Spracherkennung
|
||||
- Live-Dashboard mit 21 Tagen Detailhistorie auf Port 8099
|
||||
- Dashboard-Umschaltung zwischen LLM-Betrieb, ACE-Step-Musikstudio,
|
||||
@@ -110,8 +110,8 @@ zuerst das aktive llama.cpp-Profil und Qwen3-TTS. Anschließend läuft der
|
||||
FP8-Transformer auf der RTX 5080 und der in NF4 geladene Qwen3-8B-Textencoder
|
||||
auf der RTX 3060. Vor dem VAE-Decoding werden Transformer und Textencoder
|
||||
freigegeben. Nach dem Bildauftrag stoppt der Router den Bild-Worker und stellt
|
||||
Qwen3-TTS sowie das zuvor aktive Textprofil automatisch wieder her. Piper
|
||||
bleibt währenddessen als CPU-Fallback verfügbar.
|
||||
Qwen3-TTS sowie das zuvor aktive Textprofil automatisch wieder her. Während
|
||||
der exklusiven Nutzung der RTX 3060 ist TTS vorübergehend nicht verfügbar.
|
||||
|
||||
Die Beta ist derzeit bewusst auf `1024x1024`, vier Schritte, Guidance `1.0`,
|
||||
einen parallelen Auftrag und maximal vier lokale Referenzbilder begrenzt.
|
||||
|
||||
Reference in New Issue
Block a user