Document production image prompt enhancement

This commit is contained in:
Mikei386
2026-09-21 15:13:18 +02:00
parent fd3f3f5979
commit bb06545956
6 changed files with 103 additions and 71 deletions
+8 -2
View File
@@ -22,6 +22,8 @@ dokumentieren den ausgerollten Stand, reduzierte Statuslatenzen und Tests.
- genau ein aktives llama.cpp-Profil: Fast, Medium, Large, Ultra oder Uncensored
- Profile Router auf Port 8081
- Qwen-Image-2.1 INT8 als produktiver Bildworker auf der RTX 5080
- offizielle Qwen-Image-2.1 Prompt-Enhancer T2I und I2I als kurzlebige
Q5-Worker auf der RTX 3060
- FLUX.2 Klein 9B FP8 Beta als gestoppter Rückfallcontainer
- Qwen3-TTS 1.7B auf der RTX 3060 hinter dem TTS-Gateway; kein Piper-Fallback
- Whisper.cpp `small` auf der CPU für lokale deutsche Spracherkennung
@@ -48,8 +50,12 @@ ist nicht mehr Bestandteil der produktiven Architektur.
Bildanfragen an den Router verwenden seit dem 21. September
**Qwen-Image-2.1 INT8** über gepinntes ComfyUI. Der Worker läuft mit Low-VRAM
auf der RTX 5080, 25 Schritten, CFG 1 und kann bis zu vier Referenzbilder
verarbeiten. Das aktive Textprofil und TTS werden für den Auftrag angehalten
und anschließend wiederhergestellt. Der bisherige FLUX.2-Worker und seine
verarbeiten. Vor dem Rendern schreibt der passende offizielle Q5-Prompt-
Enhancer den kurzen Text automatisch um: PE-T2I für reine Textaufträge und
PE-I2I für Referenzbilder. Er läuft dafür vorübergehend auf der RTX 3060.
OpenClaw benötigt weder ein neues Werkzeug noch besondere Promptregeln. Das
aktive Textprofil und TTS werden für den Auftrag angehalten und anschließend
wiederhergestellt. Der bisherige FLUX.2-Worker und seine
Gewichte bleiben als gestoppter, explizit allowlist-beschränkter Rückfallpfad
erhalten. Reproduzierbarer Stand und Rückschaltung:
[Qwen-Image-2.1](docs/QWEN_IMAGE_21.md).