Make Qwen Image 2.1 the production image worker
This commit is contained in:
+4
-4
@@ -39,10 +39,10 @@ nicht mehr den aktuellen Containerzustand.
|
||||
|
||||
## Weitere Dienste
|
||||
|
||||
- FLUX.2 Klein 9B FP8 Beta: Transformer/VAE auf 5080, Qwen3-8B-NF4-
|
||||
Textencoder auf 3060. Produktiv freigegeben sind höchstens 1024 × 1024,
|
||||
vier Schritte, Guidance 1, vier Referenzbilder und 128 Encoder-Tokens.
|
||||
1280 × 1280 lief im Test in CUDA-OOM.
|
||||
- Qwen-Image-2.1 INT8 läuft produktiv über gepinntes ComfyUI mit Low-VRAM auf
|
||||
der RTX 5080. Der Router verwendet 25 Schritte, Guidance 1 und bis zu vier
|
||||
Referenzbilder. FLUX.2 Klein 9B FP8 bleibt mit seinen Gewichten als
|
||||
gestoppter, explizit allowlist-beschränkter Rückfallcontainer erhalten.
|
||||
- Qwen3-TTS 1.7B auf 3060 hinter dem TTS-Gateway; kein Piper-Fallback.
|
||||
- Whisper.cpp `ggml-small` auf CPU über `/v1/audio/transcriptions`.
|
||||
- `mike-ai-embedding` stellt EmbeddingGemma 300M Q8 CPU-only über den privaten
|
||||
|
||||
Reference in New Issue
Block a user