Add dual-GPU FLUX 9B image pipeline
This commit is contained in:
@@ -1,6 +1,29 @@
|
||||
# Aktueller produktiver Laufzustand
|
||||
|
||||
Stand: 3. September 2026
|
||||
Stand: 7. September 2026
|
||||
|
||||
## FLUX.2 Klein 9B FP8 Beta
|
||||
|
||||
Die bisherige 4B-Bildinferenz wurde testweise durch FLUX.2 Klein 9B FP8
|
||||
ersetzt. Athenas Profile Controller stellt dafür einen exklusiven Zwei-GPU-Pfad
|
||||
bereit:
|
||||
|
||||
- RTX 5080: 9B-FP8-Diffusionstransformer und VAE-Decoding
|
||||
- RTX 3060: Qwen3-8B-Textencoder in NF4
|
||||
- Qwen3-TTS und aktives llama.cpp-Profil werden für den Bildauftrag pausiert
|
||||
- Piper bleibt währenddessen als CPU-TTS verfügbar
|
||||
- nach Abschluss werden TTS und das vorherige Textprofil wiederhergestellt
|
||||
|
||||
Ein vollständiger Aufruf über Athenas OpenAI-kompatiblen Router wurde mit
|
||||
HTTP 200, einem korrekt gespeicherten 1024×1024-PNG und anschließender
|
||||
Wiederherstellung von Qwen3-TTS und `qwen-fast` erfolgreich geprüft. Ein
|
||||
isolierter Vergleich ergab ungefähr 14,6 Sekunden Bildlaufzeit mit dem
|
||||
GPU-Textencoder gegenüber 102,1 Sekunden mit CPU-Textencoder. Diese Werte sind
|
||||
eine lokale Einzelmessung und keine allgemeine Modellgarantie.
|
||||
|
||||
Das Modell ist nicht kommerziell lizenziert. Die Bedingungen der beiden
|
||||
zugriffsbeschränkten Black-Forest-Labs-Repositories müssen vor dem Download
|
||||
akzeptiert werden. Details stehen in [FLUX_9B_BETA.md](FLUX_9B_BETA.md).
|
||||
|
||||
## Lokale Spracherkennung
|
||||
|
||||
|
||||
Reference in New Issue
Block a user