diff --git a/compose.yaml b/compose.yaml index 0a2f247..1a8e13a 100644 --- a/compose.yaml +++ b/compose.yaml @@ -520,6 +520,16 @@ services: OLLAMA_BASE_URL: "" OPENAI_API_BASE_URLS: http://router:8081/v1 OPENAI_API_KEYS: "${ROUTER_API_KEY:?ROUTER_API_KEY is required}" + # Open WebUI uses the router's OpenAI-compatible image endpoint. The + # router performs the exclusive RTX-5080 hot swap and restores the + # previously active Qwen profile after every image. + ENABLE_IMAGE_GENERATION: "true" + IMAGE_GENERATION_ENGINE: openai + IMAGE_GENERATION_MODEL: flux + IMAGES_OPENAI_API_BASE_URL: http://router:8081/v1 + IMAGES_OPENAI_API_KEY: "${ROUTER_API_KEY:?ROUTER_API_KEY is required}" + IMAGE_SIZE: 1024x1024 + IMAGE_STEPS: "4" AUDIO_TTS_ENGINE: openai AUDIO_TTS_OPENAI_API_BASE_URL: http://router:8081/v1 AUDIO_TTS_OPENAI_API_KEY: "${ROUTER_API_KEY:?ROUTER_API_KEY is required}" diff --git a/docs/CURRENT_REFERENCE.md b/docs/CURRENT_REFERENCE.md index e501aa4..175a835 100644 --- a/docs/CURRENT_REFERENCE.md +++ b/docs/CURRENT_REFERENCE.md @@ -100,6 +100,10 @@ leitet das Bild dann direkt weiter und führt keinen Modellwechsel mehr aus. - der Controller beendet Qwen vor dem Job; Bildprompts bleiben im internen Netz - Worker wird nach jedem Job vollständig beendet - Qwen wird anschließend mit exakt dem vorherigen Profil wiederhergestellt +- gemessene reine Bildgenerierung bei 1024 × 1024: 11,67 bis 14,59 Sekunden +- gemessener kompletter Hot-Swap einschließlich Qwen-Wiederherstellung: etwa 31 Sekunden +- OpenWebUI ist global auf den OpenAI-kompatiblen Router-Endpunkt, vier Schritte + und 1024 × 1024 Pixel vorkonfiguriert ## Sprache