# Aktuelle Laufzeitnotizen Stand: 12. September 2026. Der verbindliche Abgleich steht im [geprüften Live-Stand](LIVE_STATE.md). Produktiv läuft **llama.cpp b10930**, zuvor b10872. Die frühere Angabe b10781 war veraltet. Alle fünf installierten Profile wurden aktualisiert; die Startoption wurde auf `--load-mode none` migriert. [B10930-Updatebericht](LLAMA_B10930_UPDATE_20260912.md): Version, Image-ID, Funktionsproben, Vergleichsmessungen und gesicherter Rückfallstand. FLUX verwendet **9B FP8 Beta** mit Textencoder auf der RTX 3060. [Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md): 1024 erfolgreich, 1280 CUDA-OOM; produktive Begrenzung weiterhin 1024. Sprachausgabe: Qwen3-TTS 1.7B ohne Piper. Spracherkennung: Whisper.cpp small auf CPU. Datierte ältere Testberichte beschreiben ihre damaligen Versuchsbedingungen, keine automatische Freigabe für den heutigen Betrieb. Die Repository-Matrix enthält zusätzlich beta1; auf Athena sind nur fünf Textprofile installiert.