# Aktuelle Laufzeitnotizen Stand: 20. September 2026. Der verbindliche Abgleich steht im [geprüften Live-Stand](LIVE_STATE.md). Produktiv läuft **llama.cpp 0.4.1** auf Commit `b29c606`, zuvor b10930. Alle fünf installierten Profile verwenden dasselbe CUDA-Image. Die Startoption bleibt `--load-mode none`. Medium läuft im aktuellen OpenClaw-Praxistest mit zwei Slots. `--kv-unified` teilt den 160.000-Token-KV-Pool dynamisch zwischen beiden Slots; das Dashboard zeigt je Slot die aktuell noch erreichbare Kapazität. Alle anderen Profile und der Installationsstandard bleiben bei einem Slot. [B10930-Updatebericht](LLAMA_B10930_UPDATE_20260912.md): Version, Image-ID, Funktionsproben, Vergleichsmessungen und gesicherter Rückfallstand. [Update-Audit vom 15. September](UPDATE_AUDIT_20260915.md): aktualisierte Komponenten, unveränderte aktuelle Komponenten, Aufräumarbeiten und Rollback. FLUX verwendet **9B FP8 Beta** mit Textencoder auf der RTX 3060. [Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md): 1024 erfolgreich, 1280 CUDA-OOM; produktive Begrenzung weiterhin 1024. Sprachausgabe: Qwen3-TTS 1.7B ohne Piper. Spracherkennung: Whisper.cpp 1.9.4 mit dem Modell `small` auf der CPU. Applio basiert auf dem stabilen Release 3.6.4. Datierte ältere Testberichte beschreiben ihre damaligen Versuchsbedingungen, keine automatische Freigabe für den heutigen Betrieb. Die Repository-Matrix enthält zusätzlich beta1; auf Athena sind nur fünf Textprofile installiert.