1.5 KiB
Aktuelle Laufzeitnotizen
Stand: 20. September 2026.
Der verbindliche Abgleich steht im geprüften Live-Stand.
Produktiv läuft llama.cpp 0.4.1 auf Commit b29c606, zuvor b10930.
Alle fünf installierten Profile verwenden dasselbe CUDA-Image. Die Startoption
bleibt --load-mode none.
Medium läuft im aktuellen OpenClaw-Praxistest mit zwei Slots. --kv-unified
teilt den 160.000-Token-KV-Pool dynamisch zwischen beiden Slots; das Dashboard
zeigt je Slot die aktuell noch erreichbare Kapazität. Alle anderen Profile und
der Installationsstandard bleiben bei einem Slot.
B10930-Updatebericht: Version, Image-ID, Funktionsproben, Vergleichsmessungen und gesicherter Rückfallstand.
Update-Audit vom 15. September: aktualisierte Komponenten, unveränderte aktuelle Komponenten, Aufräumarbeiten und Rollback.
FLUX verwendet 9B FP8 Beta mit Textencoder auf der RTX 3060.
Auflösungstest: 1024 erfolgreich,
1280 CUDA-OOM; produktive Begrenzung weiterhin 1024.
Sprachausgabe: Qwen3-TTS 1.7B ohne Piper. Spracherkennung: Whisper.cpp 1.9.4
mit dem Modell small auf der CPU. Applio basiert auf dem stabilen Release 3.6.4.
Datierte ältere Testberichte beschreiben ihre damaligen Versuchsbedingungen, keine automatische Freigabe für den heutigen Betrieb. Die Repository-Matrix enthält zusätzlich beta1; auf Athena sind nur fünf Textprofile installiert.