1.5 KiB
Aktuelle Laufzeitnotizen
Stand: 21. September 2026.
Der verbindliche Abgleich steht im geprüften Live-Stand.
Produktiv läuft llama.cpp 0.4.1 auf Commit b29c606, zuvor b10930.
Alle fünf installierten Profile verwenden dasselbe CUDA-Image. Die Startoption
bleibt --load-mode none.
Medium läuft im aktuellen OpenClaw-Praxistest mit zwei Slots. --kv-unified
teilt den 160.000-Token-KV-Pool dynamisch zwischen beiden Slots; das Dashboard
zeigt je Slot die aktuell noch erreichbare Kapazität. Alle anderen Profile und
der Installationsstandard bleiben bei einem Slot.
B10930-Updatebericht: Version, Image-ID, Funktionsproben, Vergleichsmessungen und gesicherter Rückfallstand.
Update-Audit vom 15. September: aktualisierte Komponenten, unveränderte aktuelle Komponenten, Aufräumarbeiten und Rollback.
Der produktive Bildpfad verwendet Qwen-Image-2.1 INT8 mit ComfyUI auf der
RTX 5080. FLUX 9B FP8 und seine Gewichte bleiben als gestoppter Rückfallpfad.
Qwen-Betriebsdoku; der historische
FLUX-Auflösungstest gilt nur für FLUX.
Sprachausgabe: Qwen3-TTS 1.7B ohne Piper. Spracherkennung: Whisper.cpp 1.9.4
mit dem Modell small auf der CPU. Applio basiert auf dem stabilen Release 3.6.4.
Datierte ältere Testberichte beschreiben ihre damaligen Versuchsbedingungen, keine automatische Freigabe für den heutigen Betrieb. Die Repository-Matrix enthält zusätzlich beta1; auf Athena sind nur fünf Textprofile installiert.