Files
AI-Profile-Router/docs/CURRENT_RUNTIME_NOTES.md

1.5 KiB

Aktuelle Laufzeitnotizen

Stand: 21. September 2026.

Der verbindliche Abgleich steht im geprüften Live-Stand. Produktiv läuft llama.cpp 0.4.1 auf Commit b29c606, zuvor b10930. Alle fünf installierten Profile verwenden dasselbe CUDA-Image. Die Startoption bleibt --load-mode none.

Medium läuft im aktuellen OpenClaw-Praxistest mit zwei Slots. --kv-unified teilt den 160.000-Token-KV-Pool dynamisch zwischen beiden Slots; das Dashboard zeigt je Slot die aktuell noch erreichbare Kapazität. Alle anderen Profile und der Installationsstandard bleiben bei einem Slot.

B10930-Updatebericht: Version, Image-ID, Funktionsproben, Vergleichsmessungen und gesicherter Rückfallstand.

Update-Audit vom 15. September: aktualisierte Komponenten, unveränderte aktuelle Komponenten, Aufräumarbeiten und Rollback.

Der produktive Bildpfad verwendet Qwen-Image-2.1 INT8 mit ComfyUI auf der RTX 5080. FLUX 9B FP8 und seine Gewichte bleiben als gestoppter Rückfallpfad. Qwen-Betriebsdoku; der historische FLUX-Auflösungstest gilt nur für FLUX. Sprachausgabe: Qwen3-TTS 1.7B ohne Piper. Spracherkennung: Whisper.cpp 1.9.4 mit dem Modell small auf der CPU. Applio basiert auf dem stabilen Release 3.6.4.

Datierte ältere Testberichte beschreiben ihre damaligen Versuchsbedingungen, keine automatische Freigabe für den heutigen Betrieb. Die Repository-Matrix enthält zusätzlich beta1; auf Athena sind nur fünf Textprofile installiert.