Files
AI-Profile-Router/docs/CURRENT_RUNTIME_NOTES.md
T

1.5 KiB

Aktuelle Laufzeitnotizen

Stand: 20. September 2026.

Der verbindliche Abgleich steht im geprüften Live-Stand. Produktiv läuft llama.cpp 0.4.1 auf Commit b29c606, zuvor b10930. Alle fünf installierten Profile verwenden dasselbe CUDA-Image. Die Startoption bleibt --load-mode none.

Medium läuft im aktuellen OpenClaw-Praxistest mit zwei Slots. --kv-unified teilt den 160.000-Token-KV-Pool dynamisch zwischen beiden Slots; das Dashboard zeigt je Slot die aktuell noch erreichbare Kapazität. Alle anderen Profile und der Installationsstandard bleiben bei einem Slot.

B10930-Updatebericht: Version, Image-ID, Funktionsproben, Vergleichsmessungen und gesicherter Rückfallstand.

Update-Audit vom 15. September: aktualisierte Komponenten, unveränderte aktuelle Komponenten, Aufräumarbeiten und Rollback.

FLUX verwendet 9B FP8 Beta mit Textencoder auf der RTX 3060. Auflösungstest: 1024 erfolgreich, 1280 CUDA-OOM; produktive Begrenzung weiterhin 1024. Sprachausgabe: Qwen3-TTS 1.7B ohne Piper. Spracherkennung: Whisper.cpp 1.9.4 mit dem Modell small auf der CPU. Applio basiert auf dem stabilen Release 3.6.4.

Datierte ältere Testberichte beschreiben ihre damaligen Versuchsbedingungen, keine automatische Freigabe für den heutigen Betrieb. Die Repository-Matrix enthält zusätzlich beta1; auf Athena sind nur fünf Textprofile installiert.