Files
AI-Profile-Router/docs/CURRENT_RUNTIME_NOTES.md

31 lines
1.5 KiB
Markdown

# Aktuelle Laufzeitnotizen
Stand: 21. September 2026.
Der verbindliche Abgleich steht im [geprüften Live-Stand](LIVE_STATE.md).
Produktiv läuft **llama.cpp 0.4.1** auf Commit `b29c606`, zuvor b10930.
Alle fünf installierten Profile verwenden dasselbe CUDA-Image. Die Startoption
bleibt `--load-mode none`.
Medium läuft im aktuellen OpenClaw-Praxistest mit zwei Slots. `--kv-unified`
teilt den 160.000-Token-KV-Pool dynamisch zwischen beiden Slots; das Dashboard
zeigt je Slot die aktuell noch erreichbare Kapazität. Alle anderen Profile und
der Installationsstandard bleiben bei einem Slot.
[B10930-Updatebericht](LLAMA_B10930_UPDATE_20260912.md): Version, Image-ID,
Funktionsproben, Vergleichsmessungen und gesicherter Rückfallstand.
[Update-Audit vom 15. September](UPDATE_AUDIT_20260915.md): aktualisierte
Komponenten, unveränderte aktuelle Komponenten, Aufräumarbeiten und Rollback.
Der produktive Bildpfad verwendet **Qwen-Image-2.1 INT8** mit ComfyUI auf der
RTX 5080. FLUX 9B FP8 und seine Gewichte bleiben als gestoppter Rückfallpfad.
[Qwen-Betriebsdoku](QWEN_IMAGE_21.md); der historische
[FLUX-Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md) gilt nur für FLUX.
Sprachausgabe: Qwen3-TTS 1.7B ohne Piper. Spracherkennung: Whisper.cpp 1.9.4
mit dem Modell `small` auf der CPU. Applio basiert auf dem stabilen Release 3.6.4.
Datierte ältere Testberichte beschreiben ihre damaligen Versuchsbedingungen,
keine automatische Freigabe für den heutigen Betrieb. Die Repository-Matrix
enthält zusätzlich beta1; auf Athena sind nur fünf Textprofile installiert.