Files
AI-Profile-Router/docs/CURRENT_RUNTIME_NOTES.md
T

1.2 KiB

Aktuelle Laufzeitnotizen

Stand: 15. September 2026.

Der verbindliche Abgleich steht im geprüften Live-Stand. Produktiv läuft llama.cpp 0.4.1 auf Commit b29c606, zuvor b10930. Alle fünf installierten Profile verwenden dasselbe CUDA-Image. Die Startoption bleibt --load-mode none.

B10930-Updatebericht: Version, Image-ID, Funktionsproben, Vergleichsmessungen und gesicherter Rückfallstand.

Update-Audit vom 15. September: aktualisierte Komponenten, unveränderte aktuelle Komponenten, Aufräumarbeiten und Rollback.

FLUX verwendet 9B FP8 Beta mit Textencoder auf der RTX 3060. Auflösungstest: 1024 erfolgreich, 1280 CUDA-OOM; produktive Begrenzung weiterhin 1024. Sprachausgabe: Qwen3-TTS 1.7B ohne Piper. Spracherkennung: Whisper.cpp 1.9.4 mit dem Modell small auf der CPU. Applio basiert auf dem stabilen Release 3.6.4.

Datierte ältere Testberichte beschreiben ihre damaligen Versuchsbedingungen, keine automatische Freigabe für den heutigen Betrieb. Die Repository-Matrix enthält zusätzlich beta1; auf Athena sind nur fünf Textprofile installiert.