Files
AI-Profile-Router/docs/CURRENT_RUNTIME_NOTES.md
T

991 B

Aktuelle Laufzeitnotizen

Stand: 12. September 2026.

Der verbindliche Abgleich steht im geprüften Live-Stand. Produktiv läuft llama.cpp b10930, zuvor b10872. Die frühere Angabe b10781 war veraltet. Alle fünf installierten Profile wurden aktualisiert; die Startoption wurde auf --load-mode none migriert.

B10930-Updatebericht: Version, Image-ID, Funktionsproben, Vergleichsmessungen und gesicherter Rückfallstand.

FLUX verwendet 9B FP8 Beta mit Textencoder auf der RTX 3060. Auflösungstest: 1024 erfolgreich, 1280 CUDA-OOM; produktive Begrenzung weiterhin 1024. Sprachausgabe: Qwen3-TTS 1.7B ohne Piper. Spracherkennung: Whisper.cpp small auf CPU.

Datierte ältere Testberichte beschreiben ihre damaligen Versuchsbedingungen, keine automatische Freigabe für den heutigen Betrieb. Die Repository-Matrix enthält zusätzlich beta1; auf Athena sind nur fünf Textprofile installiert.