Files
AI-Profile-Router/docs/CURRENT_RUNTIME_NOTES.md
T

21 lines
991 B
Markdown

# Aktuelle Laufzeitnotizen
Stand: 12. September 2026.
Der verbindliche Abgleich steht im [geprüften Live-Stand](LIVE_STATE.md).
Produktiv läuft **llama.cpp b10930**, zuvor b10872. Die frühere Angabe b10781
war veraltet. Alle fünf installierten Profile wurden aktualisiert; die
Startoption wurde auf `--load-mode none` migriert.
[B10930-Updatebericht](LLAMA_B10930_UPDATE_20260912.md): Version, Image-ID,
Funktionsproben, Vergleichsmessungen und gesicherter Rückfallstand.
FLUX verwendet **9B FP8 Beta** mit Textencoder auf der RTX 3060.
[Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md): 1024 erfolgreich,
1280 CUDA-OOM; produktive Begrenzung weiterhin 1024.
Sprachausgabe: Qwen3-TTS 1.7B ohne Piper. Spracherkennung: Whisper.cpp small auf CPU.
Datierte ältere Testberichte beschreiben ihre damaligen Versuchsbedingungen,
keine automatische Freigabe für den heutigen Betrieb. Die Repository-Matrix
enthält zusätzlich beta1; auf Athena sind nur fünf Textprofile installiert.