30 lines
1.5 KiB
Markdown
30 lines
1.5 KiB
Markdown
# Aktuelle Laufzeitnotizen
|
|
|
|
Stand: 20. September 2026.
|
|
|
|
Der verbindliche Abgleich steht im [geprüften Live-Stand](LIVE_STATE.md).
|
|
Produktiv läuft **llama.cpp 0.4.1** auf Commit `b29c606`, zuvor b10930.
|
|
Alle fünf installierten Profile verwenden dasselbe CUDA-Image. Die Startoption
|
|
bleibt `--load-mode none`.
|
|
|
|
Medium läuft im aktuellen OpenClaw-Praxistest mit zwei Slots. `--kv-unified`
|
|
teilt den 160.000-Token-KV-Pool dynamisch zwischen beiden Slots; das Dashboard
|
|
zeigt je Slot die aktuell noch erreichbare Kapazität. Alle anderen Profile und
|
|
der Installationsstandard bleiben bei einem Slot.
|
|
|
|
[B10930-Updatebericht](LLAMA_B10930_UPDATE_20260912.md): Version, Image-ID,
|
|
Funktionsproben, Vergleichsmessungen und gesicherter Rückfallstand.
|
|
|
|
[Update-Audit vom 15. September](UPDATE_AUDIT_20260915.md): aktualisierte
|
|
Komponenten, unveränderte aktuelle Komponenten, Aufräumarbeiten und Rollback.
|
|
|
|
FLUX verwendet **9B FP8 Beta** mit Textencoder auf der RTX 3060.
|
|
[Auflösungstest](FLUX_RESOLUTION_TEST_20260912.md): 1024 erfolgreich,
|
|
1280 CUDA-OOM; produktive Begrenzung weiterhin 1024.
|
|
Sprachausgabe: Qwen3-TTS 1.7B ohne Piper. Spracherkennung: Whisper.cpp 1.9.4
|
|
mit dem Modell `small` auf der CPU. Applio basiert auf dem stabilen Release 3.6.4.
|
|
|
|
Datierte ältere Testberichte beschreiben ihre damaligen Versuchsbedingungen,
|
|
keine automatische Freigabe für den heutigen Betrieb. Die Repository-Matrix
|
|
enthält zusätzlich beta1; auf Athena sind nur fünf Textprofile installiert.
|