Update llama.cpp runtime to build 10872

This commit is contained in:
Mikei386
2026-09-09 12:27:36 +02:00
parent 805228abfd
commit 535bd751b5
2 changed files with 7 additions and 6 deletions
+1 -1
View File
@@ -1 +1 @@
c7bda030e7faee594dbe7550185e857351ad405d
b31b71f3a076bfc4278daad442203a9c51c6e676
+6 -5
View File
@@ -21,11 +21,12 @@ nach Standardbenchmark, Tool-Calling-Test und Kontexttest übernommen.
- Fast, Medium, Large und Uncensored: integrierte Vision; der jeweilige
Projektor liegt vollständig auf der RTX 3060
Die produktive Runtime ist auf llama.cpp Build 10781, Commit
`c7bda030e7faee594dbe7550185e857351ad405d`, festgeschrieben. Dieser Stand
enthält die ab Build 10751 verfügbare Korrektur für eine zwischenzeitliche
MTP-/KV-Cache-Initialisierungsregression. Der vorherige produktive Stand war
Build 10718, Commit `41ef91f7c8046087cdfbb276b79bff311ecf1c6d`.
Die produktive Runtime ist auf llama.cpp Build 10872, Commit
`b31b71f3a076bfc4278daad442203a9c51c6e676`, festgeschrieben. Dieser Stand
enthält unter anderem die Korrekturen für die Qwen3.8-GDN-Normalisierung,
CUDA-Races, eine divergente Barriere im F16-Flash-Attention-Kernel sowie die
Checkpoint-Verdrängung im Prompt-Cache. Der vorherige produktive Stand war
Commit `c7bda030e7faee594dbe7550185e857351ad405d`.
Die Dateien selbst sind nicht Bestandteil des Repositories. Pfade und Hashes
werden im lokalen Modellmanifest verwaltet.