Update llama.cpp runtime to build 10872
This commit is contained in:
@@ -1 +1 @@
|
|||||||
c7bda030e7faee594dbe7550185e857351ad405d
|
b31b71f3a076bfc4278daad442203a9c51c6e676
|
||||||
|
|||||||
@@ -21,11 +21,12 @@ nach Standardbenchmark, Tool-Calling-Test und Kontexttest übernommen.
|
|||||||
- Fast, Medium, Large und Uncensored: integrierte Vision; der jeweilige
|
- Fast, Medium, Large und Uncensored: integrierte Vision; der jeweilige
|
||||||
Projektor liegt vollständig auf der RTX 3060
|
Projektor liegt vollständig auf der RTX 3060
|
||||||
|
|
||||||
Die produktive Runtime ist auf llama.cpp Build 10781, Commit
|
Die produktive Runtime ist auf llama.cpp Build 10872, Commit
|
||||||
`c7bda030e7faee594dbe7550185e857351ad405d`, festgeschrieben. Dieser Stand
|
`b31b71f3a076bfc4278daad442203a9c51c6e676`, festgeschrieben. Dieser Stand
|
||||||
enthält die ab Build 10751 verfügbare Korrektur für eine zwischenzeitliche
|
enthält unter anderem die Korrekturen für die Qwen3.8-GDN-Normalisierung,
|
||||||
MTP-/KV-Cache-Initialisierungsregression. Der vorherige produktive Stand war
|
CUDA-Races, eine divergente Barriere im F16-Flash-Attention-Kernel sowie die
|
||||||
Build 10718, Commit `41ef91f7c8046087cdfbb276b79bff311ecf1c6d`.
|
Checkpoint-Verdrängung im Prompt-Cache. Der vorherige produktive Stand war
|
||||||
|
Commit `c7bda030e7faee594dbe7550185e857351ad405d`.
|
||||||
|
|
||||||
Die Dateien selbst sind nicht Bestandteil des Repositories. Pfade und Hashes
|
Die Dateien selbst sind nicht Bestandteil des Repositories. Pfade und Hashes
|
||||||
werden im lokalen Modellmanifest verwaltet.
|
werden im lokalen Modellmanifest verwaltet.
|
||||||
|
|||||||
Reference in New Issue
Block a user