Update llama.cpp to build 10781

This commit is contained in:
Mikei386
2026-09-03 12:09:10 +02:00
parent fb0cb40bed
commit b0ecc83462
3 changed files with 14 additions and 14 deletions
+8 -6
View File
@@ -1,14 +1,16 @@
# Aktueller produktiver Laufzustand # Aktueller produktiver Laufzustand
Stand: 1. September 2026 Stand: 3. September 2026
## Produktive llama.cpp-Runtime ## Produktive llama.cpp-Runtime
Alle Textprofile verwenden llama.cpp Build 10718, Alle Textprofile verwenden llama.cpp Build 10781,
Commit `41ef91f7c8046087cdfbb276b79bff311ecf1c6d`. Der vorherige Build 10587 Commit `c7bda030e7faee594dbe7550185e857351ad405d`. Der Stand enthält die ab
wurde nach einem kontrollierten A/B-Test ersetzt. Der Wechsel verbessert den Build 10751 verfügbare Korrektur für eine zwischenzeitliche
Durchsatz bei großen Werkzeuglisten, ohne im 70K-/120K-Kontext- und Cachetest MTP-/KV-Cache-Initialisierungsregression. Der vorherige produktive Stand war
eine Regression zu zeigen. Build 10718, Commit `41ef91f7c8046087cdfbb276b79bff311ecf1c6d`, und bleibt über das alte
lokale Image als unmittelbarer Rückfallpunkt erhalten, bis Build 10781 mit
Qwen, MTP, Vision und langem Kontext verifiziert ist.
## Qwen Medium: Vision-Projektor wieder aktiviert ## Qwen Medium: Vision-Projektor wieder aktiviert
+1 -1
View File
@@ -1 +1 @@
41ef91f7c8046087cdfbb276b79bff311ecf1c6d c7bda030e7faee594dbe7550185e857351ad405d
+5 -7
View File
@@ -21,13 +21,11 @@ nach Standardbenchmark, Tool-Calling-Test und Kontexttest übernommen.
- Fast, Medium, Large und Uncensored: integrierte Vision; der jeweilige - Fast, Medium, Large und Uncensored: integrierte Vision; der jeweilige
Projektor liegt vollständig auf der RTX 3060 Projektor liegt vollständig auf der RTX 3060
Die produktive Runtime ist auf llama.cpp Build 10718, Commit Die produktive Runtime ist auf llama.cpp Build 10781, Commit
`41ef91f7c8046087cdfbb276b79bff311ecf1c6d`, festgeschrieben. Im lokalen `c7bda030e7faee594dbe7550185e857351ad405d`, festgeschrieben. Dieser Stand
A/B-Test blieben normaler Durchsatz, 70K-/120K-Kontext und Prompt-Cache enthält die ab Build 10751 verfügbare Korrektur für eine zwischenzeitliche
unverändert. Mit 100 angebotenen Werkzeugen stieg der Ausgabedurchsatz von MTP-/KV-Cache-Initialisierungsregression. Der vorherige produktive Stand war
56,03 auf 60,67 Tokens/s. Der Build begrenzt insbesondere einen teuren Build 10718, Commit `41ef91f7c8046087cdfbb276b79bff311ecf1c6d`.
Qwen3-Coder-Workaround wieder auf die betroffenen Modellfamilien, statt ihn
auch auf Qwen3.8 anzuwenden.
Die Dateien selbst sind nicht Bestandteil des Repositories. Pfade und Hashes Die Dateien selbst sind nicht Bestandteil des Repositories. Pfade und Hashes
werden im lokalen Modellmanifest verwaltet. werden im lokalen Modellmanifest verwaltet.