Update llama.cpp to build 10781
This commit is contained in:
@@ -1,14 +1,16 @@
|
|||||||
# Aktueller produktiver Laufzustand
|
# Aktueller produktiver Laufzustand
|
||||||
|
|
||||||
Stand: 1. September 2026
|
Stand: 3. September 2026
|
||||||
|
|
||||||
## Produktive llama.cpp-Runtime
|
## Produktive llama.cpp-Runtime
|
||||||
|
|
||||||
Alle Textprofile verwenden llama.cpp Build 10718,
|
Alle Textprofile verwenden llama.cpp Build 10781,
|
||||||
Commit `41ef91f7c8046087cdfbb276b79bff311ecf1c6d`. Der vorherige Build 10587
|
Commit `c7bda030e7faee594dbe7550185e857351ad405d`. Der Stand enthält die ab
|
||||||
wurde nach einem kontrollierten A/B-Test ersetzt. Der Wechsel verbessert den
|
Build 10751 verfügbare Korrektur für eine zwischenzeitliche
|
||||||
Durchsatz bei großen Werkzeuglisten, ohne im 70K-/120K-Kontext- und Cachetest
|
MTP-/KV-Cache-Initialisierungsregression. Der vorherige produktive Stand war
|
||||||
eine Regression zu zeigen.
|
Build 10718, Commit `41ef91f7c8046087cdfbb276b79bff311ecf1c6d`, und bleibt über das alte
|
||||||
|
lokale Image als unmittelbarer Rückfallpunkt erhalten, bis Build 10781 mit
|
||||||
|
Qwen, MTP, Vision und langem Kontext verifiziert ist.
|
||||||
|
|
||||||
## Qwen Medium: Vision-Projektor wieder aktiviert
|
## Qwen Medium: Vision-Projektor wieder aktiviert
|
||||||
|
|
||||||
|
|||||||
@@ -1 +1 @@
|
|||||||
41ef91f7c8046087cdfbb276b79bff311ecf1c6d
|
c7bda030e7faee594dbe7550185e857351ad405d
|
||||||
|
|||||||
@@ -21,13 +21,11 @@ nach Standardbenchmark, Tool-Calling-Test und Kontexttest übernommen.
|
|||||||
- Fast, Medium, Large und Uncensored: integrierte Vision; der jeweilige
|
- Fast, Medium, Large und Uncensored: integrierte Vision; der jeweilige
|
||||||
Projektor liegt vollständig auf der RTX 3060
|
Projektor liegt vollständig auf der RTX 3060
|
||||||
|
|
||||||
Die produktive Runtime ist auf llama.cpp Build 10718, Commit
|
Die produktive Runtime ist auf llama.cpp Build 10781, Commit
|
||||||
`41ef91f7c8046087cdfbb276b79bff311ecf1c6d`, festgeschrieben. Im lokalen
|
`c7bda030e7faee594dbe7550185e857351ad405d`, festgeschrieben. Dieser Stand
|
||||||
A/B-Test blieben normaler Durchsatz, 70K-/120K-Kontext und Prompt-Cache
|
enthält die ab Build 10751 verfügbare Korrektur für eine zwischenzeitliche
|
||||||
unverändert. Mit 100 angebotenen Werkzeugen stieg der Ausgabedurchsatz von
|
MTP-/KV-Cache-Initialisierungsregression. Der vorherige produktive Stand war
|
||||||
56,03 auf 60,67 Tokens/s. Der Build begrenzt insbesondere einen teuren
|
Build 10718, Commit `41ef91f7c8046087cdfbb276b79bff311ecf1c6d`.
|
||||||
Qwen3-Coder-Workaround wieder auf die betroffenen Modellfamilien, statt ihn
|
|
||||||
auch auf Qwen3.8 anzuwenden.
|
|
||||||
|
|
||||||
Die Dateien selbst sind nicht Bestandteil des Repositories. Pfade und Hashes
|
Die Dateien selbst sind nicht Bestandteil des Repositories. Pfade und Hashes
|
||||||
werden im lokalen Modellmanifest verwaltet.
|
werden im lokalen Modellmanifest verwaltet.
|
||||||
|
|||||||
Reference in New Issue
Block a user