Update llama.cpp to b10930 and migrate model loading option

This commit is contained in:
Mikei386
2026-09-12 20:41:05 +02:00
parent 6c00b00add
commit 2415b27160
9 changed files with 122 additions and 28 deletions
+16 -5
View File
@@ -21,11 +21,22 @@ nach Standardbenchmark, Tool-Calling-Test und Kontexttest übernommen.
- Fast, Medium, Large und Uncensored: integrierte Vision; der jeweilige
Projektor liegt vollständig auf der RTX 3060
Die produktive Runtime ist auf llama.cpp Build 10781, Commit
`c7bda030e7faee594dbe7550185e857351ad405d`, festgeschrieben. Dieser Stand
enthält die ab Build 10751 verfügbare Korrektur für eine zwischenzeitliche
MTP-/KV-Cache-Initialisierungsregression. Der vorherige produktive Stand war
Build 10718, Commit `41ef91f7c8046087cdfbb276b79bff311ecf1c6d`.
Die produktive Runtime ist seit dem 12. September 2026 auf llama.cpp
**Build 10930**, Commit `56381e407c0ccfb3a6f71e668a27a901001d22ce`,
festgeschrieben. Enthalten ist der am 11. September integrierte Fix
[„speculation after an image“ (#28715)](https://github.com/ggml-org/llama.cpp/pull/28715).
Er korrigiert die Positionsübergabe an den Drafter nach Bildeingaben und ist
nicht mit einer generellen Behebung aller MMProj-/Prompt-Cache-Probleme
gleichzusetzen.
Der unmittelbar vorher laufende Build war **10872**, Commit
`b31b71f3a076bfc4278daad442203a9c51c6e676`; die frühere Angabe 10781
war im Live-System bereits überholt. Das unveränderte Rückfallimage heißt
`mike-ai/llama.cpp:b10872-pre-b10930`.
Build, Tests und Wiederherstellung sind in
[docs/LLAMA_B10930_UPDATE_20260912.md](../../docs/LLAMA_B10930_UPDATE_20260912.md)
dokumentiert.
Die Dateien selbst sind nicht Bestandteil des Repositories. Pfade und Hashes
werden im lokalen Modellmanifest verwaltet.