Update llama.cpp to b10930 and migrate model loading option
This commit is contained in:
@@ -21,11 +21,22 @@ nach Standardbenchmark, Tool-Calling-Test und Kontexttest übernommen.
|
||||
- Fast, Medium, Large und Uncensored: integrierte Vision; der jeweilige
|
||||
Projektor liegt vollständig auf der RTX 3060
|
||||
|
||||
Die produktive Runtime ist auf llama.cpp Build 10781, Commit
|
||||
`c7bda030e7faee594dbe7550185e857351ad405d`, festgeschrieben. Dieser Stand
|
||||
enthält die ab Build 10751 verfügbare Korrektur für eine zwischenzeitliche
|
||||
MTP-/KV-Cache-Initialisierungsregression. Der vorherige produktive Stand war
|
||||
Build 10718, Commit `41ef91f7c8046087cdfbb276b79bff311ecf1c6d`.
|
||||
Die produktive Runtime ist seit dem 12. September 2026 auf llama.cpp
|
||||
**Build 10930**, Commit `56381e407c0ccfb3a6f71e668a27a901001d22ce`,
|
||||
festgeschrieben. Enthalten ist der am 11. September integrierte Fix
|
||||
[„speculation after an image“ (#28715)](https://github.com/ggml-org/llama.cpp/pull/28715).
|
||||
Er korrigiert die Positionsübergabe an den Drafter nach Bildeingaben und ist
|
||||
nicht mit einer generellen Behebung aller MMProj-/Prompt-Cache-Probleme
|
||||
gleichzusetzen.
|
||||
|
||||
Der unmittelbar vorher laufende Build war **10872**, Commit
|
||||
`b31b71f3a076bfc4278daad442203a9c51c6e676`; die frühere Angabe 10781
|
||||
war im Live-System bereits überholt. Das unveränderte Rückfallimage heißt
|
||||
`mike-ai/llama.cpp:b10872-pre-b10930`.
|
||||
|
||||
Build, Tests und Wiederherstellung sind in
|
||||
[docs/LLAMA_B10930_UPDATE_20260912.md](../../docs/LLAMA_B10930_UPDATE_20260912.md)
|
||||
dokumentiert.
|
||||
|
||||
Die Dateien selbst sind nicht Bestandteil des Repositories. Pfade und Hashes
|
||||
werden im lokalen Modellmanifest verwaltet.
|
||||
|
||||
Reference in New Issue
Block a user