Update llama.cpp to b10930 and migrate model loading option

This commit is contained in:
Mikei386
2026-09-12 20:41:05 +02:00
parent 6c00b00add
commit 2415b27160
9 changed files with 122 additions and 28 deletions
+13 -12
View File
@@ -17,19 +17,20 @@ andere private Ziele werden dadurch nicht freigeschaltet.
## Produktive llama.cpp-Runtime
Alle Textprofile verwenden llama.cpp Build 10781,
Commit `c7bda030e7faee594dbe7550185e857351ad405d`. Der Stand enthält die ab
Build 10751 verfügbare Korrektur für eine zwischenzeitliche
MTP-/KV-Cache-Initialisierungsregression. Der vorherige produktive Stand war
Build 10718, Commit `41ef91f7c8046087cdfbb276b79bff311ecf1c6d`, und bleibt über das alte
lokale Image `mike-ai/llama.cpp:b10718-fallback` als unmittelbarer
Rückfallpunkt erhalten.
Aktualisiert am 12. September 2026: Alle fünf Textprofilcontainer verwenden
llama.cpp **Build 10930**, Commit
`56381e407c0ccfb3a6f71e668a27a901001d22ce`.
Build 10781 wurde nach dem Bau produktiv verifiziert: Alle fünf
Profilcontainer verwenden dasselbe neue Image, ausschließlich Medium läuft,
Qwen Medium ist mit 160.000 Tokens Kontext gesund, der MTP-Kontext wurde
erfolgreich initialisiert, der Vision-Projektor geladen und eine lokale
Textprobe korrekt beantwortet.
Der tatsächliche vorherige Live-Build war 10872
(`b31b71f3a076bfc4278daad442203a9c51c6e676`), nicht der hier zuvor
angegebene Build 10781. Er bleibt unter
`mike-ai/llama.cpp:b10872-pre-b10930` als Rückfallimage erhalten.
Das Update enthält den Fix für die Drafter-Position nach Bildeingaben
[#28715](https://github.com/ggml-org/llama.cpp/pull/28715). Modellgewichte,
Profilkontexte, GPU-Aufteilung, Vision, Slots und MTP-Parameter bleiben
unverändert. Details und Testgrenzen stehen im
[Updateprotokoll](LLAMA_B10930_UPDATE_20260912.md).
## Qwen Medium: Vision-Projektor wieder aktiviert