Update llama.cpp to b10930 and migrate model loading option
This commit is contained in:
@@ -17,19 +17,20 @@ andere private Ziele werden dadurch nicht freigeschaltet.
|
||||
|
||||
## Produktive llama.cpp-Runtime
|
||||
|
||||
Alle Textprofile verwenden llama.cpp Build 10781,
|
||||
Commit `c7bda030e7faee594dbe7550185e857351ad405d`. Der Stand enthält die ab
|
||||
Build 10751 verfügbare Korrektur für eine zwischenzeitliche
|
||||
MTP-/KV-Cache-Initialisierungsregression. Der vorherige produktive Stand war
|
||||
Build 10718, Commit `41ef91f7c8046087cdfbb276b79bff311ecf1c6d`, und bleibt über das alte
|
||||
lokale Image `mike-ai/llama.cpp:b10718-fallback` als unmittelbarer
|
||||
Rückfallpunkt erhalten.
|
||||
Aktualisiert am 12. September 2026: Alle fünf Textprofilcontainer verwenden
|
||||
llama.cpp **Build 10930**, Commit
|
||||
`56381e407c0ccfb3a6f71e668a27a901001d22ce`.
|
||||
|
||||
Build 10781 wurde nach dem Bau produktiv verifiziert: Alle fünf
|
||||
Profilcontainer verwenden dasselbe neue Image, ausschließlich Medium läuft,
|
||||
Qwen Medium ist mit 160.000 Tokens Kontext gesund, der MTP-Kontext wurde
|
||||
erfolgreich initialisiert, der Vision-Projektor geladen und eine lokale
|
||||
Textprobe korrekt beantwortet.
|
||||
Der tatsächliche vorherige Live-Build war 10872
|
||||
(`b31b71f3a076bfc4278daad442203a9c51c6e676`), nicht der hier zuvor
|
||||
angegebene Build 10781. Er bleibt unter
|
||||
`mike-ai/llama.cpp:b10872-pre-b10930` als Rückfallimage erhalten.
|
||||
|
||||
Das Update enthält den Fix für die Drafter-Position nach Bildeingaben
|
||||
[#28715](https://github.com/ggml-org/llama.cpp/pull/28715). Modellgewichte,
|
||||
Profilkontexte, GPU-Aufteilung, Vision, Slots und MTP-Parameter bleiben
|
||||
unverändert. Details und Testgrenzen stehen im
|
||||
[Updateprotokoll](LLAMA_B10930_UPDATE_20260912.md).
|
||||
|
||||
## Qwen Medium: Vision-Projektor wieder aktiviert
|
||||
|
||||
|
||||
Reference in New Issue
Block a user