Update llama.cpp to b10930 and migrate model loading option
This commit is contained in:
+12
-6
@@ -129,7 +129,8 @@ services:
|
||||
- "off"
|
||||
- --n-gpu-layers
|
||||
- all
|
||||
- --no-mmap
|
||||
- --load-mode
|
||||
- none
|
||||
- --no-ui
|
||||
- --temperature
|
||||
- "0.2"
|
||||
@@ -206,7 +207,8 @@ services:
|
||||
- "off"
|
||||
- --n-gpu-layers
|
||||
- all
|
||||
- --no-mmap
|
||||
- --load-mode
|
||||
- none
|
||||
- --no-ui
|
||||
- --temperature
|
||||
# Qwen3.8's official thinking-mode sampler. The former 0.2 setting was
|
||||
@@ -292,7 +294,8 @@ services:
|
||||
- "off"
|
||||
- --n-gpu-layers
|
||||
- all
|
||||
- --no-mmap
|
||||
- --load-mode
|
||||
- none
|
||||
- --no-ui
|
||||
- --temperature
|
||||
- "1.0"
|
||||
@@ -371,7 +374,8 @@ services:
|
||||
- "off"
|
||||
- --n-gpu-layers
|
||||
- all
|
||||
- --no-mmap
|
||||
- --load-mode
|
||||
- none
|
||||
- --no-ui
|
||||
- --temperature
|
||||
- "0.2"
|
||||
@@ -449,7 +453,8 @@ services:
|
||||
- "off"
|
||||
- --n-gpu-layers
|
||||
- all
|
||||
- --no-mmap
|
||||
- --load-mode
|
||||
- none
|
||||
- --no-ui
|
||||
- --temperature
|
||||
- "0.2"
|
||||
@@ -531,7 +536,8 @@ services:
|
||||
- "off"
|
||||
- --n-gpu-layers
|
||||
- all
|
||||
- --no-mmap
|
||||
- --load-mode
|
||||
- none
|
||||
- --no-ui
|
||||
- --temperature
|
||||
- "0.2"
|
||||
|
||||
Reference in New Issue
Block a user