22 lines
1.1 KiB
Markdown
22 lines
1.1 KiB
Markdown
# Profilmatrix
|
|
|
|
Diese Datei wird aus `config/profile-matrix.json` erzeugt. Änderungen gehören nur in die JSON-Matrix.
|
|
|
|
Standardprofil: **medium** · globales Ausgabelimit: **8192 Token**
|
|
|
|
| Profil | API-Alias | Gesamtkontext | Slots | Modell | GPU-Verteilung | Vision | MTP |
|
|
|---|---|---:|---:|---|---|---|---:|
|
|
| fast | `qwen-fast` | 76,800 | 1 | Qwen3.8-27B IQ4 Mix | 5080 only | ja | 2 |
|
|
| medium | `qwen-medium` | 160,000 | 1 | Qwen3.8-27B IQ4 XS Pure | 85:15 | ja | 3 |
|
|
| large | `qwen-large` | 192,000 | 1 | Qwen3.8-27B IQ4 XS Pure | 86:14 | ja | 2 |
|
|
| ultra | `qwen-ultra` | 262,144 | 1 | Qwen3.8-27B IQ4 XS Pure | 80:20 | nein | 2 |
|
|
| uncensored | `qwen-uncensored` | 80,000 | 1 | Qwen3.8-27B Abliterated Q4_K_M | 90:10 | ja | 2 |
|
|
|
|
## Zweck
|
|
|
|
- **fast**: Schnelles Profil für kurze Chats und zügige Werkzeugaufgaben.
|
|
- **medium**: Ausgewogenes Standardprofil für Alltag und lange agentische Aufgaben.
|
|
- **large**: Großes Profil für umfangreiche Dokumente und lange technische Arbeiten.
|
|
- **ultra**: Maximaler Textkontext; bewusst ohne Vision-Projektor.
|
|
- **uncensored**: Weniger restriktives Spezialprofil; Werkzeugrechte bleiben unverändert.
|