42 lines
1.4 KiB
Markdown
42 lines
1.4 KiB
Markdown
# Migration vom bestehenden Host
|
|
|
|
## Behalten
|
|
|
|
- Qwen3.8-27B IQ4-MIX und das getestete MTP2-Profil
|
|
- IQ4_XS Pure für Medium
|
|
- Q3-Vision-Modell und passender `mmproj`
|
|
- festgeschriebener llama.cpp-Commit
|
|
- Router, Whisper, XTTS und Websuche
|
|
- spezialisierte MCPs nach Sicherheitsprofil
|
|
- relevante Benchmarkresultate
|
|
|
|
## Nicht übernehmen
|
|
|
|
- RX-470-Dienste
|
|
- doppelte Whisper-Server
|
|
- automatisch aktivierte Modellrennen und Benchmarks
|
|
- unvollständige Modelldownloads
|
|
- alte llama.cpp-/BeeLlama-Testbuilds
|
|
- alte systemd-Backups
|
|
- Caches und generierte Medien
|
|
- doppelte oder klar unterlegene Modelle
|
|
|
|
## Reihenfolge
|
|
|
|
1. Repositories und verschlüsselte Konfiguration sichern.
|
|
2. Modellmanifest mit Dateigrößen und SHA256 erstellen.
|
|
3. Neuen Host installieren und Speicherlayout festlegen.
|
|
4. NVIDIA-Treiber und CUDA verifizieren.
|
|
5. Festgeschriebenen llama.cpp-Commit bauen.
|
|
6. nur die benötigten Modelle übertragen und Hashes prüfen.
|
|
7. Fast-Profil ohne MCP starten und testen.
|
|
8. Medium und Long einzeln testen.
|
|
9. Router installieren und Profilwechsel testen.
|
|
10. Web, HA, ARR und Unraid nacheinander hinzufügen.
|
|
11. STT, TTS und Vision ergänzen.
|
|
12. Standardbenchmark und Sicherheitsprüfung ausführen.
|
|
13. Erst danach Clients umstellen.
|
|
|
|
Der alte Host bleibt bis zum bestandenen Abnahmetest unverändert und dient nur
|
|
als Referenz. Es werden keine Caches oder unbekannten Altverzeichnisse kopiert.
|