Files
AI-Profile-Router/docs/MIGRATION.md
T

42 lines
1.4 KiB
Markdown

# Migration vom bestehenden Host
## Behalten
- Qwen3.8-27B IQ4-MIX und das getestete MTP2-Profil
- IQ4_XS Pure für Medium
- BF16-`mmproj` für die integrierte Vision aller Qwen-Profile
- festgeschriebener llama.cpp-Commit
- Router, Whisper, XTTS und Websuche
- spezialisierte MCPs nach Sicherheitsprofil
- relevante Benchmarkresultate
## Nicht übernehmen
- RX-470-Dienste
- doppelte Whisper-Server
- automatisch aktivierte Modellrennen und Benchmarks
- unvollständige Modelldownloads
- alte llama.cpp-/BeeLlama-Testbuilds
- alte systemd-Backups
- Caches und generierte Medien
- doppelte oder klar unterlegene Modelle
## Reihenfolge
1. Repositories und verschlüsselte Konfiguration sichern.
2. Modellmanifest mit Dateigrößen und SHA256 erstellen.
3. Neuen Host installieren und Speicherlayout festlegen.
4. NVIDIA-Treiber und CUDA verifizieren.
5. Festgeschriebenen llama.cpp-Commit bauen.
6. nur die benötigten Modelle übertragen und Hashes prüfen.
7. Fast-Profil ohne MCP starten und testen.
8. Medium und Long einzeln testen.
9. Router installieren und Profilwechsel testen.
10. Web, HA, ARR und Unraid nacheinander hinzufügen.
11. STT, TTS und den Projektor für integrierte Vision ergänzen.
12. Standardbenchmark und Sicherheitsprüfung ausführen.
13. Erst danach Clients umstellen.
Der alte Host bleibt bis zum bestandenen Abnahmetest unverändert und dient nur
als Referenz. Es werden keine Caches oder unbekannten Altverzeichnisse kopiert.