Files
AI-Profile-Router/docs/MIGRATION.md
T

1.4 KiB

Migration vom bestehenden Host

Behalten

  • Qwen3.8-27B IQ4-MIX und das getestete MTP2-Profil
  • IQ4_XS Pure für Medium
  • BF16-mmproj für die integrierte Vision aller Qwen-Profile
  • festgeschriebener llama.cpp-Commit
  • Router, Whisper, XTTS und Websuche
  • spezialisierte MCPs nach Sicherheitsprofil
  • relevante Benchmarkresultate

Nicht übernehmen

  • RX-470-Dienste
  • doppelte Whisper-Server
  • automatisch aktivierte Modellrennen und Benchmarks
  • unvollständige Modelldownloads
  • alte llama.cpp-/BeeLlama-Testbuilds
  • alte systemd-Backups
  • Caches und generierte Medien
  • doppelte oder klar unterlegene Modelle

Reihenfolge

  1. Repositories und verschlüsselte Konfiguration sichern.
  2. Modellmanifest mit Dateigrößen und SHA256 erstellen.
  3. Neuen Host installieren und Speicherlayout festlegen.
  4. NVIDIA-Treiber und CUDA verifizieren.
  5. Festgeschriebenen llama.cpp-Commit bauen.
  6. nur die benötigten Modelle übertragen und Hashes prüfen.
  7. Fast-Profil ohne MCP starten und testen.
  8. Medium und Long einzeln testen.
  9. Router installieren und Profilwechsel testen.
  10. Web, HA, ARR und Unraid nacheinander hinzufügen.
  11. STT, TTS und den Projektor für integrierte Vision ergänzen.
  12. Standardbenchmark und Sicherheitsprüfung ausführen.
  13. Erst danach Clients umstellen.

Der alte Host bleibt bis zum bestandenen Abnahmetest unverändert und dient nur als Referenz. Es werden keine Caches oder unbekannten Altverzeichnisse kopiert.