Expand router into reproducible local AI platform
This commit is contained in:
@@ -0,0 +1,41 @@
|
||||
# Migration vom bestehenden Host
|
||||
|
||||
## Behalten
|
||||
|
||||
- Qwen3.8-27B IQ4-MIX und das getestete MTP2-Profil
|
||||
- IQ4_XS Pure für Medium
|
||||
- Q3-Vision-Modell und passender `mmproj`
|
||||
- festgeschriebener llama.cpp-Commit
|
||||
- Router, Whisper, XTTS und Websuche
|
||||
- spezialisierte MCPs nach Sicherheitsprofil
|
||||
- relevante Benchmarkresultate
|
||||
|
||||
## Nicht übernehmen
|
||||
|
||||
- RX-470-Dienste
|
||||
- doppelte Whisper-Server
|
||||
- automatisch aktivierte Modellrennen und Benchmarks
|
||||
- unvollständige Modelldownloads
|
||||
- alte llama.cpp-/BeeLlama-Testbuilds
|
||||
- alte systemd-Backups
|
||||
- Caches und generierte Medien
|
||||
- doppelte oder klar unterlegene Modelle
|
||||
|
||||
## Reihenfolge
|
||||
|
||||
1. Repositories und verschlüsselte Konfiguration sichern.
|
||||
2. Modellmanifest mit Dateigrößen und SHA256 erstellen.
|
||||
3. Neuen Host installieren und Speicherlayout festlegen.
|
||||
4. NVIDIA-Treiber und CUDA verifizieren.
|
||||
5. Festgeschriebenen llama.cpp-Commit bauen.
|
||||
6. nur die benötigten Modelle übertragen und Hashes prüfen.
|
||||
7. Fast-Profil ohne MCP starten und testen.
|
||||
8. Medium und Long einzeln testen.
|
||||
9. Router installieren und Profilwechsel testen.
|
||||
10. Web, HA, ARR und Unraid nacheinander hinzufügen.
|
||||
11. STT, TTS und Vision ergänzen.
|
||||
12. Standardbenchmark und Sicherheitsprüfung ausführen.
|
||||
13. Erst danach Clients umstellen.
|
||||
|
||||
Der alte Host bleibt bis zum bestandenen Abnahmetest unverändert und dient nur
|
||||
als Referenz. Es werden keine Caches oder unbekannten Altverzeichnisse kopiert.
|
||||
Reference in New Issue
Block a user