Files
Athena-Deck/VOXCPM2_COMPONENTS.md
T

46 lines
2.6 KiB
Markdown

# VoxCPM2: Komponentenpaket und Ausführungsstatus
Für `openbmb/VoxCPM2/model.safetensors` besitzt Deck ein eigenes Komponentenrezept:
- `audiovae.pth`: Audio-VAE-Gewichte.
- `config.json`: Modellkonfiguration einschließlich Audio-VAE-Architektur.
- `tokenizer.json`: Text-Tokenizer/Wortschatz.
- `tokenizer_config.json`: Einstellungen des Text-Tokenizers.
- `special_tokens_map.json`: Spezialtokens.
Diese Dateien müssen dieselbe feste Repository-Revision wie die Hauptgewichte
verwenden. Vorhandene Downloads werden wiederverwendet. Die zwei Tokenizer-Dateien
sind verschiedene Teile eines Pakets, keine doppelten Modelle. Separater Textencoder
und Vision-Projektor werden nicht benötigt. Der optionale externe Denoiser ist
nicht Bestandteil dieses Grundpakets.
Das Dateirezept ist anhand des [offiziellen Modells](https://huggingface.co/openbmb/VoxCPM2)
und des [originalen Loaders](https://github.com/OpenBMB/VoxCPM/blob/main/src/voxcpm/model/voxcpm2.py)
geprüft. Es ist keine Zusage getesteter Inferenz: **Der Deck-Generierungsworker ist noch nicht angebunden.** Eine vorhandene audio.cpp- oder
llama.cpp-Installation ersetzt diese Anbindung nicht. Das Profil bleibt gesperrt.
Der Katalog erlaubt `.pth` ausschließlich für die exakt benannte offizielle
Audio-VAE-Datei dieses Repositorys. Der Download führt keine Datei aus. Das spätere
Laden muss wie im Original mit `weights_only=True` erfolgen. Kein automatisches
Ausführen von Python-Dateien aus Modell-Repositories.
Die Bibliothek gruppiert Text-Tokenizer gesondert; sie erscheinen nicht zusätzlich
als allgemeine Konfiguration. „Alle fehlenden Dateien herunterladen“ prüft zunächst,
ob für alle Pflichtkomponenten eine herunterladbare Datei angeboten wird. Erst danach
werden Downloads eingereiht; bei einem späteren Fehler zeigt Deck bereits eingereihte
Dateien an. Manuelle, ungeprüfte Listen erhalten weiterhin keinen Sammeldownload.
## Laufzeit über die Oberfläche installieren
Unter **Laufzeiten → VoxCPM** oder im Komponentenbereich über
**Passende Laufzeit installieren** lässt sich das offizielle Paket VoxCPM 2.0.3
in einer eigenen Python-Umgebung installieren und abbrechen. Die Installation
prüft CUDA-PyTorch, Paketkonsistenz und den VoxCPM2-Loader, lädt aber weder
Modellgewichte noch ein Modell in die GPUs. Vorhandene CUDA-Pakete der
Bildlaufzeit werden lesend wiederverwendet. Versionen stehen in
`deploy/voxcpm-requirements.lock`.
Backup exportiert den Installationswunsch und die Version; Restore installiert
diese Laufzeit erneut. **Eine installierte Laufzeit schaltet das Profil noch
nicht frei: Der Generierungsworker muss zusätzlich angebunden werden.**