Files
Athena-Deck/VOXCPM2_COMPONENTS.md
T

1.9 KiB

VoxCPM2: Komponentenpaket und Ausführungsstatus

Für openbmb/VoxCPM2/model.safetensors besitzt Deck ein eigenes Komponentenrezept:

  • audiovae.pth: Audio-VAE-Gewichte.
  • config.json: Modellkonfiguration einschließlich Audio-VAE-Architektur.
  • tokenizer.json: Text-Tokenizer/Wortschatz.
  • tokenizer_config.json: Einstellungen des Text-Tokenizers.
  • special_tokens_map.json: Spezialtokens.

Diese Dateien müssen dieselbe feste Repository-Revision wie die Hauptgewichte verwenden. Vorhandene Downloads werden wiederverwendet. Die zwei Tokenizer-Dateien sind verschiedene Teile eines Pakets, keine doppelten Modelle. Separater Textencoder und Vision-Projektor werden nicht benötigt. Der optionale externe Denoiser ist nicht Bestandteil dieses Grundpakets.

Das Dateirezept ist anhand des offiziellen Modells und des originalen Loaders geprüft. Es ist keine Zusage getesteter Inferenz: Die VoxCPM-Python/PyTorch-Laufzeit und ihr Deck-Worker sind noch nicht angebunden. Eine vorhandene audio.cpp- oder llama.cpp-Installation ersetzt diese Anbindung nicht. Das Profil bleibt gesperrt.

Der Katalog erlaubt .pth ausschließlich für die exakt benannte offizielle Audio-VAE-Datei dieses Repositorys. Der Download führt keine Datei aus. Das spätere Laden muss wie im Original mit weights_only=True erfolgen. Kein automatisches Ausführen von Python-Dateien aus Modell-Repositories.

Die Bibliothek gruppiert Text-Tokenizer gesondert; sie erscheinen nicht zusätzlich als allgemeine Konfiguration. „Alle fehlenden Dateien herunterladen“ prüft zunächst, ob für alle Pflichtkomponenten eine herunterladbare Datei angeboten wird. Erst danach werden Downloads eingereiht; bei einem späteren Fehler zeigt Deck bereits eingereihte Dateien an. Manuelle, ungeprüfte Listen erhalten weiterhin keinen Sammeldownload.