Use qwen3-asr throughout speech integrations
This commit is contained in:
@@ -39,7 +39,7 @@ nicht automatisch ein ungenutzter Rest.
|
||||
| `mike-ai-tts-gateway` | kein eigenes Modell | Normalisiert Text, konvertiert Ausgabeformate und stellt Qwen3-TTS sowie natives PCM-Streaming über eine stabile interne API bereit. |
|
||||
| `mike-ai-voice-studio` | `k2-fsa/OmniVoice` 0.2.1 mit Whisper-ASR | Erzeugt Text-to-Speech mit einer Referenzstimme; kein Audio-to-Audio-Voice-Changer. |
|
||||
| `mike-ai-qwen-asr` | Qwen3-ASR 0.6B Q8 | CPU-Inferenz für lokale deutsche Spracherkennung. |
|
||||
| `mike-ai-qwen-asr-worker` | kein eigenes Modell | Audio-Adapter für `/v1/audio/transcriptions`; `whisper-1` ist nur ein API-Kompatibilitätsname. |
|
||||
| `mike-ai-qwen-asr-worker` | kein eigenes Modell | Audio-Adapter für `/v1/audio/transcriptions` mit dem Modellnamen `qwen3-asr`. |
|
||||
| `mike-ai-wireguard-gateway` | kein Modell | Veröffentlicht Dashboard und Fachoberflächen ausschließlich über den privaten WireGuard-Pfad. |
|
||||
| `mike-ai-xvc-studio` | `chenxie95/X-VC`, GLM-4-Voice-Tokenizer und optional Resemble Enhance | Wandelt eine vorhandene Sprachaufnahme anhand einer Referenzstimme in Audio zu Audio um; gibt das native 16-kHz-Ergebnis und optional eine neural restaurierte 44,1-kHz-Fassung aus. |
|
||||
| `mike-ai-yue2-playground` | Image `mike-ai/yue2:3b-0.1.6` | Vorhandener, gestoppter Playground; in diesem Abgleich nicht funktional getestet. |
|
||||
|
||||
+3
-3
@@ -2,9 +2,9 @@
|
||||
|
||||
Nachtrag vom 25. September 2026: Die produktive Spracherkennung läuft über
|
||||
Qwen3-ASR 0.6B Q8 auf der CPU (`mike-ai-qwen-asr` und
|
||||
`mike-ai-qwen-asr-worker`). Der Router bietet weiterhin `whisper-1` als
|
||||
Kompatibilitätsnamen und zusätzlich `qwen3-asr` an. Beide wurden mit einer
|
||||
M4A-Aufnahme über `/v1/audio/transcriptions` geprüft. Whisper-Container,
|
||||
`mike-ai-qwen-asr-worker`). Der Router bietet nur `qwen3-asr` als STT-Modell
|
||||
an; OpenClaw und die Voice-Brücke verwenden denselben Namen. Eine M4A-Aufnahme
|
||||
wurde über `/v1/audio/transcriptions` geprüft. Whisper-Container,
|
||||
Images und Modellvolume wurden entfernt. Das aktive Ultra-Profil wurde bei
|
||||
dieser Umstellung nicht gewechselt. Die Angaben zu Whisper weiter unten
|
||||
beschreiben den historischen Stand vom 21. September.
|
||||
|
||||
Reference in New Issue
Block a user