qwen3_tts¶
Model type |
|
Class |
|
Task |
|
Source |
|
Description¶
Qwen3-TTS composite model for the full multi-model TTS pipeline.
Contains:
talker: Talker decoder (inputs_embeds → logits + hidden)code_predictor: Code predictor (hidden → 15 code groups)embedding: Text + codec embedding modeltalker_step_embedder: Per-frame talker input constructiontalker_prefill_embedder: Prompt prefill/trailing-text constructionspeaker_encoder: Optional ECAPA-TDNN speaker encoder
HuggingFace class: Qwen3TTSForConditionalGeneration
Usage¶
mobius build --model <MODEL_ID> output_dir/
from mobius import build
model = build("<MODEL_ID>")