Model tested: Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
import torch
from qwen_tts import Qwen3TTSModel
model = Qwen3TTSModel.from_pretrained(
"Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice",
device_map="cuda:0",
dtype=torch.bfloat16,
)
wavs, sr = model.generate_custom_voice(
text="...", language="Auto", speaker="Ryan"
)
Platform: Google Colab T4 GPU (free tier).