Qwen3-TTSのインストールと使用方法
環境の作成
ここでは、Qwen3-TTSのPython環境を
D:\qwen3-tts
に作成します。
Windowsのコマンドプロンプトを開き、次を実行します。
D:
mkdir qwen3-tts
cd qwen3-tts
uv がインストールされていない場合は、まずインストールします。
pip install uv
次に、uv を使ってPython仮想環境を作成します。
uv venv
仮想環境を有効にします。
.venv\Scripts\activate
Qwen3-TTSのインストール
Qwen3-TTSと音声ファイル出力に必要なライブラリをインストールします。
uv pip install qwen-tts soundfile
PyTorchが適切にインストールされていることも確認してください。
例えば、次のコマンドでCUDAが利用可能か確認できます。
python -c "import torch; print(torch.__version__); print('CUDA:', torch.cuda.is_available())"
GPUが正しく認識されていれば、
CUDA: True
と表示されます。
tktts_qwen3.py
tktts_qwen3.py をPythonからimportできる場所に置きます。
また、tktts_qwen3.py は共通処理として
tktts_base.py
を使用するため、このファイルも必要です。
例えば、サンプルプログラムと同じディレクトリに
sample_qwen3_tts.py
tktts_qwen3.py
tktts_base.py
を置きます。
Qwen3-TTSのサンプル
次のプログラムを sample_qwen3_tts.py として保存します。
# sample_qwen3_tts.py
#
# Qwen3-TTS の簡単な使用例
import tktts_qwen3
# モデルを読み込む
model = tktts_qwen3.load_model()
# 読み上げる文章
text = """
こんにちは。
これは Qwen3 TTS を使った音声合成のサンプルです。
ニューラルネットワークを使って、文章から音声を生成しています。
"""
# 音声を生成
tktts_qwen3.speak(
outfile="sample_qwen3.wav",
text=text,
voice="Ono_Anna",
language="Japanese",
model=model,
)
print("sample_qwen3.wav を作成しました。")
実行します。
python sample_qwen3_tts.py
正常に終了すると、
sample_qwen3.wav
が作成されます。
話者の指定
Qwen3-TTS CustomVoiceモデルには複数の話者が用意されています。
日本語では、例えば
voice="Ono_Anna"
を指定できます。
利用可能な話者は、
import tktts_qwen3
tktts_qwen3.list_available_voices()
で確認できます。
また、話し方に対する指示を instruct で指定することもできます。
tktts_qwen3.speak(
outfile="sample_qwen3.wav",
text="半導体では、電子と正孔が電気伝導を担います。",
voice="Ono_Anna",
language="Japanese",
instruct="落ち着いた講義調で、明瞭に読み上げてください。",
model=model,
)