Qwen3-TTSのインストールと使用方法

環境の作成

ここでは、Qwen3-TTSのPython環境を

D:\qwen3-tts

に作成します。

Windowsのコマンドプロンプトを開き、次を実行します。

D:
mkdir qwen3-tts
cd qwen3-tts

uv がインストールされていない場合は、まずインストールします。

pip install uv

次に、uv を使ってPython仮想環境を作成します。

uv venv

仮想環境を有効にします。

.venv\Scripts\activate

Qwen3-TTSのインストール

Qwen3-TTSと音声ファイル出力に必要なライブラリをインストールします。

uv pip install qwen-tts soundfile

PyTorchが適切にインストールされていることも確認してください。

例えば、次のコマンドでCUDAが利用可能か確認できます。

python -c "import torch; print(torch.__version__); print('CUDA:', torch.cuda.is_available())"

GPUが正しく認識されていれば、

CUDA: True

と表示されます。

tktts_qwen3.py

tktts_qwen3.py をPythonからimportできる場所に置きます。

また、tktts_qwen3.py は共通処理として

tktts_base.py

を使用するため、このファイルも必要です。

例えば、サンプルプログラムと同じディレクトリに

sample_qwen3_tts.py
tktts_qwen3.py
tktts_base.py

を置きます。

Qwen3-TTSのサンプル

次のプログラムを sample_qwen3_tts.py として保存します。

# sample_qwen3_tts.py
#
# Qwen3-TTS の簡単な使用例

import tktts_qwen3

# モデルを読み込む
model = tktts_qwen3.load_model()

# 読み上げる文章
text = """
こんにちは。
これは Qwen3 TTS を使った音声合成のサンプルです。
ニューラルネットワークを使って、文章から音声を生成しています。
"""

# 音声を生成
tktts_qwen3.speak(
    outfile="sample_qwen3.wav",
    text=text,
    voice="Ono_Anna",
    language="Japanese",
    model=model,
)

print("sample_qwen3.wav を作成しました。")

実行します。

python sample_qwen3_tts.py

正常に終了すると、

sample_qwen3.wav

が作成されます。

話者の指定

Qwen3-TTS CustomVoiceモデルには複数の話者が用意されています。

日本語では、例えば

voice="Ono_Anna"

を指定できます。

利用可能な話者は、

import tktts_qwen3

tktts_qwen3.list_available_voices()

で確認できます。

また、話し方に対する指示を instruct で指定することもできます。

tktts_qwen3.speak(
    outfile="sample_qwen3.wav",
    text="半導体では、電子と正孔が電気伝導を担います。",
    voice="Ono_Anna",
    language="Japanese",
    instruct="落ち着いた講義調で、明瞭に読み上げてください。",
    model=model,
)