add_notes_voice_pptx2 実行例
help出力 add_notes_voice_pptx2.py --help
usage: add_notes_voice_pptx2.py [-h] [--mode {list,conv}] [--monologue {0,1}]
[--tts {pyttsx3,voicevox,qwen3,qwen,irodori,irodori-tts,aquestalkplayer,atp,openai}]
[--input_path INPUT_PATH]
[--audio_dir AUDIO_DIR]
[--output_path OUTPUT_PATH] [--voices VOICES]
[--temp_dir TEMP_DIR]
[--speak_rate SPEAK_RATE]
[--tinterval TINTERVAL] [--endpoint ENDPOINT]
[--fspeak_rate FSPEAK_RATE]
[--fspeak_pitch FSPEAK_PITCH]
[--aquestalk_path AQUESTALK_PATH]
[--instruction INSTRUCTION]
[--qwen3_language QWEN3_LANGUAGE]
[--qwen3_model_id QWEN3_MODEL_ID]
[--qwen3_device QWEN3_DEVICE]
[--qwen3_dtype {auto,bfloat16,bf16,float16,fp16,float32,fp32}]
[--qwen3_instruct QWEN3_INSTRUCT]
[--irodori_caption IRODORI_CAPTION]
[--irodori_ref_wav IRODORI_REF_WAV]
[--irodori_ref_wavs IRODORI_REF_WAVS]
[--irodori_model_id IRODORI_MODEL_ID]
[--irodori_device IRODORI_DEVICE]
[--irodori_precision {auto,bf16,bfloat16,fp32,float32}]
[--irodori_codec_device IRODORI_CODEC_DEVICE]
[--irodori_codec_precision IRODORI_CODEC_PRECISION]
[--irodori_num_steps IRODORI_NUM_STEPS]
[--irodori_cfg_scale_text IRODORI_CFG_SCALE_TEXT]
[--irodori_cfg_scale_caption IRODORI_CFG_SCALE_CAPTION]
[--irodori_cfg_scale_speaker IRODORI_CFG_SCALE_SPEAKER]
[--irodori_duration_scale IRODORI_DURATION_SCALE]
[--irodori_seed IRODORI_SEED]
[--irodori_lora_adapter IRODORI_LORA_ADAPTER]
[--pause PAUSE]
PPTXノートから音声ファイルを生成し、自動再生リンクを設定するプログラム (Windows/PowerPoint, tktts使用)
options:
-h, --help show this help message and exit
--mode {list,conv} 実行モード:
list: 利用可能な音声名を表示
conv: PPTXノートから音声を生成しPPTXにリンク
--monologue {0,1} 1: 独話形式、0: '話者名,本文' の対話形式 (default: 1)
--tts {pyttsx3,voicevox,qwen3,qwen,irodori,irodori-tts,aquestalkplayer,atp,openai}
TTSエンジンを選択
--input_path, -i INPUT_PATH
[convモード] ノート設定済みPPTXファイルパス
--audio_dir, -a AUDIO_DIR
[convモード] 生成された音声ファイルを保存するディレクトリ
--output_path, -o OUTPUT_PATH
[convモード] 音声リンクが追加された出力PPTXファイルパス
--voices, -v VOICES [tktts] voice_map の上書き (話者名=ボイス;話者名=ボイス)
--temp_dir TEMP_DIR 一時ファイルを作成するディレクトリ名
--speak_rate SPEAK_RATE
[pyttsx3] 読み上げ速度 (WPM) / [AQT] 速度比
--tinterval TINTERVAL
[AQT/OpenAI/VOICEVOX] 音声ファイル間に挿入する無音区間の長さ(秒)
--endpoint ENDPOINT [VOICEVOX] Engineのendpoint
--fspeak_rate FSPEAK_RATE
[VOICEVOX] 読み上げ速度比 (標準: 1.0)
--fspeak_pitch FSPEAK_PITCH
[VOICEVOX] 声の高さ比 (標準: 0.0)
--aquestalk_path AQUESTALK_PATH
[AQT] AquesTalkPlayer.exe の実行パス
--instruction INSTRUCTION
[OpenAI] TTS APIへの追加指示
--qwen3_language QWEN3_LANGUAGE
[Qwen3-TTS] language
--qwen3_model_id QWEN3_MODEL_ID
[Qwen3-TTS] model ID
--qwen3_device QWEN3_DEVICE
[Qwen3-TTS] auto/cuda:0/cpu
--qwen3_dtype {auto,bfloat16,bf16,float16,fp16,float32,fp32}
[Qwen3-TTS] dtype
--qwen3_instruct QWEN3_INSTRUCT
[Qwen3-TTS] CustomVoice instruction
--irodori_caption IRODORI_CAPTION
[Irodori-TTS] voice/style caption
--irodori_ref_wav IRODORI_REF_WAV
[Irodori-TTS] reference WAV
--irodori_ref_wavs IRODORI_REF_WAVS
[Irodori-TTS] reference WAVs (;区切り)
--irodori_model_id IRODORI_MODEL_ID
[Irodori-TTS] model ID
--irodori_device IRODORI_DEVICE
[Irodori-TTS] auto/cuda/cuda:0/cpu
--irodori_precision {auto,bf16,bfloat16,fp32,float32}
[Irodori-TTS] precision
--irodori_codec_device IRODORI_CODEC_DEVICE
[Irodori-TTS] codec device
--irodori_codec_precision IRODORI_CODEC_PRECISION
[Irodori-TTS] codec precision
--irodori_num_steps IRODORI_NUM_STEPS
[Irodori-TTS] sampling steps
--irodori_cfg_scale_text IRODORI_CFG_SCALE_TEXT
--irodori_cfg_scale_caption IRODORI_CFG_SCALE_CAPTION
--irodori_cfg_scale_speaker IRODORI_CFG_SCALE_SPEAKER
--irodori_duration_scale IRODORI_DURATION_SCALE
--irodori_seed IRODORI_SEED
[Irodori-TTS] seed; random/noneも可
--irodori_lora_adapter IRODORI_LORA_ADAPTER
[Irodori-TTS] LoRA adapter
--pause PAUSE プログラム終了時にENTER入力を要求するか [0|1]
生成されたデータファイル
(データファイルが見つかりませんでした)
生成された画像一覧
(画像ファイルが見つかりませんでした)