add_notes_voice_pptx2 実行例

help出力 add_notes_voice_pptx2.py --help

usage: add_notes_voice_pptx2.py [-h] [--mode {list,conv}] [--monologue {0,1}]
                                [--tts {pyttsx3,voicevox,qwen3,qwen,irodori,irodori-tts,aquestalkplayer,atp,openai}]
                                [--input_path INPUT_PATH]
                                [--audio_dir AUDIO_DIR]
                                [--output_path OUTPUT_PATH] [--voices VOICES]
                                [--temp_dir TEMP_DIR]
                                [--speak_rate SPEAK_RATE]
                                [--tinterval TINTERVAL] [--endpoint ENDPOINT]
                                [--fspeak_rate FSPEAK_RATE]
                                [--fspeak_pitch FSPEAK_PITCH]
                                [--aquestalk_path AQUESTALK_PATH]
                                [--instruction INSTRUCTION]
                                [--qwen3_language QWEN3_LANGUAGE]
                                [--qwen3_model_id QWEN3_MODEL_ID]
                                [--qwen3_device QWEN3_DEVICE]
                                [--qwen3_dtype {auto,bfloat16,bf16,float16,fp16,float32,fp32}]
                                [--qwen3_instruct QWEN3_INSTRUCT]
                                [--irodori_caption IRODORI_CAPTION]
                                [--irodori_ref_wav IRODORI_REF_WAV]
                                [--irodori_ref_wavs IRODORI_REF_WAVS]
                                [--irodori_model_id IRODORI_MODEL_ID]
                                [--irodori_device IRODORI_DEVICE]
                                [--irodori_precision {auto,bf16,bfloat16,fp32,float32}]
                                [--irodori_codec_device IRODORI_CODEC_DEVICE]
                                [--irodori_codec_precision IRODORI_CODEC_PRECISION]
                                [--irodori_num_steps IRODORI_NUM_STEPS]
                                [--irodori_cfg_scale_text IRODORI_CFG_SCALE_TEXT]
                                [--irodori_cfg_scale_caption IRODORI_CFG_SCALE_CAPTION]
                                [--irodori_cfg_scale_speaker IRODORI_CFG_SCALE_SPEAKER]
                                [--irodori_duration_scale IRODORI_DURATION_SCALE]
                                [--irodori_seed IRODORI_SEED]
                                [--irodori_lora_adapter IRODORI_LORA_ADAPTER]
                                [--pause PAUSE]

PPTXノートから音声ファイルを生成し、自動再生リンクを設定するプログラム (Windows/PowerPoint, tktts使用)

options:
  -h, --help            show this help message and exit
  --mode {list,conv}    実行モード:
                         list: 利用可能な音声名を表示
                         conv: PPTXノートから音声を生成しPPTXにリンク
  --monologue {0,1}     1: 独話形式、0: '話者名,本文' の対話形式 (default: 1)
  --tts {pyttsx3,voicevox,qwen3,qwen,irodori,irodori-tts,aquestalkplayer,atp,openai}
                        TTSエンジンを選択
  --input_path, -i INPUT_PATH
                        [convモード] ノート設定済みPPTXファイルパス
  --audio_dir, -a AUDIO_DIR
                        [convモード] 生成された音声ファイルを保存するディレクトリ
  --output_path, -o OUTPUT_PATH
                        [convモード] 音声リンクが追加された出力PPTXファイルパス
  --voices, -v VOICES   [tktts] voice_map の上書き (話者名=ボイス;話者名=ボイス)
  --temp_dir TEMP_DIR   一時ファイルを作成するディレクトリ名
  --speak_rate SPEAK_RATE
                        [pyttsx3] 読み上げ速度 (WPM) / [AQT] 速度比
  --tinterval TINTERVAL
                        [AQT/OpenAI/VOICEVOX] 音声ファイル間に挿入する無音区間の長さ(秒)
  --endpoint ENDPOINT   [VOICEVOX] Engineのendpoint
  --fspeak_rate FSPEAK_RATE
                        [VOICEVOX] 読み上げ速度比 (標準: 1.0)
  --fspeak_pitch FSPEAK_PITCH
                        [VOICEVOX] 声の高さ比 (標準: 0.0)
  --aquestalk_path AQUESTALK_PATH
                        [AQT] AquesTalkPlayer.exe の実行パス
  --instruction INSTRUCTION
                        [OpenAI] TTS APIへの追加指示
  --qwen3_language QWEN3_LANGUAGE
                        [Qwen3-TTS] language
  --qwen3_model_id QWEN3_MODEL_ID
                        [Qwen3-TTS] model ID
  --qwen3_device QWEN3_DEVICE
                        [Qwen3-TTS] auto/cuda:0/cpu
  --qwen3_dtype {auto,bfloat16,bf16,float16,fp16,float32,fp32}
                        [Qwen3-TTS] dtype
  --qwen3_instruct QWEN3_INSTRUCT
                        [Qwen3-TTS] CustomVoice instruction
  --irodori_caption IRODORI_CAPTION
                        [Irodori-TTS] voice/style caption
  --irodori_ref_wav IRODORI_REF_WAV
                        [Irodori-TTS] reference WAV
  --irodori_ref_wavs IRODORI_REF_WAVS
                        [Irodori-TTS] reference WAVs (;区切り)
  --irodori_model_id IRODORI_MODEL_ID
                        [Irodori-TTS] model ID
  --irodori_device IRODORI_DEVICE
                        [Irodori-TTS] auto/cuda/cuda:0/cpu
  --irodori_precision {auto,bf16,bfloat16,fp32,float32}
                        [Irodori-TTS] precision
  --irodori_codec_device IRODORI_CODEC_DEVICE
                        [Irodori-TTS] codec device
  --irodori_codec_precision IRODORI_CODEC_PRECISION
                        [Irodori-TTS] codec precision
  --irodori_num_steps IRODORI_NUM_STEPS
                        [Irodori-TTS] sampling steps
  --irodori_cfg_scale_text IRODORI_CFG_SCALE_TEXT
  --irodori_cfg_scale_caption IRODORI_CFG_SCALE_CAPTION
  --irodori_cfg_scale_speaker IRODORI_CFG_SCALE_SPEAKER
  --irodori_duration_scale IRODORI_DURATION_SCALE
  --irodori_seed IRODORI_SEED
                        [Irodori-TTS] seed; random/noneも可
  --irodori_lora_adapter IRODORI_LORA_ADAPTER
                        [Irodori-TTS] LoRA adapter
  --pause PAUSE         プログラム終了時にENTER入力を要求するか [0|1]


生成されたデータファイル

(データファイルが見つかりませんでした)

生成された画像一覧

(画像ファイルが見つかりませんでした)