インストール
インストールと準備
動画を生成する前に、Python パッケージといくつかの外部依存ツールをセットアップする必要があります。
前提条件: Python 3
slidemovie には Python 3.8 以降が必要です。先に使用している OS 向けの Python 3 をインストールし、次のコマンドで利用できることを確認してください。
python3 --version
Python 2 と Python 3 が区別される環境では、以降のコマンドも python3 -m pip を使用してください。
pip がまだ利用できない場合は、パッケージをインストールする前に次を実行してください。
python3 -m ensurepip --upgrade
python3 -m pip install --upgrade pip
1. Python パッケージのインストール
最も簡単な方法は pip を使うことです。Windows では PowerShell を、macOS / Linux ではターミナルを開き、以下を実行してください。
python3 -m pip install slidemovie
これにより、multiai-tts や pptxtoimages を含む必要な Python ライブラリが自動的にインストールされます。
Windows: slidemovie コマンドを PATH に追加
Windows では、slidemovie コマンドを直接実行できるように、PowerShell で次を一度だけ実行して Python の Scripts フォルダーをユーザー PATH に追加してください。
$scriptsDir = python3 -c "import sysconfig; print(sysconfig.get_path('scripts'))"
$userPath = [Environment]::GetEnvironmentVariable('Path', 'User')
if ([string]::IsNullOrWhiteSpace($userPath)) {
[Environment]::SetEnvironmentVariable('Path', $scriptsDir, 'User')
} elseif (($userPath -split ';') -notcontains $scriptsDir) {
[Environment]::SetEnvironmentVariable('Path', "$userPath;$scriptsDir", 'User')
}
PowerShell を閉じて新しく開いた後、次を実行して確認してください。
slidemovie -h
2. 外部ツールのインストール
slidemovie は、いくつかの強力なコマンドラインツールの指揮者のような役割を果たします。プログラムを動作させるには、以下のツールをシステムにインストールする必要があります。
必要なツール
- FFmpeg: 音声の処理や、画像と音声を結合して動画ファイルにするために使用します。
- Pandoc: Markdown テキストファイルを PowerPoint (
.pptx) ファイルに変換するために使用します。 - LibreOffice: PowerPoint スライドを高解像度の画像に変換するために(ヘッドレスモードで)使用します。
- Poppler (pdftoppm): スライドから画像を抽出するために使用される PDF レンダリングライブラリです。
- ImageMagick (
convert/magick): スライド画像をscreen_sizeに正規化し、アスペクト比を保ったまま均等な余白(レターボックス/ピラーボックス)を付与するために使用します。
インストールコマンド
macOS の場合 (Homebrew 使用)
Homebrew がインストールされていない場合は brew.sh を参照してください。
brew install ffmpeg pandoc poppler imagemagick
brew install --cask libreoffice
Ubuntu / Debian の場合
sudo apt update
sudo apt install ffmpeg pandoc libreoffice poppler-utils imagemagick
Windows の場合
Windows では、Windows Package Manager(winget)を使うと、各ツールを個別にダウンロードしたり PATH を手動で設定したりせずに導入できます。PowerShell を開き、次のコマンドを一つずつ実行してください。各コマンドの完了を確認してから次へ進みます。
winget が見つからない場合は、先に Microsoft Store から「アプリ インストーラー」を更新またはインストールしてください。
winget install --id Gyan.FFmpeg --exact
winget install --id JohnMacFarlane.Pandoc --exact
winget install --id TheDocumentFoundation.LibreOffice --exact
winget install --id oschwartz10612.Poppler --exact
winget install --id ImageMagick.ImageMagick --exact
すべてのインストールが完了したら、PowerShell をいったん閉じて新しく開いてください。PATH の変更を反映した後、次のコマンドで確認します。
ffmpeg -version
ffprobe -version
pandoc --version
Get-Command pdftoppm
magick -version
winget による導入後もコマンドが見つからない場合は、Windows にサインインし直してからもう一度確認してください。
3. AI APIキーの設定
slidemovie は multiai-tts ライブラリを使用してナレーション音声を生成します。モデルの選択と API キーの設定が必要です。
1. TTS モデルの選択
まず、ユーザー設定ファイルを作成するために、次を実行してください。
slidemovie --init-config
このコマンドはデフォルトの設定ファイルを作成して終了します。保存先は macOS / Linux では ~/.config/slidemovie/config.json、Windows では C:\Users\<ユーザー名>\.config\slidemovie\config.json です。
次に、設定ファイル のページを参考にこのファイルを編集し、tts_provider, tts_model, tts_voice の項目を変更して、使用する TTS モデルを設定してください。
2. API認証情報の設定
slidemovie は音声合成に multiai-tts を使用しています。API認証情報は multiai と同じ方法で設定します。
認証情報は multiai の設定ファイルに保存できます。multiai は ~/.multiai、続いて ./.multiai の設定を読み込み、プロジェクト側の設定が優先されます。Windows の PowerShell では、次のコマンドでユーザー設定ファイルをメモ帳で開いて編集できます。$HOME はユーザーのホームディレクトリ(例: C:\Users\seki)を表します。
notepad "$HOME\.multiai"
macOS では、次のコマンドで TextEdit を使って開けます。
open -e ~/.multiai
例えば、次のように設定します。
[api_key]
openai = (OpenAI の API キー)
google = (Gemini の API キー)
azure_tts = (Azure Speech の API キー)
[azure_tts]
region = japaneast
slidemovie の設定ファイルで tts_provider に指定した TTS プロバイダについてのみ、認証情報を設定すれば利用できます。
環境変数を使う方法や multiai の設定ファイル全体の形式については、公式の multiai ドキュメント を参照してください。
注意: 選択したプロバイダ(
openai、azure)に対応する有効な認証情報が設定されていない場合、音声生成は失敗します。
VOICEVOX:
voicevoxプロバイダを選択した場合、APIキーは不要です。代わりに、ビルド前に VOICEVOX エンジン をローカルで起動しておく必要があります(デフォルトはhttp://127.0.0.1:50021)。tts_voice(話者・スタイルID)とtts_voicevox_urlについては 設定 を参照してください。