設定方法
MCP は、お使いの対応アプリ(クライアント)に下記の設定を貼り付けて使います。 タブからアプリを選び、表示された設定をコピーしてください。
Claude Desktop / Claude Code: Claude Desktop(公式デスクトップアプリ)と Claude Code(公式CLI)は同じ JSON を使います。Desktop は設定ファイルに貼り付け、Claude Code は `.mcp.json` に記述するか `claude mcp add` で追加します。
{
"mcpServers": {
"tts-mcp": {
"command": "npx",
"args": ["-y", "@kajidog/mcp-tts-voicevox"]
}
}
}
Cursor: AI 機能を内蔵したコードエディタ(`~/.cursor/mcp.json` に記述)
{
"mcpServers": {
"tts-mcp": {
"command": "npx",
"args": ["-y", "@kajidog/mcp-tts-voicevox"]
}
}
}
Cline: VS Code に追加する AI アシスタント拡張(設定画面の MCP Servers から記述)
{
"mcpServers": {
"tts-mcp": {
"command": "npx",
"args": ["-y", "@kajidog/mcp-tts-voicevox"]
}
}
}
Gemini CLI: Google の AI CLI。設定形式は Claude Desktop と同じで、`~/.gemini/settings.json` の `mcpServers` に記述するか `gemini mcp add` で追加します。
{
"mcpServers": {
"tts-mcp": {
"command": "npx",
"args": ["-y", "@kajidog/mcp-tts-voicevox"]
}
}
}
OpenAI Codex: OpenAI の CLI/IDE。設定は TOML 形式で `~/.codex/config.toml` に記述します(下記は左の JSON から自動変換した参考値です)。
[mcp_servers.tts-mcp]
command = "npx"
args = ["-y", "@kajidog/mcp-tts-voicevox"]VS Code: VS Code(GitHub Copilot のエージェント)。`mcp.json` の `servers` キーに記述します(下記は左の JSON から自動変換した参考値です)。
{
"servers": {
"tts-mcp": {
"type": "stdio",
"command": "npx",
"args": [
"-y",
"@kajidog/mcp-tts-voicevox"
]
}
}
}※ Gemini CLI は Claude Desktop と同じ mcpServers 形式のため同一の JSON を表示しています。Codex / VS Code タブの設定は、上記 JSON を各公式スキーマ(Codex=~/.codex/config.toml の TOML 形式 / VS Code=mcp.json の servers キー)へ 自動変換した参考値です。貼り付け前にお使いのバージョンの公式ドキュメントもご確認ください。
VOICEVOX TTS MCP とは
VOICEVOX は、文章を入れるとキャラクターの声で読み上げてくれる、無料の読み上げソフトです。ずんだもん・四国めたんなど多くの声があり、動画のナレーションや文章の聞き流しなどに使えます。
VOICEVOX TTS MCP は、その VOICEVOX を AI から使うための仕組みです。AI の返事をそのまま読み上げたり、原稿を音声ファイルにしたりできます。
これは有志が作った非公式ツールです(VOICEVOX の開発元が作ったものではありません)。
VOICEVOX × AI でできること
導入すると、AI への一言で VOICEVOX の声が出ます。
🔊 AI の返事を読み上げる
「今の要約をずんだもんの声で読み上げて」
→ VOICEVOX の声で再生
💾 音声ファイルにする
「この原稿を四国めたんの声で音声ファイルにして」
→ WAV ファイルを作って保存場所を返す
🎭 掛け合いで読む
「ずんだもんと四国めたんの掛け合いで読んで」
→ 話者を切り替えながら読み上げ
📖 読み方を直す
「『MCP』の読みを『エムシーピー』として辞書に登録して」
→ VOICEVOX のユーザー辞書に追加
提供される主なツール
AI から呼べる主なツールは次のとおりです(編集部が 2026年10月2日に版 0.8.1 で起動して確認)。
| ツール名 | 内容 |
|---|---|
voicevox_speak | 文章をすぐに読み上げる(パソコンのスピーカーで再生) |
voicevox_synthesize_file | 音声ファイル(WAV)を作って、保存場所を返す |
voicevox_get_speakers | 使える声(話者)の一覧を取得する |
voicevox_speak_player | 会話の中に再生ボタン付きのプレイヤーを出す(対応したクライアントのみ) |
voicevox_stop_speaker | 再生を止める |
voicevox_get_accent_phrases | 文章の読みとアクセントを調べる |
voicevox_add_user_dictionary_word など | ユーザー辞書の確認・追加・修正・削除 |
voicevox_ping | VOICEVOX のエンジンが動いているか確かめる |
このほか、再生ボタンのプレイヤー画面の中だけで使う補助のツール(名前が _ で始まるもの)があります。
再生ボタン(プレイヤー)について: 会話の中に再生ボタンを出す機能は、対応したクライアントでだけ使えます。Claude Desktop はこのページの設定のまま使えます。ChatGPT で使うには、MCP サーバーをインターネット経由でつなぎ、
VOICEVOX_PLAYER_DOMAINを設定する必要があります(公式 README)。プレイヤーでは、話者・速さ・アクセントの調整や、WAV ファイルへの書き出しもできます。対応していないクライアントではvoicevox_speakで読み上げます。
VOICEVOX TTS MCP について
VOICEVOX TTS MCP(npm パッケージ名 @kajidog/mcp-tts-voicevox)は、有志の開発者 kajidog 氏が公開している MCP サーバーです。日本語の README があり、Windows・macOS・Linux で動きます。
スペック
- 配布形態: npm パッケージ(
@kajidog/mcp-tts-voicevox)。Node.js 20 以上(Bun でも可)/Docker - 認証: 不要(手元で動く VOICEVOX につなぐ)
- 提供元: コミュニティ実装(kajidog/mcp-tts-voicevox)/ ISC
- 公式リポジトリ: github.com/kajidog/mcp-tts-voicevox
もっと単純なものがよい場合: 読み上げのツール1つだけを持つ
@t09tanaka/mcp-simple-voicevox(有志製・Apache-2.0)もあります。話者の番号を指定して読み上げるだけの作りです。
導入手順
前提条件
- VOICEVOX(無料)をインストールして起動しておく
- Node.js 20 以上
ステップ
- VOICEVOX を起動する(起動すると、読み上げのエンジンもパソコンの中で動き出します)
- ページ上部のタブから使用環境を選び、JSON 設定をコピー
- 設定ファイル(claude_desktop_config.json など)に追記して保存
- クライアントを再起動する
- 「こんにちはと喋って」と話しかけて、声が出るか確かめる
注意事項
- 使うあいだは VOICEVOX を起動しておく必要があります。 VOICEVOX が動いていないと読み上げできません(
voicevox_pingで確かめられます)。 - 作った音声を動画などで公開するときは、クレジット表記が必要です。 VOICEVOX の利用規約では、VOICEVOX を使ったことが分かる表記を求めています。また、声ごとに別の規約があるので、使う声の規約も確かめてください。
- 長い文章は読み上げに時間がかかることがあります。
- 編集部は、VOICEVOX のエンジン(版 0.25.2)につないで、ずんだもんの声で音声ファイルが作れることを確認しました。スピーカーでの再生と、会話の中の再生ボタンは確認していません。
主なユースケース
- 「今の要約をずんだもんの声で読み上げて」と頼むと、AI の返事を VOICEVOX の声で再生する
- 「この原稿を四国めたんの声で音声ファイルにして」と頼むと、WAV ファイルを作って保存場所を教えてくれる
- 「ずんだもんと四国めたんの掛け合いで読んで」と、1回の指示で話者を切り替えながら読み上げられる
- 「『MCP』の読みを『エムシーピー』として辞書に登録して」と、読み間違える言葉を VOICEVOX のユーザー辞書に追加できる
セットアップ・利用上の注意
- 導入・前提FFmpeg に入っている再生ソフト ffplay を入れておくと、再生が速く安定します(任意)。無くても、Windows は PowerShell、macOS は afplay など OS の機能で再生します。
- 補足Docker が使える場合は、公式の Docker Compose で VOICEVOX のエンジンと MCP サーバーをまとめて起動する方法もあります(Node.js と VOICEVOX のインストールが不要)。ただし Docker の中には音を出す装置が無いため、パソコンのスピーカーで直接鳴らす読み上げは使えず、会話の中の再生ボタンや音声ファイルを使います。