本文へ移動

SHIZUKALAB / VCClient GUIDE

RVCボイスチェンジャー
VCClientの使い方。

マイクの声をリアルタイムに、女声やキャラクターボイスへ。
Windowsでの導入・女性声モデルの登録から、音高調整、Discord・OBSへの接続まで案内します。

ShizukaLab編集 · 更新・配布情報確認: · 対象:Windows / VCClient 2.1.4-alpha系

RVCを自然に聴かせるには? 入力する声の演技が大切。

RVCは声質を変える道具であり、キャラクターの演技をすべて自動で作る道具ではありません。 男声から女声への変換でも、それ以外の変換でも、言葉の区切り、感情、抑揚、息づかい、テンポは入力の話し方が仕上がりを左右します。ShizukaLabでは、モデルや数値の調整と同じくらい、まず「なりたい声の人物として話す」ことを大切にしています。

低い男声を女声へ変換するときの、演じ方のコツ

普段の低い声をそのまま入力して、音高の設定だけで女性らしさを作ろうとするよりも、女性のキャラクターになりきって話してみてください。無理のない範囲で普段よりやや高めの、明瞭で綺麗なトーンを意識し、嬉しい・困った・寂しいといった感情を、語尾や抑揚にも乗せてマイクへ入力します。

高くすればよい、強く感情を出せばよい、という意味ではありません。落ち着いた女性声なら穏やかな抑揚、元気なキャラクターなら弾むテンポというように、目指す人物に合う演技を選びます。喉を締めたり、大声や無理な高音を出したりせず、楽に出せる声で試してください。

設定を変える前に、同じ台詞を3回演じて比べる

  1. 普段どおりの声。 比較の基準として録ります。
  2. 目指す人物としての声。 無理なく少しトーンを変え、言葉を明瞭にして話します。
  3. 感情を乗せた声。 同じ台詞に、喜びやためらいなど、場面に合う抑揚・間・語尾を加えます。

同じモデル・同じ設定で変換し、声質だけでなく「感情が伝わるか」「言葉が自然につながるか」を聴き比べましょう。入力の演技を工夫することで、仕上がりが大きく改善することがあります。 改善の幅は入力・モデル・設定によって異なり、特定の演じ方ですべての声が同じ結果になるわけではありません。

これはShizukaLabの制作上の実践ポイントです。VCClient公式の固定プリセットではありません。演技の方向が決まった後に、音高・index・遅延の調整をひとつずつ進めます。

自分の声・男声を、リアルタイムに女声へ変換するには?

VCClientで女性声のRVCモデルを選び、実マイクから声を入力すると、モデルの声質への変換を試せます。単純に音程を上げるピッチシフトとは異なり、RVCは学習した声質への変換を行います。Neneのような女性声モデルを使う場合も、まず短い一文をヘッドホンで聴き比べましょう。

女声への変換では、モデルの登録とTUNE/Pitchの調整を分けて考えます。男声だから必ず同じ音高設定になるわけではありません。入力の声の高さや話し方、選んだモデルに合わせて調整し、言葉の明瞭さ・語尾・声の自然さを確認してください。誰の入力でも同じ女声になることや、遅延ゼロを保証するものではありません。

配信・通話で使うなら、変換に成功した後でDiscord・OBSへ変換音声を送る設定へ進みます。文章から女性声の台詞を作りたい場合は、ボイスチェンジャーではなくStyle-Bert-VITS2の読み上げが別の選択肢です。

01 / マイクから、新しい声へ

文章ではなく、あなたの声を入力する。

VCClientはw-okada氏によるリアルタイム音声変換ソフトです。RVCモデルを使うと、話す内容や声の出し方を入力にして、別の声質へ変換できます。文章を読み上げるStyle-Bert-VITS2とは、入力するものが違います。

通話のキャラクターボイス、配信中の声の演出、短い台詞の試行などに使えます。すでに録音した歌や台詞をファイルとして仕上げたい場合は、RVC Guideのファイル変換手順を先にご覧ください。

目標は「変換した声が自分に聞こえる」→「通話・配信アプリに届く」の2段階です。最初から全部を接続すると、無音の原因を見つけにくくなります。

02 / バージョンと対応モデル

新しい番号だけで選ばない。

2026年10月2日に公式配布一覧を確認した時点で、WindowsのRVC対応v2配布にはvcclient_win_cuda_2.1.4-alpha.zipとvcclient_win_dml_2.1.4-alpha.zipがあります。本稿はこの2.1.4-alpha系を中心に、Windowsでの導入と操作の流れを案内します。alphaは正式安定版を意味しません。

環境・目的確認する配布注意
Windows / NVIDIA GPUvcclient_win_cuda_2.1.4-alpha.zipCUDA版。すべてのGPU・ドライバーでの動作を保証するものではありません
Windows / AMD・Intel GPUなどvcclient_win_dml_2.1.4-alpha.zipDirectML系。モデル形式・GPU推論への対応を使用版で確認してください
ひとつ前のbeta配布vcclient_win_cuda_2.0.78-beta.zip2.1.4とは画面が異なる場合があります。betaも動作保証ではありません
2.2.2-beta / std…only_beatrice.zipBeatrice向け。RVCを使う目的で選ばないでください

公式READMEのエディション対応表と、実際に配布されているZIPを両方確認してください。Mac・Linuxもありますが、本稿のWindows手順をそのまま当てはめないでください。

公式の詳しい日本語RVCチュートリアルはv1.5.3.13向けです。本稿では設定の意味・音声経路の参考として使い、旧版のボタン位置や既定ポートを現行v2のものとして固定しません。表示名は使用版・言語設定で変わります。

03 / 先にそろえる

マイク、ヘッドホン、声モデル。

  • Windows PCと入力マイク。 まずWindowsの録音機能などで、普通の声が録れることを確かめます。
  • ヘッドホン。 スピーカーの変換音をマイクが拾うと、音が回り込む原因になります。
  • RVCの推論用モデル。 配布された.pthなどと、同梱されていれば対応する.indexを用意します。学習用チェックポイントとは区別します。
  • 初回起動時のインターネット接続と空き容量。 ZIP本体に加えて展開先と実行用データの容量が必要です。
  • 仮想オーディオ機器(通話・配信へ送る場合)。 最初のヘッドホン試聴だけなら、まだ不要です。

RVCモデルの「v2」とVCClientアプリの「v2」は別のバージョンです。モデルの仕様とアプリの版を混同しないでください。モデル・アプリは信頼できる配布元から取得し、商品の利用条件も確認します。

04 / 導入

公式配布から、別フォルダへ。

  1. 公式GitHubから、公式Hugging Face配布一覧を開きます。GitHubのソースZIPと、実行用の配布ZIPは別です。
  2. 自分の環境に合うRVC対応ZIPを選びます。NVIDIA向けの例はvcclient_win_cuda_2.1.4-alpha.zipです。
  3. ZIPを右クリックして「すべて展開」。英数字の短いパスに、旧版とは別のフォルダで展開します。ZIPの中から直接起動しないでください。例:C:\VCClient\2.1.4\。
  4. 展開先の起動用バッチを実行します。start_http.batが同梱されている配布ではこれを使います。別名の場合は同梱案内を優先し、単体の実行ファイルを推測して起動しないでください。
  5. 初回のデータ取得と起動が終わるまで、ログのウィンドウを閉じずに待ちます。失敗した場合は、最後のエラーを確認します。
  6. アプリ画面が開いたら、表示された版を確認します。画面が開かない場合は、起動ログに出たローカルURLを確認します。旧記事のポート番号を決め打ちしないでください。

警告が出たときは配布元と対象ファイルを確認してください。セキュリティ機能を一括で無効にする必要はありません。このガイドはローカルPCで使う手順です。ルーターのポート開放やインターネットへの公開は不要です。

05 / 声モデルの登録

モデルは画面から登録する。

  1. 商品ZIPも別のフォルダへ展開し、同梱説明で推論用モデルとindexを確認します。元の配布ファイルは残します。
  2. VCClientでモデル一覧・モデルスロットの編集/追加画面を開き、アップロードの項目へ進みます。変換方式を選ぶ画面ではRVCを選びます。
  3. モデルファイル欄で配布された推論用.pthを指定します。index欄がある場合は、同じモデルに対応する.indexを指定します。別商品のindexを混ぜないでください。
  4. 登録を実行し、完了を待ちます。登録後のモデルを一覧から選択します。
  5. 選んだモデル名が画面に表示され、エラーが出ていないことを確認します。

RVC WebUIのassets/weightsへ置く方法と、VCClientのスロット登録は別です。VCClientの内部フォルダへファイルを置くだけで登録できるとは限りません。ONNX形式を使う配布では、その版の読込対応と変換方法を確認し、拡張子だけ変更しないでください。

06 / 最初の成功

まず、自分に聞こえるようにする。

  1. 入力(Input)に実際のマイクを選びます。仮想ケーブルやPC全体の音を最初の入力にしないでください。
  2. 出力(Output)にヘッドホンを選び、音量を控えめにします。マイクの使用許可が必要なら、そのアプリ・ブラウザに許可します。
  3. 音声デバイスのClient/Server切替がある場合、まず一方で入力と出力を設定します。Clientはブラウザ側、Serverは変換サーバ側が機器を扱う方式です。方式を変えたら機器を選び直します。
  4. 変換開始(Start)を押し、短い一文を話します。初回はモデル読み込みを待ちます。
  5. 入力の反応と、変換された声がヘッドホンへ届くことを確認します。元の声がそのまま出る場合は、Pass through/バイパスが有効になっていないか確認します。
  6. 声を止めたときに大きな雑音が続かないか、言葉の始めと終わりが欠けないかも聴きます。

ここで成功したら、通話アプリを開く前に設定を控えましょう。「入力マイク→VCClient→ヘッドホン」が動く状態を残しておくと、後の接続を切り分けられます。

07 / 通話・配信への受け渡し

変換後の声を、アプリのマイクへ。

VCClientで聞こえるだけでは、DiscordやOBSに届きません。アプリ間で音を受け渡す仮想オーディオ機器を使います。Windowsの一例はVB-AudioのVB-CABLEです。導入・再起動は公式案内に従ってください。

実マイク
  → VCClientの入力
  → RVCで声を変換
  → VCClientの出力:CABLE Input
  → Discord / OBSの入力:CABLE Output

InputとOutputが逆に見えるのがポイント。 VCClientから「ケーブルへ入れる」先がCABLE Input、通話・配信アプリが「ケーブルから受け取る」側がCABLE Outputです。

Discordに送る

  1. VCClientの出力をCABLE Inputに変更します。入力は実マイクのままです。
  2. Discordの音声設定で、入力デバイスをCABLE Outputにします。出力は普段のヘッドホンにします。
  3. マイクテストで変換後の声が届くことを確認してから、通話に入ります。通話相手に確認してもらう方法もあります。

OBSに送る

  1. 音声入力キャプチャにCABLE Outputを選びます。
  2. 同じ実マイクが別の音声ソースやグローバル音声設定でも有効なら、不要な方をミュートします。元の声との二重取りを避けます。
  3. いきなり配信せず、短いローカル録画で映像と声のタイミングを確認します。

ケーブルへ出力すると、自分のヘッドホンには聞こえなくなる場合があります。それだけで変換失敗とは限りません。使用版のモニター出力を確認してください。モニター音を変換入力へ戻す経路、PC全体の出力を同じケーブルへ流す設定は、ループや相手の声の混入を招くため避けます。

08 / 一項目ずつ調整

声質と待ち時間を、分けて考える。

同じ一文を話して、設定をひとつずつ変えます。次はRVC系で使われる項目の意味です。版・モデル形式によって表示名や選択肢は異なります。数値はNene専用の推奨プリセットではありません。

項目何を変えるか聴くところ
TUNE / Pitch入力の音高の変更高すぎ・低すぎ、裏返り。性別だけで固定値を決めない
INDEX / Index ratio対応indexの特徴検索を混ぜる割合モデルの声質への寄り方と明瞭さ。検索には追加処理が必要
F0 / Pitch extractor入力の音高を推定する方式音程の揺れ、急な音飛び。使用版で選べる方式を比較
CHUNK / Chunk size一度に処理する音声区間大きくすると途切れが改善する場合がある一方、待ち時間が増える
EXTRA(表示される版)変換に加える過去の音声の長さ文脈と処理負荷の兼ね合い。長ければ常に最適ではない
Input / Output gain入力・出力の音量小さすぎ、歪み。大きくしすぎてクリッピングしない
Threshold / Noise gate小さな入力を無音にする境界上げすぎると小声・語頭・語尾が欠ける

音切れを直したいときに、声質・音高・バッファを全部動かさないでください。まず負荷とCHUNK、その後に声質を調整します。配信やゲームとの同時使用では、単独使用より余裕が必要です。

09 / 困ったとき

音が止まった場所を見つける。

モデルを登録できない/RVCが選べない

Beatrice専用のstd版でないか、推論用ファイルか、モデルとindexが対応しているかを確認します。別版の内部フォルダへ手動で置くより、画面から登録してください。エラー全文、アプリ版、モデル形式を控えます。

VCClientで声が聞こえない

①Windowsで実マイクを録音できるか、②VCClientの入力が実マイクか、③Startを押したか、④出力先とヘッドホン音量、⑤マイク権限の順で確認します。仮想ケーブルへ出しているなら、いったんヘッドホン出力へ戻して切り分けます。

VCClientでは聞こえるが、Discord・OBSに届かない

VCClientの出力がCABLE Input、受け取るアプリの入力がCABLE Outputか確認します。相手に元の声が届くなら、通話アプリが実マイクを選んでいないか確認してください。自動で選ばれる「既定」ではなく、機器名を指定すると切り分けやすくなります。

音が途切れる/遅れが大きい

まずVCClient単独で確認し、不要な高負荷処理を止めます。使用GPUと処理時間を確認し、CHUNKを段階的に増やして安定性を比較します。安定してから少しずつ小さくします。通話・配信アプリ側にもバッファや処理があるため、アプリ全体で確認してください。

小声や語尾が消える/声が歪む

実マイクの録音を先に確認します。入力ゲイン、ゲートの閾値、重複したノイズ抑制をひとつずつ確認します。歪みは出力音量だけ下げても、入力時点のクリッピングが残ることがあります。

二重に聞こえる/ハウリングする

まず変換を停止し、音量を下げます。スピーカーの音を実マイクが拾っていないか、元の実マイクと変換音を二重に配信していないか、モニター出力を入力へ戻していないか確認します。

起動ウィンドウだけ出て、画面が開かない

初回取得が完了しているかとログの最後のエラーを確認します。通信失敗、必要データの取得失敗、機器・ドライバーの非対応などは別の原因です。エラーを無視して外部公開したり、セキュリティ保護を一括解除したりしないでください。

10 / 次回も同じ声で

設定を残して、停止してから閉じる。

使いやすい設定が決まったら、保存機能がある版では保存し、アプリ版・モデル名・index・入出力機器・音高・CHUNKなどを控えます。録音する場合は入力と出力を別名で残し、元素材を上書きしません。

終了時は通話・配信を終え、VCClientの変換を停止してからアプリを閉じます。起動ログ側のサーバも終了したことを確認します。更新するときは旧フォルダを上書きせず、新しい版でモデルと設定を確認してください。

ソフトウェアの規約、声モデルの規約、入力する録音や楽曲の利用許諾は別です。変換できることと、公開・販売してよいことを分けて確認してください。

11 / VOICE → NENE

Neneの声で、話してみる。

Nene RVCは、入力音声をNeneの声質へ変換する声モデルです。収録内容と利用条件は、最新のBOOTH商品ページをご確認ください。VCClient本体と声モデルは別に用意します。

Nene RVC Edition変換前とNeneの声を聴き比べる →歌唱・会話・多言語の変換実演。

文章から台詞を生成したい場合はNeneのTTS版との違いへ。録音済みの音声を作品として仕上げる手順はRVC Guideにまとめています。

12 / 公式資料と知見

版が違ったら、ここで確認する。

参照日:2026年10月2日。本稿はShizukaLabによる案内で、VCClient開発元の公式マニュアルではありません。対象の配布版・モデル形式・画面表示を確認しながら進めてください。