ボイスクローンを0円で試すなら、ElevenLabsは外れます。無料版に声の複製が無く、月6ドルのStarterからです。音声AI47本の料金ページを10月1日に調べると、声の複製の記載は21本でした。0円のまま作れると確かめられたのはCoeFontだけで、非商用に限られます。
- ボイスクローンを無料で試すやり方は、CoeFontの無料プランか手元のPCで動かすIrodori-TTSとVoiceStudioの2通りであること
- 音声AI47本の料金ページで声の複製の記載があったのは21本で、日本語対応の印が最上位で日本円でも払えるのはCoeFontの1本だけだったこと
- ElevenLabsの無料版には声の複製が無く、Starterの月6ドル(約945円)から使えること
- Gemini 3.8 Flash TTSは30秒の録音に加えて声の持ち主が同意を話した録音が要り、料金はまだ公表されていないこと
- Claudeに無料で声を複製できるツールを聞くとCoeFontもIrodori-TTSも挙がらず、声優の声の質問では刑事罰の可能性を落としたこと
- 録音の台本・原稿の直し・規約の読み取りに使えるプロンプト3つと、いまやっておく5つのこと
数十秒の録音から自分の声を複製するボイスクローンに、9月に入ってGoogleも乗り出しました。Googleは2026年9月23日に音声合成のGemini 3.8 Flash TTSを公開し、30秒の録音から声を再現できるようにしています。9月30日にはHugging Faceが日本語も測る音声合成の順位表を公開し、声の複製に対応するモデルだけを比べる切り替えを付けました。
日本語の動きもあります。手元のPCで声を複製できる日本語のIrodori-TTSは、2026年2月25日にGitHubで公開されました。Gemini 3.8 Flash TTSも100を超える言語に日本語が入り、Google AI StudioとGemini APIから使えます。料金と無料の枠で使えるかどうかは、公式ブログに書かれていません。
検索も動いています。AInformationが10月1日にキーワードプランナーで測ると、「ボイスクローン」は月720回調べられていました。2026年8月の検索は前年同月比+126%です。「elevenlabs 料金」は2025年9月の月320回から2026年8月の880回へ、2.75倍に増えました。キーワードプランナーの数字は8月までなので、9月のGoogleの発表の分はまだ入っていません。
では、いま無料でどこまでできるのか。AInformationは2026年10月1日の夜に、AIツールデータベースで音声・ナレーションに使える47本の料金ページを開きました。読めたのは45本です。声の複製の記載を1本ずつ数え、どのプランから使えるかも読んでいます。同じ日の夜にClaudeへ2つの質問を投げ、答えを料金表と内閣府の整理に照らしました。
結論を先に書きます。声の複製の記載があったのは21本で、0円のプランのまま作れると料金表で確かめられたのはCoeFontの1本だけでした。そのCoeFontも無料プランは非商用利用向けです。ElevenLabsは無料版に声の複製が無く、月6ドル(約945円)のStarterからでした。0円で自分の声を複製する道はもう1つあり、手元のPCで動くIrodori-TTSとVoiceStudioです。
ボイスクローンを無料で試すやり方はCoeFontか手元のPCの2通りだ
自分の声のボイスクローンを0円で作るには、どこから始めればいいのか。答えは2通りです。クラウドで手軽に試すなら、CoeFontの無料プランを使います。パソコンに入れて動かせる人なら、Irodori-TTSかVoiceStudioも0円で使えます。
ElevenLabs・HeyGen・Flikiは料金表を見る限り、無料版では声の複製を使えません。Gemini 3.8 Flash TTSは料金が公表されていないので、0円の選択肢にはまだ数えていません。3つの入口を並べると次のようになります。

CoeFontの無料プランは登録してWeb録音から始める
CoeFontの料金ページで、Freeは非商用利用向けのプランです。Web録音からカスタムAI音声を作成できると書かれていて、AI音声での音声生成は800文字・1プロジェクトまでになります。手順は、登録してブラウザで自分の声を録ってから原稿を読ませる流れです。800文字を使い切ったあとは、個人向けのStandardで80,000文字まで広がります。
1つ目は録音の台本を作らせるプロンプト
どのサービスでも、まず自分の声を録る台本が要ります。録る長さはサービスごとに違いました。Gemini 3.8 Flash TTSは30秒の録音から声を再現する作りです。Azureのパーソナル ボイスは5〜90秒の音声を使います。Irodori-TTSは参照の音声をつなげて120秒までです。台本は、ChatGPTやClaudeに次の文を貼れば2本まとめて作れます。
自分の声をAIで複製するための録音の台本を作ってください。
・ふつうの速さで読んで30秒で終わるものと、90秒で終わるものの2本
・ア行からワ行までの音と、濁音・半濁音・のばす音がまんべんなく入る文にする
・数字・英語の略語・カタカナ語を少しずつ混ぜる
・YouTubeのナレーションで使う、落ち着いた説明の口調にする
・言いにくい早口言葉は入れない
最後に、録音するときに気をつけること(部屋の静かさ・マイクとの距離・読む速さ)を3行で添えてください。
2つ目はナレーションの原稿をAIの声向けに直すプロンプト
声ができたら、次は読ませる原稿です。読み間違えやすい語を先に直しておくと、作り直す回数が減ります。CoeFontの無料プランのように文字数に上限があるときほど、この下ごしらえが効きます。
下の【原稿】を、AIの音声合成で読み上げる前提で直してください。
・読み間違えやすい漢字・固有名詞・英語には、カッコでよみがなを付ける
・数字は読み方が1つに決まる書き方にする
・1文を40字以内に切り、間を置きたい所で改行する
・全体を800文字以内に収める
最後に、直した所と理由を表で見せてください。
【原稿】
(ここに原稿を貼る)
3つ目は規約で確かめる所を抜き出させるプロンプト
自分の声でも、商用に使えるかはプランで変わります。CoeFontの無料プランは非商用利用向けで、ElevenLabsは商用ライセンスがStarterからです。申し込む前に利用規約をAIに読ませ、該当する所を抜き出させると見落としが減ります。
下の【利用規約】は、AIで声を複製できるサービスのものです。次の5つについて、書かれている所をそのまま抜き出してください。書かれていない項目は「記載なし」と答えてください。
1 作った声を商用に使える条件(どのプランからか・クレジット表記が要るか)
2 自分以外の人の声を登録するときの決まり(本人の同意の取り方)
3 録音や作った声のデータを、サービス側が学習に使うかどうか
4 作った声を消したいときの手順
5 収益化したYouTube動画に使えるかどうか
最後に、判断がつかない点を問い合わせの文面にしてください。
【利用規約】
(ここに貼る)
音声AI47本の料金ページで声の複製の記載があったのは21本だ
声を複製できるAIは、実際にどれくらいあるのか。AIツールデータベースで音声・ナレーションに使える47本を調べると、料金ページに声の複製の記載があったのは21本でした。
47本の料金ページを開いて声の複製の語を探した
対象は、AIツールデータベースの496本のうち用途に音声・ナレーションが入っている47本です。データベースは2026年9月30日に更新した版を使いました。10月1日の22時59分から23時にかけて、47本の料金ページを機械で開いています。開けたのは45本です。Grok(X Premium)は403、Dubverseは500のエラーで読めませんでした。
読めた本文とページ内のデータから、voice cloningやInstant Voice Cloningのような声の複製を表す語を探しました。日本語のページでは、カスタムAI音声のような言い方も拾っています。当たった部分は1本ずつ読み、声の複製ではないものを外しました。Papercupはprofessional voice-overという語に当たっただけで、Steve AIのCustom Voicesは用意された声を足す機能でした。

21本は動画を作るAIが多く歌声の2本も入る
21本には、ElevenLabs・HeyGen・Descript・Fliki・Pictory・Speechify・Synthesiaが入っています。ほかにVEED.IO・Podcastle・Captions・Colossyan・DeepBrain AI Studios・Designs.ai・Elai.ioがあります。残りはInVideo AI・Kits AI・Musicfy・Rask AI・Voicemaker・Zebracat・CoeFontです。動画を作るツールに、声の複製が付いている形が多く見られました。このうちKits AIとMusicfyは、話し声ではなく歌声を複製する道具です。
ChatGPTとGemini(Google AI プラン)の料金ページには、声の複製の記載がありませんでした。Googleの声の再現は、開発者向けのGemini 3.8 Flash TTSのほうに入っています。
0円のプランがあっても声の複製まで0円とは限らない
21本のうち、料金ページに0円のプランがあるのは15本でした。ただし0円のプランがあっても、声の複製まで0円で使えるとは限りません。どのプランから声の複製が入るかを料金表の文字で読めたのは5本だけで、残る16本は料金表から読み取れませんでした。読めた5本のうち、0円のプランのまま声を複製できると書かれていたのはCoeFontだけです。
日本語と日本円の両方がそろうのは21本中CoeFontの1本だけだ
日本語で使えて、請求も円になるボイスクローンはどれか。21本のうちAIツールデータベースで日本語対応の印が最上位なのは3本で、日本円で払えるのも3本でした。両方がそろうのはCoeFontの1本だけです。
日本語の印が最上位なのはElevenLabs・Rask AI・CoeFont
日本語対応の印は3段階で付けています。いちばん高い印が付いているのは、ElevenLabs・Rask AI・CoeFontの3本でした。日本円で払えるのはSynthesia・Designs.ai・CoeFontの3本です。SynthesiaとDesigns.aiは円で払えますが、日本語の印は最上位ではありません。
ElevenLabsは日本語の印が最上位でも、料金はドル建てです。AIツールデータベースの換算(1ドル157.52円)で円に直すと、Starterの月6ドルは約945円になります。為替が動けば、毎月の請求額も変わります。
声の複製の記載があった21本の内訳
| 分け方 | 本数 | ツール |
|---|---|---|
| 日本語対応の印が最上位 | 3本 | ElevenLabs・Rask AI・CoeFont |
| 日本円で払える | 3本 | Synthesia・Designs.ai・CoeFont |
| 両方がそろう | 1本 | CoeFont |
| 料金ページに0円のプランがある | 15本 | 0円で声の複製まで使えるとは限らない |
| 歌声を複製する | 2本 | Kits AI・Musicfy |
音声AI47本の月額の中央値は3,465円
音声・ナレーションの47本のうち、0円のプランがあるのは25本でした。有料プランの月額の中央値は3,465円です。CoeFontの個人向けのStandardは、料金ページに月3,300円(税込)と出ていて注記の印が付いています。申し込むときは注記の中身も読んでください。
ElevenLabsは無料版に声の複製が無く月6ドルのStarterから使える
ElevenLabsは無料で声を複製できるのか。できません。料金ページの無料プランは月10kクレジットで、声の複製は入っていません。インスタントボイスクローンが付くのは、月6ドルのStarterからです。

Starterは約945円でCreatorは約3,465円
AIツールデータベースの換算で円に直すと、Starterの月6ドルは約945円です。Starterにはインスタントボイスクローンと商用ライセンスが入ります。プロフェッショナルボイスクローンは、月22ドル(約3,465円)のCreatorからでした。Creatorは初月だけ50%引きの11ドル(約1,733円)です。
料金はドル建てだけで、円での表示はありません。ドル建ての料金を円で考えるときの注意は、Claudeの料金を日本円で聞いた検証でもふれています。

「elevenlabs 料金」の検索は2025年9月から2.75倍になった
ElevenLabsの料金を調べる人は増えています。キーワードプランナーで測ると、「elevenlabs 料金」は2025年9月の月320回から2026年1月に720回へ増えました。2月からは8月まで毎月880回です。前年同月比は+175%でした。
HeyGenとFlikiも声の複製は有料のプランから
動画を作るAIでも同じ形でした。HeyGenは無料の次のプランの説明が「Everything in Free, plus Voice Cloning」で、声の複製は無料プランに入っていません。FlikiはStandardプランに声の複製が入り、Premiumでは複数の声を複製できます。
DescriptはHobbyist(年払いで月16ドル・月払いで月24ドル)に、カスタムの声の複製を使った読み上げが入っています。無料プランで声の複製を使えるかは、料金表の文字からは読み取れませんでした。
料金表で確かめた5本の声の複製の入り口
| ツール | 0円のプランで複製 | 声の複製が入るプラン | 料金の通貨 |
|---|---|---|---|
| CoeFont | ○ 非商用利用向け | Free(Web録音からカスタムAI音声) | 日本円 |
| ElevenLabs | × | Starter 月6ドル(約945円) | ドル |
| HeyGen | × | 無料の次のプラン | ドル |
| Fliki | × | Standard | ドル |
| Descript | 読み取れず | Hobbyist 月16ドル(年払い) | ドル |
検索結果の「無料」と料金表の線引きは同じではない
「ボイスクローン 無料」でYahoo!を検索すると、10月1日の夜は上位10本のほとんどがツールを出している会社の自社ページでした。HeyGenの声の複製のページも、「あらゆる声を数秒で無料コピー」という見出しで並んでいます。一方でHeyGenの料金表では、声の複製は無料の次のプランの欄に書かれていました。
無料の紹介ページで何回まで試せるかは、今回は確かめていません。続けて使うつもりなら、紹介ページの見出しではなく料金表のどの欄に声の複製があるかで判断してください。
CoeFontは無料プランでもWeb録音から自分の声を作れるが非商用に限る
日本語で、しかも0円で自分の声を作れるサービスはあるのか。21本の中ではCoeFontが当てはまります。料金ページのFreeは非商用利用向けのプランで、Web録音からカスタムAI音声を作成できると書かれています。

無料は800文字で有料のStandardは80,000文字
無料で読ませられるのは、800文字・1プロジェクトまでです。個人向けのStandardは料金ページの表示で月3,300円(税込)で、80,000文字まで使えます。21本の中で日本語対応の印が最上位で、日本円でも払えるのはCoeFontだけでした。国産のサービスなので、請求が円で届くのも分かりやすい点です。
YouTubeの収益化が非商用に入るかは書かれていない
気をつけたいのは非商用の線引きです。料金ページには、収益化したYouTube動画に使うのが非商用に入るかどうかが書かれていません。広告収入のある動画に使うつもりなら、Standard以上にするか申し込む前に問い合わせて確かめてください。
AInformationは今回、CoeFontで実際に声を作るところまでは試していません。Web録音にどれくらいの長さが要るかも、料金ページには書かれていませんでした。
Gemini 3.8 Flash TTSは30秒の録音と本人の同意が要る
Googleの新しい音声合成なら、何を用意すれば声を複製できるのか。Gemini 3.8 Flash TTSは30秒の録音から声を再現します。ただし声の持ち主が同意を話した録音も出す必要があり、その声は参照の録音と同じ人でなければなりません。

使えるのはGoogle AI StudioとGemini API
Googleは2026年9月23日に、Gemini 3.8 Flash TTSとFlash-Lite TTSを公開しました。Google AI StudioとGemini APIで使え、100を超える言語に日本語が入っています。用意された声は2,000を超えていて、出力した音声にはSynthIDの透かしが入ります。
AI Studioでの声の再現は、米国のイリノイ州とテキサス州・EEA・英国・スイス・インドでは使えません。日本はこの一覧に入っていませんが、AInformationは日本から声の再現を試していません。料金と無料の枠で使えるかどうかも、公式ブログには書かれていませんでした。
キーワードプランナーで測ると、「gemini tts」は月1,000回調べられていて前年同月比は+69%でした(9月24日に測定)。数字は8月までなので、9月23日の発表の分はまだ入っていません。
Azureのパーソナル ボイスは5〜90秒で申請が要る
MicrosoftのAzure AI Speechにも、パーソナル ボイスという声の複製があります。5〜90秒の人の音声と、話者が同意を話した録音から声を作る仕組みです。APIを使うには申請が要り、対象の顧客と承認された使い道に限られます。話せる言語は91です。
GoogleとMicrosoftは、どちらも本人の同意を録音で確かめる作りにしていました。参照の声と同じ人が同意を話す必要があるので、他人の録音だけでは条件を満たせません。
声を複製するときの録音と同意の条件
| サービス | 使う録音の長さ | 本人の同意の録音 | 使い始めの条件 |
|---|---|---|---|
| Gemini 3.8 Flash TTS | 30秒 | 必須 | Google AI StudioかGemini API・料金は公表なし |
| Azure パーソナル ボイス | 5〜90秒 | 必須 | APIの利用は申請制 |
| Irodori-TTS | つなげて120秒まで | 確かめていない | 手元のPCで動かす・コードはMIT |
| CoeFont | 料金表に記載なし | 確かめていない | Freeは非商用利用向け |
手元のPCならIrodori-TTSとVoiceStudioが0円で使える
料金を払わずに自分の声を複製する方法は、ほかにあるのか。自分のパソコンで動かすオープンソースの音声合成なら、ソフトの使用料はかかりません。日本語ならIrodori-TTS、たくさんの言語をまとめて扱うならVoiceStudioがあります。

Irodori-TTSは参照の音声を120秒までつなげられる
Irodori-TTSは日本語の音声合成モデルです。参照の音声から声をゼロショットで複製でき、参照の音声は何本かつなげて120秒まで使えます。ゼロショットは、その人の声で学習し直さずに複製するやり方です。コードはMITライセンスで、2026年2月25日にGitHubで公開されました。10月1日時点のスターは1,371です。
注意したいのは、MITなのはコードだという点です。声を作るモデルの重みの条件は、AInformationでは確かめていません。商用に使うなら、モデルの配布ページの条件も読んでください。
検索の伸びは目立ちます。キーワードプランナーで測ると、「irodori tts」は2026年1月の0回から3月に1,900回へ増えました。4月は14,800回で、5月は22,200回です。8月も12,100回あり、月平均は6,600回でした(9月22日に測定)。
VoiceStudioは手元で動くElevenLabsの代わりを名乗る
VoiceStudioは、手元のPCだけで動くElevenLabsの代わりを名乗るオープンソースです。声の複製・声のデザイン・動画の吹き替え・文字起こしなどを646の言語で扱います。ライセンスはAGPL-3.0で、2026年4月9日に公開されました。10月1日23時の時点で、GitHubのスターは51,097です。
会社のサービスに組み込むつもりなら、AGPL-3.0の条件を先に読んでください。自分の動画のナレーションを作るだけでも、パソコンに入れて動かす手間はかかります。
日本語の似かたはOpen TTS Leaderboardで比べられる
どのモデルが日本語で本人に近い声を出すかは、まだ数字で比べにくい状況です。Hugging Faceが9月30日に公開したOpen TTS Leaderboardは、聞き取りやすさ・速さ・話者の似かたを機械で測ります。声の複製に対応するモデルだけを比べる切り替えがあり、日本語は文字の誤り率(CER)で測ります。Irodori-TTSとVoiceStudioには、公式に日本語の話者の似かたの数字が出ていません。
Claudeの答えた3つにCoeFontもIrodori-TTSも入らなかった
AIに聞けば、無料で声を複製できるツールが分かるのか。10月1日の夜にClaudeへ次の質問を投げました。
日本語で自分の声をAIでクローンして、YouTube動画のナレーションに使いたいです。無料プランのままで声の複製までできるツールを3つ教えてください。有料にすると月いくらになるか、録音は何秒あればいいかもあわせて知りたいです。
返ってきた3つには、料金表で0円のまま作れると確かめたCoeFontが入っていませんでした。9月23日に出たGemini 3.8 Flash TTSも、手元で動くIrodori-TTSとVoiceStudioも出てきません。
答えは120.8秒で返り2つを無料で複製できるとした
Claudeはウェブを検索してから、120.8秒で921字の答えを返しました。挙げたのはMiniMax Audio・Fish Audio・ElevenLabsの3つです。MiniMax Audioは無料で3つまで声を作れて、録音は約10秒でよいという答えでした。Fish Audioは無料の枠で全部の機能を使えて、録音は最小15秒としています。有料の最安は、MiniMax Audioが月5ドルでFish Audioが月11ドルという答えでした。
ElevenLabsは要確認として決めきらなかった
ElevenLabsについては、無料プランで複製できるかは情報源によって割れているとして△の印を付けました。最安の有料プランをStarterの6ドルとした所は、料金ページと合っています。商用ライセンスがStarterから付くという注意も合っていました。
ただ、料金ページを開けば無料プランに声の複製が無いことは決まります。Claudeは検索したのに、そこを決めきらずに登録するときの確認を勧めていました。
MiniMax AudioとFish AudioはAIツールデータベースの外だった
MiniMax AudioとFish Audioは、AIツールデータベースの496本に入っていません。今回の料金ページ調べの外です。2本が本当に無料で声を複製できるかは、AInformationでは確かめていません。Fish Audioは、「ボイスクローン 無料」のYahoo!の検索で10月1日の夜に2番目に出ていた自社ページの持ち主でもあります。
ChatGPTにも同じ質問を投げる予定でした。10月1日の夜は画面の起動が2回とも途中で止まり、答えを取れていません。この記事では、ChatGPTの答えの良し悪しは書きません。
Claudeが挙げた3つと料金ページで確かめた結果
| Claudeが挙げたツール | Claudeの答え | AInformationが確かめた結果 |
|---|---|---|
| MiniMax Audio | 無料で3つまで複製・録音は約10秒 | AIツールデータベースに無く確かめていない |
| Fish Audio | 無料の枠で全機能・録音は最小15秒 | AIツールデータベースに無く確かめていない |
| ElevenLabs | 無料で複製できるかは要確認・Starterは6ドル | 無料版に声の複製は無い・Starterの月6ドルは合っている |
声優の声のクローンは内閣府の整理で3つの場合にパブリシティ権が及ぶ
好きな声優の声を複製して、自分の動画のナレーションに使ってよいのか。AInformationは個別の答えを出せませんが、国の考え方は整理されています。内閣府のAI時代の知的財産権検討会が2024年5月に出した中間とりまとめは、声の扱いを4つの点で書いています。
声は肖像権では守られにくくパブリシティ権は3つの場合に及ぶ
1つ目は、声が判例でいう肖像権で守られる可能性は高いとは言えないという点です。2つ目に、パブリシティ権で守られうる場合が3つ挙がっています。声そのものを鑑賞の対象として売る場合・商品の差別化に声を付ける場合・声を広告に使う場合の3つです。3つ目に、声そのものは著作隣接権では守られないとしています。
AIの音声でなりすますと刑事罰の可能性がある
4つ目が刑事罰です。生成AIの音声でほかの人になりすますような行為は、詐欺罪(刑法246条)や偽計業務妨害罪(刑法233条)に問われる可能性があると書かれています。民事の権利だけの話ではありません。
YouTubeのナレーションに声優の声を使う場合が3つのどれに当たるかは、この資料には書かれていません。収益化する動画で使う前に、権利者の許可を取るか弁護士に相談してください。

Claudeは刑事罰の可能性にふれなかった
同じ日の夜、Claudeに「好きな声優の声をAIでクローンして、自分のYouTube動画のナレーションに使うのは日本では違法ですか?」と聞きました。答えは54.6秒で返っています。
内閣府の4つの点と照らすと、合っていたのはパブリシティ権の話だけでした。Claudeは声がパブリシティ権で守られうると書き、有名人の声であることと収益化を危ない要素に挙げています。肖像権と著作隣接権には、ふれていません。
食い違ったのは刑事罰です。Claudeは「〇〇罪」で逮捕されるような刑事上の違法行為ではないと言い切りました。内閣府の整理は、AIの音声でなりすますと詐欺罪などに問われる可能性があると書いています。使い方によっては刑事罰の話になる点を、Claudeの答えは落としていました。
内閣府の整理とClaudeの答えを照らした結果
| 内閣府の中間とりまとめ | Claudeの答え |
|---|---|
| 声は判例の肖像権では守られにくい | ふれていない |
| パブリシティ権は3つの場合に及びうる | ○ 守られうると答えた(3つの場合は挙げず) |
| 声そのものは著作隣接権で守られない | ふれていない |
| なりすましは詐欺罪などの可能性 | × 刑事上の違法行為ではないと言い切った |
Claudeが挙げた法務省の指針は原文を確かめられていない
もう1つ気になったのは出どころです。Claudeは2026年8月7日に法務省が声の無断利用についての指針を出したと書き、出典にはai-revolutionなどの名前を示しました。法務省のページは挙げていませんでした。
AInformationは法務省の原文を確かめられていないので、この記事ではその指針の中身を事実として扱いません。実在の声優がSNSの運営会社を訴えた件が進んでいるとも書いていましたが、裁判所や当事者の発表も確かめていません。法律の話をAIに聞いたときは、答えに出てくる資料を役所のサイトで開いてから使ってください。
副業1,661件のうち声の案件は16件でAIの名前が入るのは2件だ
自分の声を複製できるようになると、仕事にもつながるのか。AI副業ナビで集めている案件1,661件を見ると、ナレーションや声の案件は16件でした。タイトルにAIが入るのは2件です。
1件はココナラの「AIキャラクターの音声収録にご協力いただける方を募集します」です。もう1件はランサーズの「【在宅OK・未経験歓迎】AIナレーションツールを使った音声作成のお仕事(継続案件あり)」でした。案件は2026年10月1日の朝に取り直した分です。
AIに声を渡す仕事とAIの声で作る仕事がある
2件は向きが逆です。前者はAIのために自分の声を録る仕事で、後者はAIの声で音声を作る仕事です。声を渡す側に回るなら、その声がどこまで使われるかを契約で確かめておく必要があります。
ナレーションの制作に使う音声AIの月額の中央値は3,465円
AI副業ナビでは、副業の種類ごとに使うツールの月額を並べています。ナレーションの制作に使う音声AI47本の月額の中央値は3,465円で、いちばん安いものは725円でした。声の複製まで有料で使うなら、ElevenLabsのStarterの約945円がこの中では安い側に入ります。
ボイスクローンを試す前にいまやっておく5つのこと
Gemini 3.8 Flash TTSの料金はまだ出ていません。それでも、いまから準備できることがあります。AIツールデータベースで料金を見比べながら、次の5つを順に進めてください。
- 自分の声を30秒と90秒と120秒で録っておく。使う録音はGemini 3.8 Flash TTSが30秒・Azureのパーソナル ボイスが5〜90秒・Irodori-TTSが120秒までです。同じ部屋と同じマイクで録っておけば、どのサービスにも使い回せます。
- CoeFontの無料プランで800文字のナレーションを作る。登録とWeb録音だけで、自分の声の仕上がりを0円で確かめられます。非商用利用向けなので、公開する動画にはまだ使わないでください。
- 収益化する動画に使うなら商用のプランの月額を先に見積もる。ElevenLabsはStarterの月6ドル(約945円)から商用ライセンスが付きます。CoeFontで収益化した動画が非商用に入るかは、料金ページに書かれていないので問い合わせてください。
- 他人の声を使うなら許可を書面で取る。GoogleとMicrosoftは、声の持ち主が同意を話した録音を出すよう求めています。内閣府の整理でも、声を広告に使う場合などにはパブリシティ権が及ぶとされています。
- Gemini 3.8 Flash TTSの料金が出たら手元のPCと比べる。料金と無料の枠はまだ公表されていません。発表を待つ間に、Open TTS Leaderboardで日本語の誤り率を見てモデルの目星を付けておきます。
「音声クローン 無料」と検索する人は、2026年8月で月210回いました。直近3か月の推移は+24%です。検索の上位には無料をうたうページが並びますが、料金表で読めた5本のうちElevenLabs・HeyGen・Flikiは声の複製が有料の欄にありました。まずは自分の声を録り、0円で試せる範囲を確かめるところから始めてください。
声の複製は、検索結果の言葉と料金表のずれが大きい分野だと感じました。検索の上位には無料をうたうページが並びますが、料金表で読めたElevenLabs・HeyGen・Flikiは声の複製が有料の欄にありました。自分の声をナレーションに使うだけなら、まずCoeFontの無料プランで試せば足ります。収益化の段階で商用のプランを選んでも遅くありません。他人の声は、技術でできても使ってよいとは限りません。GoogleとMicrosoftが本人の同意の録音を求めているのは、その線引きの表れだと見ています。
- ボイスクローンは無料で作れますか?
- 作れますが、選べるものは少ないです。AInformationが2026年10月1日に音声AI47本の料金ページを調べると、声の複製の記載は21本でした。0円のプランのまま作れると料金表で確かめられたのはCoeFontだけで、非商用利用向けです。手元のPCで動くIrodori-TTSとVoiceStudioも、ソフトの使用料はかかりません。
- ElevenLabsの無料版で声のクローンはできますか?
- できません。料金ページの無料プランは月10kクレジットで、声の複製は入っていません。インスタントボイスクローンはStarter(月6ドル・約945円)から、プロフェッショナルボイスクローンはCreator(月22ドル・約3,465円)からです。Creatorは初月だけ11ドルになります。料金はドル建てだけで、為替が動くと請求額も変わります。
- Gemini TTSで自分の声を再現するには何秒の録音が要りますか?
- 30秒です。Googleが2026年9月23日に公開したGemini 3.8 Flash TTSは、30秒の録音から声を再現します。声の持ち主が同意を話した録音も必要で、参照の声と同じ人である必要があります。Google AI StudioとGemini APIで使え、日本語にも対応しています。料金は公式ブログに書かれていません。
- Irodori-TTSは無料で使えますか?
- コードはMITライセンスで、自分のPCで動かせば使用料はかかりません。参照の音声から声をゼロショットで複製でき、参照の音声はつなげて120秒まで使えます。声を作るモデルの重みの条件はAInformationでは確かめていないので、商用に使う前にモデルの配布ページの条件を読んでください。
