日本語音声の選び方と端末別の設定
試聴用の短文
新幹線のぞみ三号は、東京駅を午前九時十五分に出発します。
東京、大阪、札幌という地名を自然に読めるか確認します。
合計金額は一万二千四百五十円で、消費税を含みます。
午後二時三十分にPDFの第三章を開いてください。
AI、URL、USBなどの英字略語を文章の中で確認します。
疑問文では、語尾の抑揚と読点の間が変わるか聞き比べます。
このページに表示される音声
VoiceAI Freeは、現在のブラウザーがWeb Speech APIを通して公開する音声一覧を表示します。サイト側で日本語音声の数を固定したり、端末にない音声を自動追加したりすることはありません。Windows、macOS、Android、iOSでは、音声名、品質、ダウンロード方法が異なります。同じパソコンでもChromeとEdgeで一覧の読み込み方が違う場合があります。まずja-JPの音声を選び、短い挨拶だけでなく、数字、固有名詞、疑問文を含む複数の文で確認してください。localServiceという表示はブラウザーの技術情報であり、完全なオフライン動作や利用許諾を保証しません。
Windowsで日本語音声を追加する
Windowsの「設定」から「時刻と言語」、「言語と地域」を開き、日本語を追加します。言語のオプションに音声またはテキスト読み上げの項目がある場合は、必要なデータをインストールしてください。その後、ブラウザーを完全に終了して起動し直します。音声が表示されないときは、「アクセシビリティ」のナレーター関連設定も確認し、ChromeとEdgeの両方で試します。会社や学校の端末では管理ポリシーが言語データの取得を制限することがあります。その場合、VoiceAI Freeから制限を解除することはできないため、端末管理者に確認してください。
macOSでシステム音声を管理する
macOSでは「システム設定」、「アクセシビリティ」、「読み上げコンテンツ」からシステム音声を確認します。「声を管理」などの項目に日本語の追加音声があれば、必要なものをダウンロードします。メニュー名はOSのバージョンによって異なることがあります。完了後にブラウザーを再起動し、このページの音声一覧を読み込み直してください。日本語音声は一般文が自然でも、人名、地名、商品名、英字略語の読みを誤ることがあります。公開する原稿では、実際に使う語彙を含むテスト文を用意すると修正点を見つけやすくなります。
AndroidとiPhoneの設定
Androidでは「言語」、「ユーザー補助」、「テキスト読み上げ」などの設定から、使用中の音声サービスと日本語データを確認します。端末メーカーによって画面構成が異なるため、選択中のサービス内でダウンロード状態を確認してください。iPhoneとiPadでは「設定」、「アクセシビリティ」、「読み上げコンテンツ」、「声」から日本語音声を追加できます。インストール後はモバイルブラウザーを再起動します。空き容量が少ない端末では、使用頻度の低い音声データが後で削除されることがあります。音声が消えた場合は、サイトのデータを消す前にOS側の一覧を確認してください。
標準語、地域差、固有名詞
ja-JPというコードだけでは、抑揚、話速、地域的な印象、固有名詞の読み方までは判断できません。東京式のアクセントを想定した音声でも、地名や姓に複数の読みがあると誤る場合があります。日付、時刻、助数詞、住所、金額、アルファベットを完成した文の中で試してください。教育、案内、動画など公開範囲が広い内容では、日本語話者が原稿と音声を通して確認する必要があります。対象地域で用語やイントネーションが重要な場合は、その地域の確認者を入れます。音声コードは編集確認の代わりにはなりません。
長文、速度、読み上げ位置
最初は速度1.0で発音と間を確認し、その後で用途に合わせて調整します。速度を上げすぎると、助詞、促音、数字の区切りが聞き取りにくくなります。長い文章はブラウザーのキューが安定するよう複数の区間に分けて再生されます。EPUB、DOCX、TXTのツールでは章や区間を選び、停止時の区間と速度を端末内に保存できます。ただし、すべてのシステム音声が単語単位の位置を同じ方法で返すわけではありません。復元後は開始文を確認してから続きを聞いてください。
プライバシー、WAV、利用条件
入力した日本語本文はVoiceAI Freeの音声生成サーバーに送られず、分析イベントにも含まれません。ただし、端末音声がオンラインサービスを利用するかどうかはOSや音声提供元の設定に依存します。日本語の端末音声はWeb Speech APIによる再生用で、サイトが音声データを取得してWAVとして保存することはできません。ローカルAIモードは、現在明示されている英語音声でWAVを端末内生成します。再生できること、ローカルで動くこと、ダウンロードできることは、商用利用の包括的な許諾を意味しません。音声、モデル、原稿、公開目的の条件を個別に確認してください。
よくある質問
端末によって日本語音声が違うのはなぜですか?
OS、インストール済み音声、ブラウザー、端末のバージョンがそれぞれ一覧に影響するためです。言語データを追加した後はブラウザーを再起動してください。
日本語音声をWAVで保存できますか?
日本語の端末音声は現在、ブラウザー内の再生に使います。Web Speech APIは音声データの書き出しを提供しません。
入力文は分析に送られますか?
送られません。分析イベントには入力文、ファイル本文、ファイル名、生成音声を含めません。
収益化した動画で使えますか?
技術的に再生できることは許諾ではありません。選択したシステム音声またはモデルと、原稿、配信目的の利用条件を確認してください。