ElevenLabs、音声合成「Eleven v4」発表。日本語のナレーションや音声応答づくりに

ElevenLabsが感情表現を強めた音声合成モデル「Eleven v4」と低遅延版「Eleven v4 Turbo」を公開。日本語を含む90以上の言語に対応します。発表の要点と、企業・学校での使いどころ、始め方、注意点を解説します。

Eleven v4で音声づくりはどう変わる?(AIニュース|ElevenLab/9月28日発表/90以上 対応言語数(日本語を含む))
Vendor
ElevenLabs
Announced
2026.09.28
Published
2026.10.03
Checked
2026-10-03 15:09
Reading
約7分
Supervisor
舟橋 遼亮(代表取締役CEO)

ElevenLabsは、感情表現を強めた音声合成モデル「Eleven v4」と、低遅延版の「Eleven v4 Turbo」を公開しました。日本語を含む90以上の言語に対応しており、日本の企業・学校では、ナレーション・教材音声・電話などの音声応答を作る方法を見直すきっかけになります。

この記事は、ElevenLabsが2026年9月28日に公開した公式発表をもとに、2026年10月3日時点の情報で書いています。

何が発表されたか

音声合成(テキストを読み上げ音声に変える技術。TTSとも呼ばれます)の新しいモデルが2つ公開されました。要点は次のとおりです。

  • 新しいアーキテクチャの2モデル: 表現力を重視した「Eleven v4」と、エージェント(会話型AI)など低遅延の用途向けの「Eleven v4 Turbo」です
  • 話し方の指示: 文章の口調・間・感情・文脈を読み取って話し方を変えます。[laughs] のような音声タグや自然な文章で、話し方や効果音を指定できます。従来モデルより指示に正確に従うとしています
  • 複数話者の会話: 直前の発言を踏まえた自然なやり取りを生成し、話者ごとの声の特徴を保つとしています
  • 多言語: 両モデルとも90以上の言語に対応します。公式ドキュメントの対応言語一覧には日本語が含まれています。ある言語で録った声が、別の言語をその言語らしいアクセントで話せます
  • 声のクローン: 「Instant Voice Clone」は10秒の音声で声を高い忠実度で再現できるとしています。より高品質な「Professional Voice Clone(PVC)」にも対応します
  • 提供先: ElevenAgents・ElevenCreative・ElevenAPIで提供が始まっています。無料アカウントで試せると案内されています
Eleven v4は表現力を重視したモデルでナレーションや吹き替え向き、Eleven v4 Turboは話し始めまでの時間の中央値が約150msの低遅延版でElevenAgentsなどの会話型AI向き。どちらも90以上の言語に対応し、ElevenAgents・ElevenCreative・ElevenAPIで使える。
FIG.01Eleven v4とEleven v4 Turboの違い
項目 内容
発表日 2026年9月28日
対応言語 90以上(日本語を含む)
料金 モデル別の料金は発表本文に書かれていません
キャンペーン 発表ページの告知欄に「Creator+」で10月12日までクレジット3倍との案内があります

なお、表現力の評価(Artificial Analysisのランキング1位、聞き比べで約75%が選んだ)や速さの数字は、ElevenLabsが2026年9月に示した条件での結果です。

日本の企業・学校でどう使えるか

業務・授業での使いどころ

ここからはTERRAISEの考えです。業務を「入力 → 処理 → 出力」に分けると、AIに任せる範囲が見えます。

  1. 研修・マニュアル動画のナレーション(人事・製造現場・営業企画) - 入力: 原稿と、話し方の指示(落ち着いて、要点は強調など) - 処理: Eleven v4で読み上げ音声を作る - 出力: 動画に載せるナレーション - 原稿を直せば音声を作り直せるため、録り直しの手間が減ることが考えられます。同じ声で他言語版を作る使い方もあります
  2. 問い合わせ窓口の音声応答(カスタマーサポート) - 入力: お客様の発話 - 処理: ElevenAgentsのエージェントが回答を考え、Eleven v4 Turboが話す - 出力: 音声での案内。難しい内容は担当者へ引き継ぐ - まずは営業時間の案内など、答えが決まっている質問から試すのがおすすめです
  3. 外国語のリスニング・会話教材(高校・大学の授業) - 入力: 話者ごとに分けた会話の台本 - 処理: 複数話者の会話として音声を生成 - 出力: 場面に合った会話音声の教材 - 教員が台本と発音を確かめてから授業で使う形が考えられます

始め方

一般的な進め方として、次の手順をおすすめします。

  1. 担当者が無料アカウントで試す: 機密を含まない社内原稿や教材の一節を使い、日本語の読み上げを聞き比べます
  2. 用途を1つに絞る: 「研修動画のナレーション」など1つを選び、入力・処理・出力を書き出します
  3. 契約条件を確認する: 情報システム・法務の担当が、料金プラン・利用規約・データの扱いを公式サイトで確認します
  4. 声のクローンは同意を取ってから: 社員などの声を使う場合は、本人の同意を文書で残します
  5. 開発部門はAPIで小さく試作する: 音声応答なら、Eleven v4 Turboで限られた質問だけに答える試作から始めます

注意点

  • 入力する情報: 顧客の個人情報や未公開の情報を原稿に入れてよいか、社内ルールで先に決めておきましょう
  • 声のクローンの扱い: 10秒の音声で声を再現できるとされているため、なりすましへの悪用に注意が要ります。本人の同意と、生成した音声であることの明示を検討してください
  • 日本語の品質: 公式ドキュメントは、言語によって流暢さに差があるとしています。読み方の指定(IPA=国際音声記号)の改善が日本語の固有名詞にどこまで効くかは示されていません。社名や専門用語の読みは必ず人が確認してください
  • 機能の制約: 公式ドキュメントでは、Eleven v4はSSML(読み方を細かく指定する記法)に対応せず、Style・Speedのスライダーも使えないとされています。音声タグもまだ完全ではないとしています
  • 文字数の上限: モデル一覧では、Eleven v4の文字数上限は10,000(音声で約10分)とされています。長い教材は分けて作る前提で計画しましょう
  • 料金: モデル別の料金は発表本文に書かれていません。利用量が増える前に料金ページで確認してください

TERRAISEに相談する

音声合成を研修動画・問い合わせ対応・教材のどこに当てはめるかは、業務を入力・処理・出力に分けると整理しやすくなります。60分の無料相談で、自社・自校の業務に合わせた使い方を一緒に整理できます。学校での活用は教育機関向けAI教育、社内での使い方の研修はAX Academyもご覧ください。

出典(2026年10月3日 15:09 確認)

製品名・機能・提供範囲・料金は変わることがあります。導入前に必ず公式情報をご確認ください。

TERRAISE代表 舟橋遼亮のポートレート

Supervised by — 監修

株式会社TERRAISE 代表取締役CEO 舟橋 遼亮

2025年2月に株式会社TERRAISEを創業。お茶の水女子大学 外部講師、Google AI Student Ambassador(2025年)を務める。上場企業や全国の高校などで、AIの活用を実際に指導している。

執筆:株式会社TERRAISE(公式発表をもとにAIで下書きし、出典と照合して掲載)。公開日:2026年10月3日

よくあるご質問

Q01Eleven v4は日本語に対応していますか?

公式ドキュメントの対応言語一覧に日本語が含まれています。両モデルとも90以上の言語に対応します。ただし言語によって流暢さに差があるとされているため、社名や専門用語の読みは人が確認することをおすすめします。

Q02Eleven v4とEleven v4 Turboはどう使い分けますか?

表現力を重視するナレーションや教材にはEleven v4、電話応答など素早い返答が要る会話型AIにはEleven v4 Turboが向いています。Turboは話し始めまでの時間の中央値が約150msとされています。

Q03料金はいくらですか?

モデル別の料金は発表本文に書かれていません。発表ページの告知欄には「Creator+」で10月12日までクレジット3倍との案内があります。利用前に公式の料金ページで確認してください。

まず、御社の「あの業務」を、ひとつ教えてください。

  1. 01業務を1つ伺う
  2. 02その場で入力・処理・出力に分解する
  3. 03AIに任せられる範囲の当たりをつける
60分の無料相談を予約する

業務名をひとつ挙げていただければ、入力・処理・出力に分解して、その場で当たりをつけます。資料の準備は要りません。初回相談は60分・無料です。

会社紹介資料を請求する