本文へ移動
YOBITSUGI AIメディア
AI の紹介AI により執筆

ElevenLabs とは: 読み上げ・音楽・効果音・文字起こし

公開 5 分で読めます

共有XFacebookLINEはてブ

基本の情報

提供元
ElevenLabs
種類
読み上げ(音声合成)・音楽・効果音・文字起こし
YOBITSUGI AI で使えるモデル
Eleven v3・Eleven Multilingual v2・Eleven Flash v2.5・Eleven Music・効果音・Scribe
日本語
読み上げ・音楽・文字起こしのモデルが対応(2026 年 10 月時点)
料金
YOBITSUGI AI では使った分だけ(yobitsugi.ai/pricing)
公式サイト
elevenlabs.io

ElevenLabs は、AI による音声の生成と認識を提供している会社です。文章を自然な声で読み上げる音声合成のほか、音楽と効果音の生成、音声の文字起こしなどを、Web のサービスと API で提供しています。YOBITSUGI AI では、読み上げ・音楽・効果音・文字起こしに使えます。

できること

読み上げ(音声合成)

ElevenLabs のドキュメントでは、YOBITSUGI AI で使える 3 つの読み上げのモデルを次のように説明しています(2026 年 10 月時点)。どれも日本語に対応しています。

モデル 特長 対応言語 1 回の上限
Eleven v3 表現が豊か。会話の音声にも対応 70 以上 5,000 文字(約 5 分)
Eleven Multilingual v2 安定した品質。長い文章向き 29 10,000 文字(約 10 分)
Eleven Flash v2.5 速く、単価が低い 32 40,000 文字(約 40 分)

電話番号や日付、金額などの数字の読み方は、Multilingual v2 のほうが適切に整えられるとして、ElevenLabs は数字の読み方が大切な場面では Multilingual v2 を勧めています。

なお、ElevenLabs のドキュメントには、より新しい世代の Eleven v4 も載っており、Eleven v3 は前の世代のモデルと位置づけられています。Eleven v4 は、YOBITSUGI AI の現時点の対応モデルには含まれていません。

音楽(Eleven Music)

文章で指示して、ジャンル・雰囲気・構成を指定した曲を作れます。歌入りでも、楽器だけでも作れ、歌は英語・スペイン語・ドイツ語・日本語などに対応しています。曲の一部分や曲全体の音と歌詞を直すこともできます。ElevenLabs は、レーベル・音楽出版社・アーティストと協力して作ったモデルだと説明しています。API の料金ページでは、1 回に作れる長さの上限は 5 分です。

効果音

文章で説明した音を作れます。長さは 0.1〜30 秒で指定でき、繰り返し再生してもつなぎ目が目立たないループの音も作れます。形式は MP3 で、ループしない効果音は 48 kHz の WAV でも書き出せます。

文字起こし(Scribe)

Scribe v2 は 90 以上の言語に対応し、単語ごとのタイムスタンプや、最大 32 人の話者の聞き分けができます。ElevenLabs の文字起こしのドキュメントでは、日本語の認識の精度を、単語誤り率(WER)5% 以下の「Excellent」に分類しています。

得意なこと・向いている使い方

ElevenLabs のドキュメントでは、それぞれの使い道として次のものを挙げています。

  • Eleven v3: 感情の起伏がある読み上げや、複数の話者による会話の音声
  • Eleven Multilingual v2: ゲームやアニメのキャラクターの声、企業の動画や e ラーニングの教材、複数の言語にまたがる制作
  • Eleven Flash v2.5: リアルタイムの音声エージェントやチャットボット、すぐに応答が要るゲームやアプリ、大量の読み上げ
  • Eleven Music: ゲームのサウンドトラック、ポッドキャストの BGM、広告用の短い動画の BGM
  • 効果音: 映画や予告編の音づくり、ゲームの効果音、動画の環境音
  • Scribe v2: 音声や動画の文字起こし、会議の記録、音声の内容の分析

YOBITSUGI AI での使い方

YOBITSUGI AI では、読み上げの Eleven v3・Eleven Multilingual v2・Eleven Flash v2.5、音楽の Eleven Music、効果音、文字起こしの Scribe を使えます。YOBITSUGI AI のサイトでは、ElevenLabs を「自然な声・音楽・効果音・文字起こし」の AI として案内しています。

日本語で頼むと、Claude エージェントが ElevenLabs に音声を頼み、届いたものを確認してから、マイファイルに保存します。使う AI を名前で指定して頼むこともできます。

頼み方の例:

  • 「このナレーション原稿を、ElevenLabs の落ち着いた女性の声で読み上げて」
  • 「ElevenLabs で、カフェで流す落ち着いたピアノの BGM を 2 分で作って」
  • 「木のドアがきしみながら開く効果音を、ElevenLabs で作って」
  • 「この会議の録音を ElevenLabs で文字起こしして、話している人ごとに分けて」

料金

YOBITSUGI AI では、提供元の定価をもとに、使った分だけクレジットを消費します。月額費用はかかりません。ElevenLabs の単価は料金ページで確認できます。

ElevenLabs の API(ElevenAPI)の単価は次のとおりです(2026 年 10 月時点・税抜)。

モデル・機能 単価
Eleven v3 1,000 文字あたり $0.08
Eleven Multilingual v2 1,000 文字あたり $0.08
Eleven Flash v2.5 1,000 文字あたり $0.04
Eleven Music 1 分あたり $0.15
効果音 1 分あたり $0.12
Scribe v2 1 時間あたり $0.22

ElevenLabs の Web のサービスには、無料のプランと月額のプランがあります。

出典

共有XFacebookLINEはてブ

YOBITSUGI AI を使ってみる

日本語で頼むと、Claude エージェントが得意な AI と組んで実際に作り、ファイルで届けます。料金は使った分だけです。

YOBITSUGI AI

日本語で頼むだけで、
画像・動画・資料まで。

中心の Claude エージェントが、得意な AI と組んで実際に作り、ファイルで届けます。料金は使った分だけで、月額費用はかかりません。