2026年10月8日

ElevenLabsがOpenRouterで公式利用可能に、Eleven v4など11モデル

室谷室谷代表取締役
ElevenLabsの音声モデルが、OpenRouterで公式に使えるようになったんですよね。これは音声AIを組み込む開発者にとってはかなり大きい発表です。
テキトー教師テキトー教師DotAI 認定講師
そうなんですよ。ElevenLabsのモデルはこれまで自社APIやダッシュボード経由が基本で、使うには個別の契約や実装が必要でした。

それがOpenRouterという統合APIプラットフォームから、他モデルと同じように呼び分けられるようになった。単に選択肢が増えたという話じゃないんですよ。
室谷室谷代表取締役
まず何が発表されたかを整理しましょうか。OpenRouterが公式にアナウンスしたのは、ElevenLabsのテキスト読み上げ(TTS)9モデルと、音声認識(STT)2モデルが利用可能になったという内容です。
テキトー教師テキトー教師DotAI 認定講師
発表のポイントを箇条書きにするとこうです。
  • TTS 9モデル、STT 2モデルがOpenRouter経由で公式利用可能
  • TTSは最大90以上の言語に対応
  • STTは話者ラベルと単語レベルのタイムスタンプに対応
  • OpenRouter上の全ElevenLabsモデルが10月19日午前8時(PT)まで50%オフ
室谷室谷代表取締役
発表元はOpenRouterで、ElevenLabsのモデルを自社プラットフォームから呼べるようにしたという形ですね。ここは提供元と発表元を分けて理解しておきたいところです。

ElevenLabsがOpenRouterで公式に使えるようになったとは?

まとめ
ElevenLabs × OpenRouter 公式対応のポイント
  • OpenRouterは複数のAIモデルを単一APIで呼び分けられる統合プラットフォーム。開発者は個別契約なしにモデルを切り替えられる
  • ElevenLabsがOpenRouterの公式プロバイダーとして追加された
  • 従来はElevenLabsのモデル利用に自社API/ダッシュボード経由の個別契約と実装が必要だった
  • OpenRouter上で他モデルと並べてElevenLabsを呼べるようになり、音声まわりの接続が一本化される
  • ElevenLabsプロバイダーページには11モデル(TTS 9つ、STT 2つ)が掲載
  • モデルごとに用途・言語数・文字数上限・料金が異なる
  • Launch offer: 50% off through October 19, 2026 — 全ElevenLabsモデルが定価の半額で利用可能
テキトー教師テキトー教師DotAI 認定講師
そもそもOpenRouterは、複数のAIモデルを単一のAPIで呼び分けられる統合プラットフォームです。開発者は個別契約なしにモデルを切り替えられる。

今回そこにElevenLabsが公式プロバイダーとして加わったわけです。
室谷室谷代表取締役
これまでElevenLabsのモデルを使うには、自社APIやダッシュボード経由が基本で、個別の契約と実装が必要でした。それがOpenRouter上で、他のモデルと並べて呼べるようになった。

MYUUUでも音声まわりは別々に繋ぎ込む手間があったので、この一本化は実務的にありがたいんですよね。
テキトー教師テキトー教師DotAI 認定講師
公式ページを見ると、ElevenLabsのプロバイダーページには11モデルが並んでいます。TTSが9つ、STTが2つ。

モデルごとに用途・言語数・文字数上限・料金が違うので、ここを理解しておくのが第一歩です。
室谷室谷代表取締役
しかもOpenRouterのモデルページには『Launch offer: 50% off through October 19, 2026』と明記されていて、全ElevenLabsモデルがElevenLabsの定価の半額で使えると。これは試すハードルを大きく下げますよね。

OpenRouter経由で使えるElevenLabsのモデル一覧と用途

OpenRouter経由で使えるElevenLabsモデル一覧
モデル種別言語文字数上限料金(50%オフ後)
Eleven v4TTS90+10,000$40/M characters
Eleven v4 TurboTTS90+10,000$20/M characters
Eleven v3TTS70+5,000$40/M characters
Eleven v3 ConversationalTTS70+5,000$20/M characters
Eleven Flash v2.5TTS3240,000$20/M characters
Eleven Turbo v2TTS英語のみ30,000$20/M characters
Eleven Multilingual v2TTS2910,000$40/M characters
Eleven Turbo v2.5TTS3240,000$20/M characters
Eleven Flash v2TTS英語のみ30,000$20/M characters
Scribe v2STT90+—$0.000031/second
Scribe v2 MedicalSTT90+—$0.000031/second
テキトー教師テキトー教師DotAI 認定講師
まずは提供されているモデルを整理しましょう。公式ページに載っている11モデルです。
モデル種別言語文字数上限料金(50%オフ後)
Eleven v4TTS90+10,000$40/M characters
Eleven v4 TurboTTS90+10,000$20/M characters
Eleven v3TTS70+5,000$40/M characters
Eleven v3 ConversationalTTS70+5,000$20/M characters
Eleven Flash v2.5TTS3240,000$20/M characters
Eleven Turbo v2TTS英語のみ30,000$20/M characters
Eleven Multilingual v2TTS2910,000$40/M characters
Eleven Turbo v2.5TTS3240,000$20/M characters
Eleven Flash v2TTS英語のみ30,000$20/M characters
Scribe v2STT90+—$0.000031/second
Scribe v2 MedicalSTT90+—$0.000031/second
室谷室谷代表取締役
こうして並べると、用途ごとにきれいに分かれているのが分かります。表現力重視のv4系、低遅延のTurbo・Flash系、長文ナレーション向けのMultilingual v2、そして文字起こしのScribe系ですね。
テキトー教師テキトー教師DotAI 認定講師
料金の単位がTTSは『100万文字あたり』、STTは『秒あたり』で違う点も押さえておきたいです。文字起こしは音声の長さで課金されるので、会議の議事録のように長時間の音声を扱う場合は見積もり方が変わってきます。
室谷室谷代表取締役
ちなみにTurbo v2系については、公式ドキュメントで『Flash系に置き換え推奨』とされています。つまり新規で組むならFlash系を選ぶのが素直な判断ですね。

Eleven v4・v4 Turbo・Flash v2.5の違いと使い分け

Eleven v4・v4 Turbo・Flash v2.5の違いと使い分け
Eleven v4
  • 最も表現力が高いモデル
  • インライン音声タグで感情・話し方を制御
  • 複数タグを重ねて順番に追従可能
  • 90以上の言語に対応
  • リクエスト上限10,000文字
  • ナレーションやキャラクターボイス向け
Eleven v4 Turbo
  • 表現力と音声タグを維持
  • リアルタイム向けに振ったモデル
  • 推論レイテンシは中央値約100ms
  • サポートエージェントやAIアシスタント向け
  • インタラクティブなキャラクター向け
テキトー教師テキトー教師DotAI 認定講師
ここが今回の一番の勘所です。まずEleven v4は、ElevenLabsで最も表現力が高いモデルとされています。

[whispering]のようなインラインの音声タグで感情や話し方を制御でき、90以上の言語、10,000文字のリクエスト上限という仕様です。
室谷室谷代表取締役
音声タグはv3から導入された仕組みで、v4では複数のタグを重ねて順番に追従させられるよう拡張されているんですよね。ナレーションやキャラクターボイスで『ここは囁き、次は強調』みたいな演技指示ができる。
テキトー教師テキトー教師DotAI 認定講師
v4 Turboはその表現力と音声タグを保ったまま、リアルタイム向けに振ったモデルです。公式ドキュメントでは中央値で約100msの推論レイテンシとされています。

サポートエージェントやAIアシスタント、インタラクティブなキャラクターに向く。
室谷室谷代表取締役
一方のFlash v2.5は超低遅延に振り切ったモデルで、公式には約75msとされています。32言語対応で、40,000文字という大きめの上限を持つ。

会話やリアルタイム用途に強く、しかも公式ドキュメントでは『API生成で文字あたり50%低い価格』と説明されています。
テキトー教師テキトー教師DotAI 認定講師
使い分けを整理するとこうなります。
  • 表現力・演技重視ならEleven v4
  • リアルタイムの対話で品質も欲しいならEleven v4 Turbo(約100ms)
  • とにかく低遅延・低コストで会話を回すならEleven Flash v2.5(約75ms、32言語)
  • 長文ナレーションやオーディオブックならEleven Multilingual v2(29言語、安定性重視)
室谷室谷代表取締役
ここは実際に触ってみないと分からない部分でもあるので、50%オフのうちに自分のユースケースで聴き比べるのがいいと思います。ちなみにElevenLabsの音声モデルについては、Eleven v4 Turboとは?ElevenLabsの新TTSがリーダーボード首位でも詳しく解説しているので、あわせて読むと解像度が上がります。

Scribe v2/Scribe v2 Medicalでできる文字起こし

テキトー教師テキトー教師DotAI 認定講師
次はSTT側です。Scribe v2は90以上の言語で正確に文字起こしできる音声認識モデルで、単語レベルのタイムスタンプ、任意の話者分離、音声イベントのタグ付けに対応しています。
室谷室谷代表取締役
話者分離は最大32話者まで、キータームのプロンプトは最大1,000語、エンティティ検出は65種類。公式ドキュメントを見ると、自然言語の指示で文字起こしを編集する機能まであります。

議事録や字幕を作る側からすると、このあたりはかなり効いてきますよね。
テキトー教師テキトー教師DotAI 認定講師
Scribe v2 Medicalは、臨床・医療の音声にチューニングしたモデルです。公式には『臨床音声でScribe v2比35%少ない文字起こしエラー』とされ、日常会話ではScribe v2と同じ精度、機能・言語・料金・APIもScribe v2と同じと説明されています。
室谷室谷代表取締役
医療向けに特化したモデルが同じ料金で選べるのは面白いですね。専門用語が多い現場では、こういうチューニングの差がそのまま実務の差になります。
テキトー教師テキトー教師DotAI 認定講師
ちなみにScribe v2 Realtimeというリアルタイム文字起こしモデルも公式には存在しますが、今回OpenRouterで公式に挙がっているSTTはScribe v2とScribe v2 Medicalの2つです。ここは混同しないようにしたいですね。

ElevenLabs on OpenRouterの料金と50%オフはいつまで?

室谷室谷代表取締役
料金をもう一度整理すると、TTSは100万文字あたりで$20か$40、STTは秒あたり$0.000031。これが10月19日午前8時(PT)まで50%オフ、つまり表示されている価格がすでに半額ということです。
テキトー教師テキトー教師DotAI 認定講師
期間の表現は公式ページで『through October 19, 2026』『until Oct 19』と書かれています。タイムゾーンはPT(太平洋時間)なので、日本時間にすると10月20日の早い時間帯まで、と考えると分かりやすいです。
室谷室谷代表取締役
注意点として、この50%オフは『OpenRouter経由のみ』と公式スレッドに明記されています。ElevenLabsの自社API経由では適用されないので、そこは勘違いしないようにしたいですね。
テキトー教師テキトー教師DotAI 認定講師
無料枠については、今回のソースではOpenRouter側の無料提供やElevenLabsの無料枠との比較までは明らかにされていません。ここは『現時点では明らかにされていません』と正確に伝えておきます。
室谷室谷代表取締役
APIキーの取得手順やSillyTavernなど特定ツールへの組み込み手順も、今回の公式ソースには具体的な記載がありません。ただ、OpenRouterの統合APIから呼べるということは、OpenRouterに対応しているツールなら経由で使える可能性がある、という整理になります。

音声エージェント・字幕・議事録など実用的なユースケース

テキトー教師テキトー教師DotAI 認定講師
公式スレッドでは用途として『voice agents、customer service、narration、captions、meeting notes』が挙げられています。音声エージェント、カスタマーサービス、ナレーション、字幕、議事録ですね。
室谷室谷代表取締役
音声エージェントならv4 TurboやFlash v2.5、ナレーションならv4やMultilingual v2、字幕や議事録ならScribe v2系、というようにモデルを用途で選び分けられるのが今回の強みです。
テキトー教師テキトー教師DotAI 認定講師
特に大きいのは、OpenRouter上でLLMとTTS・STTを同じプラットフォームから呼べる点です。対話のテキスト生成と音声合成を組み合わせれば、音声チャットボットのような構成が組みやすくなります。
室谷室谷代表取締役
開発者からすると、複数モデルを用途別に試してコストと言語対応を比較する手間が減るのが実務的なメリットなんですよね。MYUUUでも音声まわりは繋ぎ込みが地味に重い部分だったので、この統合は歓迎です。
テキトー教師テキトー教師DotAI 認定講師
背景として、音声モデル分野は競争が激しくなっています。TechCrunchによれば、CartesiaやDeepgram、Fish Audio、Boson、WellSaid Labsといったスタートアップに加え、GoogleやOpenAIも音声モデルを強化している。

ElevenLabsは今年Sequoiaから5億ドルを調達し、企業向け通話事業では売上の55%超が大企業由来とされています。
室谷室谷代表取締役
そういう市場の中で、あえてOpenRouterという統合プラットフォームにモデルを開放したのは、開発者の入口を広げる戦略なんですよね。使ってもらいながら、より大きなエンタープライズ案件に繋げていく。
テキトー教師テキトー教師DotAI 認定講師
講座でも音声AIを組み込みたいという受講生さんが増えているので、こういう統合の発表は追い風です。まずは50%オフの期間中に、自分の用途でどのモデルが合うかを試しておくのがおすすめですよ。

よくある質問

Q. ElevenLabsのモデルはOpenRouter経由で何モデル使えますか?

A. 公式ページでは11モデルが掲載されています。内訳はテキスト読み上げ(TTS)が9モデル、音声認識(STT)が2モデルです。

Q. 50%オフはいつまでですか?

A. 10月19日午前8時(PT)までです。OpenRouter上の全ElevenLabsモデルが対象で、この割引はOpenRouter経由のみに適用されると公式スレッドに明記されています。

Q. Eleven v4とv4 Turbo、Flash v2.5はどう違いますか?

A. Eleven v4は最も表現力が高いモデルで、90以上の言語と10,000文字の上限に対応します。v4 Turboはその表現力を保ちつつリアルタイム向けに振ったモデルで、中央値約100msの推論レイテンシとされています。Flash v2.5は超低遅延(約75ms)に振り切ったモデルで、32言語・40,000文字の上限を持ちます。

Q. Scribe v2 Medicalは何が違いますか?

A. 臨床・医療の音声にチューニングされたモデルで、公式には臨床音声でScribe v2比35%少ない文字起こしエラーとされています。日常会話ではScribe v2と同じ精度で、機能・言語・料金・APIもScribe v2と同じです。

Q. 無料で使えますか?

A. 無料枠やOpenRouter側の無料提供については、今回の公式ソースでは明らかにされていません。料金はTTSが100万文字あたり$20〜$40、STTが秒あたり$0.000031(いずれも50%オフ後の表示価格)です。

Q. APIキーの取得や既存ツールへの組み込み方法は?

A. 今回の公式ソースには具体的な取得手順や特定ツールへの組み込み手順の記載はありません。OpenRouterの統合APIから呼び出せる形になっている、という点が今回の発表内容です。

Related

関連記事

New Articles

新着記事

ガイド

OpenAI APIの使い方|APIキー取得から料金・レート制限まで

2026年10月8日
室谷テキトー教師
ニュース

v0でChatGPTサブスクが使えるように、iOSアプリで接続

2026年10月8日
室谷テキトー教師
ニュース

Grok Botの「@bot」とは?Xの投稿をNotionに取り込む使い方

2026年10月8日
室谷テキトー教師
ニュース

Googleの「Guided Vision」とは?Gemini Liveの視覚支援機能

2026年10月8日
室谷テキトー教師
ニュース

Grok 4.7とは?xAIがMicrosoft Foundryで提供開始した最新モデル

2026年10月8日
室谷テキトー教師
ニュース

SynthID Detectorとは?Google DeepMindが一般公開、AI生成コンテンツを見分ける検証ツール

2026年10月8日
室谷テキトー教師
ガイド

Claude Fable 5とは?読み方・料金・Fable 5.1との違いを整理

2026年10月8日
室谷テキトー教師
ニュース

Cursorの「Remote Control」とは?iOSアプリからPCのエージェントを遠隔操作

2026年10月8日
室谷テキトー教師
ニュース

OpenAIの「ChatGPT Meetings」とは?会議議事録を自動化する新プラグイン

2026年10月8日
室谷テキトー教師
ニュース

Google Playgroundとは?コーディング不要でゲームが作れる実験的プラットフォーム

2026年10月8日
室谷テキトー教師

Join

AIプレナーになる。

入会は審査制です。いまの事業と、AIで何を動かしたいのかを聞かせてください。

参加を申請する