2026年7月8日

Meta、画像生成AI「Muse Image」と動画生成「Muse Video」発表

Meta、画像生成AI「Muse Image」と動画生成「Muse Video」を発表

室谷室谷代表取締役
Metaがまたすごいものを出してきましたね。画像生成AIの「Muse Image」と動画生成の「Muse Video」です。

しかもMeta Superintelligence Labs初のメディア生成モデルという位置づけ。これ、かなり本気度が高いですよ。
テキトー教師テキトー教師DotAI 認定講師
そうですね。Muse Imageは「最も先進的な画像生成モデル」と自称していますが、実際に指示追従や精密編集、複数参照合成に加えて、Instagramの文脈を考慮した生成やエージェント的なツール使用までできる。

従来の画像生成AIとは一線を画す印象です。
室谷室谷代表取締役
特に気になるのは「エージェント的なツール使用」ですね。単にプロンプトから画像を生成するだけでなく、検索やコーディングツールを呼び出して精度を高めたり、自己改善したりする。

まさにエージェント型の画像生成。
テキトー教師テキトー教師DotAI 認定講師
その背景には、Metaが以前から進めている「Muse」シリーズの研究があるでしょう。今回のMuse Imageは、Masked Generative Transformersという技術をベースにしていて、特にテキスト描画の精度が高いのが特徴です。
室谷室谷代表取締役
テキスト描画って、これまでの画像生成AIでは苦手とされてきた分野ですよね。看板の文字が読めない、ポスターの文字が崩れる、みたいな。

Muse Imageはそれを克服していると。

Muse Imageの5つの革新機能 – 指示追従・精密編集・複数参照合成・Instagram文脈・エージェント連携

テキトー教師テキトー教師DotAI 認定講師
公式発表では5つの革新機能が挙げられています。まず「指示追従」は、複雑なプロンプトでも忠実に再現できる。

次に「精密編集」は、画像の一部を細かく修正できる。そして「複数参照合成」は、複数の参考画像から要素を組み合わせて新しい画像を作れる。
室谷室谷代表取締役
さらに「Instagram文脈」というのがユニークですよね。Instagramのトレンドやフォーマットを考慮した生成ができる。

SNS投稿を前提とした機能です。最後に「エージェント連携」で、Muse Sparkという補助モデルと連携して、コード実行や検索ツールを呼び出せる。
テキトー教師テキトー教師DotAI 認定講師
例えば、インフォグラフィックやチラシを作るときに、QRコードを正確に生成したり、グラフを描画したりできる。公式のデモでは、ICMLのポスターにQRコードを埋め込む例がありました。
室谷室谷代表取締役
あれすごかったですよね。Julia集合やIFSフラクタルをコードで生成して、それを画像に組み込むとか、普通の画像生成AIではできない芸当です。
テキトー教師テキトー教師DotAI 認定講師
まさにエージェント的です。Muse Imageは単なる生成モデルではなく、ツールを使いこなすエージェントとして動作する。

この発想は、今後のAI画像生成のスタンダードになるかもしれません。

Muse Video – ネイティブオーディオ対応の高品質動画生成

室谷室谷代表取締役
そしてもう一つが「Muse Video」。こちらは同じ事前学習ベースを使った動画生成モデルで、特徴は「ネイティブオーディオ対応」。

動画と同時に音声も生成できるんです。
テキトー教師テキトー教師DotAI 認定講師
これまでの動画生成AIは映像のみで、音声は別途生成する必要がありました。Muse Videoは映像に合わせた効果音やBGMを同時に生成できるので、クリエイターの作業が大幅に効率化されますね。
室谷室谷代表取締役
現時点ではプレビュー段階ですが、クリエイター向けに順次展開予定とのこと。MetaのSNSプラットフォームとの連携も視野に入れているでしょう。
テキトー教師テキトー教師DotAI 認定講師
品質についても「exceptional visual fidelity」と謳っていますから、既存の動画生成モデルと同等以上のクオリティを期待していいでしょう。

実際に試す方法 – 対応アプリと展開地域

室谷室谷代表取締役
Muse Imageは今日から使えるんですよね。対応アプリはMeta AIアプリ、ウェブ版のmeta.ai、そしてInstagram Stories(米国)、WhatsApp(一部の国)。

今後はMessengerやFacebookにも展開予定。
テキトー教師テキトー教師DotAI 認定講師
ただし、現時点では米国と一部の国限定です。日本での展開はまだ未定。

ただ、WhatsAppで使える国が広がれば、日本でも近いうちに使えるようになるかもしれません。
室谷室谷代表取締役
料金はどうなんでしょう? 現時点では明らかにされていませんが、おそらくMeta AIの無料枠の一部として提供される可能性が高い。
テキトー教師テキトー教師DotAI 認定講師
Meta AI自体は無料で使えますからね。追加料金なしでMuse Imageも使える可能性があります。

ただし、高頻度で使う場合は制限があるかもしれません。

競合モデルとの違い – Metaが目指すマルチモーダルAIの展望

室谷室谷代表取締役
競合と比べてどうかというと、Metaは今回「エージェント的ツール使用」と「ソーシャルコンテキスト」という独自の強みを打ち出しています。画像生成にInstagramのカルチャーを反映できるのは、Metaならではですね。
テキトー教師テキトー教師DotAI 認定講師
また、Muse Videoでネイティブオーディオを実現したのも差別化ポイント。他社の動画生成モデルではまだ音声生成が主流ではない。
室谷室谷代表取締役
しかも、Muse ImageとMuse Videoは同じ基盤モデルから派生しているので、将来的には画像と動画をシームレスに連携させたマルチモーダルな体験が可能になるでしょう。
テキトー教師テキトー教師DotAI 認定講師
Meta Superintelligence LabsはLlamaシリーズも手がけていますから、テキスト、画像、動画、音声を統合した真のマルチモーダルAIへ向けた布石と見ていいでしょう。

【FAQ】よくある質問 – 使い方・料金・日本語対応など

Q: Muse Imageはどこで使えますか? A: Meta AIアプリ、meta.ai、Instagram Stories(米国)、WhatsApp(一部の国)で利用可能。Messenger、Facebookにも順次展開予定です。

Q: 料金はかかりますか? A: 現時点では明らかにされていません。Meta AIは無料で提供されているため、同様に無料で利用できる可能性があります。

Q: 日本語に対応していますか? A: 現時点では日本語対応の詳細は明らかにされていません。英語をはじめとする主要言語で利用可能とみられます。

Q: 画像内のテキストを正確に描けますか? A: はい。公式発表によれば、Muse Imageは「cleanly and accurately」にテキストを描画できるとされています。インフォグラフィックやチラシの作成に有用です。

Q: Muse Videoの音声はどのように生成されますか? A: ネイティブオーディオ対応で、映像に合わせた効果音やBGMを同時に生成します。詳細な仕組みは公開されていませんが、高品質な音声を出力できるとされています。

Related

関連記事

New Articles

新着記事

ニュース

ElevenLabsの「The Search」とは?賞金10万ドルの広告コンテスト

2026年10月6日
室谷テキトー教師
ニュース

ClineがPareto 26.10 Preview発表、56倍安の衝撃

2026年10月6日
室谷テキトー教師
ニュース

Reflectionの新モデルBeam、Artificial Analysisが独立評価開始

2026年10月6日
室谷テキトー教師
ガイド

Microsoft Copilot Studioとは?できること・料金・ログインからエージェント作成まで

2026年10月6日
室谷テキトー教師
ニュース

CognitionがDevinの「Dreaming」発表、記憶をGit管理するOSS標準も

2026年10月6日
室谷テキトー教師
ガイド

Geminiの学生無料はどこまで?AI PlusとAI Proの違いから申し込み期限まで

2026年10月6日
室谷テキトー教師
ガイド

OpenRouterとは?料金・無料モデルの制限・エージェント連携を公式情報で解説

2026年10月6日
室谷テキトー教師
ニュース

OpenAI、ChatGPTとCodexのテキストに電子透かし導入へ

2026年10月6日
室谷テキトー教師
ガイド

Fireflies.aiとは?料金プラン・AIクレジット・機能・セキュリティを解説

2026年10月6日
室谷テキトー教師
ガイド

Hugging Faceとは?できること・料金・商用利用とNVIDIA買収の現在

2026年10月6日
室谷テキトー教師

Join

AIプレナーになる。

入会は審査制です。いまの事業と、AIで何を動かしたいのかを聞かせてください。

参加を申請する