音声・音楽の AI の比較(2026 年 10 月)
OpenAI・Google・ElevenLabs の読み上げと文字起こし、ElevenLabs の音楽・効果音、Google の Lyria 3.5 を、言語・長さ・料金など公式の情報で比べました。
TAG
11 本の記事
OpenAI・Google・ElevenLabs の読み上げと文字起こし、ElevenLabs の音楽・効果音、Google の Lyria 3.5 を、言語・長さ・料金など公式の情報で比べました。
Veo 3.1・Seedance 2.5・Seedance 2.0・Gen-4.5・Gen-4 Turbo・Grok Imagine Video を、長さ・解像度・音声・入力・API の料金など、公式の情報で比べました。

店内で流す BGM や、店内アナウンス・動画のナレーションを AI で作る方法です。YOBITSUGI AI で使える音楽と読み上げの AI と頼み方を、作例つきで紹介します。
GPT-Image-2.5・Nano Banana Pro・Nano Banana 2・Grok Imagine・Gen-4 Image・Civitai のモデルを、解像度・料金・ライセンスなど公式の情報で比べました。

SNS やお店の紹介に使う縦長(9:16)の短い動画を AI で作る方法です。YOBITSUGI AI で使える動画生成 AI と頼み方を、作例の動画のコマつきで紹介します。

白い背景の商品写真や、商品を使っている場面の写真を AI で作る方法です。YOBITSUGI AI で使える画像生成 AI と頼み方を、作例つきで紹介します。
Google の Nano Banana(画像)、Veo 3.1(動画)、Lyria 3.5(音楽)、Gemini 3.1 Pro・3.8 Flash(文章)などの紹介と、YOBITSUGI AI での頼み方・料金です。
Claude・GPT-6・Gemini・Grok・DeepSeek・Sakana AI の文章とコードのモデルを、扱える長さ・入力できるもの・API の料金など、各社の公式の情報で比べました。
Google は Gemini アプリの Gemini Live に、カメラや画面を共有して音声で操作を案内する「シンプルガイド」を追加しました。介護職員向けの活用ガイドブックも公開しています。
Google DeepMind は、テキスト・画像・音声・動画を扱える軽量な埋め込みモデル EmbeddingGemma 2 を公開しました。Apache 2.0 ライセンスで、端末上での動作を想定しています。
Google は、文章で指示するだけでゲームを作って遊び、共有できる実験的なプラットフォーム「Playground」を発表しました。米国の 18 歳以上向けに公開されています。