ニュース図鑑 · 2026-09-24
DeepMind、Gemini 3.8 Flash TTSなど2モデル発表
Google DeepMind が音声生成モデル Gemini 3.8 Flash TTS と Flash-Lite TTS を発表。何が起きた?
1枚カード(画像)を開く →何が起きた
Google DeepMind は、音声生成モデル Gemini 3.8 Flash TTS と Gemini 3.8 Flash-Lite TTS を発表した。Flash TTS は自然言語のプロンプトで新しい声を一から作り、台本を1行ずつ演出できるモデル、Flash-Lite TTS は大量処理と費用効率を目的にしたモデルと説明している。100を超える言語・方言に対応し、2,000以上の声のライブラリを使えるとしており、30秒の音声サンプルからの声の再現には、同意の確認、SynthID の透かし、C2PA の資格情報を付けると説明している。開発者向けには Gemini API と Google AI Studio で提供を始め、Flash TTS は Gemini Notebook で、Flash-Lite TTS は Google Vids で一般向けに提供を始めた。
この仕組みで読む
音声を作るAIモデルは、作った音声の量に応じて API の利用料が決まる形が多い。声を人が収録する場合は、収録や編集の人件費とスタジオの費用がかかり、AIで生成する場合は、利用量に応じた利用料がかかる。ゲームの声、オーディオブック、ポッドキャスト、吹き替えを作る会社は、この2つの費用の組み合わせで制作の原価が決まる。
音声を生成する計算はデータセンターで動き、提供する会社にはその機械と電気の費用が生じる。声を作るAIでは、本人の同意の確認や、生成物に印を入れる仕組みも、提供する側の対応として付く。
この出来事に左右される会社
会社の頁の「何に左右される」に、「企業のIT投資」が挙がっている会社は66社ある。売上の大きい順に8社を並べた。
この技術に有報で触れている日本の会社
有価証券報告書の「研究開発活動」「事業の内容」に「生成AI」や「AIエージェント」や「データセンター」を書いている上場会社のうち、売上の大きい順に8社。
つながる図鑑
この頁から辿れる辺。問いの形で置いてある。
出典と生成
この頁はデータから作った。更新日 2026-09-24。編集方針
