2026年9月25日(金)1時間ごとに更新

いま話題のニュースを、1時間ごとにランキングで。

トップ > テクノロジー

テクノロジー

音声生成モデル「Gemini 3.8 Flash TTS」公開 声をゼロから作成

ひとことで言うとテキストから音声を作る新しい生成モデル「Gemini 3.8 Flash TTS」と、その軽量版が公開されました。あらかじめ用意された声を選ぶ方式から進み、自然言語で指示して声そのものをゼロから作れるのが特徴です。日本語を含む多言語に対応し、開発者向けAPIなどで順次提供されます。

内容

テキストから音声を生成するモデル「Gemini 3.8 Flash TTS」と、その軽量版が公開されました。「ゼロから声を作れる音声生成モデル」として伝えられています。

これまでの音声合成は、あらかじめ用意された声の候補から選ぶ方式が中心でしたが、今回のモデルは自然言語による指示で声そのものをゼロから作り出せる点が変わりました。話し方の演技や感情についても、細かく制御できるとされています。

対応言語は日本語を含む多言語。生成された音声には、AIが作ったコンテンツであることを示す透かし技術「SynthID」が埋め込まれます。提供は開発者向けのAPIのほか、各種サービスで順次進められる予定で、「Gemini Notebook」でも利用できるとされています。

個別の価格や、各サービスでいつから使えるようになるかといった詳細は、現時点で明らかになっている範囲を超える部分があります。

ソース記事

今話題の記事

ランキング登場履歴

2026年9月25日 4時18位
2026年9月25日 3時7位
2026年9月25日 2時18位

この記事の内容に誤りを見つけた方は 情報の誤りを報告 からお知らせください。