こんにちは!ガールズオピニオンのパートタイムブロガー、しほです♡ 今日は最近発表された、最新の音声生成についてお話しちゃいます!なんと、米Googleが新しいTTS(テキストから音声を生成する)モデルを発表したんですよ♪その名も「Gemini 3.8 Flash TTS」と「Gemini 3.8 Flash-Lite TTS」。この二つのモデル、実は私たちの楽しみ方を一変させる可能性が大なのです!
まず、一番驚いたのは新しい声をゼロから作れるところ!今までのモデルは30種類の既存の声の中から選ばないといけなかったのに、新モデルでは役柄やアクセントまで指定できちゃうらしいの。たとえば、アニメのキャラクターのような声や、深い大人の声、おばあちゃんの声まで自由自在に生成できるとしたら、それって最高じゃない!?(≧▽≦)
ゲームやオーディオブック、ポッドキャストなんかでの活用が期待されているみたいだけど、個人的にはTikTokの動画で使いたいなぁ。まさに声優気分が味わえるかも♡ ゲーム実況をする時なんかも、自分の好きなキャラクターの声でプレイできたら、めっちゃ面白そうだよね!え、私だけの妄想?(笑)
さらに、対応言語なんて130種類もあって、日本語にも対応しているから、日本国内でも大活躍しそう。なんだか、国際的にみんなが声を作って、ユニークなコンテンツが生まれるのも楽しみ!これからはアニメ声の友達と話すのも普通になる時代が来るのかな…?
その上、ボイスレプリケーション機能もあるらしいよ。自分の声を直に再現できるって絶対面白いよね!ただし、しっかりとした同意が必要らしいから、気をつけなきゃいけない部分もあるみたいだけど。それにしても、自分の声でおしゃべりできる機能、学生の頃にあったらよかったなぁ、なんて思っちゃう(苦笑)。
話は変わるけど、Googleが考えている「SynthID」技術についても興味が湧くね。AIが生成した音声には、聞こえない透かしが埋め込まれているらしくて、これで著作権の問題も少し解決できるかも!音声コンテンツが増えてきている今だからこそ、これって素晴らしいアイデアかもしれないね。
これからの音声コンテンツがより一層生き生きとして、楽しくなる予感しかしないわ~!特にイベントなどでオリジナリティを追求する人にとっては、これは革命的なツールになるんじゃないかな。音楽の秋だし、歌を作るのもいいかも!声をいろんな感じにアレンジして、自分だけのオリジナルソングができちゃうかもしれないし✨
もちろん、まだまだ課題もあるみたいだけど、未来への期待感が高まるよね!音声生成でどんなストーリーが生まれるのか、これから注目していきたいな。最新の音声技術、私たち20代女子にもピッタリなトピックでしょ?あなたたちも、ぜひこの新しい技術に触れてみて、クリエイティブな活動を楽しんでね!
さて、長くなっちゃったけど、今日はこの辺で。新しい音声生成モデルについて私の気持ちを語ることで、何かインスピレーションのきっかけになれば嬉しいな♡ 自分らしい声で、楽しいコンテンツを作っていこうね。それじゃあ、また次のブログでお会いしましょう!バイバイ!


