Video wird geladen...
Video konnte nicht geladen werden
【検証】Gemini 3.8 Flash TTSで、自分の声をクローンしてみた 結論、クローンの精度が高い。個人的には、ElevenLabsの有料のプロ向けクローンよりも良いかなと思いました。(普通の読み上げは3.1 Flash時点でも精度高かったので、まあまあという印象でした。) ・約24秒話して、同意文を読むだけで声をコピー ・英語も中国語も、自分の声のまま話せる ・標準の声は前のモデルから優秀で、そこは大差なし 私は動画作成で音声をめちゃくちゃ使うので、かなり重宝してます。 今回の図解アニメはClaude Opus 5.5、声はGemini 3.8 Flash TTS、冒頭の顔と声はSeedance 2.5。この3つで、大体のショート動画は精度高く作れるかなと。
3 Kommentare

はな🌸"あなたの色"で輝くお手伝いvor 2 Tagen
「声」だけで考えると ものすごく精度高いですね👀 イントネーションは茶圓さん本人と違うなって感じるから "クローン"としての向上を今後に期待、と思います☺️ (今のようにAIと本人の判別をできた方が安全かも、ともちょっと思います🧐)

まぁる@YouTube×AI自動化の設計士vor 2 Tagen
ElevenLabs超えてくるならAPI連携のコスト感も一気に変わりそうです🔥

おぢ、AIを雇う|社員ゼロで11年vor 2 Tagen
社員ゼロで11年の一人社長です。自分の声で話せるなら、うちで最初に任せたいのは取引先への折り返し電話の一言目です。一人会社は、電話に出た瞬間に手が止まるのが一番重いので。
