正在加载视频...

视频加载失败

今の音声合成はローカルでもこのくらい作れるよってサンプル ローカルのIrodori-TTS-v4.1-AnimeをGPT Astraに操作してもらって作った。 テーマは雑談配信。

42,194 次观看 • 10 天前 •via X (Twitter)

6 条评论

柳生おたま 的头像
柳生おたま9 天前

私も女性声で100声ぐらい作ったんですけど 結局このカスレ音や高音域のノイズが除去できないんですよねぇ それさえできれば完璧な音声AIだとは思うんですが。。。 あと男性ボイスは軒並みレベル低いのが気になりますわirodoriは

なちゃっと 的头像
なちゃっと9 天前

基本的には高クオリティだと思うんですが、ノイズがあったりするので厳格な製品には使いずらいかもですね。あと確かに男性はクオリティが違う気がしますね...

ElysianAI 的头像
ElysianAI9 天前

うぇ!?すごすぎる

0xShugo 的头像
0xShugo9 天前

audio.cpp now supports Irodori-TTS-v4.1-Anime

ミスターえるね@AIイラスト 的头像
ミスターえるね@AIイラスト9 天前

これは凄い😲

ハロー 的头像
ハロー8 天前

そこはかとなく感じる七海千秋感

相关视频

✨AI音声で一貫した声を作り会話させるチャレンジ 前に音声を使ってLLMの文章を読ませることには成功していたけど、今回はオリジナルの声を作成してみました。 やったこと: ①まずQwen3-TTSで声を1個作る ②その声で171個量産(台詞バリエーション) ③Style-Bert-VITS2で学習 → 50分でカスタム音声モデル完成 ④UIに接続 → リアルタイムで喋る やばい!自分で作った声だと楽しい😊 苦労したところ: ・最初はブラウザ内TTS(Chatterbox)を試した → 1文30秒&英語のみでまだ難しいしそもそもこの用途が厳しいかも💦 ・SBV2に切り替えたら環境構築に手間取ったけどうまくいった ・ただライセンスは要注意。やる場合は先にライセンス確認を。用途によっては制限があるものもある📝 まだまだ色々あるけど、今後のことを考えるとNVIDIAからも良い音声AIが出てるし、対応できるようにしておきたい。 今回は前回と同じくモデルはGPT-OSS 20Bだけど、Ollamaから読んでるので早い。 WebGPUでこれぐらい出たら嬉しいけどなー🥰 とはいえローカルでここまでできるようになったのは嬉しい。データは一切外に出ないしね。 声の元はAI生成だから、「存在しない人の声」をAIが学習して、AIキャラが喋る。 #AI #TTS

LUTA@AI

57,505 次观看 • 7 个月前