正在加载视频...

视频加载失败

MiniMax H3 のお話 引用ポストを参考にさせていただき 「Larry Turbo + H3 Sage」を基本に ちゃっぴーと相談して高速化してみました 1MPで10秒のI2V動画で RTX 4070 で11分12秒で生成 高速化前の約1/3になりました😆 アップスケールとフレーム補間もしてます 出だしの顔の映りが小さいときに 少しガビガビしますが概ね良好です あと音声がイマイチです 今はいろんな方が高速化に挑んで 日々更新されているので 昨日の方法が今日はもう古い みたいな世界です😅 画像素材はChatGPT-Images 2.0で生成(2枚目)

55,219 次观看 • 1 个月前 •via X (Twitter)

0 条评论

暂无评论

原始帖子的评论将显示在这里

相关视频

ローカルのMiniMax H3のR2Vで、8秒間の1080p級(アップスケール)の動画を8分弱で生成する方法を詰めてみました。 RTX 5090で8秒・1920×1056の動画を480p生成160秒+アップスケール310秒の合計7分50秒でできました。 ByteDanceのアップスケーラもかなり良いのですが、階調がおかしくなったり、変なトランジションが入ることがあります。 今回のlatent Upscalerによるものは元々の動画生成の際のlatentの段階で拡大しているので、仕組みが違うようです。 元のワークフローだと、拡大後のrefineが生成と同じ25stepsで回るようだったので、そこだけR2V用の蒸留LoRA(minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16)に変えました。4stepsと8stepsで試しましたが、秒数の違い(250秒くらい違う)の割に差が自分にはわかりませんでした。 蒸留LoRA 4stepsは「一から絵を描かせるのはキツいけど、細部を修正するくらいなら全然できる」という感じです。 もうひとつ大切なのは、アップスケールの時のconditioningを生成時と同じものに付け直すのが効いたという点です。 標準だと480p用の条件を引き伸ばして使うそうで劣化しているらしいです(Claude Codeが言うには)。 そこで同じ参照を目標解像度で付け直すと、ちゃんとリファレンスどおりになります。 例えば、今回の動画ですと、眉毛のところの描写がキャラクターのリファレンス通りになっています。1枚目の比較画像で分かると思います。 ちなみにSeedance 2.5のオムニリファレンスだと、8秒間の動画をリファレンス8枚付きで生成しようとすると936クレジットでした。スタンダードプラン5,200円で5,775クレジットなので、1本あたり約843円という計算になります。 ローカルのH3はさすがにSeedance 2.5と同レベルとは言えませんし、Seedanceが絶対に必要な場面は存在していますが、とはいえ高解像度のものがローカルで手軽に出せるのはいいですね。

鈴木憂一 | Highdrama

12,169 次观看 • 1 个月前

Hailuo H3とSeedance 2.5で、Music Videoのワンシーンを比較してみました😃 参照画像、参照音楽、Promptはほぼ同じものを使用しています。 本来はH3とSeedance 2.5でPromptの書き方も変えた方が良さそうですが、今回はあえて同じ条件で比較。 画像生成、動画生成ともにPollo aiを使っています。 動画内に出しているロゴもPollo aiで生成していて、その際は女性のReference画像も一緒に参照させて、全体の雰囲気が揃うようにしてみました。 今回かなり良かったのがHailuo H3のReference性能とLip Sync。 腰上くらいの比較的アップな画像をReferenceにすると、顔もほとんど崩れず、かなり自然に歌ってくれました。高速な歌詞にもちゃんと追従していて、Lip Syncだけ見ると有料の専用サービスと比べてもかなり良いところまで来ている印象です。 対してSeedance 2.5は、今回は出だしでうまく歌ってくれませんでした。 ただ、肌の質感や細かい表情の変化、顔の生っぽさみたいな部分はSeedance 2.5の方が一段リアルに感じます。このあたりはやっぱり強いですね。 今回はアップ中心で、激しいアクションや大きなカメラ移動、引きの映像もほとんどないので、Seedance 2.5の良さをあまり活かせていない比較だったかもしれません。逆にそのあたりはH3が少し弱い印象もあるので、今回はややH3有利な条件です。 それにしてもH3は生成コストがかなり安いので、このReference性能とLip Syncまで考えるとコスパはすごいですね。クオリティの差はあると思いますが、H3はローカルという選択肢もでてきましたしね。 Pollo AI 動画生成のPromptなどはコメントに記載します😌

AI Girl's Photo Studio

10,420 次观看 • 1 个月前

【ワンカット風ライブMVの作成方法】 引用元の動画、たくさんの方にリアクションいただきありがとうございました✨️ 本当はX記事で整理して書きたかったんですが、操作難しすぎたのでツリー形式でご紹介します。 読みにくくてすみません。 正直汎用性があるのか微妙ですが、Codexを使用した効率化の考え方としては参考になるかなと思います。 説明が下手なので複雑に見えるかもしれませんが、やってみるとシンプルですし、今回のようなワンカット方式だけではなく長尺の作品にも応用できると思いますので、ぜひお試しください😆 わかりにくいところや他にも気になる点があれば遠慮なく聞いてください!!! --- 今回は下記の3つ(+おまけ1つ)をご紹介します。 (②以降はリプ欄) ① Start/Endフレームを繋げて長尺ワンカットに見せる ② Codexでフレーム画像を効率的に作る ③ 動画生成プロンプト作成 ④ おまけ:動画プロンプトから絵コンテで動画のイメージを事前チェックする --- ① Start/Endフレームを繋げて長尺ワンカットに見せる 今回のMVは150秒なので、15秒の動画素材であれば最低10個作成し、動画の素材間をシームレスに繋げる必要があります。(今回はシーンの関係上一部15秒未満にしたため12個作ってます) そこで利用したのが、Start/Endフレーム指定方式です。 添付1枚目のGIFのように前シーンのEndフレームを次のシーンのStartフレームにすることでワンカットになるように見せています。 GIFはScene3までですが、これを最後のシーンまで繰り返します。 編集する時、頭もしくはお尻の1、2フレームを抜いたり、速度を上げると少しスムーズに繋がることが多いです。 また、今回はHailuoのSeedance2.0を使用したのですが、Start/Endフレーム指定は2枚目のようなイメージです。

Mankyu | AI動画生成

111,509 次观看 • 4 个月前

歌コレルーキー1位のE-LAND( 「動画拝見しました!」と言いながら、27分間に21回の自薦。 聴いてないですよね? 聴いてたとしても、何秒聴いたのでしょうか? ニコニコ動画は聴き合う文化・交流の文化だと思ってましたが、聴かないで自薦だけしてる方が強いというのが証明されてしまいました。 残念ながら現在E-LANDの返信欄を見ても、どんどん証拠は消されていってます。 自分でも隠したい過去になったのでしょう。 あなたとの交流の痕跡ごと消されていってます。 期間中にE-LANDとコメントでやり取りをした方、今も残ってるか確認してください。 いいね、マイリスしたと言われた方、マイリスは見えないけどいいねは見えます。本当にいいねされたか確認してください。 歌コレとボカコレが壊れたと言った理由はこれです。 順位が公平かどうかというレベルの話ではありません。 根本の聴き合う文化・交流の文化の破壊です。 このままにしていていいのでしょうか? 声をあげろとは言いません。 拡散の手伝いをしてください。 文化の破壊者がのうのうとしていては必ず後に続く者が出て来ます。 そして、今回こういう告発をしましたが、実は本当に腹がたったのは他の人の作品を「コピペで適当に褒めた事」です(動画を参照)。 自分の作品が伸びなかった時、ひとつの感想にどれだけ救われるか。それがコピペだなんて。 人の心がないんかいマジで。

NorthP

414,042 次观看 • 1 年前