Video wird geladen...

Video konnte nicht geladen werden

Zur Startseite

久々にローカル環境の MiniMax H3 のお話 最近ComfyUI公式からVAE高速化の話が出てきて いろんな高速化の話題も一段落しているようなので 今現在バランスの良さそうな構成で試してみました 結論: 思ってたより速い!😂 引用と同じ構成で RTX 4070 12GB 1MPixel相当で10秒間のI2V動画が 約10~11分で生成できました ※詳細な構成はリプ欄に記載しました 生成した動画は↓ 個人的にこの速度なら待てる気がしてきました まだこれだけですが色々試したくなりました😌

39,990 Aufrufe • vor 14 Tagen •via X (Twitter)

0 Kommentare

Keine Kommentare verfügbar

Kommentare vom Original-Post werden hier angezeigt

Ähnliche Videos

引き続きSeedance 2.0。 自分がNoteで公開している各種の画像付き小説には動画が付いているものがありますが、一部を除いて、当時の技術で生成可能だったレベルの動画を、チョロっとだけ試しに生成する程度でした。 技術が成熟してきたら、いずれは動画でのリメイクに取り組みたいという思いは常に持っていて、Sora2やSeedance 2.0のような技術レベル向上が見られた際に、試すようにしています。 「【MC Heroine】潜入捜査 - レッドの場合」 ということで、添付はレッドの物語の1シーンを、パイロット的にSeedance 2.0で生成してみたわけですが・・・ ヤバいなと思うのは、ちょっと試してみようか、と気軽に生成してこのクオリティが出てしまうと、「この次のシーンを」「前のシーンを」「ディテールをもっと改善したい」と、次々生成したくなるという中毒にハマるということですね。案の定、これを生成したあと、前後のシーンを引き続き付け加えたりしていますw このまま長い動画を作り始めてしまうと、いろいろ余裕がなくなりますので、適当なところで止めるつもりですが・・・ (Seedanceだけで作るのはコスト的にとても無理なので、動きの少ない場面はKling等を併用するようにしています) しかしSeedance 2.0は相変わらず顔参照のOK/NG判定基準がよくわからず、思わぬところでひっかかったりしますね。

hvplan

15,915 Aufrufe • vor 5 Monaten

(※ChatGPT + 動画生成AI + 画像生成AI + AE) 【ご報告】 勇気を出して、憧れのとある制作チームに志願してみたところ、なんと快く受け入れてもらえました。 今までマネタイズもせず、ただただAI動画の認知度を上げるためだけに投稿してきましたが、ようやく自分の活動ができそうです。 オンラインで面談をして頂き、まずはお試しで仕事をさせてもらう形になれたと思うので結果を出して正式に採用されたら報告ができるかもです。 一部の人は目にすることになるかもしれない期待のプロジェクトにさっそく参加させてもらえるようです。 練習を兼ねたいので、Xでの制作内容や投稿内容が少し変わるかもしれませんが、引き続きツール紹介などはかかさず投稿するつもりです。 フルコミットしだしたらXの投稿が遅れることもあるかもしれないですが、既に多くの方が同じようにツール紹介をしてくれているので引用やリポストも多様します。 これからも別の角度からAI動画を盛り上げる役割を果たすつもりですので、引き続き宜しくお願いします。 ※ ちなみにこの動画は、ChatGPT 4oでタイトルを作って、Runway Gen3で動かして、Midjourney V7で作ったイラスト合成して、AfterEffectsで編集した動画です。 こういう動画を含め、ソシャゲ系とかキャラ動作、フラットアニメ風とかも増えると思います。 今までは仕事が別だったのでSNSは50%くらいでしかやってませんでしたが、仕事の練習になるなら全力でできる機会も増えるので、おそらく投稿作品のクオリティーはあがります。 AI動画界隈の人達みんなの活動がいずれ、クリエイターとして仕事になるようにサポートできればいいなと思っていますので、これからは指標になれるような存在を目指します! 応援してくれた方々に良い報告ができるよう頑張るぞ! いつも見てくれてありがとう!!!🙏🙏🙏

SEIIIRU😈動画生成AIを使う映像クリエイター

52,641 Aufrufe • vor 1 Jahr

ローカルのMiniMax H3のR2Vで、8秒間の1080p級(アップスケール)の動画を8分弱で生成する方法を詰めてみました。 RTX 5090で8秒・1920×1056の動画を480p生成160秒+アップスケール310秒の合計7分50秒でできました。 ByteDanceのアップスケーラもかなり良いのですが、階調がおかしくなったり、変なトランジションが入ることがあります。 今回のlatent Upscalerによるものは元々の動画生成の際のlatentの段階で拡大しているので、仕組みが違うようです。 元のワークフローだと、拡大後のrefineが生成と同じ25stepsで回るようだったので、そこだけR2V用の蒸留LoRA(minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16)に変えました。4stepsと8stepsで試しましたが、秒数の違い(250秒くらい違う)の割に差が自分にはわかりませんでした。 蒸留LoRA 4stepsは「一から絵を描かせるのはキツいけど、細部を修正するくらいなら全然できる」という感じです。 もうひとつ大切なのは、アップスケールの時のconditioningを生成時と同じものに付け直すのが効いたという点です。 標準だと480p用の条件を引き伸ばして使うそうで劣化しているらしいです(Claude Codeが言うには)。 そこで同じ参照を目標解像度で付け直すと、ちゃんとリファレンスどおりになります。 例えば、今回の動画ですと、眉毛のところの描写がキャラクターのリファレンス通りになっています。1枚目の比較画像で分かると思います。 ちなみにSeedance 2.5のオムニリファレンスだと、8秒間の動画をリファレンス8枚付きで生成しようとすると936クレジットでした。スタンダードプラン5,200円で5,775クレジットなので、1本あたり約843円という計算になります。 ローカルのH3はさすがにSeedance 2.5と同レベルとは言えませんし、Seedanceが絶対に必要な場面は存在していますが、とはいえ高解像度のものがローカルで手軽に出せるのはいいですね。

鈴木憂一 | Highdrama

12,169 Aufrufe • vor 1 Monat