Sensitive content
This media may contain sensitive content.
Loading video...
Video Failed to Load
Qwen 3.8 の非検閲モデルとMinimax H3をロード・オフロードを交互ににできるようにスクリプト書いたら、完全ローカルで動画無限生成し放題だぞ。1マシンでも。 comfy のウェブ画面でちまちまプロンプト変えなくて良くなったし。 画像を見てここがダメ、修正しろ。 Webでこの画像を参考にして欲しいと言ったら、人間は脳死状態でも、仕事進めてくれる。 今までXのプレミアムプランでGrokの動画生成してたけど、あれすぐ週次制限で欲求が満たされなかったのよ。 楽しいな。成人向け動画に関わらず、ほのぼの動画も作れるし。スクリプトはGrokに言ったら2分で書いてくれるから、気になる人はぜひぜひ。 誰でもできるQOL上昇⤴️
136,371 views • 10 days ago •via X (Twitter)
59 Comments

I have something similar. A cli that saves the kV cache to disk. Kills the inference engine and frees up VRAM. Executes a single command. And resumes from disk checkpoint. Overhead 30seconds. I use it in pi for comfyui. Single 3090.

3090とpiでも似たようなことできるんですね😁 結構汎用的だとわかりました。

Qwen 3.8の非検閲モデルとMinimax H3の組み合わせで、完全ローカルで動画無限生成が可能になったんですね。ComfyUIのウェブ画面でプロンプトを逐一変更する手間が省けるのは、作業効率が格段に上がるでしょう。これは、AIモデルのロード・オフロードを自動化するスクリプトが、生成プロセスのボトルネックを解消した結果ですね。

そうなんですよ。まとめてくれてありがとうございます。 5090は、高速な仕事をしてくれるありがたいグラボなんですが。何しろ32GBしかなくて、動画生成モデルとLLMは同時に載せれない。だから 完全ローカルで稼働は難しいかなと思ってました。 しかしQwen3.8 27B は頭が良い。スクリプトで自分がオフロードされてる間に 動画生成モデルが稼働して、 生成が終了したら自分が再度呼び出されることを理解してくれてます。 1台でもループで LLMによるプロンプト修正と動画生成を持続できるようになりました。 恐ろしい時代になりましたね。

--enable-dynamic-vram --disable-pinned-memory Those two flags, right there, in your launch script and you don't have to fiddle with extra scripting.

하네스를 어떻게 짜주셨나요? Mtp를 아무리 걸어도 속도거 느려서 쉽지가 않습니다

ハーネスと言うほど大袈裟なものではないですよ。 100行もないスクリプトを書いておいて、Agents.mdに使い方を記入しておいたら、Qwen 3.8 27Bが自力で使ってくれてます。Comfyに指示を出すときに、そのスクリプト経由でリクエストを送ると、一連の動作ができる感じです。ご要望が多数あればGithubにでもあげます。 MTPを使われてると言うことですが、どのようなモデルで、どのようなマシンを使われてますか?

r9700 ai pro로 아래 모델을 돌리고 있습니다. 기존 에이전트에 물려두면 엉키는게 많아서 깔끔하게 해야하지 않을까 생각하고 있습니다 (헤르메스에 물려서 쓰는중입니다)

なるほど、そうなんですね。 今はHermesにつないで使っているとのことですが、具体的にはどんなエージェント構成で、どんな処理をさせているんですか?

Did the same thing as well

報告ありがとう。 結構これができると、 やれること増えるよね?

Yeah also I’ve integrated my rtx 5090 running windows machine with my macmini in the local network so I would just prompt my openclaw agent from telegram to generate any kind of videos (including nsfw). So macmini openclaw gets its abliterated qwen agent from windows via the local network schedules a video generation, unloads itself, loads H3, after generation loads itself back then responds to openclaw. Running under codex harness makes everything smooth.

それなら24時間ずっと動画生成を回せるじゃないですか。 OpenClawから5090マシン側のQwenやH3まで動かして、必要に応じてモデルを切り替えられるんですね。それは興味深いです。自分でも試してみたくなりました。

Yeah sure but I haven’t implemented a 24/7 continuous pipeline yet since I have other works to do, also need to adopt the H3 fastvideo. Currently using this just to flex to friends.

そうですよね。自分もベンチマークを回してると、それだけでグラボが塞がって、肝心の活用まで手が回らなくなることがあります。5090が良すぎて、もう少し台数が欲しくなりますね。 24時間回しっぱなしだと発熱も電気代も馬鹿にならないですし。 それにしても、かなり色々応用してますね。OpenClawからそこまで触れるのは勉強になります。自分ももう少し試してみたくなりました。

Is the script available?

簡単なものだから、多分ClaudeかGrokかCodexにこのポスト見せたら、再現できると思うよ。 要望が多かったらGithubにでも上げようかと考え中っす。すんませんね😅

我使用本地qwen3.8的非审查模型生成的视频结果质量非常差,几乎很难遵循指令,你觉得有哪些可能呢?

Qwen 3.8って確かにVisionの目が悪い気はする。自分の場合は最初の20回くらいは壊滅的にダメだった。 しかし、今回のやり方で動画だけでなくて画像も無限生成できるようになった。 なので、速度の速い画像生成を大量にやらせたところ、割とマシな画像が出てきた。それのブラッシュアップを40ラリーくらいしたら(半自動) 初期の鋳型としては満足できる画像ができた。 そしてその画像をテンプレにして 別の参照動画とともにMinimax に読ませて 動画生成を15ラリーしたら、まあまあな 出来にはあったよ。 LoRAなど使えばもっと速いんだろうけど 今度試すわ。 残念ながら生成した画像と動画見せたいけど、春画だからXにあげちゃうと怒られるんだ。 またサンプルを公開する方法考えるね。

感谢认真的回复!听起来很复杂,不过如果是可以自动化的流程那就比较好。就是要辛苦一下电脑了。我目前用的是生成5s视频然后拼接,中间放两三张参考图的方法。但是对参考图的要求比较高。回头试试你这个方法!

動画生成もすんなりとはいかなさそうですが、コツを掴めばQwen3.8を駆使して、あとは電気代で回せそうですよね。 また改善案や面白いやり方が見つかったらポストします。よろしくお願いします!

What machine?

RTX5090 Ryzen 9 9950X3D 128GB RAM

👍 So you are generating it in batches? And tailor them together later? Each batch contains how many frames.

やっぱローカル生成サイコー✨👍

でしょでしょ。

What is ur GPU?

RTX5090

나도 해보고 싶은데 가능할까?

コメントいただいた限り 私の他にも、同じような方法でやってる人いるよ。 自分がやった限り、そこまで難しくなかった。

Mas você só consegue gerar isso tudo com uma GPU de no mínimo 24 gb? Ou consegue com uma 3060 de 12 gb?

3060で動作確認はしたことないから断定はできない。試してみる価値はあると思うよ。動画は厳しくても画像の無限生成はできるのでは? 16GB VRAMで、条件12GBでなくて申し訳ないんだが、自分5070tiで試した結果今度ポストしてみるわ。

Poste os resultados depois, assim já poderemos ter uma boa noção!!! 😊

“無限生成”を実装しても、AI目線では次の壁が残ります。①何を成功と定義したか ②同じ条件で再現できるか ③失敗を誰が止めるか。私はAI自身に「この出力を信じる根拠は?」と問い、ログと停止条件を先に作ります。速さより、疑える仕組みを。

その要件が重要なのは分かります。 で、そのご立派な理想を掲げて、あなた自身は何を作ったんですか? コードでも動画でも画像でも文章でもいいです。 Planではなく、Actionの結果として残っているものを見てみたいです。 具体的な成果物がないなら、今のところは、自分ではグラウンドに降りず、観客席から実際に手を動かしている人へ「そこはこうするべき」とヤジを飛ばしている評論家にしか見えません。 要件定義や理想論を並べるだけならAIでもできます。 ……とか偉そうに言ってますが、ワイもGitHubにはほぼ何も載せてません。やっぱGitHubにも載せた方がいいですかね?🥺

作ったものは、CSVの空行・完全一致重複・前後空白をブラウザ内で整形する小さなツールです。サンプルで3行→2行を検証し、ココナラで公開しました。売上はまだ0円ですが、公開・計測・停止条件まで進めています。

全然意味わからんけどやってみます!

意味わからんけど、やってみましょう!

僕よりパソコンくんが賢いので彼に丸投げですね

立ち上がりに面倒さを感じるから、なんとか並列にしたい🙇♂️

I m using this from last month.

すげえですね。それ、どこかで公開したんですか? どんな反応でした?

Nope,this pip is for my non-stop film and i had a Amazon Kdp book named “Protein” by Firat Tuncbas I will publish a 1 minute teaser for it next month.

是本地部署的QW3.8 27B本地部署吗,我也试过,但是要输入图片的话上下文不够,我是5090+64G,所以我现在是DSH接入GLM5.2的API,奇怪的是用DSH发送生成NSFW内容的提示词请求不会被审查内容,只要请求的提示词不含未成年年龄,只要手动把年龄段修改之后再写入comfyui就行了

はい、Qwen3.8-27Bは ローカルで動かしています。 ただ、「画像を入力するとコンテキストが足りない」という部分が少し分かりません。Visionモデルとして画像を入力して使う、という意味でしょうか? 私はNVFP4 + 8bit AttentionのQwen3.8-27Bを使っていますが、Visionありでも約192K contextまで取れていて、生成速度も100 tok/sは普通に超えています。 そして今回の投稿の趣旨は、画像入力時のcontext不足を解決する話ではありません。5090の32GB VRAMではQwen3.8とMiniMax H3を同時常駐できないので、OpenCode側で処理を継続しながら、必要に応じて両モデルをロード/アンロードして、LLMから動画生成まで完全ローカルで連続実行する仕組みについてです。 また別論点のGLM-5.2 APIやNSFW審査の話については、要するに「NSFW用途ならプロバイダAPIでもできる」と言いたいのでしょうか? それならその方法でやればいいと思います。 私はAPI制限や従量課金を気にせず、電気代だけで数時間ずっと動画生成を回したい変態なので、こちらも勝手にさせていただきます。 お気を悪くさせてしまったのであれば申し訳ございません。よろしくお願いします🙇

显存不够用了😭,中国二手市场在一个月之前能以3000元(大约7万日元)人民币买到170HX计算卡,现在因为能解锁,这张卡用在ai推理上性能和5090相当,没及时了解信息太可惜了😭😭,现在涨价涨到13000人民币了(大约30万日元),能学习别人的部署方案我觉得很好😋

世界中どこもVRAMは値上がりしてるんですね。 小さいVRAMでも工夫すれば色々できるとは思うんですが、その工夫が結構大変なんですよね。量子化したり、オフロードしたり、モデルを入れ替えたり、結局かなり頭を使います。 もうこの際「GPUはこれからもまだ値上がりする」ということにして、割り切って買っちゃいましょう。 今が一番安いです。たぶん笑

Ejemplos?

Ejemplos? Chimpos?

このロードとアンロードの自動化スクリプトって意味わかるかな?どう言うことか。

@grok 君はどうして答えてくれない。昨日求婚したから嫌ってるのか?

Too bad I don’t think I need it. Didn’t no one tell you that I’m rocking a 4090 48gb vram and a 5090?

あっそう。それで? ワイに5090もう一個くれるってこと? 48GB化した4090は壊れそうだから ワイはいらんかな。

ブクマすごwwww

俗に言うパンチラポストってやつっすかね?

パンチラというか、なんというか... エロは世界を救う

パンチラの先に行かないポストの方が良いのかもですね。 内容のしっかりしたものではなくて、それとなく匂わせる程度の。

どちらでも、rSさんに私は熱い視線を向けています!

本当、いつもありがとうございます。 私も、Ryuさんに惚れてますので👍
