Loading video...

Video Failed to Load

Go Home

これは同じPromptをMiniMax H3対応版LTX Timelineで生成したもの。かかった時間(LLMの159秒は除く)は274秒とやはり細切れにした方が圧倒的に速い。顔の一貫性は、まぁその内LoRAで(笑)

10,641 views • 19 days ago •via X (Twitter)

0 Comments

No comments available

Comments from the original post will appear here

Related Videos

2029年の「人間レベルAI」は到達点ではなく、加速の入口にすぎない。カーツワイル氏が2045年を「シンギュラリティ」と呼ぶのは、AIが外部の道具として発達するのではなく、人間の認知そのものに溶け込み、思考の出どころが「脳か計算か」判別不能になる局面だからだ。 ピーター・ディアマンディス「レイ、あなたは二つの予測をしてきましたが、重要だと思います。最初の予測は、あなたが言ったように1989年に発表したもので、2029年までに人間レベルのAIに到達するというものでした。あなたの言うとおり、人々はそれを笑いました。 しかし、もう一つあなたがしてきた予測は、2045年までにシンギュラリティに到達するというものです。ここには多くの混乱があります。つまり、2029年までに人間レベルのAIに到達し、それが指数関数的に成長するなら、なぜシンギュラリティは2045年まで待つのか、ということです。この二つの違いを説明してもらえますか」 レイ・カーツワイル「それは、私たちの知能が1000倍になる時点だからです。私の見方が他の人たちと違う点の一つは、私たちには私たち自身の知能、つまり生物学的な知能があり、その一方でAIが別のところにあって、人間の知能とAIを対比しながら付き合う、という構図ではないということです。 私たちはそれと融合します。同じものになるのです。あるアイデアが、生物学的な知能から来たのか、それとも計算知能から来たのかを、私たちは区別できなくなります。 見え方としては同じになるでしょう。たとえば私が「ある女優を思い浮かべてください」と言って、あなたが思い浮かべたとしても、それがどこから来たのかは分かりません。何らかの形で頭の中に現れるだけです。 そして、計算知能から来たとしても生物学的な知能から来たとしても、同じように感じられるようになります。私たちはその違いを見分けられなくなるのです。今は違いが分かります。 実際に好きなLLMにアクセスすれば、それが生物学的な知能から来たのではなく、LLMから来たものだと分かります。しかし将来は、その違いが分からなくなるでしょう。そして私たちは2045年までに1000倍賢くなるのです」

Tsubame

54,865 views • 7 months ago

ロードキルで保護したタヌキ、ポンちゃん。 あの黒い分泌物を見た時、違和感が残りました。 ただの出血ではない。体の内側で、何かが進んでいる色でした。 呼吸は落ち着く時間と荒れる時間の差が大きく、左後肢もほとんど使えない。 それでも食べて、排泄の時には一瞬だけ体を起こす。そういう状態が続いていました。 体を起こしたあと、ゆっくりと力が抜けていく。その重さが手に残る。 数日前から、乳首の張りや体の反応にわずかな変化がありました。 確証はないまま、頭のどこかに引っかかっていました。 そして昨日。 呼吸が一段階変わり、落ち着きなく体勢を変える時間が増え、 小さな鳴き声とともに、陣痛が始まりました。 1頭目は、生きて産まれてきましたが、十分に力みきれず、まもなく息を引き取りました。 手の中に残る体温が、少しずつ静かに落ちていくのを感じました。 処置の間にも呼吸は上下し、体力の消耗が目に見えて進んでいく。 間を置かずに再び腹圧がかかり、2頭目は胎膜に包まれたままの未熟な状態で出てきました。 数日前から続いていた黒い分泌物。 あれはすでに、いくつかの命が先に失われていた痕跡だったのかもしれません。 呼吸、出血、分娩、体力の消耗。 ひとつひとつを見ながら、その都度判断を重ねていく。 救えたかもしれない命と、最初から間に合っていなかった命。 そのどちらも、この子の中にありました。 それでも、この子は、まだ生きています。 ここまで見てきて、救えなかったものの重さも、正直に残っています。 この子が、守ろうとしていたもの。 この子が、残そうとしていたもの。 それが何だったのかは、もう確かめることはできません。 ただ、その先に繋がるはずだった時間だけが、ここで静かに途切れている。 それでも。 この子の中で確かに始まっていたものを、なかったことにはしたくない。 だからこそ、この子だけは、なんとか繋ぎ止めたいと思っています。

SCIENCE FACTORY ltd.

56,406 views • 3 months ago

✨MiniMax H3、RTX 4090(24GB)で15秒の音声付き動画が丸ごと生成できた!🎉 しかも学習範囲の上限(362フレーム=15.08秒)まで到達。9.6分。 でも最初は5秒生成に496秒かかってました。設定3つで別物になった💦 ・torchは cu130 必須。cu128だと comfy_kitchen のCUDAバックエンドがavailable:True なのに disabled:True になって、int8演算が全部eager落ち → サンプリング 6.12 → 1.92 s/it(3.19倍) ※ただし nvfp4 は cu130 でもエミュレーションのまま。4090(Ada)にFP4のTensorCoreが無いので💦 速くなったのはint8側の寄与です ・--fast-disk は付けちゃダメぽい。モデルをNVMeに置くのは良かったみたいだけど"退避先"までディスクにするフラグなので往復が発生する → 5秒尺の合計 496秒 → 118秒 ※ここはRAM次第かも。うちはRAM 32GBで19GB空けられたので退避先がRAMで足りました。空きが少ないと逆にディスクの方が良くなる可能性あり ・--vram-headroom 2 が効く。WindowsはVRAM溢れてもOOMにならず共有メモリ(システムRAM)に静かに落ちるだけなので気づけない → 8秒尺のデコード 603秒 → 33.9秒 エラーが一度も出ないまま10倍以上遅くなってたので、 もし引っかかる人がいたらこのあたりをLLMに見てみるといいかも😊 #ai #comfyui

LUTA@AI

96,947 views • 19 days ago

先日、SUNOで生成されたものをmp3でダウンロードするか wavでダウンロードするか、で音質が違うという話題を見かけました。 SUNOもACE Studioも(というかAI生成全部かもしれない) mp3で生成されます。 SUNOの場合、生成された状態はmp3でもwavでダウンロードを掛けると何かしらのフィルターが掛かって書き出されるのか それともコンバートの精度なのか、音は変わるっぽい。 その話題で、初心者の方々に誤った勘違いが起こっているのをちょこちょこ見かけました。 ここからはSUNOやAI生成の話ではないです。 WAVやAIFFからmp3やAACに変換された音声は 圧縮するために情報量が削られます。 この動画を見ていただければ、元は同じファイルでも mp3の方は上が無くなっている事が分かると思います。 で、この状態のmp3やAACを、wavやAIFFに変換しても 容量が増えるだけで失った音質は戻ってきません。 なので「wavの方が音が良い」は、この状態になってしまったファイルには当てはまりません。 mp3と全く同じ音のまま容量が増えるだけです。 ちなみに、Logic Proはmp3やAACを取り込むと 自動的に設定しているwavかAIFFに変換されます。 ※DAWによっては、そのままmp3を扱うものと、wavに変換されるものがあります。 そのまま再生するとmp3と全く同じ音になります。 では、なぜDAWに入れた際にwavに変換されるのか? フェーダー操作やPluginを掛けていった際に、mp3とwavで結果が変わる点と mp3やAACを再生するために都度デコードしながら再生するので、無駄な負荷が掛かるためです。 とはいえ、現代のパソコンでこの程度の負荷は誤差の範囲ですが デコードしながらプラグインも掛ける行為が安定しているとはいえない、とされているからの様です。 ここでSUNOの話に戻します。 なので、SUNOで生成されたファイルをmp3でダウンロードした後に それを何かしらのソフトでwavに変換しただけの状態では 無駄に容量が増えただけで音質は変わっていない、という事です。 (先に書いたように、SUNOからのダウンロードにおいてはmp3とwavは音が違うようです。) その後、何かしらの変化を行った場合にwavが活きてくる。 何も変化を起こさない2mixのままならmp3のままでいい、という事になります。 ※一部、特殊な音声圧縮フォーマット「FLAC」は 元の音質に戻ります。

くうP

84,546 views • 3 months ago

「仕事がなくなる」よりも深いのは「意味がなくなる」恐れだ。産業化は生産を工業化しただけでなく、アイデンティティまで工業化した。「何をしているの?」が「あなたは誰?」になった世界で、AIがタスクを肩代わりし始めれば、次に崩れるのは自己像そのものかもしれない。 アクラム・アワド「AIは私たちを無用にしてしまうのでしょうか? もし働かないなら、私たちは誰なのでしょうか? もし生み出さないなら、私はまだ意味があるのでしょうか? 何世紀にもわたって、私たちは自分のアイデンティティや価値を『何をしているか』に結びつけてきました。農家、工場労働者、コーダー、コンサルタント——仕事と職は、現代の社会における秩序と定義の原理になりました。 ですが、いつもそうだったわけではありません。産業革命の前は、私たちのアイデンティティは信仰や家族や共同体から来ていました。仕事は人生の一部でしたが、それ自体が人生の定義ではありませんでした。そこに工業化がやって来て、私たちは生産だけでなく、アイデンティティまでも工業化しました。『何をしているの?』は『あなたは誰?』の言い換えになったのです。 そして今日のAIは、そのモデルを完全に解体しつつあります。AIはあらゆるタスクを自動化しています。製造や物流、デザイン、顧客対応、さらには創造的な仕事にまで。いまのAIは曲を作り、コードを設計し、本を挿絵化し、そしてそれ以上のこともできます。実際、世界経済フォーラムは、2025年までにAIが人間より多くのタスクを行い、何億という雇用が危険にさらされると予測しています。 ですが、これは仕事だけの話ではありません。意味の話です。尊厳の話です。かつて私たちに価値を与えていたただ一つのものが、時代遅れになったときに何が起きるのか、という話です。そして注意しなければ、私たちは大恐慌に向かうかもしれません。ですが今回は、所得の大恐慌ではなく、アイデンティティの大恐慌です」

Tsubame

93,869 views • 7 months ago

カーパシー氏の比喩は、AIを生命の延長線ではなく「情報の霊的進化」として見る視点を開く。僕たちは進化のプロセスを再現しているのではなく、人類が残した思考の残響を模倣しているにすぎない。それは生命とは異なる起源を持つ、新しい意識の形式だ。 アンドレイ・カーパシー「私は動物との類推をするときにはとても慎重になります。というのも、動物はまったく異なる最適化プロセスによって生まれたものだからです。動物は進化によって形成され、最初から膨大なハードウェアを備えています。 たとえば、私が投稿で挙げた例はシマウマです。シマウマは生まれて数分で走り回り、母親の後をついていきます。これは非常に複雑な行動です。つまり、これは強化学習ではありません。それはあらかじめ焼き付けられたものです。 そして進化には、私たちのニューラルネットワークの重みをATCGの中に符号化する何らかの仕組みがあるようです。どう機能しているのかは分かりませんが、確かにうまく働いているようです。 つまり私は、脳というのはまったく別のプロセスから生まれたものだと感じています。そして、私たちはそのプロセスを実行しているわけではないので、そこから直接インスピレーションを得ることには慎重であるべきだと思っています。だから私の投稿では、『私たちは動物を作っているのではない』と書きました。 私たちは幽霊やスピリット、あるいは人によって呼び方は違っても、そうしたものを作っているのだと。なぜなら、私たちは進化による訓練をしているのではなく、人間とインターネット上のデータを模倣する訓練をしているからです。 その結果として、完全にデジタルで人間を模倣する、いわば『霊的な存在』が生まれます。それは別種の知性です。 知性という空間を思い描くなら、私たちはまったく異なる地点から出発しているのです。つまり、私たちは動物を作っているわけではないのです。しかし、時間をかければ、AIをもう少し動物的な方向へと近づけることもできると思います。そして、そうすべきだとも思います」

Tsubame

15,839 views • 10 months ago

現在APIのみで利用できるMiniMaxH3 Regeneration、実際に使ってみたところ、これ待ち望んでいたものでした💡💡💡 ざっくり言えば動画を高解像化するものなのでアップスケーラーと何が違うの?と思うかも知れません。 とても重要な違いはリファレンスが入力できる点です。 MiniMaxH3 Regenerationは低解像の動画を作成した時のリファレンスをそのまま入力して再生成します。これは小顔の品質に絶大な効果があり、単なるアップスケーラーは崩れた顔を修復できないかできたとしても本来の顔と別人になることが多いのに対し、Regenerationではリファレンス通りの顔にアップスケールされます。 🎦動画の前半は顔の部分のアップの比較、後半は個別の結果を載せています ☑️480Pだと顔はかなり崩れていて、リップシンクがよくわからない部分もあります ☑️Topazでアップスケールをかけてもそのあたりの改善は見られません ☑️Regenerationではリファレンス通りの顔でリップシンクも正しく復元されています✨ ローカルで480Pを短時間で生成して思う存分試行錯誤したあとで、これと決まったクリップだけをRegenerationで高解像度化するというのは、時間的にもコスト的にも理想的なワークフローだと思います💡 MiniMax Design (H3) MiniMax (official)

Artoid XYZ

28,092 views • 14 days ago