Загрузка видео...

Не удалось загрузить видео

На главную

ローカルのMiniMax H3で、約9分で15秒の2K超え動画を生成する話(RTX 5090)。 Alibabaの蒸留LoRAで480pの当たりを引いて、同じlatentを1344×768に拡大して4ステップのrefine、最後にRTX Video Super Resolutionで2倍の2688×1536にアップスケール、という分担です。 RTX VSRは、拡散モデルのように描き直すのではなくフレームを1回通すだけなので、2688×1536へのアップスケールでも1フレーム0.1〜0.2秒くらいで済みます。 ただし、再生成ではないので元の絵がダメならダメなまま大きくなります。今回もrefineで絵を綺麗にしてから解像度を上げていますが、やはり2Kといっても寝ぼけた感じにはなってしまっています。 数値は今日の実測(362フレームで約85秒、モデル読み込み含む)を丸めたものです。 480p生成が約2分55秒、refineが約4分40秒、VSRが約1分25秒。 画質だけなら非蒸留の25ステップや、Alibabaの蒸留LoRAで最初から768pで回したほうがいいのかもしれないです。 ただ、480pなら1本3分弱で回して、当たりだけ、保存しておいたlatentでアップスケールすればいいので、こちらのほうが気楽に生成できます。

26,566 просмотров • 14 дней назад •via X (Twitter)

Комментарии: 9

Фото профиля 鈴木憂一 | Highdrama
鈴木憂一 | Highdrama14 дней назад

参照に使った画像と、最後に使ったプロンプトです。 部屋の絵1枚、キャラの体3面と頭3面、配信アバター1枚の計8枚。部屋の絵は素のまま渡して、モニターに映るアバターの配置・動きは参照だけでH3に任せています。 手順のメモはGitHubに置いています。 (以下、プロンプト全文) subject_definitions: <Subject 1> is the streaming room and its camera viewpoint, taken from <Picture 1>: a high-angle view looking down from near the ceiling into a small messy apartment room at night, a large white L-shaped desk in the right half with three monitors, a webcam on top of the center monitor, a microphone on a boom arm, a keyboard and a mouse on a pink desk mat, plastic bottles and snack packages piled on the desk and rolling on the wooden floor, a grey gaming chair in front of the desk, an unmade single bed with a cream comforter in the lower left, pink curtains half drawn over a window showing a dark night sky, a closet on the far left, the room brightly lit by a warm ceiling light. <Subject 2> is the young woman, defined by <Picture 2>, <Picture 3> and <Picture 4> (body: front, left side, back) and <Picture 5>, <Picture 6> and <Picture 7> (head: front, left profile, back): long black hair tied up in a loose messy bun with strands falling out and a lavender ribbon tied in the bun, large violet eyes with heavy lids and long lashes, pale porcelain skin, no makeup, a cool detached expression, slim build. She wears an oversized matte black zip-up tracksuit jacket with a hood, lavender stripes down the sleeves, thin white frilled lace along the inner collar edge on both sides, a lavender ribbon bow on the chest, a small ribbon on the zipper pull, the jacket half zipped over a plain white t-shirt and sagging off one shoulder, loose black track pants with lavender stripes, elastic ankles bunched up, and bare feet. <Subject 3> is her 2D streaming avatar and its stream background, defined by <Picture 8>: a cute bust-up anime girl with fluffy wavy hair fading from white to glowing mint like a jellyfish, large sparkling eyes, big over-ear headphones with jellyfish-shaped ornaments, a dark capelet over a white top, smiling brightly and waving, standing in a glowing virtual laboratory with tall glass tubes, neon-lit shelves and floating bubbles in cyan and pink behind her; this whole picture, avatar plus lab background, is what the center-right monitor shows as a flat 2D stream image. summary: [reference generation] A single locked high-angle shot of <Subject 2> ending her stream in <Subject 1>: she waves goodbye to the webcam with her back to us in a bright, high-energy streamer voice while her 2D avatar on the monitor mirrors the wave, clicks the mouse to stop the stream, slumps in silence, picks up a short black heated tobacco device with a white stick from the desk, spins the chair around fast so her face is seen for the first time, slides down in the chair and throws her bare legs onto the bed, draws one deep, slow breath through it with the air around her face staying completely clear, holds the breath, and finally lets it out in a long exhale at the very end. retention_analysis: <Picture 1>: fully_preserved - the room layout, furniture, clutter, lighting and the exact camera position and angle are kept; the woman is added in the chair, and while the stream is on the center-right monitor shows <Subject 3> instead of the plain dashboard seen in the picture. <Picture 2>: fully_preserved - body proportions and outfit. <Picture 3>: fully_preserved - outfit from the side. <Picture 4>: fully_preserved - back of the jacket, hair bun and ribbon from behind. <Picture 5>: fully_preserved - face and hairstyle. <Picture 6>: fully_preserved - profile of the face and bun. <Picture 7>: fully_preserved - back of the head and bun. <Picture 8>: fully_preserved - the avatar and its background shown on the monitor keep this exact design, colors and proportions in every frame while the stream is on. detailed_description: The entire target video is rendered in the exact clean cel-shaded anime style of <Picture 1> and <Picture 2>: crisp lineart, flat pastel fills with soft two-tone shadows, limited-animation clarity. <Picture 1> provides the set and the camera: the camera is locked in the same high-angle position for the whole video, Static Shot, no panning, no tilting, no zoom, no cut. [Shot 1] A single continuous 15-second take. At the start the woman sits in the grey gaming chair facing the desk with her back to the camera, only the back of her black jacket and the messy bun with the lavender ribbon visible, the monitors in front of her showing a streaming dashboard and chat that stay exactly the same, pixel-still, for the entire video, and on the center-right monitor the streaming avatar <Subject 3> exactly as in <Picture 8>, crisp and unchanging in design. A heated tobacco device lies on the desk just to the left of the mouse: a short matte black cylinder about the size of her thumb, with a tiny rectangular display and two small buttons on its face, and a short white tobacco stick standing out of its top. At 00:00.000 she leans toward the webcam on the center monitor and throws both arms up high, waving both hands big and fast above her head, saying her sign-off in a bright, bubbly, high-pitched streamer voice, full of energy and rising at the end of each phrase: (S1) <d>[Japanese] 今日はここまで〜!ばいば〜い!</d> On the center-right monitor, the avatar <Subject 3> (the same jellyfish-haired girl from <Picture 8>, same face, same colors, same headphones, same neon laboratory behind her) raises both arms and waves both hands at exactly the same moments, mirroring every swing of her real arms and every bob of her head frame for frame, like a live-tracked 2D model; its design never changes. Her face stays turned away from us toward the webcam. She keeps both hands waving for a full second after the last word of the line is spoken, still facing the webcam, the avatar waving with her. At 00:03.500, well after she has finished the whole line and stopped waving, she brings her right arm down in a clear visible arc to the desk, reaches across the pink desk mat and places her right hand on the white mouse, her fingers wrapping over it in plain view of the camera; she nudges the mouse a few centimeters to move the cursor, then presses the left button with her index finger with a distinct small click motion, and keeps her hand resting on the mouse for a moment before letting go. Only the center-right monitor reacts; the left monitor and the right monitor keep showing exactly the same dashboard and chat image as at the start, with no flash, no white screen, no scrolling and no layout change. At 00:04.500 the moment the stream is off, her whole posture changes: the bright streamer smile switches off, her shoulders drop, her head hangs forward for a moment and she lets out a long, heavy sigh with no words, the exhaustion shown only in her posture. The avatar <Subject 3> disappears from the monitor, replaced by a plain idle screen. From this moment to the end of the video, the center-right monitor shows only a plain blank idle screen, and the left and right monitors continue to show the identical static dashboard and chat image they showed from the first frame, frozen and unchanged; no face, no character, no avatar of any kind appears on any screen again. At 00:05.500 she looks down at the desk, reaches her right hand across to the short black heated tobacco device lying on the desk mat just to the left of the mouse, wraps her fingers around the black cylinder with the white stick pointing up, and lifts it clearly off the desk, then holds it loosely in her right hand; this pick-up is shown plainly, the black device with its white stick visible in her hand as she brings it back. At 00:07.000 the chair spin is timed like Japanese limited animation, with a clear anticipation, a snap and a held pose: first she plants one bare foot against the desk and coils her upper body a little in the opposite direction, holding that wound-up pose completely still for a beat of about half a second (the tame); then she kicks off hard and the chair whips around toward the camera in only a few frames, a fast blurred half turn with her hair and the lavender ribbon streaking behind her (the tsume); at the same moment as the spin she raises her left hand and sweeps it back through her bangs, pushing her hair up and off her forehead in one lazy stroke as her face comes around, the hair falling back loosely afterward; the chair overshoots slightly, snaps back, and freezes in a held pose facing the camera, her left hand still resting in her hair for a beat, while only her hair strands and the loose jacket keep swinging and settle late. As the chair whips around her face is seen for the first time: heavy-lidded violet eyes, a calm detached expression. At 00:08.500 she slides down in the chair until she is half lying in it, her back low against the backrest, and throws both bare legs out to her left onto the bed, heels landing on the edge of the mattress, the track pants riding up to show her ankles. At 00:09.500 she raises the device so the white stick touches her lips and takes a very long, very slow inhale from it that lasts a full two and a half seconds, until 00:12.000, the black cylinder held in her fist below her mouth, her chest rising slowly the whole time, eyes gradually closing; it is a deep inhale, drawn in through the device: her chest and shoulders rise, her lips stay sealed around the tip, and the air around her face, the device and the whole room stays perfectly clear and clean the entire time, exactly like the air in every earlier second of the video; the only sounds during the inhale are a faint, slow intake of breath and the room tone. At 00:12.000 she lowers the device and holds the breath with her lips closed and her eyes shut, completely still, not breathing out at all, for a long two seconds until 00:14.000; during this hold her lips stay sealed, her chest stays full, and the air around her face remains perfectly clear and clean, identical to the air during the inhale; this hold is silent apart from the PC fan hum and the room tone, with her breath completely held. At 00:14.000 she tilts her head back and only now, for the first time, begins to exhale, a slow, long, drawn-out breath that continues all the way to the end of the video, its soft exhale sound starting at exactly this moment and lasting as long as the visible breath, and only with this exhale, after 00:14.000, does anything visible leave her lips: a faint, thin, barely visible wisp of pale vapor that dissolves within a second; her head resting back against the chair as the video ends on the same locked wide shot. Movement is unhurried throughout with easing on every start and stop, and every action uses Japanese anime timing: a short anticipation, a fast decisive main motion, then a held pose with only hair and clothing settling; hair strands and the loose jacket settle after each motion. The bottles, clothes and clutter in the room stay exactly where they are. The air in the room is perfectly clear and clean for the whole video, including the pick-up, the deep inhale and the breath-hold; the single exception is the exhale after 00:14.000, a faint thin wisp only, gone within a second. Consistent character identity, hairstyle, outfit and cel-shaded anime style throughout; no morphing, no identity drift, no extra people, no second character, no other avatar or face on any screen after the stream ends, no camera movement, no cuts, no glow, no retro anime look, no photorealistic rendering. overall_soundscape: her bright high-pitched energetic streamer voice for the sign-off line, then a single mouse click, a long heavy wordless sigh, the squeak and rattle of the office chair spinning fast, a soft rustle as she pushes her hair back, the faint hum of PC fans, silence with only the fan hum while she inhales slowly and holds her breath, then a soft, long, slow exhale sound that begins only at 00:14.000 in sync with the visible breath and lasts to the end, quiet apartment room tone at night. non_diegetic_music: N/A

Фото профиля weee
weee14 дней назад

minimax h3的开源协议限定限制了美国 欧盟 韩国的本地部署,很神奇的对日本没有任何限制呢

Фото профиля Harry - AI Video
Harry - AI Video13 дней назад

Thanks for sharing! My workflow is pretty much the same. I also use 0.4mp for the draw and when I see it looks decent, I zoom in on the space. I just went straight to 1.8mp instead _(:з」∠)_

Фото профиля Ares
Ares14 дней назад

slopu

Фото профиля Eric Kang
Eric Kang13 дней назад

RTX 5090でH3ローカル生成9分で2K超え、蒸留LoRA→refine→RTX VSRの分担が効率的ですね。H3プロンプト例をオープンソースで公開中:

Фото профиля Begotten Hickory
Begotten Hickory13 дней назад

DLSS 5 with frame gen my jigga

Фото профиля Clark
Clark13 дней назад

好厉害

Фото профиля Gemma月
Gemma月13 дней назад

这个流程很有意思,等于把生成分成三份工作:先用蒸馏LoRA快速拿到低分辨率基础,再用latent放大和refine控制细节,最后靠RTX的视频超分补足最终分辨率。这样既避免了全程跑高分辨率的高显存压力,也把5090的硬件优势用在了最后一步。

Фото профиля ちきぱぱ@5y+2y知育幼児アプリ開発
ちきぱぱ@5y+2y知育幼児アプリ開発13 дней назад

ローカルの Minmax h3。用途を限定すればめちゃくちゃ使いやすいんですよね。サーバーの Minmax でもやっぱり 1 分 100 円はかかるので。24時間で 10 万円越え。。。うーん GeForce 5080 買おうかなあ。。。

Похожие видео

✨MiniMax H3の4ステップLoRA、Xで見かけたので試してみました! 1280x736・14秒が 15分57秒 → 4分3秒 になりました(3.9倍) 同じシード・同じ参照画像・同じプロンプトでの比較です。 使ったのはlightx2vの蒸留LoRAを、KijaiさんがComfyUI用に変換してくれているもので、少し深めに調査してみました😊 ファイル名がFL2V用になってたけど、Ref2VA(参照から動画)に挿してみたら普通に動きました🤔 絵は20ステップ版と並べてみて、明らかに落ちる感じはしなかったです。細部もそんなに変わらない。 ただ4ステップの方が動きが小さめでした🤔 3本回しても同じだったので、シードではなくステップ数の影響だと思います。少ないステップで決めきる必要があるぶん、無難な方に寄るんじゃないかなと とはいえ20ステップの方は動きが激しいぶんキャラが反転したりしていたので、どっちが良いとも言い切れないです あと生成速度は5倍にはなりませんでした💦 ステップは20→4で1/5になるんですが、VAEデコードとmp4書き出しの時間は変わらないので、そこが全体の4分の1くらいを占めます。どれだけステップを減らしてもこの1分弱は残るので、頭打ちがあるぽいです そして前にSageとEasyCacheは同時に使えて速さも重なると書きましたが、EasyCacheとこのLoRAは重なりませんでした🤔 ログを見ると1ステップも飛ばしてなくて、監視の分だけ5〜6%遅くなるだけでした。同じシードで比べたら絵も音も完全に同じです 理由は「何を削っているか」が同じだからだと思います。EasyCacheは前のステップと似ていたら計算を省く仕組みなんですが、4ステップだと1歩の変化が大きすぎて似ていない。ステップ間の余りをLoRAが先に全部使ってしまった感じです Sageは計算のやり方を変える手法なのでステップ数と関係なく、こちらは重なります なのでEasyCacheが悪いわけではなくて、20ステップなら普通に効きます(前に測った時は5/20飛ばして1.34倍でした)。今回のは4ステップの話です あと前回「15秒だけ通らない」と書いた件、4ステップでも同じところで落ちました。ステップ数ではなく1回の計算に渡る量で決まっているみたいです なので15秒の中で激しいカット割りをやりたい時は、今はまだこのLoRAじゃないかもしれません。作者さんもv0.1のプレビュー版で「改良版を開発中」と書いているので、そこは待ちかなと思っています とはいえ4分なら試せる回数が全然違うので、しばらくこれで回してみます😊 リプにリンクと導入手順👇 #ai #comfyui

LUTA@AI

40,722 просмотров • 1 месяц назад

シンギュラリティのトリガーである「再帰的自己改善」は、すでに少し前に起きているという。もちろん、まだ全自動ではないが、「進歩のどこまでがAIでどこまでが人間なのか」は曖昧になってきている。著者性が溶けるこの感覚こそ、分単位で進むシンギュラリティの手触りなのだ。 サリム・イスマイル「再帰的自己改善(RSI)がシンギュラリティの本当のトリガーだという話は、以前からしてきました。そしてそれは、すでに少し前に起きているんです。だから今やっているのは、その道筋を加速しているだけです。私たちは今この瞬間にも、産業時代を恒久的に抜けつつあります」 デイブ・ブランディン「ええ、シンギュラリティが分単位で展開していく様子は、私が経験した中で最も興味深いものだと本当に思いますし、アレックスの言うとおりです。いまは、人間がループの中にいて貢献している時期ではあるのですが、進歩のどこまでがAIでどこまでが人間なのかが、本当に曖昧なんです。実際にコーディングしていると、『あれは自分のアイデアだったのか?』となります。 半分は自分のアイデアのようでも、AIが別の案を提案してきて、それを採用していくうちに、結局それが自分のアイデアだったのかどうかも分からなくなります。ただ、いまのモードでは、こうしたコアアルゴリズムの研究の多くが、『500本のテストを走らせて、どのハイパーパラメータが良かったか、どのニューラルトポロジーが良かったかを教えて』という形になっています。相対論を発明したり発見したりするような話ではありません。 いろいろな試行を大量に回して、うまくいったものを選んで再デプロイし、そうするとより賢いAIになって、さらに多くの試行をする——その繰り返しです。私たちはその道筋をかなり進んでいる可能性が高いと思います」

Tsubame

15,386 просмотров • 7 месяцев назад

いまのAIに決定的に欠けているのは、僕たちの背景を理解する能力だ。だから毎回プロンプトで関係性を組み立て、状況説明をし、欲しい出力へ誘導しなければならない。だが、その制約が外れ始めたとき、AIは単なる便利ツールではなくなるのだろう。その日はきっと、それほど遠くない。 サム・アルトマン「今のモデルは、将来そうなるものと比べれば、まだかなり愚かです。しかもそれ以上に、あなたの人生についての理解がきわめて限られています。今はまだ、こちらがうまく、なだめたりすかしたりしながら、欲しいものを引き出さなければならないのです。 ですが、あなたの文脈をすべて知っているようなモデルは、もうそれほど遠くありません。そのモデルは、あなたのことを知っている。あなたの人生を知っている。何をしているかを知っている。何を大事にしているかを知っている。あなたの人生にいる人たちのことも知っている。もちろん、あなたが望む形で、望む範囲においてですが、あなたのコンピュータやブラウザにもアクセスできる。そして時間がたつにつれて、現実世界であなたの周囲に起きていることにも、ますますアクセスするようになるかもしれません。 それは、コンピュータを使う感覚、そしてAIを使う感覚そのものを、完全に変えてしまうはずです。私はそれに強く興奮しています。ただ、実際それがどんな感覚になるのかは、私たち自身でさえ、まだ十分に直感できていないと思います」 グレッグ・ブロックマン「まさにその点ですが、今の私たちは、チャットでも何でも、使っているツールに対して『何が起きているのか』を説明するのに、ものすごく多くの時間を使っています。そしてそれがどれだけ苛立たしいかを考えてみてください。まるで同僚に対して、いや、私が欲しいのはこういうことで、今こういう状況なんだ、と延々説明し続けているようなものです。今のシステムの振る舞い方は、本来こうあってほしい姿ではないのです」

Tsubame

15,287 просмотров • 5 месяцев назад

実は今日ライブ配信をつけたのには、どうしても話さなければいけない理由がありました。 このまま何も言わずに済ませることは出来ないと思って。昔の僕たちの姿を愛してくださることはわかっていますし、気持ちも理解しています。 でも、今のENHYPENの姿を受け入れられなかったり否定したりする方もまだかなり多いようです。これまで僕たちがはっきり話してこなかったから説明してない、メンバーの人数について色々話される事も多かったです。 今のENHYPENは6人です、皆さん。ENHYPENは6人です。 コンサートでそういう事を言ったり、応援方法の事も含め、これまで明確にしてこなかったのでその気持ちは理解できます。でもその事でエンジン同士が争う姿を見るのは本当にいい気持ちはしません。正直に言うと公演にもかなり支障がでています。 今日こうしてはっきりお話ししたので、本当にこれからもENHYPENを好きで、僕たちを応援してくださる方なら、どう行動すべきかは皆さん自身が分かると思います。これは僕がはっきり言います。曖昧な言い方をすると伝わらないかもしれないので。 「ENHYPEN は7人だ」といった話をする事は結局エンジン同士を争わせる事になると思います。ファン同士が争うことなんて誰も望んでいませんよね。会社も望んでないしエンジンももちろん望んでない。 そして何より、僕たち6人が望んでません。だから今後そういう争いを煽るような事をするひとは、僕はファンではないと考えます。 メンバーを代表して、僕が話しに来ました。他の5人のメンバーもみんな同じ考えです。 これからそういうことはやめてほしいです。本気でお願いしています。公演中も本当に気になってしまいます。お金を払って長い時間をかけて来てくださる方々がいるし高価な公演です。そういう方々にも迷惑がかかっています。 だからそういう事はもうやめていただきたいです。 ジョンウォン、やっぱりジョンウォンがリーダーでよかった。これからもついて行くㅠㅠㅠありがとう

yo~i

448,924 просмотров • 2 месяцев назад

Sora2でカット割り -> Grokで動画化 今回のMVは自作の「Sora2のカット割りツール」を使ったらどれだけ時短できるかの検証をしてみました。下記を満たすのを品質条件にした前提で作業自体は約1時間で終わりました ◇品質条件 --- ゆるいストーリー(気まずい二人のデート)をもった2分半の動画。同一人物の一貫性、彼らの背景など様々なカットを出して「喧嘩してる」「でも二人とも心の中ではそんな小さなことにとらわれてちゃいけないよな」と気づいてはいる、というところまで映像で曲をサポートできている ---- なのでこれをnano-bananaでひとつずつやってくと結構大変です。全体で40カットあるのでその生成と選定で結構時間かかります。 Sora2では「高速なカット割り」とプロンプトすると結構カットを切り替えてくれます。このカット割りがとても優秀なのでこれをフレーム抽出して使う人も増えています。しかし微妙に時間かかります。40カットをポチポチ選んでいく必要があります。 今回はSora2で12秒動画を3つだし、40カットほどのフレーム抽出をしました。 このフレーム抽出リプ欄で紹介しているツールを使うとほんとに数秒で終わります。(今回一番時短したかったポイント!) さて、今回はかなり怠惰な生成アプローチをしたいのでGrokにノープロンプトで投げ続けました。あとはそれをつないだだけです。もっとこだわれるところはめちゃくちゃありますが、今回は上記の品質さえ満たせばOKって感じなのでこの辺は妥協してます Sora2を待っている時間が多分一番長かったのです。Grokは早いですね。途中から僕はただのコピペマシンでしたw てかGrokこれだけじゃんじゃん生成できてクオリティ高いの普通にバグってるわ このSora2のフレーム抽出ツール、需要がありそうなのでちょっと体裁を整えて明日ごろに公開します。別にSora2の動画じゃなくても使えます。一気にフレーム抽出できるのは楽しいですよ!

yachimat - AI Short Anime

36,412 просмотров • 11 месяцев назад

サム・アントナッチくんは、ピッツバーグのブランドン・ロウさんとの一件について質問されました。 淡々とした話し方からは分かりにくいかもしれませんが、かなり熱のこもったインタビューでした。 インタビュアー: あそこでブランドン・ロウくんとの間に何があったのか、説明してもらえますか? サム・アントナッチくん: はい。満塁でした。彼がより難しい送球をしなきゃいけないように、できるだけ強くベースに突っ込みました。完全に合法なプレーです。ルールブックを見て、それから実際に何が起きたのかを見てください。ベースとの接触を保っている限り、どれだけ遅くスライディングしてもいい。それがまさに今回起きたことです。 今のこのゲーム、この時代では、多くの人がこういうプレーではただ力を抜くことに慣れていると思います。「シーズン162試合もあるんだから、早めに力を抜こう。相手と接触したくない」って。でも、ここではどんな方法でもいいから1点を取りにいっているんです。 接戦でしたし、こういう試合はプレーオフ争いにも関わってきます。だから、あそこで何としてでも1点をもぎ取りたかっただけです。 (次の発言は、特に英語圏の人たちが注目している部分です) 彼が素晴らしい人なのは分かっています。でも、最後に僕に対していくつか言いたいことがあったみたいです。それから、彼はそのまま立ち去りました。自分に何か問題があって、そんなふうに立ち去るんだったら……僕は話し合うことに何の問題もありません。 でも、僕のことを悪く言ったあとに、あんなふうに立ち去ることはできないでしょう。彼だって大人なんですから。でも、そうは言っても、向こうが試合に勝った。だから最後に笑ったのは向こうです。 インタビュアー: ロウくんがあなたにいくつか言ったと話していましたが、特に印象に残ったことはありましたか? アントナッチくん: たぶん彼は、そういう状況では選手が60フィートくらいのところで力を抜いて、そのままスライディングをやめるのに慣れているんだと思います。今はそういうのが普通になっていますから。 昔の野球について僕が語るつもりはありませんけど、当時は多くの選手が途中で力を抜いていたとは思いません。今ではそれが当たり前になっているんじゃないですかね。ここではどんな方法でもいいから1点を取りにいっているんです。昨日も同じことをしましたけど、彼は何も言いませんでした。ただ、少し何かをつぶやいていたのは聞こえました。 でも、僕としてはただ全力で野球をやっているだけです。ただ、他の人にはそういうふうには見えないみたいですね。 #WhiteSox

ホワイトソックス

55,108 просмотров • 11 дней назад

3Dの生成AI系で、「なんかクオリティ低ない?」って思う時は大体顔がガビガビしてます!衣装が多少ガビったところで全然気にならん! 人間の認知の仕組みなのかどうかは知らないけど、顔が綺麗だとモデル全体が綺麗に見える気がします! Tripo様からのPR依頼ですが、Tripoの紹介というより自分がやってるワークフローの共有になってます。 やり方!(Blenderで首つなぐやり方まで) 基本的には、綺麗に見せたいパーツに分割して生成するだけです! この例の場合は頭と体(衣装つき)を分けて生成しています。 もしできる方は髪の毛まで分割すると、かなり綺麗に見えるモデルになりますよ〜 Tripoのスマートメッシュの新しいやつのP2.0というモデルを使います! いずれの場合も「トポロジー」メニューから「四角面」のポリ数「25000」で! 入力画像を頭と体に分けて、それぞれ三面図を作ります。(今回体は正面図だけで作りました) デザインはチャッピーがおすすめで、三面図への整理はGemini(Nanobanana)がおすすめ なぜ分割するか?ですが、Tripoのスマートメッシュは生成できるポリゴン数に上限がある&テクスチャが1枚で出されます。(四角面25000ポリ三角面50000ポリ) その内で全身を一括生成してしまうと、ガビる箇所が出てくるというわけです。 今のP2.0は賢いので、一括生成でも顔や髪にポリゴンを集中させてはくれますが、それでもまだまだ実用的ではないです。 なので、顔25000+体25000で出すとめちゃくちゃ綺麗になるという仕組みです。テクスチャも分かれるのでより綺麗。 あと、AIモデル自体の生成の集中力(?)みたいなのが、一括でやると分散されてしまって、単純にポリ数の問題だけでなく造形力もガタ落ちすると感じました。 ⚪︎Tripoでの作業 Tripoでの作業はそこまで難しくないです。 画像読み込んでぽちぽち生成するだけ。 三面図はフルになくても大丈夫です。自分の場合は正面・右・背面だけでやりました。 生成したら、造形が気にいるまで無料再生成(テクスチャ生成後はできないので注意)→テクスチャ生成→エクスポート ファイル形式はFBXがおすすめ ⚪︎モデルの下処理 Blenderに読み込んだら、全てのモデルに対して編集モード→Aキーで頂点全選択→Mキーで「距離」で頂点をマージ。 あと、シェーディングが気になる人はデータタブ→形状データ→「カスタム法線データをクリア」 ⚪︎分割生成したモデルをくっつける 頭と体の位置を調整して、オブジェクトを右クリックから統合 ↓ お互いの首の切れ目とのループを選択(辺選択モードでAlt押しながらループ選択) ↓ 上のタブとかあるとこの「辺」→「辺ループのブリッジ」でメッシュが繋がる ↓ いい感じに頂点をいじいじして段差とか違和感をなくす あとはお好きなようにモデルを調整やら改変やらしてあげてください。 ここからは正直再現性のない領域だということが判明したので、頑張ってください(投げやり) ここまできたらボーンのセットアップはほとんど一般的なフローと同じなので、YouTubeとかでチュートリアル動画を見るのをオススメします〜 このモデルではVRMのボーンを入れました! 前のポストから色々研究してみましたが、「素体が出るか」もだいぶガチャで、まだまだ調整は難しいですね… 正直Blender玄人以外ボーン入れるのは難しいかも 初心者の方は、なるべくシンプルなTシャツ+ショートパンツで作った方が作りやすいです。 スカートとかの揺れものや、装飾があると難易度100倍くらいになるので… 安定して素体出す方法を研究してみます!

Nano(ナノ)

103,328 просмотров • 19 дней назад

『これは代表して言ったことです ENHYPENを代表して ほかのメンバーもみんな同じ考えです』 🐈皆さん、そして僕がこの言葉は必ず言わないとと思って、実はLiveを点けた理由があります …このままでは次へ行けないと思って点けたんだけど、えっと…これは翻訳されるんですよねweverseが。 僕達の以前の姿をすごく愛してくださって..そういう方が多いみたいです 以前の姿を好きでいてくださって、いまだに今の僕達ENHYPENの姿を否定される方がすごく多いようなのですが… それで今まで僕達がはっきりと話をしてこなかったから、とある方は僕達が"ちゃんと話していない"とメンバーの数について話をたくさんされるんですよ。 でも、もちろん以前のENHYPENを愛してくださっていた方達の気持ちも理解できますが、 今はもうENHYPENは6人です、皆さん…はい ENHYPENは6人ですし コンサートでそう言ったり、応援法も理解はできます 僕達が今まではっきり話してこなかったから 理解はできますが、何かそういうことの所為で ENGENEが互いに争っているのはあまり見ていて良くないですね はい、正直にいうとコンサートの妨げにもなっています、かなり。本当に正直。 うーん….まぁ今日こうして正確に話をしたので、これから本当にENHYPENを好きな方々、僕達を応援してくださる方達なら、どう行動なさるかはご自身がお分かりだと思います いやこれははっきりと僕が話しますね 曖昧に話したら伝わらないかもしれないので これから、"ENHYPEN is 7だ"とかそういう話は 正直ENGENE達同士争えという事ですよね それは、ファン同士で争うという事は誰も望んでいないじゃないですか 会社も望まないし、ENGENEも当然望まないだろうし、何よりも僕達6人が望まないので、 これからそういう紛争をこうして助長する方達は、 ファンではないと僕は思う事にします 僕もそうですし、実はこのLiveをこの事の為に点けたんです。この話をしようと メンバー達とも…メンバー達を代表して僕が来たんですし。はい。 同じ考えです他のメンバーも 僕達他の5人のメンバー達も なのでこれからは、そうなさらないでくださったら嬉しいです。本心です、はい。 先程も言いましたが、コンサートにも正直すごく神経を使いますし、とにかくお金を出して見に来てくださった方がいらっしゃいますし、すごく時間も長いし高額なコンサートなのに、すごくそういう方達にも迷惑ですし、はい とにかくもうそういう事らやめて下さったらと思います 多分翻訳されているので全てお分かりになったと思いますが だからといってブラジルやペルーのコンサートが良くなかった。そういうことではありませんよ。すごく素晴らしい、すごく良いコンサートでした。 なのでこれからすぐあるメキシコ公演も、楽しみにしています。 僕は皆さん、はっきりと言いましたよ これは代表して言ったことです。 ENHYPENを代表して。 ほかのメンバーもみんな同じ考えです。 はい。 やめて下さり、ただ少ししっかりご自身の考えを整理して下さったらと思います どちらにせよ僕達はENGENEの為に活動する人達なので、あのように見えるのは、あまり良くはありませんでした。互いに争う姿やそういうのは。 まさかこういうのを誰かにやらされて言っているんだとか、そういう人はいませんよね? 僕の考えです、皆さん もしも本当にそういう話出たなら、ファン同士争う事を望んでいる人なんだと思わないとです とにかく、そういう事です。

rinrin

158,316 просмотров • 2 месяцев назад

🗣️2026-27シーズンの契約継続および、3年間の複数年契約について チーム側からオファーをしていただいたことに、とても嬉しく思います。この3年で優勝狙うぞっていうチームからの強い思いがありましたし、すごく大切な存在だということを言われたので、その思いに報いたい、応えたいなっていう思いを込めて今回契約させてもらいました。 前回の複数年契約の時は、ライアンが来て新たな三河を作っていくっていうところでの土台作りという形だったんですけど、今回の複数年契約もヘッドコーチが変わるタイミングではあります。前のシーズンまで自分たちがしっかりと土台を作れた上に、その土台となるところからまた上に積み上がるものの契約だったので、前回と違うと言われれば違うと思うので、やっぱり今回の3年契約っていうのはすごく重みがあるのかなと感じます。 一緒のクラブで長いシーズンいる選手はあんまりいないと思うんですけど、正直なところ、そこまで他チームにいってプレーするっていう意欲は今まであまりありませんでした。チーム側からも自分のことをすごく大事にしているってことは、常に言われていたので、その思いも含めて三河でやりたいなっていう気持ちがずっとありました。 あとは自分が小さい頃から三河っていうのはすごく強いチームで、そういったチームで自分がプレーでできるっていうのはすごく誇りに思っています。自分の親も家族もみんな三河というチームが昔からあるっていうのは知っているので、そこでプレーできているっていうのはすごく嬉しいことだよねっていうことを常に言っています。そういうチームで長年こうやって自分がプレーできるってことはすごく嬉しく思います。 長野誠史 #長野誠史 #シーホース三河

シーホース三河

118,056 просмотров • 3 месяцев назад

つぼみ大革命のワンマンライブ、自分が書く最後のライブが終わりました。 ダイジェスト動画作ってみました😌 映像にもこだわったり、セリフや演出には今までのすべてを詰め込みました...。 つぼみ大革命はあと一ヶ月で活動終了します。 メンバーと過ごして15年、ライブ演出はじめて10年が経ちました。 こんなに長い青春をさせてもらえて幸せです。 裏方としてのクリエイティブの楽しさをつぼみ大革命に教わりました。 文字通り寝食を忘れて没頭してきたし、これ以上に命削って注げることはもう人生でないかもしれないと思います。 どれだけ寝てなくても間に合ってなくても毎日みんなでゲラゲラ笑いながらやる稽古がすごく楽しかったし、間違いなく全員の生きがいでした。 映像作らせてもらったり、いつしか曲まで作らせてもらったり、普通の人生じゃ味わえない、クリエイティブのキッザニアみたいなことをつぼみ大革命に味わわせてもらって、すごく感謝してます。 つぼみ大革命は、テレビでの私のキャラとか、私がボケで名前出しちゃうのもあってナメられがちやったけど、ほんまはめっちゃくちゃかっこいいライブパフォーマンスしてて、だからその場のお笑いの流れをぶち壊してでも、今のつぼみ大革命はめっちゃカッコいいんですって言えばよかったなと今になって思います。 こんなに熱くて面白いライブ、本当は生のエネルギーを感じてほしいけど、配信でもじゅうぶん面白いと思うので、配信アーカイブでぜひ見てほしいです。6/8まで見られます。 (つぼみ大革命ルミネワンマンで検索したらすぐに見逃しチケット出てきます。) そしてつぼみ大革命はまだあと一ヶ月あるので、私が書くワンマンライブは最後でしたが、ぜひ会いに行ってみてほしいです。

3時のヒロイン 福田麻貴

47,666 просмотров • 1 год назад

先日、SUNOで生成されたものをmp3でダウンロードするか wavでダウンロードするか、で音質が違うという話題を見かけました。 SUNOもACE Studioも(というかAI生成全部かもしれない) mp3で生成されます。 SUNOの場合、生成された状態はmp3でもwavでダウンロードを掛けると何かしらのフィルターが掛かって書き出されるのか それともコンバートの精度なのか、音は変わるっぽい。 その話題で、初心者の方々に誤った勘違いが起こっているのをちょこちょこ見かけました。 ここからはSUNOやAI生成の話ではないです。 WAVやAIFFからmp3やAACに変換された音声は 圧縮するために情報量が削られます。 この動画を見ていただければ、元は同じファイルでも mp3の方は上が無くなっている事が分かると思います。 で、この状態のmp3やAACを、wavやAIFFに変換しても 容量が増えるだけで失った音質は戻ってきません。 なので「wavの方が音が良い」は、この状態になってしまったファイルには当てはまりません。 mp3と全く同じ音のまま容量が増えるだけです。 ちなみに、Logic Proはmp3やAACを取り込むと 自動的に設定しているwavかAIFFに変換されます。 ※DAWによっては、そのままmp3を扱うものと、wavに変換されるものがあります。 そのまま再生するとmp3と全く同じ音になります。 では、なぜDAWに入れた際にwavに変換されるのか? フェーダー操作やPluginを掛けていった際に、mp3とwavで結果が変わる点と mp3やAACを再生するために都度デコードしながら再生するので、無駄な負荷が掛かるためです。 とはいえ、現代のパソコンでこの程度の負荷は誤差の範囲ですが デコードしながらプラグインも掛ける行為が安定しているとはいえない、とされているからの様です。 ここでSUNOの話に戻します。 なので、SUNOで生成されたファイルをmp3でダウンロードした後に それを何かしらのソフトでwavに変換しただけの状態では 無駄に容量が増えただけで音質は変わっていない、という事です。 (先に書いたように、SUNOからのダウンロードにおいてはmp3とwavは音が違うようです。) その後、何かしらの変化を行った場合にwavが活きてくる。 何も変化を起こさない2mixのままならmp3のままでいい、という事になります。 ※一部、特殊な音声圧縮フォーマット「FLAC」は 元の音質に戻ります。

くうP

84,546 просмотров • 4 месяцев назад

今回は自分の中では、一番作り込んだ動画です📽️✨ 動画編集ソフトのdavinci resolve studioを導入して、音楽のタイミングも含めて編集に気を使いました。 私なりに楽しんでいただけるものを目指したつもりなので、最後までご覧いただけたら嬉しいです🥹 --- #TapNow #10000ParallelUniverses TapNowの「1万の並行宇宙」グローバル・クリエイティブ・コンテストへの応募作品でもあります。 コンテストへの参加は依頼ではなく、挑戦してみたい気持ちが芽生えたので自発的に応募しました♪(*ˊᵕˋ*) 動画も、大きな困難に向かって、主人公が懸命に挑戦する姿を描きました。 ✨✨✨ この動画だけではちょっと分かりにくいのですが、巨大な像は宝を守っていたのではなく、「叡智を託すに相応しい相手を待っていた」という設定があります。 どこか優しい雰囲気で、眠るように崩れていくのはそれが反映されています😌 今回はダイジェストみたいなもので、継続的にシリーズとして展開することも考えています。 王道アドベンチャーにしてもいいですし、宇宙人が作った遺跡ということでSF寄りにしたりするのも面白いかもしれませんね。 今のところ、分かりやすくするためにオーソドックスなデザインにしてありますが、もっと凝った感じにするのも良いですね。 ✨✨✨ 今回のコンテストは、あなたの応援(インタラクション)が今後の活動への大きな力となります。 Xだけじゃなくて、TapTV内でのリアクションが大事なのかもしれません。 応援よろしくお願いします(*・ω・)*_ _)ペコリ

ほしみこ

40,852 просмотров • 3 месяцев назад