Video wird geladen...
Video konnte nicht geladen werden
MVDiffusion: How to take a pre-trained text2image model for a perspective view (e.g., Stable Diffusion) and retrain to generate multiple consistent views (e.g., a panorama). Project site: Hugging Face demo: Code out in a month.
33,456 Aufrufe • vor 3 Jahren •via X (Twitter)
8 Kommentare

Yasutaka Furukawavor 3 Jahren
I am very sorry. Typo fixing. Had to delete the old one and retweet.

Yasutaka Furukawavor 3 Jahren
I had to delete and repost. Highly appreciate it if you could reshare/retweet this post

Ziyu Wanvor 3 Jahren
Awesome work!!!!! I wonder where we could find the paper😊

Yasutaka Furukawavor 3 Jahren
Thank you Ziyu. Did not realize that we haven't uploaded to arxiv yet... Asking students to upload in a day.

Jake Harrisonvor 3 Jahren
I would add to my newsletter

Philipp Tsipmanvor 3 Jahren
🔥

Asriel Hvor 3 Jahren
does it support image prompt as input or only text prompt?

Yasutaka Furukawavor 3 Jahren
Only text for this work. But it seems trivial to add image-prompt capability.
