huggingface / huggingface/diffusers

Add support to Meissonic

Aperta
#9,794 7 commenti 0 reazioni 0 assegnatari Vedi su GitHub
contributions-welcome stale
Lingua principale
Python
Stelle
34.5k
Fork
7.3k
Merge medio
3g 3h
PR unite (30g)
91

Descrizione

Meissonic is a non-autoregressive mask image modeling text-to-image synthesis model that can generate high-resolution images. It is designed to run on consumer graphics cards.

The model checkpoint can be found in https://huggingface.co/MeissonFlow/Meissonic
The inference code can be found in https://github.com/viiika/Meissonic
The paper can be found in https://arxiv.org/abs/2410.08261

Anyone interested in implementing this?

Guida per i contributori

Apri la guida per i contributori

Direzione di ricerca

Start with the Meissonic checkpoint, linked inference code, and paper to understand the model and expected behavior. Then identify the integration surface in diffusers and validate that the added support reproduces the linked inference results; done means Meissonic can generate high-resolution images on consumer graphics cards.

Scritto dal modello di indicizzazione a partire dal testo della issue.

Valutazione

Stack tecnologico
huggingface, python, pytorch
Ambito
computer-vision, machine-learning
Tipo di issue
Funzionalità
Difficoltà
5/5
Tempo stimato
Più di una settimana
Stato di attività
Ferma
Chiarezza
Da chiarire
Idoneità per principianti
30/100

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.