modelscope / modelscope/DiffSynth-Studio
QwenImageVAE tiled decode未实现?
Nessuno ha ancora preso questa issue.
- Lingua principale
- Python
- Stelle
- 13.1k
- Fork
- 1.3k
- Merge medio
- 13h 12m
- PR unite (30g)
- 45
Descrizione
我看到尽管QwenImagePipeline.__call__有把tiled, tile_size, tile_stride参数传入self.vae.decode,但QwenImageVAE.decode只是用**kwargs接收,并没有实际用到。
https://github.com/modelscope/DiffSynth-Studio/blob/afd101f3452c9ecae0c87b79adfa2e22d65ffdc3/diffsynth/pipelines/qwen_image.py#L444
https://github.com/modelscope/DiffSynth-Studio/blob/afd101f3452c9ecae0c87b79adfa2e22d65ffdc3/diffsynth/models/qwen_image_vae.py#L716
我对模型原理了解有限,想请教一下:请问是 功能暂未实现 还是 QwenImageVAE模型架构本身就无法支持tiled decoding?感谢您的时间和贡献!
Guida per i contributori
Nessuna guida per i contributori indicizzata per questo repository
Come iniziare
- Leggi tutta la issue e poi la guida ai contributi del progetto.
- Commenta sulla issue per dire che te ne occupi tu — evita che due persone facciano lo stesso lavoro.
- Fai un fork del repository e lavora su un branch.
- Apri una pull request che faccia riferimento al numero della issue.
Direzione di ricerca
Inizia dal punto di ingresso collegato QwenImagePipeline.call in diffsynth/pipelines/qwen_image.py e segui gli argomenti tiled, tile_size e tile_stride fino a QwenImageVAE.decode in diffsynth/models/qwen_image_vae.py. Determina se questo VAE supporta la decodifica a tasselli e se gli argomenti inutilizzati rappresentano funzionalità mancanti; il lavoro è completato quando il comportamento è stato chiarito ed è coperto da una validazione o spiegazione appropriata.
Scritto dal modello di indicizzazione a partire dal testo della issue.
Valutazione
- Stack tecnologico
- python
- Ambito
- machine-learning
- Tipo di issue
- Funzionalità
- Difficoltà
- 4/5
- Tempo stimato
- 3-5 giorni
- Stato di attività
- Ferma
- Chiarezza
- Abbastanza chiara
- Idoneità per principianti
- 35/100