modelscope / modelscope/DiffSynth-Studio
QwenImageVAE tiled decode未实现?
Nadie ha tomado este issue todavía.
- Lenguaje dominante
- Python
- Estrellas
- 13.1k
- Forks
- 1.3k
- Merge medio
- 13 h 12 min
- PR fusionados (30 d)
- 45
Descripción
我看到尽管QwenImagePipeline.__call__有把tiled, tile_size, tile_stride参数传入self.vae.decode,但QwenImageVAE.decode只是用**kwargs接收,并没有实际用到。
https://github.com/modelscope/DiffSynth-Studio/blob/afd101f3452c9ecae0c87b79adfa2e22d65ffdc3/diffsynth/pipelines/qwen_image.py#L444
https://github.com/modelscope/DiffSynth-Studio/blob/afd101f3452c9ecae0c87b79adfa2e22d65ffdc3/diffsynth/models/qwen_image_vae.py#L716
我对模型原理了解有限,想请教一下:请问是 功能暂未实现 还是 QwenImageVAE模型架构本身就无法支持tiled decoding?感谢您的时间和贡献!
Guía de contribución
No hay ninguna guía de contribución indexada para este repositorio
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Línea de trabajo
Comienza en el punto de entrada enlazado QwenImagePipeline.call en diffsynth/pipelines/qwen_image.py y sigue los argumentos tiled, tile_size y tile_stride hasta QwenImageVAE.decode en diffsynth/models/qwen_image_vae.py. Determina si este VAE admite la decodificación por teselas y si los argumentos no utilizados representan funcionalidad faltante; se considera terminado cuando el comportamiento esté resuelto y cubierto por una validación o explicación adecuada.
Escrito por el modelo de indexación a partir del texto del issue.
Evaluación
- Stack tecnológico
- python
- Área
- machine-learning
- Tipo de issue
- Nueva funcionalidad
- Dificultad
- 4/5
- Tiempo estimado
- 3-5 días
- Estado de actividad
- Estancado
- Claridad
- Bastante claro
- Aptitud para principiantes
- 35/100