modelscope / modelscope/DiffSynth-Studio

QwenImageVAE tiled decode未实现?

Abierto
#1,069 0 comentarios 0 reacciones 0 asignados Ver en GitHub

Nadie ha tomado este issue todavía.

Lenguaje dominante
Python
Estrellas
13.1k
Forks
1.3k
Merge medio
13 h 12 min
PR fusionados (30 d)
45

Descripción

我看到尽管QwenImagePipeline.__call__有把tiled, tile_size, tile_stride参数传入self.vae.decode,但QwenImageVAE.decode只是用**kwargs接收,并没有实际用到。
https://github.com/modelscope/DiffSynth-Studio/blob/afd101f3452c9ecae0c87b79adfa2e22d65ffdc3/diffsynth/pipelines/qwen_image.py#L444
https://github.com/modelscope/DiffSynth-Studio/blob/afd101f3452c9ecae0c87b79adfa2e22d65ffdc3/diffsynth/models/qwen_image_vae.py#L716
我对模型原理了解有限,想请教一下:请问是 功能暂未实现 还是 QwenImageVAE模型架构本身就无法支持tiled decoding?感谢您的时间和贡献!

Guía de contribución

No hay ninguna guía de contribución indexada para este repositorio

Primeros pasos

  1. Lee el issue completo y luego la guía de contribución del proyecto.
  2. Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
  3. Haz un fork del repositorio y trabaja en una rama.
  4. Abre un pull request que haga referencia al número del issue.

Línea de trabajo

Comienza en el punto de entrada enlazado QwenImagePipeline.call en diffsynth/pipelines/qwen_image.py y sigue los argumentos tiled, tile_size y tile_stride hasta QwenImageVAE.decode en diffsynth/models/qwen_image_vae.py. Determina si este VAE admite la decodificación por teselas y si los argumentos no utilizados representan funcionalidad faltante; se considera terminado cuando el comportamiento esté resuelto y cubierto por una validación o explicación adecuada.

Escrito por el modelo de indexación a partir del texto del issue.

Evaluación

Stack tecnológico
python
Área
machine-learning
Tipo de issue
Nueva funcionalidad
Dificultad
4/5
Tiempo estimado
3-5 días
Estado de actividad
Estancado
Claridad
Bastante claro
Aptitud para principiantes
35/100

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.