huggingface / huggingface/diffusers
Difference in Output When Using PIL.Image vs numpy.array for Image and Mask Input.
- Vorherrschende Sprache
- Python
- Sterne
- 34.5k
- Forks
- 7.3k
- Ø Merge
- 3 T. 3 Std.
- Gemergte PRs (30 T.)
- 91
Beschreibung
hi.
I get different results when providing image and mask as input using PIL.Image versus numpy. array. Why does this happen?
Is there an issue with my normalization method?
| pillow | array |
|---|---|
|  |  |
#### pillow code
```python
image = Image.open(image_path).convert("RGB")
mask = Image.open(mask_path).convert("L")
output_image = pipeline(
image=image,
mask_image=mask,
generator=torch.Generator(device=self.device).manual_seed(0),
).images[0]
```
#### array code
```python
image = Image.open(image_path).convert("RGB")
mask = Image.open(mask_path).convert("L")
image_array = np.array(image) / 255.0
mask_array = np.array(mask) / 255.0
output_image = pipeline(
image=image_array,
mask_image=mask_array,
generator=torch.Generator(device=self.device).manual_seed(0),
).images[0]
```
Beitragsleitfaden
Rechercherichtung
Beginne damit, den Pipeline-Aufruf mit den PIL-Eingaben und den im Issue gezeigten normalisierten NumPy-Arrays unter Verwendung desselben Seeds zu reproduzieren. Verfolge, wie die Pipeline jeden Eingabetyp verarbeitet, und bestimme, ob die unterschiedliche Ausgabe erwartet wird oder auf ein Konvertierungsproblem hindeutet; abgeschlossen ist die Aufgabe, wenn die Ursache und die korrekte Eingabenormalisierung dokumentiert sind.
Vom Indexierungsmodell aus dem Issue-Text verfasst.
Bewertung
- Tech-Stack
- numpy, python, pytorch
- Bereich
- computer-vision, machine-learning
- Issue-Typ
- Bug
- Schwierigkeit
- 4/5
- Geschätzter Aufwand
- 3-5 Tage
- Aktivitätsstatus
- Veraltet
- Klarheit
- Muss geklärt werden
- Anfängerfreundlichkeit
- 25/100