allenai / allenai/pdffigures2

Unable to extract all images from PDF

Aperta
#59 0 commenti 0 reazioni 0 assegnatari Vedi su GitHub
Lingua principale
Scala
Stelle
759
Fork
130
Metriche di merge delle PR
Nessuna PR unita negli ultimi 30g

Descrizione

When I use the `pdffigures2` to extract images from a PDF, there are often images that are overlooked. For example, it extracts only 3 images from a PDF file that contains 5 images.
I guess maybe `pdffigures2` uses default parameters such as "image size" or "resolution" to filter some images?
Can you give me some advice or clues?
Thank you for your assistance.

Guida per i contributori

Nessuna guida per i contributori indicizzata per questo repository

Valutazione

Questa issue non è ancora stata valutata.

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.