CodeForPhilly / CodeForPhilly/scorecard
PDF summary.
- Lingua principale
- Jupyter Notebook
- Stelle
- 3
- Fork
- 0
- Metriche di merge delle PR
- Nessuna PR unita negli ultimi 30g
Descrizione
The web scraper only scrapes and summarizes HTML pages. PDF files are skipped. As an enhancement, the script can extract the text from the PDF and summarize the PDF contents.
Guida per i contributori
Nessuna guida per i contributori indicizzata per questo repository
Direzione di ricerca
Individua il web scraper e il percorso esistente per la sintesi HTML, quindi traccia il modo in cui vengono gestiti i file PDF ignorati. Il lavoro è completato quando il testo dei PDF viene estratto e sintetizzato insieme alle pagine HTML; l’issue non indica file o test specifici, quindi è necessario esplorare prima la struttura del repository.
Scritto dal modello di indicizzazione a partire dal testo della issue.
Valutazione
- Stack tecnologico
- jupyter-notebook
- Ambito
- backend
- Tipo di issue
- Funzionalità
- Difficoltà
- 4/5
- Tempo stimato
- 3-5 giorni
- Stato di attività
- Ferma
- Chiarezza
- Abbastanza chiara
- Idoneità per principianti
- 45/100