bigscience-workshop / bigscience-workshop/data_tooling

Create dataset global_voices_portuguese

Ouverte
#153 0 commentaires 0 réactions 0 personnes assignées Voir sur GitHub
data catalog
Langage dominant
HTML
Étoiles
91
Forks
47
Métriques de merge des PR
Aucune PR mergée en 30 j

Description

- uid: global_voices_portuguese
- type: primary
- description:
- name: Global Voices Portuguese
- description: Global Voices pages in Portuguese
- homepage: https://pt.globalvoices.org/
- validated: True
- languages:
- language_names:
- Portuguese
- language_comments:
- language_locations:
- Americas
- Europe
- Western Africa
- Timor-Leste
- validated: False
- custodian:
- name:
- in_catalogue: global_voices
- type:
- location:
- contact_name:
- contact_email:
- contact_submitter: False
- additional:
- validated: False
- availability:
- procurement:
- for_download: Yes - it has a direct download link or links
- download_url: https://pt.globalvoices.org/
- download_email:
- licensing:
- has_licenses: Yes
- license_text: https://globalvoices.org/about/global-voices-attribution-policy/
- license_properties:
- open license
- license_list:
- cc-by-3.0: Creative Commons Attribution 3.0 Unported
- pii:
- has_pii: Yes
- generic_pii_likely: very likely
- generic_pii_list:
- names
- email addresses
- numeric_pii_likely: somewhat likely
- numeric_pii_list:
- telephone numbers
- sensitive_pii_likely: very likely
- sensitive_pii_list:
- racial or ethnic origin
- political opinions
- religious or philosophical beliefs
- no_pii_justification_class:
- no_pii_justification_text:
- validated: False
- source_category:
- category_type: website
- category_web: news or magazine website
- category_media:
- validated: False
- media:
- category:
- text
- text_format:
- .HTML
- audiovisual_format:
- image_format:
- database_format:
- text_is_transcribed: No
- instance_type: article
- instance_count: 1K

Guide de contribution

Aucun guide de contribution indexé pour ce dépôt

Piste de recherche

Créez global_voices_portuguese.json à partir de l’enregistrement complet du dataset dans l’issue. Commencez par localiser les fichiers de catalogue de datasets existants dans le dépôt et comparez leur structure, puis ajoutez le nouvel enregistrement et vérifiez que son nom de fichier, ses champs, ses URLs, sa langue, sa licence et ses métadonnées de confidentialité correspondent à l’issue.

Rédigé par le modèle d'indexation à partir du texte de l'issue.

Évaluation

Domaine
data
Type d'issue
Fonctionnalité
Difficulté
2/5
Temps estimé
1-3 heures
Activité
À l'abandon
Clarté
Plutôt claire
Accessibilité débutants
45/100

Recevez les nouvelles issues par e-mail

Un résumé court des issues GitHub adaptées aux débutants.