bigscience-workshop / bigscience-workshop/biomedical

Create dataset loader for RuMedNLI

Ouverte
#653 0 commentaires 0 réactions 0 personnes assignées Voir sur GitHub
DUA English New Dataset NLI Russian
Langage dominant
Python
Étoiles
505
Forks
117
Métriques de merge des PR
Aucune PR mergée en 30 j

Description

## Adding a Dataset
- **Name:** *RuMedNLI*
- **Description:** *There is a shortage of text medical resources for the Russian language. This is a substantial obstacle in state-of-the-art NLP deep learning models research and development.. This dataset is a translated the MedNLI data from English to Russian*
- **Task:** *NLI*
- **Data:** *https://physionet.org/content/rumednli-russian-inference/1.0.0/*
- **License:** *PhysioNet license*
- **Motivation:** *Russian language dataset*

Guide de contribution

Ouvrir le guide de contribution

Piste de recherche

Aucun fichier ni test n’est indiqué. Commencez par examiner les chargeurs de datasets existants du dépôt et la source de RuMedNLI à l’URL PhysioNet indiquée ; le travail sera terminé lorsque le dataset russe de NLI pourra être chargé de manière cohérente avec les autres datasets biomédicaux du projet et que sa licence PhysioNet sera représentée.

Rédigé par le modèle d'indexation à partir du texte de l'issue.

Évaluation

Stack technique
python
Domaine
data, machine-learning
Type d'issue
Fonctionnalité
Difficulté
3/5
Temps estimé
1-2 jours
Activité
À l'abandon
Clarté
Plutôt claire
Accessibilité débutants
45/100

Recevez les nouvelles issues par e-mail

Un résumé court des issues GitHub adaptées aux débutants.