NVIDIA / NVIDIA/cuda-python

Rely more on the driver for input checks to reduce latency

Ouverte
#685 0 commentaires 0 réactions 0 personnes assignées Voir sur GitHub

Personne n'a encore pris cette issue.

cuda.core enhancement P1
Langage dominant
Cython
Étoiles
3.4k
Forks
329
Merge moyen
1 j 23 h
PR mergées (30 j)
116

Description

Instead of doing all of these checks in Python, if we just set the options as passed and try the launch, does CUDA error gracefully where we can post process the error code to make it meaningful to the user? Doing all of these checks in Python feels expensive and will hurt kernel launch latency.

Originally posted by @kkraus14 in https://github.com/NVIDIA/cuda-python/pull/676#discussion_r2126787942

Guide de contribution

Ouvrir le guide de contribution

Par où commencer

  1. Lisez l'issue en entier, puis le guide de contribution du projet.
  2. Signalez en commentaire que vous la prenez — cela évite que deux personnes fassent le même travail.
  3. Forkez le dépôt et travaillez sur une branche.
  4. Ouvrez une pull request qui référence le numéro de l'issue.

Piste de recherche

L’issue ne nomme aucun fichier, test ou point d’entrée. Examinez les vérifications d’entrée côté Python ainsi que le chemin de lancement et de gestion des erreurs de CUDA, puis déterminez quelles vérifications peuvent être déléguées sans risque et comment rendre les erreurs du pilote compréhensibles pour les utilisateurs. Le travail est terminé lorsque la latence de lancement est réduite sans perdre les erreurs d’entrée utiles.

Rédigé par le modèle d'indexation à partir du texte de l'issue.

Évaluation

Stack technique
python
Domaine
performance
Type d'issue
Refactorisation
Difficulté
5/5
Temps estimé
Plus d'une semaine
Activité
À l'abandon
Clarté
À clarifier
Accessibilité débutants
25/100

Recevez les nouvelles issues par e-mail

Un résumé court des issues GitHub adaptées aux débutants.