Rely more on the driver for input checks to reduce latency
Personne n'a encore pris cette issue.
- Langage dominant
- Cython
- Étoiles
- 3.4k
- Forks
- 329
- Merge moyen
- 1 j 23 h
- PR mergées (30 j)
- 116
Description
Instead of doing all of these checks in Python, if we just set the options as passed and try the launch, does CUDA error gracefully where we can post process the error code to make it meaningful to the user? Doing all of these checks in Python feels expensive and will hurt kernel launch latency.
Originally posted by @kkraus14 in https://github.com/NVIDIA/cuda-python/pull/676#discussion_r2126787942
Guide de contribution
Ouvrir le guide de contribution
Par où commencer
- Lisez l'issue en entier, puis le guide de contribution du projet.
- Signalez en commentaire que vous la prenez — cela évite que deux personnes fassent le même travail.
- Forkez le dépôt et travaillez sur une branche.
- Ouvrez une pull request qui référence le numéro de l'issue.
Piste de recherche
L’issue ne nomme aucun fichier, test ou point d’entrée. Examinez les vérifications d’entrée côté Python ainsi que le chemin de lancement et de gestion des erreurs de CUDA, puis déterminez quelles vérifications peuvent être déléguées sans risque et comment rendre les erreurs du pilote compréhensibles pour les utilisateurs. Le travail est terminé lorsque la latence de lancement est réduite sans perdre les erreurs d’entrée utiles.
Rédigé par le modèle d'indexation à partir du texte de l'issue.
Évaluation
- Stack technique
- python
- Domaine
- performance
- Type d'issue
- Refactorisation
- Difficulté
- 5/5
- Temps estimé
- Plus d'une semaine
- Activité
- À l'abandon
- Clarté
- À clarifier
- Accessibilité débutants
- 25/100