[Question] Shared and Host Buffers can offer the same overall performance on Intel Integrated Graphics?
Dieses Issue hat noch niemand übernommen.
Bewertung
- Schwierigkeit
- 5/5
- Geschätzter Aufwand
- Über eine Woche
- Anfängerfreundlichkeit
- 15/100
- Issue-Typ
- Bug
- Klarheit
- Muss geklärt werden
- Aktivitätsstatus
- Veraltet
- Tech-Stack
- cpp
- Bereich
- performance
Rechercherichtung
Beginne mit der Anwendung sharedMemoryEffect im verlinkten Repository codeBlogArticles und vergleiche deren Läufe mit host-buffer und shared-buffer mit den im Blog berichteten Ergebnissen. Im Issue wird keine Level Zero-Quelldatei und kein zu ändernder Test genannt; als erledigt würde gelten, die memory-bound- und compute-bound-Fälle zu reproduzieren und festzustellen, ob die beobachtete Performance auf integrierten Intel-Grafikprozessoren erwartungsgemäß ist.
Vom Indexierungsmodell aus dem Issue-Text verfasst.
Beschreibung
I am interested in analyzing the overall performance (end-to-end applications) when using different types of buffer allocation. I wrote this blog-entry for reference:
https://jjfumero.github.io/posts/2022/05/overall-performance-of-unified-shared-memory-level-zero/
What I saw was that running an application with host buffers offers the same performance as running with shared memory buffers. My understanding is that, when running applications using shared memory buffers, the GPU driver can migrate the buffers from the host to the device, while host memory will be accessed from the device every time a data item is required. I have two scenarios: a) memory-bound and b) compute-bound. I was surprised to see that, when running the memory-bound case, the overall performance was very similar when allocating buffers using host memory only, and shared memory only. Is this performance expected when running on Intel Integrated graphics?
If you want to reproduce all numbers, the whole application is available here: https://github.com/jjfumero/codeBlogArticles/tree/master/may2022/sharedMemoryEffect
- Vorherrschende Sprache
- C++
- Sterne
- 335
- Forks
- 140
- Ø Merge
- 12 Std. 32 Min.
- Gemergte PRs (30 T.)
- 5
Beitragsleitfaden
Erste Schritte
- Lesen Sie das ganze Issue und danach den Beitragsleitfaden des Projekts.
- Schreiben Sie ins Issue, dass Sie es übernehmen — das erspart doppelte Arbeit.
- Forken Sie das Repository und arbeiten Sie in einem Branch.
- Öffnen Sie einen Pull Request, der die Issue-Nummer nennt.
Mehr aus oneapi-src/level-zero
-
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 84/100
oneapi-src/level-zero#495 ·
-
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 72/100
oneapi-src/level-zero#485 ·
-
Schwierigkeit 1/5 Unter einer Stunde Anfängerfreundlichkeit 76/100
oneapi-src/level-zero#447 · 2 Kommentare ·
-
Need DMA/RDMA support Offen
Schwierigkeit 5/5 Über eine Woche Anfängerfreundlichkeit 30/100
oneapi-src/level-zero#482 · 1 Kommentar ·
-
Schwierigkeit 4/5 3-5 Tage Anfängerfreundlichkeit 25/100
oneapi-src/level-zero#419 ·
Alle Issues in oneapi-src/level-zero
Ähnliche Issues
-
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 86/100
-
Sensor initialization takes very long when `--initial-sim-time` is set to current UNIX timestamp Offen
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 78/100
gazebosim/gz-sensors#662 · 1 Kommentar ·
-
enhancement
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 76/100
-
comp-datalake
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 88/100
ClickHouse/ClickHouse#121222 ·
-
Schwierigkeit 2/5 1-3 Stunden Anfängerfreundlichkeit 68/100
LadybirdBrowser/ladybird#12123 ·