OpenMathLib / OpenMathLib/OpenBLAS

how to use parallel potrf

オープン
#5,246 コメント 4 件 リアクション 0 件 担当者 0 名 GitHub で見る

まだ誰も着手していません。

主要言語
C
スター
7.6k
フォーク
1.7k
平均マージ
1日 3時間
マージ済み PR(30日)
42

説明

I am currently using the develop version of OpenBLAS which was built with simpe make , and I'm trying to utilize the parallel version of the POTRF function. However, I am encountering issues with parallel execution.
Here is the core code.

#include "cblas.h"
#include "lapacke.h"
// ...

info = LAPACKE_spotrf(LAPACK_ROW_MAJOR, 'L', n, A, n);

matrix sizes ranging from 36000 x 36000 to 60000 x 60000 and runs on a 256 core tsv110 architecture machine.
I have set OPENBLAS_NUM_THREADS=20, but when I monitor the process with the top command, I observe that only one core is being utilized.

コントリビューションガイド

このリポジトリのコントリビューションガイドは索引されていません

はじめの一歩

  1. issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
  2. 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
  3. リポジトリをフォークし、ブランチを切って変更します。
  4. issue 番号を参照したプルリクエストを送ります。

調査の方向性

ソースファイルもテストも指定されていません。LAPACKE_spotrf エントリポイントと単純な make ビルド構成から始め、報告された TSV110 セットアップで OPENBLAS_NUM_THREADS が並列 POTRF にどのような影響を与えるかを確認してください。必要な構成と予想されるスレッド動作を文書化してください。

索引モデルが issue の本文から書いたものです。

評価

技術スタック
c
領域
hpc, performance
issue の種類
ドキュメント
難易度
4/5
見積もり時間
3〜5日
活発さ
停滞
明瞭さ
説明が足りない
初心者へのやさしさ
20/100

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。