OpenMathLib / OpenMathLib/OpenBLAS
how to use parallel potrf
まだ誰も着手していません。
- 主要言語
- C
- スター
- 7.6k
- フォーク
- 1.7k
- 平均マージ
- 1日 3時間
- マージ済み PR(30日)
- 42
説明
I am currently using the develop version of OpenBLAS which was built with simpe make , and I'm trying to utilize the parallel version of the POTRF function. However, I am encountering issues with parallel execution.
Here is the core code.
#include "cblas.h"
#include "lapacke.h"
// ...
info = LAPACKE_spotrf(LAPACK_ROW_MAJOR, 'L', n, A, n);
matrix sizes ranging from 36000 x 36000 to 60000 x 60000 and runs on a 256 core tsv110 architecture machine.
I have set OPENBLAS_NUM_THREADS=20, but when I monitor the process with the top command, I observe that only one core is being utilized.
コントリビューションガイド
このリポジトリのコントリビューションガイドは索引されていません
はじめの一歩
- issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
- 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
- リポジトリをフォークし、ブランチを切って変更します。
- issue 番号を参照したプルリクエストを送ります。
調査の方向性
ソースファイルもテストも指定されていません。LAPACKE_spotrf エントリポイントと単純な make ビルド構成から始め、報告された TSV110 セットアップで OPENBLAS_NUM_THREADS が並列 POTRF にどのような影響を与えるかを確認してください。必要な構成と予想されるスレッド動作を文書化してください。
索引モデルが issue の本文から書いたものです。
評価
- 技術スタック
- c
- 領域
- hpc, performance
- issue の種類
- ドキュメント
- 難易度
- 4/5
- 見積もり時間
- 3〜5日
- 活発さ
- 停滞
- 明瞭さ
- 説明が足りない
- 初心者へのやさしさ
- 20/100