apache / apache/hugegraph-computer
improve(core): vertices and edges loading optimization
- 主要言語
- Java
- スター
- 65
- フォーク
- 52
- PR マージ指標
- 30日以内にマージされた PR はありません
説明
### Feature Description (功能描述)
`ComputerOptions.INPUT_FILTER_CLASS` default value is `DefaultInputFilter`.
`org.apache.hugegraph.computer.core.input.filter.DefaultInputFilter`
```java
public class DefaultInputFilter implements InputFilter {
@Override
public Vertex filter(Vertex vertex) {
vertex.properties().clear();
return vertex;
}
@Override
public Edge filter(Edge edge) {
edge.properties().clear();
return edge;
}
}
```
Load all properties first, then clear.
Could we specify some properties when loading vertices or edges? May could improve performance.
Just like mysql:
```sql
select a, b, c
```
instead of
```sql
select *
```
`org.apache.hugegraph.computer.core.input.hg.HugeVertexFetcher`
```java
@Override
public Iterator fetch(InputSplit split) {
Shard shard = toShard(split);
return this.client().traverser().iteratorVertices(shard,
this.pageSize());
}
```
But it seems that the traverser api does not yet support specifying some properties to load vertices or edges on the server side.
コントリビューションガイド
このリポジトリのコントリビューションガイドは索引されていません
調査の方向性
まず DefaultInputFilter と HugeVertexFetcher を読み、次に iteratorVertices が使用する traverser API を調べて、サーバー側でのプロパティ選択がサポートされているかどうかを確認します。頂点とエッジの読み込みで、すべてのプロパティを読み込んで後から削除するのではなく、選択したプロパティだけを要求できるようになれば、issue は完了です。
索引モデルが issue の本文から書いたものです。
評価
- 技術スタック
- java
- 領域
- distributed-systems
- issue の種類
- 機能追加
- 難易度
- 5/5
- 見積もり時間
- 1週間以上
- 活発さ
- 停滞
- 明瞭さ
- 説明が足りない
- 初心者へのやさしさ
- 30/100