microsoft / microsoft/semantic-kernel-java
Java: Use functions/stored procedures for calculating similarity
オープン
まだ誰も着手していません。
java
stale
- 主要言語
- Java
- スター
- 276
- フォーク
- 56
- 平均マージ
- 17時間 45分
- マージ済み PR(30日)
- 4
説明
The implementation of the memory nearest match API computes cosine similarity on the client side.
Is it possible to compute cosine similarity on the database side through a database function or stored procedure?
If so, withEmbeddings could be pushed to the database side (i.e., should the embeddings column be selected?)
- Could sorting and limiting be done on the database side, too?
- Is the extra overhead on the database a good tradeoff for less overhead in data on the wire?
コントリビューションガイド
はじめの一歩
- issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
- 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
- リポジトリをフォークし、ブランチを切って変更します。
- issue 番号を参照したプルリクエストを送ります。
調査の方向性
memory nearest match API とその withEmbeddings の動作から始めてください。cosine similarity、ソート、件数制限が現在どのように処理されているかを調査し、その処理をデータベースに移せるかどうか、データベース関数または stored procedure を使って検討してください。この issue では、具体的な実装や完了基準は定義されていません。
索引モデルが issue の本文から書いたものです。
評価
- 技術スタック
- java
- 領域
- databases
- issue の種類
- 機能追加
- 難易度
- 5/5
- 見積もり時間
- 1週間以上
- 活発さ
- 停滞
- 明瞭さ
- 説明が足りない
- 初心者へのやさしさ
- 25/100