sqlbot在使用中的一些问题与建议

オープン
#289 コメント 4 件 リアクション 0 件 担当者 0 名 GitHub で見る

まだ誰も着手していません。

評価

難易度
5/5
見積もり時間
1週間以上
初心者へのやさしさ
25/100
issue の種類
機能追加
明瞭さ
説明が足りない
活発さ
停滞
技術スタック
javascript
領域
ai, databases

調査の方向性

ファイル、テスト、エントリーポイントは指定されていません。まず、対話フロー、メタデータ/テーブル関係の管理、データソース設定の場所を特定し、次に、テーブルの事前選択、トピックドメイン、モデル支援によるリレーション生成をそれぞれ独立して指定できるかどうかを判断してください。各提案について合意された設計と文書化された動作があれば、完了とします。

索引モデルが issue の本文から書いたものです。

説明

使用背景:尝试在项目中使用sqlbot辅助用户通过对话的方式查看感兴趣的指标。

问题1:数据库中存在上百张表,如果选择整个库中的所有表,会导致系统提示词超长且可能溢出,使用成本也会很高。
建议:能否对问题做一个预处理机制,通过预处理筛选出相关度topn的表,当前这个预处理机制可能会很复杂依赖表自身的描述信息,字段信息等因素,需要具体讨论可行的方案。

问题2:同一个数据源中,能否提供主题域的概念?比如电商场景下:一个库中有上百张表,常见的主题域可能是订单主题域、用户主题域、商品主题域......,通过划分主题域并且在主题域中配置好表与表之间的关系,在对话时,先通过问题预测主题域,获取命中主题域对应表的元数据,理论上也能减小系统提示词的长度。当前这个功能不影响现有的对话流程,如果没有主题域,退化为现有的对话逻辑。

问题3:现有的表关系管理模块,是否能够利用大模型的能力自动生成初版表关系,然后人工进行校对?

主要言語
JavaScript
スター
6.8k
フォーク
882
平均マージ
4時間 41分
マージ済み PR(30日)
35

コントリビューションガイド

コントリビューションガイドを開く

はじめの一歩

  1. issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
  2. 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
  3. リポジトリをフォークし、ブランチを切って変更します。
  4. issue 番号を参照したプルリクエストを送ります。

dataease/SQLBot のほかの issue

dataease/SQLBot の issue をすべて見る

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。