ProjectTech4DevAI / ProjectTech4DevAI/kaapi-backend

Knowledge Base: Organize data by project

Offen
#1,109 0 Kommentare 0 Reaktionen 0 zugewiesene Personen Auf GitHub ansehen

Dieses Issue hat noch niemand übernommen.

Vorherrschende Sprache
Python
Sterne
18
Forks
10
Ø Merge
2 T. 20 Std.
Gemergte PRs (30 T.)
14

Beschreibung

Is your feature request related to a problem?
All knowledge base endpoints currently use a single bucket, making it difficult to perform a clean data flush for NGOs, resulting in offboarding issues.

Describe the solution you'd like

  • Organize data into per-project-ID folders within the same bucket (following the audio setup).
  • Implement a migration script for existing documents and a legacy fallback option in the code (check top level, then project level).
  • Conduct testing on staging first.
  • Defer the bring-your-own-bucket/credentials aspect until TAP.

Priority

  • P2, September in-person ops/infra sprint.
Original issue

Context

For knowledge base enpoints, everything currently lands in a single bucket. If an NGO uses the product for two years and then requests a full data flush, that's very hard to honour cleanly — an offboarding liability.

Fix

  • Same bucket, per-project-ID folders (audio already does this; documents may not).
  • Provide a migration script for existing documents and a legacy fallback in code (check top level, then project level).
  • Test on staging first.
  • The bring-your-own-bucket/credentials half of this is deferred until TAP.

Priority

  • P2, September in-person ops/infra sprint.

Beitragsleitfaden

Beitragsleitfaden öffnen

Erste Schritte

  1. Lies das ganze Issue und danach den Beitragsleitfaden des Projekts.
  2. Schreib ins Issue, dass du es übernimmst — das erspart doppelte Arbeit.
  3. Forke das Repository und arbeite in einem Branch.
  4. Öffne einen Pull Request, der die Issue-Nummer nennt.

Rechercherichtung

Beginne damit, die Endpunkte der Wissensdatenbank nachzuverfolgen und ihr Speicherlayout mit dem bestehenden Audio-Setup zu vergleichen. Definiere das Migrationsskript und das Verhalten bei der Suche nach Legacy-Daten und teste anschließend die Migration und den Fallback auf Staging; die Arbeit ist abgeschlossen, wenn Dokumente Ordner pro Projekt-ID verwenden, während vorhandene Dokumente auf oberster Ebene weiterhin zugänglich bleiben.

Vom Indexierungsmodell aus dem Issue-Text verfasst.

Bewertung

Tech-Stack
python
Bereich
backend, infrastructure
Issue-Typ
Feature
Schwierigkeit
4/5
Geschätzter Aufwand
3-5 Tage
Aktivitätsstatus
Ruhig
Klarheit
Größtenteils klar
Anfängerfreundlichkeit
45/100

Neue Issues direkt in Ihr Postfach

Eine kurze Übersicht über anfängerfreundliche GitHub-Issues.