apache / apache/iotdb

An easy method to count the total number of time-series data

Offen
#6,762 2 Kommentare 0 Reaktionen 0 zugewiesene Personen Auf GitHub ansehen
Vorherrschende Sprache
Java
Sterne
6.4k
Forks
1.2k
Ø Merge
1 T. 23 Std.
Gemergte PRs (30 T.)
115

Beschreibung

I used workbench to write a large number of data into iotdb, e.g. 50000 devices and 100 sensors for each device. Then I wanted to verify whether the total number of data actually written into iotdb is equal to the number expected.

I used sql statements like "select count(*) from root.test.** group by level =3", but can't get the correct answer which should be 50000\*100. It seems like that result columns over 1000 has been truncated.

What I expect is, when I execute one single sql statement, it can return the correct number of all data in db. In industry, large data is ubiquitous, so a good support for large data might be a common scene.

Now, I used a sql and shell combined way to verify the number, such like "select count(*) from root.test.**.d_${i} group by level =3". Here i ranges from 1 to 50000. And finally add 50000 results together to get the correct number.

Beitragsleitfaden

Beitragsleitfaden öffnen

Rechercherichtung

Beginne damit, die einzelne Abfrage `select count(*) from root.test.** group by level =3` mit mehr als 1000 Ergebnisspalten zu reproduzieren, und vergleiche sie mit dem erwarteten Zählergebnis von 50000×100. Verfolge die Verarbeitung des Abfrageergebnisses, um festzustellen, wo Spalten abgeschnitten werden. Als erledigt gilt die Aufgabe, wenn eine SQL-Anweisung die vollständige Anzahl für den gemeldeten großen Datensatz zurückgibt.

Vom Indexierungsmodell aus dem Issue-Text verfasst.

Bewertung

Tech-Stack
java, sql
Bereich
databases
Issue-Typ
Feature
Schwierigkeit
4/5
Geschätzter Aufwand
3-5 Tage
Aktivitätsstatus
Veraltet
Klarheit
Größtenteils klar
Anfängerfreundlichkeit
35/100

Neue Issues direkt in Ihr Postfach

Eine kurze Übersicht über anfängerfreundliche GitHub-Issues.