DT Data Tools

SQL auf CSV — CSV-, JSON- und Parquet-Dateien mit SQL abfragen

Führe SQL-Abfragen auf CSV-, TSV-, JSON- und Parquet-Dateien direkt im Browser mit DuckDB-wasm aus. Dateien verknüpfen, aggregieren, filtern und Ergebnisse als CSV exportieren.

🔒 Läuft vollständig in Ihrem Browser — nichts wird hochgeladen

Drop CSV, TSV, JSON or Parquet files here or click to browse

Add several files to join them. Each file becomes a SQL view named after the file.

Ctrl/Cmd + Enter runs the query

Load a file or run the demo query. The DuckDB SQL engine (about 35 MB) downloads from this site on first use, then runs offline in your browser.

Advertisement

Tabellen und Datendateien mit echtem SQL abfragen

Tabellenkalkulationsformeln eignen sich hervorragend für kleine Änderungen, werden aber mühsam, wenn du Tausende Zeilen filtern, nach mehreren Spalten gruppieren oder zwei Exporte mit gemeinsamer ID zusammenführen musst. Mit SQL auf CSV behandelst du gewöhnliche Datendateien wie Datenbanktabellen. Zieh eine CSV-, TSV-, JSON- oder Parquet-Datei hinein, und sie wird sofort zu einer SQL-View mit dem Namen der Datei – sales_2024.csv lässt sich also mit SELECT * FROM sales_2024 abfragen. Füge weitere Dateien hinzu, und du kannst sie per Join verknüpfen, per Union zusammenführen oder vergleichen, ohne irgendetwas in einen Datenbankserver zu importieren.

Der Motor hinter dem Tool ist DuckDB, eine analytische Datenbank, die für schnelle Abfragen auf spaltenorientierten Daten entwickelt wurde. Ihr SQL-Dialekt ähnelt stark PostgreSQL und unterstützt Joins, GROUP BY, Fensterfunktionen, Common Table Expressions (CTEs), SUMMARIZE für sofortige Spaltenstatistiken sowie eine umfangreiche Bibliothek an Text-, Datums- und Mathematikfunktionen. Spaltennamen und -typen werden automatisch erkannt, und der Schemabereich zeigt genau, was DuckDB für jede Datei abgeleitet hat.

Privat by Design: Alles läuft in deinem Browser

Viele Online-SQL-Umgebungen verlangen, dass du deine Daten zuerst hochlädst. Diese Seite nicht. DuckDB ist zu WebAssembly kompiliert und läuft in deinem Browser, sodass die hinzugefügten Dateien in den Arbeitsspeicher deines Browsers gelesen und lokal abgefragt werden. Nichts wird an einen Server gesendet – damit eignet sich das Tool für Kundenexporte, Finanzberichte, Logdateien und andere Daten, die du nicht an Dritte weitergeben solltest. Beim ersten Besuch wird die Engine (etwa 35 MB) von einem CDN heruntergeladen; danach kann dein Browser sie zwischenspeichern.

Tipps für schnellere und genauere Abfragen

Beginne mit den Beispiel-Schaltflächen: Preview rows zeigt eine Stichprobe der Zeilen, Column stats führt SUMMARIZE aus und liefert Minima, Maxima, Anteile an Nullwerten und die Anzahl unterschiedlicher Werte, und die Join-Vorlage bietet dir einen Ausgangspunkt, um zwei Dateien zu kombinieren. Setze Spaltennamen, die Leerzeichen oder Großbuchstaben enthalten, in doppelte Anführungszeichen, zum Beispiel "Order Date". Wird eine CSV-Spalte mit dem falschen Typ erkannt, wandle sie explizit mit CAST(col AS DOUBLE) oder TRY_CAST um. Das Ergebnisraster zeigt bis zu 1.000 Zeilen an, während Export result as CSV jede von der Abfrage zurückgegebene Zeile speichert. Da die Dateien im Arbeitsspeicher gehalten werden, hängen sehr große Datensätze vom RAM ab, der deinem Browser zur Verfügung steht; Parquet-Dateien sind meist die kompakteste Option.

So verwenden Sie

  1. Dateien hinzufügenZieh eine oder mehrere CSV-, TSV-, JSON- oder Parquet-Dateien hinein. Jede wird zu einer SQL-View mit dem Namen der Datei.
  2. Schema prüfenÜberprüfe die erkannten Spaltennamen, Datentypen und Zeilenzahlen, die für jede geladene Datei angezeigt werden.
  3. SQL schreiben und ausführenWähle eine Beispielabfrage oder schreibe deine eigene und klicke dann auf Run query oder drücke Ctrl/Cmd + Enter.
  4. Ergebnis exportierenLade das vollständige Abfrageergebnis als CSV-Datei herunter.

Häufig gestellte Fragen

Werden meine Dateien auf einen Server hochgeladen?
Nein. Die Dateien werden in den Arbeitsspeicher deines Browsers gelesen und von DuckDB abgefragt, das zu WebAssembly kompiliert ist. Die Engine selbst wird von einem CDN geladen, und deine Daten verlassen nie dein Gerät.
Welche Dateiformate kann ich abfragen?
CSV, TSV und reine Texttabellen, JSON-Arrays oder zeilenweise getrenntes JSON (NDJSON/JSON Lines) sowie Apache Parquet. Spaltennamen und -typen werden automatisch erkannt.
Welcher SQL-Dialekt wird unterstützt?
DuckDB-SQL, das PostgreSQL sehr ähnlich ist. Du kannst Joins, GROUP BY, Fensterfunktionen, CTEs, SUMMARIZE, Text- und Datumsfunktionen und vieles mehr verwenden.
Wie viele Zeilen kann ich sehen?
Die Ergebnistabelle zeigt die ersten 1.000 Zeilen, damit die Seite reaktionsschnell bleibt. Der CSV-Export enthält jede von der Abfrage zurückgegebene Zeile.
Wie groß dürfen meine Dateien sein?
Die Dateien werden vollständig in den Arbeitsspeicher des Browsers geladen, daher hängen die praktischen Grenzen von deinem Gerät ab. Dateien von einigen Dutzend bis zu einigen hundert Megabyte funktionieren in einem Desktop-Browser meist gut.
Advertisement