DT Data Tools

SQL na CSV — Wykonuj zapytania SQL na plikach CSV, JSON i Parquet

Uruchamiaj zapytania SQL na plikach CSV, TSV, JSON i Parquet bezpośrednio w przeglądarce dzięki DuckDB-wasm. Łącz pliki, agreguj, filtruj i eksportuj wyniki do CSV.

🔒 Działa całkowicie w Twojej przeglądarce — nic nie jest przesyłane

Drop CSV, TSV, JSON or Parquet files here or click to browse

Add several files to join them. Each file becomes a SQL view named after the file.

Ctrl/Cmd + Enter runs the query

Load a file or run the demo query. The DuckDB SQL engine (about 35 MB) downloads from this site on first use, then runs offline in your browser.

Advertisement

Przeszukuj arkusze i pliki danych prawdziwym SQL

Formuły arkuszy kalkulacyjnych świetnie sprawdzają się przy drobnych zmianach, ale stają się uciążliwe, gdy trzeba przefiltrować tysiące wierszy, pogrupować dane według kilku kolumn lub połączyć dwa eksporty ze wspólnym identyfikatorem. SQL na CSV pozwala traktować zwykłe pliki z danymi jak tabele w bazie danych. Upuść plik CSV, TSV, JSON lub Parquet, a od razu stanie się on widokiem SQL nazwanym tak jak plik – dzięki temu sales_2024.csv można odpytać poleceniem SELECT * FROM sales_2024. Dodaj kolejne pliki, a będziesz mógł je złączać (join), scalać (union) lub porównywać bez importowania czegokolwiek na serwer bazodanowy.

Silnikiem narzędzia jest DuckDB – analityczna baza danych zaprojektowana z myślą o szybkich zapytaniach na danych kolumnowych. Jej dialekt SQL jest zbliżony do PostgreSQL i obsługuje złączenia, GROUP BY, funkcje okna, wspólne wyrażenia tablicowe (CTE), SUMMARIZE do błyskawicznych statystyk kolumn oraz bogatą bibliotekę funkcji tekstowych, datowych i matematycznych. Nazwy i typy kolumn są wykrywane automatycznie, a panel schematu pokazuje dokładnie, co DuckDB wywnioskował dla każdego pliku.

Prywatność w standardzie: wszystko działa w przeglądarce

Wiele internetowych środowisk SQL wymaga najpierw przesłania danych. Ta strona nie. DuckDB jest skompilowany do WebAssembly i działa w Twojej przeglądarce, więc dodawane pliki są wczytywane do pamięci przeglądarki i przetwarzane lokalnie. Nic nie trafia na serwer, dlatego narzędzie nadaje się do eksportów danych klientów, raportów finansowych, logów i innych informacji, których nie należy przekazywać osobom trzecim. Przy pierwszej wizycie silnik (około 35 MB) jest pobierany z sieci CDN; później przeglądarka może przechowywać go w pamięci podręcznej.

Wskazówki dotyczące szybszych i dokładniejszych zapytań

Zacznij od przycisków z przykładami: Preview rows pokazuje próbkę wierszy, Column stats uruchamia SUMMARIZE, ujawniając wartości minimalne i maksymalne, odsetek wartości pustych (null) oraz liczbę unikalnych wartości, a szablon złączenia daje punkt wyjścia do łączenia dwóch plików. Nazwy kolumn zawierające spacje lub wielkie litery ujmuj w podwójny cudzysłów, na przykład "Order Date". Jeśli kolumna CSV zostanie rozpoznana z niewłaściwym typem, przekonwertuj ją jawnie za pomocą CAST(col AS DOUBLE) lub TRY_CAST. Siatka wyników wyświetla do 1000 wierszy, natomiast Export result as CSV zapisuje każdy wiersz zwrócony przez zapytanie. Ponieważ pliki są przechowywane w pamięci, obsługa bardzo dużych zbiorów danych zależy od ilości RAM dostępnej dla przeglądarki; pliki Parquet są zwykle najbardziej kompaktową opcją.

Jak używać

  1. Dodaj plikiUpuść jeden lub więcej plików CSV, TSV, JSON lub Parquet. Każdy z nich staje się widokiem SQL nazwanym tak jak plik.
  2. Sprawdź schematPrzejrzyj wykryte nazwy kolumn, typy i liczby wierszy wyświetlane dla każdego wczytanego pliku.
  3. Napisz i uruchom SQLWybierz przykładowe zapytanie lub napisz własne, a następnie kliknij Run query albo naciśnij Ctrl/Cmd + Enter.
  4. Wyeksportuj wynikPobierz pełny wynik zapytania jako plik CSV.

Najczęściej zadawane pytania

Czy moje pliki są przesyłane na serwer?
Nie. Pliki są wczytywane do pamięci przeglądarki i przetwarzane przez DuckDB skompilowany do WebAssembly. Sam silnik jest pobierany z sieci CDN, a Twoje dane nigdy nie opuszczają urządzenia.
Jakie formaty plików mogę odpytywać?
CSV, TSV i tabele w zwykłym tekście, tablice JSON lub JSON rozdzielany znakami nowej linii (NDJSON/JSON Lines) oraz Apache Parquet. Nazwy i typy kolumn są wykrywane automatycznie.
Jaki dialekt SQL jest obsługiwany?
SQL DuckDB, zbliżony do PostgreSQL. Możesz używać złączeń, GROUP BY, funkcji okna, CTE, SUMMARIZE, funkcji tekstowych i datowych oraz wielu innych.
Ile wierszy mogę zobaczyć?
Tabela wyników pokazuje pierwsze 1000 wierszy, aby strona działała płynnie. Eksport CSV zawiera wszystkie wiersze zwrócone przez zapytanie.
Jak duże mogą być moje pliki?
Pliki są w całości wczytywane do pamięci przeglądarki, więc praktyczne limity zależą od Twojego urządzenia. Pliki o rozmiarze od kilkudziesięciu do kilkuset megabajtów zazwyczaj dobrze działają w przeglądarce na komputerze.
Advertisement