Parquet-viewer — Open Parquet-bestanden online, privé
Bekijk Apache Parquet-bestanden in je browser: schema, kolomtypen, aantal rijen en rijen per pagina. Exporteer Parquet naar CSV of JSON zonder iets te uploaden.
🔒 Draait volledig in uw browser — niets wordt geüploadSnel in Parquet-bestanden kijken
Apache Parquet is het standaard opslagformaat voor data lakes, Spark-jobs, pandas-exports en veel analysepijplijnen. Het is compact en snel, maar het is een binair, kolomgericht formaat, dus je kunt het niet openen in een teksteditor of spreadsheet. Deze Parquet-viewer opent een .parquet-bestand rechtstreeks in je browser en laat zien wat erin zit: de kolomnamen en -typen, het totale aantal rijen, het aantal row groups, de bibliotheek die het bestand heeft geschreven en een tabel met de eigenlijke gegevens, verdeeld over pagina's.
Onder de motorkap gebruikt de tool DuckDB, gecompileerd naar WebAssembly. DuckDB leest Parquet native, inclusief Snappy-, Gzip- en Zstd-compressie, geneste lijsten en structs, datums, tijdstempels en decimalen. Het aantal rijen komt uit de metadata van het bestand en elke pagina wordt opgehaald met een kleine LIMIT/OFFSET-query, zodat bladeren soepel blijft, zelfs als het bestand miljoenen rijen bevat.
Parquet converteren naar CSV of JSON
Vaak heb je de gegevens gewoon nodig in een handiger formaat. De exportknoppen converteren het hele bestand, niet alleen de zichtbare pagina. De CSV-export schrijft een kopregel gevolgd door elk record, klaar voor Excel, Google Sheets of een database-import. De JSON-export schrijft één array van objecten, handig voor scripts, testdata en API's. Geneste kolommen blijven geneste JSON, terwijl ze in CSV als tekst verschijnen. Tijdstempels worden in ISO-formaat geschreven, zodat ze correct sorteren en worden ingelezen.
Privé en offlinevriendelijk inspecteren
Parquet-bestanden bevatten vaak productiegegevens: gebruikersrecords, transacties of telemetrie. Ze uploaden naar een onbekende website alleen om even naar het schema te kijken, is riskant. Hier wordt het bestand in het geheugen van je browser gelezen en nooit ergens naartoe gestuurd. De DuckDB-engine (ongeveer 35 MB) wordt van een CDN gedownload wanneer je voor het eerst een bestand opent en kan daarna door je browser in de cache worden bewaard. Omdat het hele bestand in het geheugen wordt gehouden, hangen zeer grote bestanden af van het RAM dat beschikbaar is voor je browsertabblad. Voor diepere analyse, zoals filters, aggregaties of joins met andere bestanden, open je hetzelfde bestand in de tool SQL on CSV.
Hoe te gebruiken
- Open een Parquet-bestandSleep een .parquet-bestand naar het neerzetgebied of klik om er een op je computer te kiezen.
- Bekijk het schemaControleer kolomnamen, DuckDB-typen, nullbaarheid, aantal rijen en bestandsmetadata.
- Blader door de rijenKies een paginagrootte en ga van pagina naar pagina of spring naar een paginanummer.
- ExporteerDownload alle rijen als CSV voor spreadsheets of als JSON-array voor code.