DT Data Tools

Visionneuse Parquet — Ouvrez des fichiers Parquet en ligne, en toute confidentialité

Affichez des fichiers Apache Parquet dans votre navigateur : schéma, types de colonnes, nombre de lignes et lignes paginées. Exportez Parquet en CSV ou JSON sans rien envoyer.

🔒 S'exécute entièrement dans votre navigateur — rien n'est téléchargé

Drop a .parquet file here or click to browse

Opened locally with DuckDB-wasm. Nothing is uploaded.

The DuckDB engine (about 35 MB) downloads from this site on first use, then runs offline in your browser.

Advertisement

Un moyen rapide de regarder à l'intérieur des fichiers Parquet

Apache Parquet est le format de stockage par défaut des data lakes, des jobs Spark, des exports pandas et de nombreux pipelines d'analyse. Il est compact et rapide, mais c'est un format binaire en colonnes : impossible donc de l'ouvrir dans un éditeur de texte ou un tableur. Cette Visionneuse Parquet ouvre un fichier .parquet directement dans votre navigateur et montre ce qu'il contient : les noms et types des colonnes, le nombre total de lignes, le nombre de groupes de lignes, la bibliothèque qui a écrit le fichier et un tableau paginé des données réelles.

En coulisses, l'outil utilise DuckDB compilé en WebAssembly. DuckDB lit Parquet nativement, y compris la compression Snappy, Gzip et Zstd, les listes et structures imbriquées, les dates, les horodatages et les décimaux. Le nombre de lignes provient des métadonnées du fichier et chaque page est récupérée avec une petite requête LIMIT/OFFSET, si bien que la navigation reste fluide même lorsque le fichier compte des millions de lignes.

Convertir Parquet en CSV ou JSON

Souvent, vous avez simplement besoin des données dans un format plus pratique. Les boutons d'export convertissent le fichier entier, pas seulement la page visible. L'export CSV écrit une ligne d'en-tête suivie de chaque enregistrement, prêt pour Excel, Google Sheets ou une importation dans une base de données. L'export JSON écrit un seul tableau d'objets, pratique pour les scripts, les jeux de données de test et les API. Les colonnes imbriquées restent du JSON imbriqué, tandis qu'en CSV elles apparaissent sous forme de texte. Les horodatages sont écrits au format ISO afin d'être triés et analysés correctement.

Une inspection privée, compatible hors ligne

Les fichiers Parquet contiennent souvent des données de production : fiches utilisateurs, transactions ou télémétrie. Les envoyer sur un site inconnu simplement pour jeter un œil au schéma est risqué. Ici, le fichier est lu dans la mémoire de votre navigateur et n'est jamais envoyé nulle part. Le moteur DuckDB (environ 35 Mo) est téléchargé depuis un CDN la première fois que vous ouvrez un fichier, puis peut être mis en cache par votre navigateur. Comme le fichier entier est conservé en mémoire, les très gros fichiers dépendent de la RAM disponible pour l'onglet de votre navigateur. Pour une analyse plus poussée, comme des filtres, des agrégations ou des jointures avec d'autres fichiers, ouvrez le même fichier dans l'outil SQL on CSV.

Comment utiliser

  1. Ouvrez un fichier ParquetDéposez un fichier .parquet dans la zone de dépôt ou cliquez pour en choisir un sur votre ordinateur.
  2. Examinez le schémaConsultez les noms de colonnes, les types DuckDB, la nullabilité, le nombre de lignes et les métadonnées du fichier.
  3. Parcourez les lignesChoisissez une taille de page, passez d'une page à l'autre ou accédez directement à un numéro de page.
  4. ExportezTéléchargez toutes les lignes en CSV pour les tableurs ou sous forme de tableau JSON pour le code.

Questions fréquemment posées

Mon fichier Parquet est-il envoyé en ligne ?
Non. Le fichier est ouvert dans votre navigateur avec DuckDB compilé en WebAssembly. Le moteur est téléchargé depuis un CDN et vos données restent sur votre appareil.
Quelles fonctionnalités de Parquet sont prises en charge ?
DuckDB sait lire les compressions courantes comme Snappy, Gzip et Zstd, les types imbriqués comme les listes et les structures, ainsi que les dates, les horodatages et les décimaux.
Puis-je exporter tout le fichier, et pas seulement la page affichée ?
Oui. L'export en CSV ou en JSON écrit toujours toutes les lignes du fichier, quelle que soit la page que vous consultez.
Pourquoi les colonnes imbriquées s'affichent-elles en texte JSON ?
Les listes et les structures ne tiennent pas dans une seule cellule d'un tableau plat : la visionneuse les affiche donc en JSON compact. L'export JSON conserve leur imbrication.
Advertisement