Visionneuse Parquet — Ouvrez des fichiers Parquet en ligne, en toute confidentialité
Affichez des fichiers Apache Parquet dans votre navigateur : schéma, types de colonnes, nombre de lignes et lignes paginées. Exportez Parquet en CSV ou JSON sans rien envoyer.
🔒 S'exécute entièrement dans votre navigateur — rien n'est téléchargéUn moyen rapide de regarder à l'intérieur des fichiers Parquet
Apache Parquet est le format de stockage par défaut des data lakes, des jobs Spark, des exports pandas et de nombreux pipelines d'analyse. Il est compact et rapide, mais c'est un format binaire en colonnes : impossible donc de l'ouvrir dans un éditeur de texte ou un tableur. Cette Visionneuse Parquet ouvre un fichier .parquet directement dans votre navigateur et montre ce qu'il contient : les noms et types des colonnes, le nombre total de lignes, le nombre de groupes de lignes, la bibliothèque qui a écrit le fichier et un tableau paginé des données réelles.
En coulisses, l'outil utilise DuckDB compilé en WebAssembly. DuckDB lit Parquet nativement, y compris la compression Snappy, Gzip et Zstd, les listes et structures imbriquées, les dates, les horodatages et les décimaux. Le nombre de lignes provient des métadonnées du fichier et chaque page est récupérée avec une petite requête LIMIT/OFFSET, si bien que la navigation reste fluide même lorsque le fichier compte des millions de lignes.
Convertir Parquet en CSV ou JSON
Souvent, vous avez simplement besoin des données dans un format plus pratique. Les boutons d'export convertissent le fichier entier, pas seulement la page visible. L'export CSV écrit une ligne d'en-tête suivie de chaque enregistrement, prêt pour Excel, Google Sheets ou une importation dans une base de données. L'export JSON écrit un seul tableau d'objets, pratique pour les scripts, les jeux de données de test et les API. Les colonnes imbriquées restent du JSON imbriqué, tandis qu'en CSV elles apparaissent sous forme de texte. Les horodatages sont écrits au format ISO afin d'être triés et analysés correctement.
Une inspection privée, compatible hors ligne
Les fichiers Parquet contiennent souvent des données de production : fiches utilisateurs, transactions ou télémétrie. Les envoyer sur un site inconnu simplement pour jeter un œil au schéma est risqué. Ici, le fichier est lu dans la mémoire de votre navigateur et n'est jamais envoyé nulle part. Le moteur DuckDB (environ 35 Mo) est téléchargé depuis un CDN la première fois que vous ouvrez un fichier, puis peut être mis en cache par votre navigateur. Comme le fichier entier est conservé en mémoire, les très gros fichiers dépendent de la RAM disponible pour l'onglet de votre navigateur. Pour une analyse plus poussée, comme des filtres, des agrégations ou des jointures avec d'autres fichiers, ouvrez le même fichier dans l'outil SQL on CSV.
Comment utiliser
- Ouvrez un fichier ParquetDéposez un fichier .parquet dans la zone de dépôt ou cliquez pour en choisir un sur votre ordinateur.
- Examinez le schémaConsultez les noms de colonnes, les types DuckDB, la nullabilité, le nombre de lignes et les métadonnées du fichier.
- Parcourez les lignesChoisissez une taille de page, passez d'une page à l'autre ou accédez directement à un numéro de page.
- ExportezTéléchargez toutes les lignes en CSV pour les tableurs ou sous forme de tableau JSON pour le code.