Переглядач Parquet — відкривайте файли Parquet онлайн, приватно
Переглядайте файли Apache Parquet у браузері: схема, типи стовпців, кількість рядків і посторінкові рядки. Експортуйте Parquet у CSV або JSON без жодного завантаження на сервер.
🔒 Працює повністю у вашому браузері — нічого не завантажуєтьсяШвидкий спосіб зазирнути всередину файлів Parquet
Apache Parquet — стандартний формат зберігання для озер даних, завдань Spark, експортів із pandas і багатьох аналітичних конвеєрів. Він компактний і швидкий, але це двійковий стовпцевий формат, тож відкрити його в текстовому редакторі чи електронній таблиці неможливо. Цей Переглядач Parquet відкриває файл .parquet безпосередньо у вашому браузері й показує, що всередині: назви та типи стовпців, загальну кількість рядків, кількість груп рядків, бібліотеку, яка записала файл, а також посторінкову таблицю з фактичними даними.
Під капотом інструмент використовує DuckDB, скомпільовану у WebAssembly. DuckDB читає Parquet нативно, зокрема зі стисненням Snappy, Gzip і Zstd, вкладеними списками та структурами, датами, мітками часу й десятковими числами. Кількість рядків береться з метаданих файлу, а кожна сторінка завантажується невеликим запитом LIMIT/OFFSET, тому перегляд залишається швидким навіть тоді, коли файл містить мільйони рядків.
Конвертуйте Parquet у CSV або JSON
Часто дані просто потрібні в зручнішому форматі. Кнопки експорту конвертують увесь файл, а не лише видиму сторінку. Експорт у CSV записує рядок заголовків, а за ним — усі записи, готові для Excel, Google Sheets або імпорту в базу даних. Експорт у JSON записує єдиний масив об’єктів, що зручно для скриптів, тестових даних і API. Вкладені стовпці зберігаються як вкладений JSON, а в CSV вони відображаються як текст. Мітки часу записуються у форматі ISO, щоб правильно сортуватися й розбиратися.
Приватний перегляд, зручний і без мережі
Файли Parquet часто містять робочі дані: записи користувачів, транзакції або телеметрію. Завантажувати їх на невідомий сайт лише для того, щоб глянути на схему, ризиковано. Тут файл зчитується в пам’ять вашого браузера й нікуди не надсилається. Рушій DuckDB (близько 35 МБ) завантажується з CDN під час першого відкриття файлу, після чого браузер може його кешувати. Оскільки весь файл зберігається в пам’яті, робота з дуже великими файлами залежить від обсягу оперативної пам’яті, доступної вкладці браузера. Для глибшого аналізу — фільтрів, агрегацій чи об’єднань з іншими файлами — відкрийте той самий файл в інструменті SQL on CSV.
Як користуватися
- Відкрийте файл ParquetПеретягніть файл .parquet в область завантаження або натисніть, щоб вибрати його на комп’ютері.
- Перегляньте схемуПеревірте назви стовпців, типи DuckDB, допустимість NULL, кількість рядків і метадані файлу.
- Гортайте рядкиВиберіть розмір сторінки й переходьте між сторінками або одразу до потрібного номера сторінки.
- ЕкспортуйтеЗавантажте всі рядки як CSV для електронних таблиць або як масив JSON для коду.