DT Data Tools

Переглядач Parquet — відкривайте файли Parquet онлайн, приватно

Переглядайте файли Apache Parquet у браузері: схема, типи стовпців, кількість рядків і посторінкові рядки. Експортуйте Parquet у CSV або JSON без жодного завантаження на сервер.

🔒 Працює повністю у вашому браузері — нічого не завантажується

Drop a .parquet file here or click to browse

Opened locally with DuckDB-wasm. Nothing is uploaded.

The DuckDB engine (about 35 MB) downloads from this site on first use, then runs offline in your browser.

Advertisement

Швидкий спосіб зазирнути всередину файлів Parquet

Apache Parquet — стандартний формат зберігання для озер даних, завдань Spark, експортів із pandas і багатьох аналітичних конвеєрів. Він компактний і швидкий, але це двійковий стовпцевий формат, тож відкрити його в текстовому редакторі чи електронній таблиці неможливо. Цей Переглядач Parquet відкриває файл .parquet безпосередньо у вашому браузері й показує, що всередині: назви та типи стовпців, загальну кількість рядків, кількість груп рядків, бібліотеку, яка записала файл, а також посторінкову таблицю з фактичними даними.

Під капотом інструмент використовує DuckDB, скомпільовану у WebAssembly. DuckDB читає Parquet нативно, зокрема зі стисненням Snappy, Gzip і Zstd, вкладеними списками та структурами, датами, мітками часу й десятковими числами. Кількість рядків береться з метаданих файлу, а кожна сторінка завантажується невеликим запитом LIMIT/OFFSET, тому перегляд залишається швидким навіть тоді, коли файл містить мільйони рядків.

Конвертуйте Parquet у CSV або JSON

Часто дані просто потрібні в зручнішому форматі. Кнопки експорту конвертують увесь файл, а не лише видиму сторінку. Експорт у CSV записує рядок заголовків, а за ним — усі записи, готові для Excel, Google Sheets або імпорту в базу даних. Експорт у JSON записує єдиний масив об’єктів, що зручно для скриптів, тестових даних і API. Вкладені стовпці зберігаються як вкладений JSON, а в CSV вони відображаються як текст. Мітки часу записуються у форматі ISO, щоб правильно сортуватися й розбиратися.

Приватний перегляд, зручний і без мережі

Файли Parquet часто містять робочі дані: записи користувачів, транзакції або телеметрію. Завантажувати їх на невідомий сайт лише для того, щоб глянути на схему, ризиковано. Тут файл зчитується в пам’ять вашого браузера й нікуди не надсилається. Рушій DuckDB (близько 35 МБ) завантажується з CDN під час першого відкриття файлу, після чого браузер може його кешувати. Оскільки весь файл зберігається в пам’яті, робота з дуже великими файлами залежить від обсягу оперативної пам’яті, доступної вкладці браузера. Для глибшого аналізу — фільтрів, агрегацій чи об’єднань з іншими файлами — відкрийте той самий файл в інструменті SQL on CSV.

Як користуватися

  1. Відкрийте файл ParquetПеретягніть файл .parquet в область завантаження або натисніть, щоб вибрати його на комп’ютері.
  2. Перегляньте схемуПеревірте назви стовпців, типи DuckDB, допустимість NULL, кількість рядків і метадані файлу.
  3. Гортайте рядкиВиберіть розмір сторінки й переходьте між сторінками або одразу до потрібного номера сторінки.
  4. ЕкспортуйтеЗавантажте всі рядки як CSV для електронних таблиць або як масив JSON для коду.

Часті запитання

Чи завантажується мій файл Parquet на сервер?
Ні. Файл відкривається у вашому браузері за допомогою DuckDB, скомпільованої у WebAssembly. Рушій завантажується з CDN, а ваші дані залишаються на вашому пристрої.
Які можливості Parquet підтримуються?
DuckDB читає поширені види стиснення, як-от Snappy, Gzip і Zstd, вкладені типи на кшталт списків і структур, а також дати, мітки часу й десяткові числа.
Чи можна експортувати весь файл, а не лише поточну сторінку?
Так. Експорт у CSV або JSON завжди записує всі рядки файлу незалежно від того, яку сторінку ви переглядаєте.
Чому вкладені стовпці показано як текст JSON?
Списки та структури не вміщаються в одну клітинку плоскої таблиці, тому переглядач показує їх як компактний JSON. Експорт у JSON зберігає їхню вкладеність.
Advertisement