Cookies voor statistiek en advertenties
We gebruiken cookies voor statistiek en voor advertenties, allebei naar Google. Weigeren verandert niets aan wat je te zien krijgt.Lees de privacypagina
Hier zet je Parquet naar XLSX om, gratis en zonder account: sleep het bestand hierboven erin en binnen een paar seconden staat het resultaat klaar om te downloaden. De omzetting gebeurt binnen je eigen browser, dus het bestand wordt nooit geüpload. Het werkt hetzelfde op Windows, macOS en Linux als op iPhone en Android, en het blijft werken als je de verbinding verbreekt.
Tot 100 bestanden tegelijk. Verschillende formaten door elkaar is prima.
Ze worden een voor een omgezet en samen in één ZIP gedownload.
Parquet naar XLSX
Een .parquet-bestand in een postvak is een kleine vertaalstoornis. Het is het standaardformaat binnen een dataplatform — compact, getypeerd, snel te bevragen — en geen enkele kantoortoepassing behandelt het als de eigen taal. Er is geen Bestand, Openen voor in Excel, en wat de Power Query-connector aanneemt hangt af van de versie en licentie die je toevallig hebt.
Zelf omzetten kost een moment en vergt niets om te installeren.
Een Parquet-bestand registreert het type van elke kolom. Een CSV registreert er geen enkele, dus elke waarde wordt tekst en Excel raadt bij het importeren zelf wat het is — waardoor identificatienummers getallen worden en codes datums.
Een cel in een werkmap draagt haar eigen type. Numerieke kolommen komen als numerieke cellen binnen en booleankolommen als booleancellen, dus een som werkt meteen en een filter biedt een numeriek bereik in plaats van een lijst met tekst.
Een tijdstempelkolom wordt geschreven als een ISO 8601-tekenreeks — 2024-03-11T09:30:00.000Z — en komt in een tekstcel terecht, dus die sorteert correct als tekst maar reageert niet op datumrekenen of een datumfilter in een draaitabel.
Omzetten is een bekende bewerking van tien seconden per kolom: selecteer de kolom, Gegevens, Tekst naar kolommen, en kies op de laatste stap Datum met de volgorde JMD. Excel maakt er dan een echte datum van.
Een werkblad houdt 1.048.576 rijen inclusief de kopregel en 16.384 kolommen — een grens van het rekenbladformaat zelf, waar geen enkele converter overheen komt.
Parquet-bestanden houden vaak meer, want het formaat bestaat juist voor tabellen die een rekenblad niet aankan. Zit het extract boven die grens, dan moet het eerst gefilterd of samengevat worden — vraag om de rijen van één maand of om totalen per categorie in plaats van om een groter bestand.
Parquet kent een 64-bits geheel getal en een rekenblad houdt zo’n vijftien significante cijfers vast. Een waarde die daarbuiten valt, wordt als tekst in de cel geschreven in plaats van als afgerond getal.
Dat is de juiste kant, ook al oogt het inconsistent naast de andere numerieke kolommen: een afgerond ordernummer lijkt nog steeds geldig, matcht nergens meer mee en is lastig terug te traceren; hetzelfde als links uitgelijnde tekstcel is duidelijk herkenbaar als zodanig.
Parquet kan een lijst, een struct of een map in één kolom houden. Een rekenbladcel houdt één waarde, dus die kolommen worden als JSON-tekst geschreven: een lijst verschijnt als ["a","b"] in één cel.
Dat is leesbaar en niet werkbaar. Zijn die kolommen belangrijk voor de analyse, vraag dan bij de bron om ze uitgevlakt te exporteren in aparte kolommen.
Een Parquet-bestand houdt precies één tabel met één schema, dus de werkmap krijgt één werkblad. De naam komt van het bestand zonder extensie, afgekapt tot de eenendertig tekens die een werkbladnaam toestaat.
De kolomnamen komen door zoals de datapijplijn ze registreerde, met alle onderstrepingstekens en padachtige segmenten — vaak niet de namen die iemand voor een rapport zou kiezen, en ze hernoemen in de eerste rij is meestal de eerste stap.
Aanzienlijk. Parquet slaat waarden binair op, comprimeert elke kolom apart en houdt een herhaalde waarde eenmaal vast met kleine verwijzingen ernaartoe; een werkblad slaat een cel per waarde op met een eigen type en stijlverwijzingen, binnen een ZIP van XML.
Een bescheiden Parquet-bestand levert daardoor een werkmap op die meerdere keren zo groot is, soms veel meer bij sterk herhalende kolommen.
De Parquet-lezer en de rekenbladschrijver draaien allebei in de browser, dus het extract blijft op je eigen machine — vaak precies de reden waarom een online converter voor dit paar wel of niet bruikbaar is, want een Parquet-bestand uit een dataplatform staat meestal dichter bij de ruwe tabel dan bij een rapport.
Dat is geregeld gepast de doorslaggevende factor: uploaden naar een converter is precies wat een gegevensbeleid probeert te voorkomen.
| Parquet | XLSX | |
|---|---|---|
| Volledige naam | Apache Parquet | Excel-werkmap |
| Bestandsextensie | .parquet | .xlsx |
| Mediatype | application/vnd.apache.parquet | application/vnd.openxmlformats-officedocument.spreadsheetml.sheet |
| Compressie | Zonder verlies — er gaat niets weg | — |
| Voor het eerst gepubliceerd | 2013 | 2007 |
| Uitgegeven door | Apache Software Foundation | Microsoft |
| Specificatie | — | ECMA-376 |
| Licentie | Open standaard | Open standaard |
| Stand van zaken | Actueel | Actueel |
| Opent in een browser | Geen browser | Geen browser |
| In plaats daarvan overwogen | CSV, JSON | CSV, ODS |
XLSX is een werkformaat en Parquet een af formaat. Wat terugkomt is bewerkbare tekst in plaats van een afbeelding van de pagina, meestal de reden voor de omzetting en tegelijk haar grens.
De gebruikelijke programma's overlappen niet: Parquet open je in pandas, Apache Spark en DuckDB, XLSX in Microsoft Excel, LibreOffice Calc en Google Sheets — wie het resultaat krijgt, heeft dus iets uit de tweede rij nodig.
De twee mikken op ander werk: Parquet op archivering en gegevens tussen programma’s verplaatsen, XLSX op bewerken. Dat is het afwegen waard, want de reden dat het ene bestaat is meestal de reden dat het andere onhandig is.
XLSX komt van Microsoft en stamt uit 2007, vastgelegd in ECMA-376. Microsoft Excel, LibreOffice Calc en Google Sheets lezen het formaat.
Nee. Deze omzetting gebeurt volledig in je browser, dus het bestand verlaat je apparaat niet. Je kunt het zelf nagaan: open het netwerktabblad van de ontwikkelaarshulpmiddelen en zet iets om. Je ziet de pagina zelf en de verzoeken voor statistiek en advertenties waarmee deze dienst betaald wordt, en geen enkel verzoek dat je bestand meeneemt. De motor achter juist dit paar is parquet-wasm, een WebAssembly-versie van de Apache Arrow-lezer; je browser haalt die één keer op en bewaart hem.
Ja. Geen account, geen watermerk en geen dagtegoed dat opraakt: het draait op je eigen machine, dus je mag zo vaak terugkomen als je wilt. De browser verwerkt bestanden tot 100 MB, 100 tegelijk. parquet-wasm wordt naar je eigen machine gehaald en draait daar, en daarom staat er geen teller op.
Nee. XLSX bewaart dezelfde inhoud zonder iets weg te gooien: het resultaat is in kwaliteit identiek aan het origineel.
XLSX is een werkformaat en Parquet een af formaat. Wat terugkomt is bewerkbare tekst in plaats van een afbeelding van de pagina, meestal de reden voor de omzetting en tegelijk haar grens.