Online datacompressiesimulator
Plak tekst en zie direct de Huffman-codes en bitlengtes. Educatieve simulator voor datacompressie, met voorbeelden en uitleg. De verwerking gebeurt lokaal in…
Aan de slag
Wat doet deze simulator?
Deze tool is een educatieve simulator voor Huffman-codering. Je plakt tekst en de simulator berekent de optimale binaire codes voor elk teken op basis van frequentie. Het resultaat toont de codes en de totale bitlengte van de originele UTF-8-weergave versus de Huffman-gecodeerde bitlengte.
Concreet voorbeeld
Plak de tekst ABBC. De originele UTF-8-bitlengte is 32 bits (4 tekens × 8 bits). De Huffman-bitlengte is 6 bits, omdat de frequenties een boom opleveren die A en C elk 2 bits geeft en B 1 bit. De simulator toont de codes en de bitlengtes.
Belangrijke beperkingen
- De Huffman-bitlengte is alleen de payload: de codeboek, boomstructuur, headers en opvulling zijn niet meegerekend. Het is dus geen echte bestandsgrootte.
- De maximale invoer is 100.000 JavaScript UTF-16-code-eenheden. Veel emoji's tellen als twee code-eenheden.
- Lege tekst wordt afgewezen. Plak op mobiel eerst een klein stukje en controleer het resultaat.
Veelgestelde vragen
Waarom zie ik \n in het resultaat?
De simulator toont witruimte in JSON-notatie om zichtbaar te maken welk teken het is. Een echte nieuwe regel wordt weergegeven als \n, een tab als \t.
Is dit een echte compressor?
Nee, dit is een leersimulator. De berekende bitlengte is alleen de payload zonder overhead. Voor korte teksten is de werkelijke compressie vaak niet gunstig.
Waarom verschilt de code bij gelijke frequenties?
Bij gelijke frequenties kan de boom op meerdere manieren worden opgebouwd. De codes kunnen dan verschillen, maar de gewogen bitlengte blijft hetzelfde. Vergelijk daarom altijd de bitlengtes, niet de codes.
De verwerking gebeurt lokaal in je browser.