huffman

  • Daten komprimieren mit Köpfchen (Teil 2) – Huffman-Code in Python umsetzen

    Daten komprimieren mit Köpfchen (Teil 2) – Huffman-Code in Python umsetzen

    Im ersten Teil wurde am Beispiel von KAFFEEPAUSE gezeigt, wie der Huffman-Algorithmus anhand von Zeichenhäufigkeiten einen Binärbaum erstellt und daraus platzsparende, eindeutige Codes gewinnt. Die Grundlagen werden in Teil 1 auf ffritze.de ausführlich erklärt.

    In diesem zweiten Teil wird der Huffman-Algorithmus in Python implementiert und in einem Jupyter Notebook schrittweise nachvollzogen. Dabei steht nicht nur das fertige Programm im Mittelpunkt. Die einzelnen Datenstrukturen und Verarbeitungsschritte werden sichtbar gemacht, sodass der Aufbau des Huffman-Baums und die Erzeugung der Codes direkt ausprobiert werden können.

    (mehr …)
  • Daten komprimieren mit Köpfchen (Teil 1) – Der Huffman-Algorithmus einfach erklärt

    Daten komprimieren mit Köpfchen (Teil 1) – Der Huffman-Algorithmus einfach erklärt

    Herkömmliche Computercodes geben jedem Buchstaben starr denselben Speicherplatz – das häufige ‚E‘ verbraucht genauso viel wie das seltene ‚K‘.

    Der Huffman-Algorithmus wählt einen clevereren Weg: Häufige Zeichen bekommen sehr kurze Codes, seltene etwas längere. So schrumpft die Datenmenge ohne jeden Informationsverlust.

    Wie aus Zeichenhäufigkeiten Schritt für Schritt ein eleganter Huffman-Baum entsteht, schauen wir uns direkt am Beispielwort an: KAFFEEPAUSE.

    (mehr …)