Wörterbuchkomprimierungssimulator
Erstellen Sie ein benutzerdefiniertes Komprimierungswörterbuch aus Ihren eigenen Beispieldaten, komprimieren Sie dann eine Zielzeichenfolge mit diesem Wörterbuch – und sehen Sie, wie es im Vergleich zu einfachem GZIP abschneidet. Der Wörterbuchkomprimierungssimulator modelliert die Funktionsweise gemeinsamer Wörterbücher von Brotli und Zstandard und zeigt die am häufigsten extrahierten Phrasen, die pro Ersetzung eingesparten Bytes und einen Vier-Wege-Größenvergleich an. Läuft vollständig in Ihrem Browser, ohne dass eine Anmeldung erforderlich ist.
Dictionary Compression Simulator
Build a custom compression dictionary from sample data, then compress a target string using that dictionary. See how dictionary coding compares to plain GZIP - and how combining both achieves maximum compression. Runs entirely in your browser.
Load an example:
Paste logs, templates, or any repetitive data
Paste new data of the same type as the sample
Dictionary Settings
Longer phrases capture more context but require more sample data. Larger dictionaries improve compression but add overhead.
Warum sollten Sie unseren Wörterbuchkomprimierungssimulator verwenden?
- Sofortige Wörterbucherstellung und Komprimierung: Fügen Sie Beispieldaten und eine Zielzeichenfolge ein, um sofort ein benutzerdefiniertes Komprimierungswörterbuch zu erstellen und die Komprimierung zu simulieren – vollständig in Ihrem Browser. Der Wörterbuchkomprimierungssimulator extrahiert Top-Phrasen nach gespeicherten Bytes und zeigt Ergebnisse in Sekunden an, ohne dass ein Server-Upload erforderlich ist.
- Sicherer Wörterbuchkomprimierungssimulator online: Ihre Beispieldaten und Zielzeichenfolgen verlassen niemals Ihr Gerät. Der Wörterbuchkomprimierungssimulator läuft vollständig in Ihrem Browser – keine Server-Uploads, keine Datenübertragung, 100 % privat. Sicher für API-Nutzdaten, Protokolldaten und proprietäre Inhalte.
- Vier-Wege-Komprimierungsvergleich: Der Wörterbuchkomprimierungssimulator zeigt vier Ergebnisse nebeneinander an: Originalgröße, nur GZIP, nur Wörterbuch und Wörterbuch + GZIP kombiniert – so können Sie genau sehen, wie viel jede Technik beiträgt und ob ein gemeinsames Wörterbuch den Mehraufwand für Ihre Daten wert ist.
- Für immer 100 % kostenlos: Der Wörterbuchkomprimierungssimulator ist völlig kostenlos, ohne Anmeldung, ohne Premium-Stufe, ohne Datengrößenbeschränkungen und ohne Werbung. Simulieren Sie die Wörterbuchkomprimierung für unbegrenzte Nutzdaten zum Nulltarif und für immer.
Häufige Anwendungsfälle für den Wörterbuchkomprimierungssimulator
- Planung der API-Antwortkomprimierung: Fügen Sie ein Beispiel Ihrer API-Antworten als Trainingsdaten und eine neue Antwort als Ziel ein. Der Wörterbuchkomprimierungssimulator zeigt, um wie viel ein gemeinsames Wörterbuch die Kabelgröße im Vergleich zu einfachem GZIP reduzieren würde – entscheidend für Hochfrequenz-API-Endpunkte, bei denen der GZIP-Kaltstart-Overhead erheblich ist.
- Analyse der Protokollzeilenkomprimierung: Verwenden Sie historische Protokollzeilen als Beispieldaten und neue Protokolleinträge als Ziel. Der Wörterbuchkomprimierungssimulator identifiziert die am häufigsten wiederholten Phrasen in Ihren Protokollen – Zeitstempel, Feldnamen, Statuscodes – und zeigt, um wie viel ein gemeinsames Wörterbuch die Protokollspeicherkosten senken würde.
- Bewertung des freigegebenen Brotli-Wörterbuchs: Bewerten Sie, ob ein freigegebenes Brotli-Wörterbuch (unterstützt in Chrome 117+ über die Spezifikation „Compression Dictionary Transport“) für Ihre Webanwendung von Vorteil wäre. Der Wörterbuchkomprimierungssimulator modelliert den gleichen Phrasenextraktionsansatz, den Brotli für sein statisches Wörterbuch verwendet.
- Zstandard-Wörterbuchtraining: Bevor Sie zstd --train auf Ihrem Server ausführen, verwenden Sie den Wörterbuchkomprimierungssimulator, um den Komprimierungsvorteil und die optimalen Phrasenlängeneinstellungen für Ihren Datentyp abzuschätzen. Dies hilft Ihnen bei der Entscheidung, ob der Schulungsaufwand für Ihren Anwendungsfall gerechtfertigt ist.
- WebSocket-Nachrichtenkomprimierung: Für WebSocket-Anwendungen, die viele kleine Nachrichten desselben Schemas senden, zeigt der Wörterbuchkomprimierungssimulator, wie stark ein gemeinsames Wörterbuch die Nachrichtengröße im Vergleich zu GZIP pro Nachricht reduzieren würde – was besonders wertvoll für Echtzeit-Datenfeeds und Chat-Anwendungen ist.
- Schulung zum Komprimierungsalgorithmus: Der Wörterbuchkomprimierungssimulator ist ein hervorragendes Lehrmittel, um zu verstehen, wie die Wörterbuchcodierung LZ77, Brotli und Zstandard funktioniert. Sehen Sie genau, welche Phrasen extrahiert werden, wie viele Ersetzungen vorgenommen werden und wie die Vorverarbeitung des Wörterbuchs die GZIP-Komprimierung verstärkt.
Was ist Wörterbuchkomprimierung?
Bei der Wörterbuchkomprimierung handelt es sich um eine Technik, bei der häufig vorkommende Teilzeichenfolgen durch kurze Rückverweise auf ein vorgefertigtes Komprimierungswörterbuch ersetzt werden. Anstatt jedes Zeichen einzeln zu kodieren, sagt der Kompressor „Verwenden Sie Phrase Nr. 42 aus dem Wörterbuch“ – eine 2-Byte-Referenz, die eine 20-Byte-Zeichenfolge ersetzt. Algorithmen wie LZ77, Brotli und Zstandard verwenden alle intern die Wörterbuchcodierung. Die wichtigste Erkenntnis besteht darin, dass ein gemeinsames Wörterbuch – vorab zwischen Kompressor und Dekomprimierer vereinbart – das Kaltstartproblem beseitigt, das GZIP für kleine Nutzlasten unwirksam macht. Unser Wörterbuchkomprimierungssimulator modelliert diesen Prozess mithilfe einer N-Gramm-Frequenzanalyse Ihrer Beispieldaten.
So funktioniert unser Wörterbuchkomprimierungssimulator
- 1 Fügen Sie Beispieldaten und eine Zielzeichenfolge ein: Die Beispieldaten werden zum Erstellen des Wörterbuchs verwendet. Verwenden Sie repräsentative Daten desselben Typs wie das, was Sie komprimieren möchten (z. B. frühere API-Antworten, Protokollzeilen, HTML-Vorlagen). Das Ziel ist die Zeichenfolge, die Sie komprimieren möchten. Beides wird vollständig in Ihrem Browser verarbeitet – es werden keine Daten an einen Server gesendet.
- 2 Klicken Sie auf „Wörterbuchkomprimierung simulieren“: Der Wörterbuchkomprimierungssimulator extrahiert alle N-Gramme (Teilzeichenfolgen konfigurierbarer Länge) aus den Beispieldaten, zählt ihre Häufigkeit und ordnet sie nach der Gesamtzahl der gespeicherten Bytes. Ein gieriger Deduplizierungsdurchlauf entfernt redundante Unterphrasen. Die obersten N Phrasen bilden das Wörterbuch.
- 3 Ergebnisse vergleichen: Der Simulator zeigt vier Größen – Original, nur GZIP, nur Wörterbuch und Wörterbuch + GZIP – mit einem visuellen Balkendiagramm, einem Statistikraster und einer Tabelle der häufigsten Wörterbuchphrasen mit ihrer Häufigkeit und den gespeicherten Bytes. GZIP-Größen sind exakt (native CompressionStream-API).
Was gemessen wird
- Wörterbuchphrasen: Die obersten N Teilzeichenfolgen aus den Beispieldaten, sortiert nach der Gesamtzahl der gespeicherten Bytes – (Phrasenlänge − 2) × Häufigkeit. Die −2 berücksichtigt die 2-Byte-Rückreferenzkosten, die jedes Vorkommen einer Phrase ersetzen.
- Durchgeführte Ersetzungen: Die Gesamtzahl der in der Zielzeichenfolge ersetzten Phrasenvorkommen. Mehr Ersetzungen bedeuten, dass die Zieldaten weitgehend mit den Beispieldaten übereinstimmen – ein gutes Zeichen für die Wirksamkeit des Wörterbuchs.
- Wörterbuch-Overhead: Die Gesamtgröße des Wörterbuchs selbst (Phrase-Bytes + 2-Byte-Index pro Eintrag). Hierbei handelt es sich um einmalige Kosten, die auf alle komprimierten Nachrichten verteilt werden und bei der Komprimierung vieler Nutzlasten vernachlässigbar sind.
- GZIP-Größen (genau): Tatsächliche GZIP-komprimierte Größen, berechnet mit der nativen CompressionStream-API des Browsers – sowohl für das ursprüngliche Ziel als auch für das im Wörterbuch vorverarbeitete Ziel.
Wörterbuchkomprimierung im Vergleich zu Standard-GZIP
Standard-GZIP erstellt für jede komprimierte Nutzlast eine eigene LZ77-Rückreferenztabelle von Grund auf. Bei großen Dateien funktioniert dies gut – der Kompressor verfügt über genügend Daten, um sich wiederholende Muster zu finden. Bei kleinen Nutzlasten (unter 1 KB) dominiert jedoch der Kaltstart-Overhead von GZIP und die Komprimierungsverhältnisse sind schlecht. Ein gemeinsames Wörterbuch löst dieses Problem, indem es den Kompressor mit bekannten Mustern vorlädt, bevor er die Zieldaten sieht. Aus diesem Grund erreicht Brotli eine bessere Komprimierung als GZIP für Webinhalte – sein integriertes statisches Wörterbuch mit mehr als 13.000 HTML-, CSS- und JavaScript-Strings verschafft ihm bei jeder Antwort einen Vorsprung. Mit dem Wörterbuchkomprimierungssimulator können Sie Ihr eigenes domänenspezifisches Wörterbuch erstellen und testen, um den gleichen Effekt zu erzielen.
Häufig gestellte Fragen
Ein Wörterbuchkomprimierungssimulator erstellt aus Beispieldaten ein benutzerdefiniertes Komprimierungswörterbuch und komprimiert damit eine Zielzeichenfolge. Dies zeigt, wie viel kleiner die Ausgabe im Vergleich zu einfachem GZIP ist. Unser kostenloser Online-Wörterbuchkomprimierungssimulator läuft vollständig in Ihrem Browser, eine Anmeldung ist nicht erforderlich.
Bei der Wörterbuchkomprimierung handelt es sich um eine Technik, bei der häufig vorkommende Teilzeichenfolgen durch kurze Rückverweise auf ein vorgefertigtes Wörterbuch ersetzt werden. Algorithmen wie Brotli und Zstandard unterstützen gemeinsame Wörterbücher – einen vorab vereinbarten Satz gemeinsamer Phrasen, die sowohl der Komprimierer als auch der Dekomprimierer kennen, was eine viel bessere Komprimierung für kleine oder sich wiederholende Nutzlasten ermöglicht.
Die Wörterbuchkomprimierung ist am effektivsten für viele kleine Nutzlasten desselben Typs – API-Antworten, Protokollzeilen, JSON-Datensätze, HTML-Vorlagen. GZIP allein hat mit kleinen Nutzlasten zu kämpfen, da für jede Nachricht ein eigenes Wörterbuch von Grund auf erstellt werden muss. Ein gemeinsames Wörterbuch beseitigt dieses Kaltstartproblem.
Ja, völlig. Der Wörterbuchkomprimierungssimulator läuft vollständig in Ihrem Browser. Ihre Beispieldaten und Zielzeichenfolgen werden niemals auf einen Server hochgeladen und verlassen niemals Ihr Gerät. Die gesamte Verarbeitung erfolgt lokal und unter vollständiger Privatsphäre.
Ja – 100 % kostenlos, für immer. Keine Anmeldung, kein Konto, keine Premium-Stufe, keine Datengrößenbeschränkungen und keine Werbung. Simulieren Sie die Wörterbuchkomprimierung für unbegrenzte Nutzlasten völlig kostenlos.
Der Wörterbuchkomprimierungssimulator extrahiert die häufigsten Teilzeichenfolgen (n-Gramm) aus Ihren Beispieldaten, sortiert nach der Gesamtzahl der gespeicherten Bytes. Es verwendet einen gierigen Deduplizierungsdurchlauf, um redundante Einträge zu vermeiden – kürzere Phrasen, die Teilzeichenfolgen bereits ausgewählter längerer Phrasen sind, werden übersprungen. Sie können die minimale und maximale Phrasenlänge sowie die Gesamtzahl der Wörterbucheinträge steuern.
Das Wörterbuch selbst nimmt Platz ein – jede Phrase muss gespeichert werden, damit der Dekomprimierer sie nachschlagen kann. Der Wörterbuchkomprimierungssimulator zeigt den Wörterbuch-Overhead in Bytes an. Bei diesem Overhead handelt es sich um einmalige Kosten, die auf alle komprimierten Nachrichten verteilt werden, sodass er beim Komprimieren vieler Nutzlasten desselben Typs vernachlässigbar wird.
Brotli (RFC 7932) verfügt über ein integriertes statisches Wörterbuch mit über 13.000 gängigen Web-Strings. Zstandard unterstützt benutzerdefinierte gemeinsame Wörterbücher über den Befehl zstd --train. Der Wörterbuchkomprimierungssimulator modelliert dieses Konzept – er erstellt ein domänenspezifisches Wörterbuch aus Ihren eigenen Beispieldaten und zeigt den Komprimierungsvorteil gegenüber generischem GZIP.