URL-Codierer/Decodierer

Codiert und decodiert URLs.

Ungültige URL

Was URL-Kodierung und -Dekodierung sind

Die URL-Kodierung, auch Prozentkodierung genannt, ist das Verfahren, das Zeichen, die eine URL nicht tragen kann – nichtlateinische Schrift und Sonderzeichen –, in eine ASCII-Zeichenkette der Form %XX verwandelt. Eine URL wurde unter der Annahme allein von ASCII-Zeichen entworfen, weshalb diese Umwandlung nötig ist, sobald Sie Mehrbytezeichen oder reservierte Zeichen wie ? und & als Parameterwert übergeben.

Dieses Werkzeug kodiert und dekodiert die eingegebene URL oder Zeichenkette mit einem Klick, und das Ergebnis lässt sich unverändert kopieren und verwenden. Es kommt bei allerlei Entwicklungsarbeit zum Zug: beim Zusammenbau von Schnittstellenanfragen, beim Erzeugen von Weiterleitungs-URLs und beim Prüfen des Inhalts einer bereits kodierten URL, die ein anderes System übergeben hat.

So verwenden Sie es

  1. Die umzuwandelnde Zeichenkette eingeben Fügen Sie Text mit nichtlateinischen Zeichen oder eine bereits kodierte URL in das Eingabefeld ein.
  2. Kodieren oder Dekodieren wählen Wählen Sie Kodieren, um eine gewöhnliche Zeichenkette in Prozentschreibweise zu bringen, oder Dekodieren, um Prozentschreibweise wieder herzustellen.
  3. Ergebnis prüfen Die umgewandelte Zeichenkette erscheint sogleich.
  4. Ergebnis kopieren und verwenden Sie können es unmittelbar in den Abfrageparameter einer Schnittstellenanfrage oder in eine Weiterleitungs-URL einfügen.

Tipps für die Nutzung

  • Das japanische Zeichen「あ」wird in UTF-8 als %E3%81%82 kodiert.
  • Ein Leerzeichen kann in URL-Pfaden zu %20 oder in Query-Parametern zu + werden – ein Unterschied zwischen RFC 3986 und der HTML-Formular-Spezifikation.
  • Reservierte Zeichen wie ?, & und = müssen kodiert werden, wenn sie als Parameterwerte verwendet werden.
  • Nützlich bei der Verwendung von Nicht-ASCII-Zeichen in REST-API-Query-Parametern oder beim sicheren Übergeben von Weiterleitungs-URLs.

Wann es nützt

Abfrageparameter für eine REST-Schnittstelle bauen

Verwenden Sie es, wenn Sie Suchbegriffe oder frei eingegebene Werte sicher in eine Abfragezeichenkette aufnehmen wollen.

Eine Weiterleitungs-URL zusammensetzen

Betten Sie eine Ziel-URL als Parameter in eine andere URL ein, verhindert das Kodieren einen Zusammenstoß mit den Trennzeichen.

Eine von einem anderen System erhaltene URL prüfen

Dekodieren Sie eine von einem Protokoll oder Fremddienst übergebene, mit Prozentschreibweise überfrachtete URL, und Sie können die tatsächlichen Parameterwerte lesen.

Links für E-Mail-Texte und das Teilen in sozialen Netzen erstellen

Sie können Text sicher in einen Mailto-Link mit Betreff und Nachricht oder in eine URL zum Teilen in sozialen Netzen einbauen.

Verwendete Begriffe

Prozentkodierung
Ein Verfahren, das ein Zeichen in seine UTF-8-Bytefolge verwandelt und jedes Byte als Prozentzeichen mit zwei hexadezimalen Ziffern ausdrückt. Es stellt Zeichen, die eine URL nicht tragen kann, sicher dar.
Reservierte Zeichen
Symbole wie ?, &, =, # und +, die der Gliederung einer URL dienen. In einem Parameterwert müssen sie kodiert werden.
Nicht reservierte Zeichen
Die alphanumerischen Zeichen sowie die vier Symbole -, _, . und ~. RFC 3986 legt fest, dass sie keiner Kodierung bedürfen.
RFC 3986
Der Internetstandard, der die Syntax eines URI festlegt. Auch die Regeln der Prozentkodierung sind dort bestimmt.
application/x-www-form-urlencoded
Das Kodierformat, das beim Absenden eines HTML-Formulars verwendet wird. Es weicht vom URI-Standard darin ab, dass es ein Leerzeichen in ein Pluszeichen statt in %20 verwandelt.

Häufige Fragen

Beim Kodieren werden Zeichen wie Leerzeichen und Nicht-ASCII-Buchstaben in das hexadezimale Format %XX umgewandelt, das in URLs sicher verwendet werden kann. Beim Dekodieren wird dieser Vorgang umgekehrt und der ursprüngliche Text wiederhergestellt.

Verwende %20 in URL-Pfaden (gemäß RFC 3986). + wird nur in application/x-www-form-urlencoded-Query-Strings (HTML-Formulardaten) eingesetzt. Im Zweifelsfall ist %20 die sicherere Wahl.

Nicht reservierte Zeichen — Buchstaben (A–Z, a–z), Ziffern (0–9) und die Symbole - _ . ~ — dürfen in URLs ohne Kodierung erscheinen. Alle anderen, einschließlich reservierter Zeichen wie & und =, müssen kodiert werden, wenn sie als Parameterwerte verwendet werden.
Tool-kun

Übrigens – Die Geburt der URL: Tim Berners-Lee und der Aufbruch des World Wide Web

Die URL wurde 1991 von Tim Berners-Lee, dem Erfinder des World Wide Web, entworfen. Da sie ursprünglich nur für ASCII-Zeichen konzipiert war, müssen Mehrbyte-Zeichen (wie Japanisch) und Sonderzeichen durch Prozentkodierung dargestellt werden.

Die URL der ersten Webseite im Internet, http://info.cern.ch/hypertext/WWW/TheProject.html, ist noch heute erreichbar. Emoji-Domains (z. B. 🍕.ws) sind technisch möglich und werden intern in Punycode (das Format, das mit xn-- beginnt) umgewandelt. Obwohl URLs theoretisch über 2.000 Zeichen lang sein können, liegen die praktischen Grenzen von Browsern und Servern bei etwa 2.048 Zeichen.

RFC 3986 definiert die URL-Spezifikation, aber die Unterscheidung zwischen %20 (Leerzeichen) und + (Leerzeichen) ist nach wie vor eine häufige Fehlerquelle. %20 ist der URI-Standard; + wird im application/x-www-form-urlencoded-Format von HTML-Formularen verwendet – die Wahl hängt vom Kontext ab.