URL-Codierer/Decodierer
Codiert und decodiert URLs.
Ungültige URL
Was URL-Kodierung und -Dekodierung sind
Die URL-Kodierung, auch Prozentkodierung genannt, ist das Verfahren, das Zeichen, die eine URL nicht tragen kann – nichtlateinische Schrift und Sonderzeichen –, in eine ASCII-Zeichenkette der Form %XX verwandelt. Eine URL wurde unter der Annahme allein von ASCII-Zeichen entworfen, weshalb diese Umwandlung nötig ist, sobald Sie Mehrbytezeichen oder reservierte Zeichen wie ? und & als Parameterwert übergeben.
Dieses Werkzeug kodiert und dekodiert die eingegebene URL oder Zeichenkette mit einem Klick, und das Ergebnis lässt sich unverändert kopieren und verwenden. Es kommt bei allerlei Entwicklungsarbeit zum Zug: beim Zusammenbau von Schnittstellenanfragen, beim Erzeugen von Weiterleitungs-URLs und beim Prüfen des Inhalts einer bereits kodierten URL, die ein anderes System übergeben hat.
So verwenden Sie es
- Die umzuwandelnde Zeichenkette eingeben Fügen Sie Text mit nichtlateinischen Zeichen oder eine bereits kodierte URL in das Eingabefeld ein.
- Kodieren oder Dekodieren wählen Wählen Sie Kodieren, um eine gewöhnliche Zeichenkette in Prozentschreibweise zu bringen, oder Dekodieren, um Prozentschreibweise wieder herzustellen.
- Ergebnis prüfen Die umgewandelte Zeichenkette erscheint sogleich.
- Ergebnis kopieren und verwenden Sie können es unmittelbar in den Abfrageparameter einer Schnittstellenanfrage oder in eine Weiterleitungs-URL einfügen.
Tipps für die Nutzung
- Das japanische Zeichen「あ」wird in UTF-8 als
%E3%81%82kodiert. - Ein Leerzeichen kann in URL-Pfaden zu
%20oder in Query-Parametern zu+werden – ein Unterschied zwischen RFC 3986 und der HTML-Formular-Spezifikation. - Reservierte Zeichen wie
?,&und=müssen kodiert werden, wenn sie als Parameterwerte verwendet werden. - Nützlich bei der Verwendung von Nicht-ASCII-Zeichen in REST-API-Query-Parametern oder beim sicheren Übergeben von Weiterleitungs-URLs.
Wann es nützt
Abfrageparameter für eine REST-Schnittstelle bauen
Verwenden Sie es, wenn Sie Suchbegriffe oder frei eingegebene Werte sicher in eine Abfragezeichenkette aufnehmen wollen.
Eine Weiterleitungs-URL zusammensetzen
Betten Sie eine Ziel-URL als Parameter in eine andere URL ein, verhindert das Kodieren einen Zusammenstoß mit den Trennzeichen.
Eine von einem anderen System erhaltene URL prüfen
Dekodieren Sie eine von einem Protokoll oder Fremddienst übergebene, mit Prozentschreibweise überfrachtete URL, und Sie können die tatsächlichen Parameterwerte lesen.
Links für E-Mail-Texte und das Teilen in sozialen Netzen erstellen
Sie können Text sicher in einen Mailto-Link mit Betreff und Nachricht oder in eine URL zum Teilen in sozialen Netzen einbauen.
Verwendete Begriffe
- Prozentkodierung
- Ein Verfahren, das ein Zeichen in seine UTF-8-Bytefolge verwandelt und jedes Byte als Prozentzeichen mit zwei hexadezimalen Ziffern ausdrückt. Es stellt Zeichen, die eine URL nicht tragen kann, sicher dar.
- Reservierte Zeichen
- Symbole wie ?, &, =, # und +, die der Gliederung einer URL dienen. In einem Parameterwert müssen sie kodiert werden.
- Nicht reservierte Zeichen
- Die alphanumerischen Zeichen sowie die vier Symbole -, _, . und ~. RFC 3986 legt fest, dass sie keiner Kodierung bedürfen.
- RFC 3986
- Der Internetstandard, der die Syntax eines URI festlegt. Auch die Regeln der Prozentkodierung sind dort bestimmt.
- application/x-www-form-urlencoded
- Das Kodierformat, das beim Absenden eines HTML-Formulars verwendet wird. Es weicht vom URI-Standard darin ab, dass es ein Leerzeichen in ein Pluszeichen statt in %20 verwandelt.
Häufige Fragen
%XX umgewandelt, das in URLs sicher verwendet werden kann. Beim Dekodieren wird dieser Vorgang umgekehrt und der ursprüngliche Text wiederhergestellt.%20 in URL-Pfaden (gemäß RFC 3986). + wird nur in application/x-www-form-urlencoded-Query-Strings (HTML-Formulardaten) eingesetzt. Im Zweifelsfall ist %20 die sicherere Wahl.- _ . ~ — dürfen in URLs ohne Kodierung erscheinen. Alle anderen, einschließlich reservierter Zeichen wie & und =, müssen kodiert werden, wenn sie als Parameterwerte verwendet werden.
Übrigens – Die Geburt der URL: Tim Berners-Lee und der Aufbruch des World Wide Web
Die URL wurde 1991 von Tim Berners-Lee, dem Erfinder des World Wide Web, entworfen. Da sie ursprünglich nur für ASCII-Zeichen konzipiert war, müssen Mehrbyte-Zeichen (wie Japanisch) und Sonderzeichen durch Prozentkodierung dargestellt werden.
Die URL der ersten Webseite im Internet, http://info.cern.ch/hypertext/WWW/TheProject.html, ist noch heute erreichbar. Emoji-Domains (z. B. 🍕.ws) sind technisch möglich und werden intern in Punycode (das Format, das mit xn-- beginnt) umgewandelt. Obwohl URLs theoretisch über 2.000 Zeichen lang sein können, liegen die praktischen Grenzen von Browsern und Servern bei etwa 2.048 Zeichen.
RFC 3986 definiert die URL-Spezifikation, aber die Unterscheidung zwischen %20 (Leerzeichen) und + (Leerzeichen) ist nach wie vor eine häufige Fehlerquelle. %20 ist der URI-Standard; + wird im application/x-www-form-urlencoded-Format von HTML-Formularen verwendet – die Wahl hängt vom Kontext ab.