Encodeur/décodeur d’URL et entités HTML

Encodez les URL, décodez les séquences d’échappement avec pourcentage et effectuez l’échappement des entités HTML.

Outil
Action
Portée de l’URL
Entrée
Sortie
Prêt. Collez du texte et choisissez une action.

Vos textes d’URL et de code HTML sont convertis dans votre navigateur. Rien n’est téléversé vers BroBroGo.

FAQ

Devrais-je choisir un composant d’URL ou l’URL complète?

Utilisez « Composant » pour les valeurs de requête, les segments de chemin ou les valeurs de formulaire. Utilisez « URL complète » lorsque vous souhaitez que les caractères comme : / ? & = restent lisibles.

Que modifie l’échappement des entités HTML?

Il convertit les caractères tels que <, >, &, les guillemets et le texte non ASCII en entités qui peuvent être collées de façon sécuritaire dans du texte ou des attributs HTML.

Pourquoi le décodage d’URL échoue-t-il parfois?

Les séquences d’échappement avec pourcentage doivent former des séquences UTF-8 complètes. Une séquence tronquée comme %E0%A4%A ne peut pas être décodée de façon fiable sans approximation.

Ce guide technique détaille le fonctionnement de l’outil de conversion pour les URL et les entités HTML. Cet outil permet de traiter des chaînes de caractères jusqu’à un maximum de 2 000 000 de caractères directement dans l’interface.

Fonctionnement de l’encodage et du décodage d’URL

L’encodage d’URL, souvent appelé encodage en pourcentage (percent-encoding), est un mécanisme qui permet de représenter des caractères spéciaux au sein des adresses web afin de garantir leur transmission sans altération. Les navigateurs et les serveurs web s’appuient sur ces représentations pour interpréter correctement les requêtes.

Le processus de décodage effectue l’opération inverse: il convertit les séquences d’échappement avec pourcentage pour restituer le texte d’origine. Par exemple, la chaîne de caractères bonjour tout le monde & city=Montreal devient bonjour%20tout%20le%20monde%20%26%20city%3DMontreal après encodage, et cette dernière retrouve sa forme initiale après décodage.

Différence entre composant d’URL et URL complète

L’outil propose deux options de portée pour le traitement des URL, qui s’appuient sur des fonctions JavaScript distinctes:

  • Composant (via encodeURIComponent / decodeURIComponent): Cette option est conçue pour traiter les valeurs individuelles destinées à être insérées dans une URL, telles que les paramètres de requête, les segments de chemin d’accès ou les valeurs de formulaires. Elle encode de manière stricte tous les caractères réservés, y compris les séparateurs comme :, /, ?, & et =.
  • URL complète (via encodeURI / decodeURI): Cette option est réservée au traitement d’une adresse web entière. Elle préserve la structure globale de l’URL en laissant lisibles et intacts les caractères de contrôle essentiels tels que :, /, ?, & et =.

Lorsque l’utilisateur sélectionne le mode lié aux entités HTML, le contrôle de la portée de l’URL est automatiquement masqué de l’interface.

Échappement et déséchappement des entités HTML

L’échappement des entités HTML consiste à remplacer certains caractères spécifiques par leurs représentations textuelles équivalentes (sous forme nommée ou numérique). Cette opération vise à rendre le texte sécuritaire pour une insertion directe dans du code ou des attributs HTML, évitant ainsi que le navigateur n’interprète ces caractères comme des balises actives ou du code exécutable.

Le traitement cible principalement:

  • Le caractère inférieur à <
  • Le caractère supérieur à >
  • La esperluette &
  • Les guillemets simples et doubles
  • Les caractères non ASCII (comme le texte 保存 ou d’autres alphabets)

Le déséchappement réalise l’opération inverse, restituant les caractères d’origine à partir de leurs entités HTML respectives. Il convient de noter que l’échappement et le déséchappement d’entités se distinguent des processus de désinfection (sanitization) de sécurité complets, car ils se limitent à la conversion brute des caractères sans analyser la structure sémantique du code.

Séquences d’échappement avec pourcentage et exigences UTF-8

Lors du décodage d’une URL, les séquences d’échappement avec pourcentage doivent impérativement correspondre à des séquences UTF-8 complètes et valides. Chaque octet d’un caractère multi-octets doit être correctement représenté.

Si l’entrée contient une séquence tronquée ou incomplète, comme %E0%A4%A, le décodage échoue. L’outil ne pouvant pas reconstituer de manière fiable le caractère d’origine sans approximation, il interrompt l’opération et affiche le message d’erreur: « Ce texte d’URL contient une séquence d’échappement avec pourcentage non valide. ».

Gestion des erreurs et messages de l’interface

L’outil intègre plusieurs règles de validation et affiche des messages précis selon l’état du traitement:

  • Absence d’entrée: Si l’utilisateur tente une conversion sans texte, le message « Veuillez d’abord coller une entrée. » s’affiche.
  • Dépassement de limite: Si le texte dépasse 2 000 000 de caractères, l’outil affiche « Cette entrée est trop volumineuse pour cet outil. Veuillez la limiter à moins de {max} caractères. ».
  • Délai d’attente dépassé: Si le traitement prend trop de temps, le message « Cette conversion prend trop de temps. Essayez une entrée plus courte. » apparaît.
  • Échec générique: En cas d’anomalie non spécifiée, l’interface indique « Impossible de convertir cette entrée. ».
  • Actions sur l’interface: Le chargement d’un exemple affiche « Exemple chargé. ». L’effacement des champs affiche « Entrée et sortie effacées. ». Le transfert du résultat vers le champ de saisie affiche « La sortie a été déplacée vers l’entrée. ».

Confidentialité et traitement des données

Le traitement de vos données s’effectue localement. Vos textes d’URL et de code HTML sont convertis dans votre navigateur. Aucune donnée n’est téléversée vers BroBroGo.


FAQ

Devrais-je choisir un composant d’URL ou l’URL complète?

Utilisez « Composant » pour les valeurs de requête, les segments de chemin ou les valeurs de formulaire. Utilisez « URL complète » lorsque vous souhaitez que les caractères comme : / ? & = restent lisibles.

Que modifie l’échappement des entités HTML?

Il convertit les caractères tels que <, >, &, les guillemets et le texte non ASCII en entités qui peuvent être collées de façon sécuritaire dans du texte ou des attributs HTML.

Pourquoi le décodage d’URL échoue-t-il parfois?

Les séquences d’échappement avec pourcentage doivent former des séquences UTF-8 complètes. Une séquence tronquée comme %E0%A4%A ne peut pas être décodée de façon fiable sans approximation.