Ce validateur de flux RSS permet d'analyser la structure XML d'un flux RSS 2.0 ou Atom 1.0 afin d'identifier son format, de lister ses entrées et de signaler les anomalies de construction, les champs obligatoires manquants ainsi que les erreurs de syntaxe dans les liens. L'outil traite l'intégralité des données localement: votre flux est vérifié dans votre navigateur, et BroBroGo ne téléverse ni n’enregistre rien.
Fonctionnement et limites de l'analyse
Le processus d'analyse se concentre exclusivement sur la conformité structurelle et syntaxique du document XML soumis. L'outil accepte des fichiers contenant jusqu'à 500 000 caractères.
Il convient de distinguer la validation structurelle de la validation de contenu. Ce rapport vérifie uniquement la structure et les règles de format courantes. Il ne prouve pas que le contenu est exact, sûr, accepté par tous les lecteurs ou prêt à être publié. De plus, l'analyseur n'effectue aucune requête réseau: il n’ouvre aucune URL et ne teste donc ni disponibilité, ni redirection, ni certificat, ni contenu de destination.
Pour les flux volumineux, l'affichage des résultats est limité afin de garantir la lisibilité: le rapport affiche un maximum de 200 problèmes et 100 entrées, en indiquant si une troncature a été appliquée.
Structure et exigences des flux RSS 2.0
Les flux basés sur la spécification RSS 2.0 doivent respecter une hiérarchie stricte sous l'élément racine. Le validateur applique des règles précises pour valider ces documents:
- Le canal unique: RSS doit contenir exactement un <channel> direct ; ‹count› ont été trouvés.
- Champs requis pour les éléments (items): Pour chaque élément du flux, l'outil vérifie la présence d'au moins un titre ou d'une description. Il extrait et valide également le
GUID, lelink(lien) et la date de publication. - Format des dates: Les dates doivent respecter la syntaxe définie par la spécification RSS 2.0 (généralement le format RFC 822/1123). Une anomalie déclenche l'alerte: Utilisez une date réelle au format exigé par ce flux.
Structure et exigences des flux Atom 1.0
Le format Atom 1.0 impose des contraintes différentes et souvent plus strictes que le format RSS 2.0, notamment en matière de gestion des identifiants et des auteurs.
Gestion des auteurs et héritage
Dans un flux Atom, la paternité du contenu est obligatoire. L'outil vérifie l'héritage de l'auteur selon les règles suivantes:
- Si le flux global ne possède pas d'auteur, chaque entrée doit en définir un individuellement. À défaut, le validateur affiche: Ajoutez un <author> au flux, ou un <author> direct à chaque entrée.
- Pour chaque entrée individuelle, l'absence d'auteur valide génère l'erreur: Ajoutez un <author> à cette entrée, à son <source> ou au flux.
Règles de contenu et de résumé
Atom permet d'inclure du contenu directement ou de faire référence à des ressources externes via l'attribut src. Le validateur applique les règles d'exclusion et de complémentarité suivantes:
- Lorsque <content> utilise src, retirez son texte et ses éléments enfants intégrés.
- Ajoutez <summary> lorsque le contenu Atom est externe ou illisible comme texte.
- Ajoutez un <link> alternatif lorsqu’une entrée Atom ne contient pas de <content> intégré.
Gestion des liens et rôle de xml:base dans Atom
Les liens et les identifiants uniques (ID) sont essentiels pour la syndication de contenu. Le validateur analyse la validité de chaque URI et applique des règles strictes pour éviter les références cassées ou ambiguës.
Résolution des liens relatifs avec xml:base
Dans le format Atom 1.0, les adresses peuvent être écrites de manière relative si et seulement si un attribut xml:base est défini au niveau du flux ou de l'élément pour résoudre l'adresse absolue. L'outil utilise cet attribut pour reconstituer les URL complètes. Si une référence relative ne peut pas être résolue, le message suivant est généré: Utilisez une adresse absolue pour ‹field›; seules les références Atom ayant un xml:base utilisable peuvent être relatives.
Identifiants uniques (ID)
Contrairement aux liens de navigation, les identifiants Atom doivent obligatoirement être des IRI absolus. Les identifiants relatifs sont rejetés avec le message: Utilisez un IRI absolu pour ‹field›; les identifiants relatifs ne sont pas des ID Atom valides. De plus, chaque ID doit être unique au sein du flux. Si un doublon est détecté, l'outil signale: Cet ID reprend la valeur rencontrée pour la première fois à la ligne ‹first›.
Erreurs courantes et messages du validateur
Lors de l'analyse d'un flux, plusieurs types d'erreurs peuvent interrompre ou invalider le traitement. Voici les principaux messages d'erreur générés par l'interface:
| Type d'anomalie | Message d'erreur de l'interface |
|---|---|
| Présence d'un DOCTYPE | Retirez la déclaration DOCTYPE avant de vérifier ce flux. |
| XML syntaxiquement incorrect | Corrigez le XML mal formé, puis relancez la validation. |
| Format non pris en charge | Utilisez un document RSS 2.0 avec <rss> ou un document Atom 1.0 avec <feed>. |
| Version incorrecte | Ce validateur accepte ‹format› ‹expected›; ‹actual› a été détecté. |
| Champ obligatoire manquant | Ajoutez le champ obligatoire ‹field›. |
| Doublon de champ unique | Conservez un seul ‹field›; ‹count› ont été trouvés. |
| Lien mal formé | Corrigez ‹field›: ce lien ne peut pas être analysé comme URL ou référence URI. |
Si le traitement rencontre une contrainte technique ou un dépassement de capacité, l'un des messages suivants s'affiche:
- Cet outil accepte jusqu’à
‹max›caractères par vérification. - La validation a pris trop de temps. Essayez un flux plus petit.
- La validation n’a pas pu aboutir.
FAQ
Quels formats de flux ce validateur accepte-t-il?
Il valide les documents RSS 2.0 et Atom 1.0 actuels. Les anciens formats RSS, RDF/RSS 1.0 et Atom 0.3 sont reconnus, sans recevoir des règles qui ne leur correspondent pas.
Ouvre-t-il ou teste-t-il les liens du flux?
Il analyse les champs contenant des liens et résout les références Atom relatives grâce à xml:base. Il n’ouvre aucune URL et ne teste donc ni disponibilité, ni redirection, ni certificat, ni contenu de destination.
Quels champs des entrées sont vérifiés?
Pour RSS, il vérifie la présence d’un titre ou d’une description et lit le GUID, le lien et la date de publication. Pour Atom, il vérifie l’ID, le titre, la date de mise à jour, l’auteur hérité, les liens alternatifs et les règles de contenu ou de résumé.
Pourquoi l'erreur concernant la déclaration DOCTYPE s'affiche-t-elle?
Les déclarations DOCTYPE peuvent poser des problèmes de sécurité ou de traitement lors de l'analyse du XML. Le validateur exige leur retrait avant de pouvoir analyser le reste de la structure du flux.