Testiranje XPath izraza na XML i HTML dokumentima
XPath (XML Path Language) je standardizirani jezik koji se koristi za navigaciju kroz strukturu XML i HTML dokumenata te za odabir specifičnih dijelova tih dokumenata, poput elemenata, atributa ili tekstualnih vrijednosti. Kako bi se osiguralo da su napisani izrazi točni i da vraćaju željene podatke, koristi se XPath ispitivač.
Ovaj alat omogućuje izravno testiranje XPath izraza na XML ili HTML sadržaju koji sami priložite. Tijekom evaluacije, sustav prikazuje sve dijelove sadržaja koji se podudaraju s vašim izrazom, uključujući informacije o njihovoj vrsti, nazivu, putanji te pregled njihove vrijednosti. Korisnik zatim može kopirati vrijednost bilo kojeg pojedinačnog rezultata radi daljnje upotrebe.
Ulazni parametri i ograničenja alata
Za uspješno testiranje potrebno je definirati tri ključna parametra unutar sučelja:
- XML / HTML unos: Tekstualni sadržaj u XML ili HTML formatu. Maksimalna dopuštena duljina ovog unosa iznosi 500.000 znakova.
- XPath izraz: Izraz koji želite testirati na priloženom dokumentu. Maksimalna duljina izraza ograničena je na 4.000 znakova.
- Vrsta unosa: Izbor između dvije opcije rada, a to su "XML" i "HTML".
Alat ima ugrađena sigurnosna i tehnička ograničenja kako bi se osigurala stabilnost rada u pregledniku. Evaluacija svakog XPath izraza automatski se prekida nakon 2 sekunde kako bi stranica ostala responzivna. Ako se ti limiti prekorače ili ako dokument sadrži pogreške, sustav će prikazati odgovarajuće obavijesti.
Rezultati evaluacije i struktura prikaza
Nakon pokretanja provjere, alat generira detaljan pregled koji sadrži sljedeće elemente:
- Rezultati: Ukupan broj pronađenih podudaranja u dokumentu.
- Pojedinosti: Za svaki podudarni čvor prikazuju se njegova vrsta, naziv, putanja i pregled vrijednosti.
- Kopiraj rezultat: Gumb koji omogućuje brzo kopiranje vrijednosti pojedinačnog rezultata u međuspremnik.
- Znakovi: Brojač koji prikazuje točan broj znakova u unesenom dokumentu.
- Rezultati (statistika): Broj prikazanih rezultata na zaslonu.
Kada alat pronađe više od 200 rezultata, primjenjuje se pravilo skraćivanja prikaza. U tom slučaju ispisuje se poruka "Prikazuje se prvih {max}." te se prikazuju samo prvih 200 rezultata kako bi se očuvale performanse preglednika.
Razlike između XML i HTML načina rada
Odabir ispravnog načina rada ključan je za točnost evaluacije jer se pravila parsiranja razlikuju ovisno o formatu dokumenta:
- XML način rada: U ovom načinu strogo se poštuju XML pravila o prostorima naziva (namespaces). Prefiksi prostora naziva koji su deklarirani u vašem XML dokumentu mogu se slobodno koristiti unutar XPath izraza, na primjer
//x:item. Za zadane prostore naziva (default namespaces), izraz poput//itemtakođer prati službenu deklaraciju unutar dokumenta. - HTML način rada: Ovaj način rada je znatno fleksibilniji i tolerantniji prema strukturi. On omogućuje da jednostavne putanje, kao što je
//a, bez poteškoća pronađu i uporede uobičajene HTML oznake, čak i ako dokument nije strogo formatiran prema XML standardima.
Važno je napomenuti da ovaj alat radi isključivo na statičkom tekstu koji unesete. On ne predstavlja niti može prikazati strukturu u stvarnom vremenu, renderirani DOM ili mrežne zahtjeve aktivnih internetskih stranica.
Pravila obrade i privatnost podataka
Tijekom korištenja ovog alata, vaša privatnost je u potpunosti očuvana lokalnim izvođenjem operacija. Vaš XML, HTML i XPath testiraju se u Vašem pregledniku. Ništa se ne prenosi na BroBroGo. Svi procesi parsiranja i evaluacije odvijaju se lokalno na vašem uređaju, što znači da vaši podaci ne napuštaju vaše računalo niti se pohranjuju na vanjske poslužitelje.
Rješavanje pogrešaka i poruke sustava
U slučaju neispravnih unosa ili tehničkih ograničenja, alat će prikazati točno definirane poruke o pogreškama:
- Ako je uneseni dokument prevelik za obradu, prikazat će se poruka: "Ovaj je dokument prevelik za testiranje ovdje. Pokušajte s manjim uzorkom."
- Ako XPath izraz prelazi maksimalnu duljinu, sustav javlja: "Ovaj je XPath izraz predug za testiranje ovdje."
- U slučaju da dokument sadrži sintaktičke pogreške zbog kojih se ne može učitati, pojavljuje se poruka: "Nije moguće analizirati ovaj dokument."
- Ako sam XPath izraz nije napisan u skladu s pravilima sintakse, prikazuje se: "Ovaj XPath izraz nije valjan."
- Ako se izraz ne može primijeniti na strukturu, sustav ispisuje: "Nije moguće evaluirati ovaj XPath."
- Ako izvođenje izraza traje predugo i aktivira se sigurnosni prekid, prikazat će se poruka: "Izvođenje ovog XPath-a trajalo je predugo. Suzite izraz ili upotrijebite manji uzorak."
- Ako u dokumentu nema elemenata koji odgovaraju vašem upitu, alat će prikazati: "Nema rezultata."
Često postavljana pitanja (FAQ)
Mogu li testirati XPath na HTML-u kao i na XML-u?
Da. XML način rada zadržava pravila XML prostora naziva (namespaces). HTML način rada je fleksibilniji i omogućuje da jednostavne putanje poput //a odgovaraju uobičajenim oznakama.
Kako funkcioniraju XML prostori naziva (namespaces)?
Prefiksi prostora naziva deklarirani u Vašem XML-u mogu se koristiti u XPath-u, kao što je //x:item. Za zadane prostore naziva, //item također prati deklaraciju dokumenta.
Zašto upit može isteći?
Evaluacija vrlo velikih dokumenata ili širokih izraza može biti zahtjevna. Alat zaustavlja izvođenje nakon 2 sekunde kako bi stranica ostala responzivna; suzite putanju ili pokušajte s manjim uzorkom.