Robots.txt გენერატორი და ვალიდატორი

შექმენით ინდექსაციის წესები და შეამოწმეთ, რომელ გზებზე აქვს წვდომა Googlebot-ს.

ინდექსაციის წესები

დაიწყეთ საძიებო რობოტით (crawler), რომელმაც უნდა დაიცვას ეს წესები.

საიტის რუკები

გენერირებული robots.txt

0
robots.txt
მზადაა. მაგალითი ბლოკავს /admin გზას ყველა რობოტისთვის.

წესების შემოწმება

    გზის ტესტირება

    თქვენი ინდექსაციის წესები იქმნება და მოწმდება თქვენს ბრაუზერში. BroBroGo-ზე არაფერი იტვირთება.

    ხშირად დასმული კითხვები

    რისი დამატება შეუძლია ამ გენერატორს robots.txt-ში?

    დაამატეთ user-agent ჯგუფი, Allow და Disallow გზები და საიტის რუკის (sitemap) ერთი ან მეტი URL-ი. წინასწარ ნაჩვენები კოდი მზადაა robots.txt ფაილში ჩასაწერად.

    როგორ ირჩევს გზის შემმოწმებელი წესს?

    ის მიჰყვება Google-ის შესაბამისობის წესს: ყველაზე გრძელი შესაბამისი გზა იმარჯვებს. თუ შესაბამისი Allow და Disallow წესები თანაბრად სპეციფიკურია, იმარჯვებს Allow.

    აშორებს თუ არა Disallow გვერდს Google Search-იდან?

    არა. დაბლოკილი გვერდი მაინც შეიძლება გამოჩნდეს ძიების შედეგებში, თუ მასზე სხვა გვერდები მიუთითებენ. გამოიყენეთ noindex, წვდომის კონტროლი ან წაშალეთ გვერდი, თუ გსურთ მისი ძიებიდან სრულიად გამორიცხვა.

    Robots.txt ფაილის დანიშნულება და მუშაობის პრინციპი

    Robots.txt არის ტექსტური ფაილი, რომელიც განთავსებულია ვებგვერდის ძირეულ დირექტორიაში და განსაზღვრავს წესებს საძიებო რობოტებისთვის (crawlers), როგორიცაა Googlebot. ამ ფაილის მეშვეობით ვებგვერდის ადმინისტრატორებს შეუძლიათ მართონ საძიებო სისტემების წვდომა საიტის სხვადასხვა ნაწილზე.

    ინსტრუმენტი "Robots.txt გენერატორი და ვალიდატორი" საშუალებას გაძლევთ შექმნათ გამართული წესები და შეამოწმოთ კონკრეტული URL გზების ხელმისაწვდომობა სხვადასხვა საძიებო რობოტისთვის. ინსტრუმენტი მუშაობს უშუალოდ მომხმარებლის ბრაუზერში — თქვენი ინდექსაციის წესები იქმნება და მოწმდება თქვენს ბრაუზერში. BroBroGo-ზე არაფერი იტვირთება.

    User-agent დირექტივები და რობოტების მართვა

    Robots.txt ფაილის სტრუქტურა ეფუძნება ჯგუფებს, რომლებიც მიმართულია კონკრეტული საძიებო რობოტებისკენ. თითოეული ჯგუფი იწყება User-agent დირექტივით, რომელიც განსაზღვრავს, თუ რომელ რობოტზე ვრცელდება შემდგომი წესები.

    • ყველა რობოტის მართვა: სიმბოლო * გამოიყენება ყველა საძიებო რობოტის ერთდროულად მისამართებისთვის. ნაგულისხმევად, გენერატორი იწყება პარამეტრებით User-agent: * და Disallow: /admin.
    • კონკრეტული რობოტები: შეგიძლიათ მიუთითოთ კონკრეტული რობოტის სახელი (მაგალითად, Googlebot). გაითვალისწინეთ, რომ User-agent-ის სახელები არ უნდა შეიცავდეს გამოტოვებებს (spaces).

    თუ ერთი და იგივე საძიებო რობოტი მითითებულია რამდენიმე სხვადასხვა ჯგუფში, ვალიდატორი აჩვენებს გაფრთხილებას: "Google აერთიანებს ჯგუფებს, რომლებიც მიუთითებენ ერთსა და იმავე user-agent-ზე".

    Allow და Disallow წესების ურთიერთქმედება

    საძიებო რობოტების ქცევის დასარეგულირებლად გამოიყენება ორი ძირითადი დირექტივა: Allow (ნებადართვა) და Disallow (აკრძალვა). ამ წესების შექმნისას დაცული უნდა იყოს შემდეგი სინტაქსური მოთხოვნები:

    1. წესის გზები აუცილებლად უნდა იწყებოდეს / სიმბოლოთი და არ უნდა შეიცავდეს გამოტოვებებს. წინააღმდეგ შემთხვევაში, სისტემა აჩვენებს შეცდომას: "წესის გზები უნდა იწყებოდეს /-ით და არ უნდა შეიცავდეს გამოტოვებებს".
    2. სიმბოლო $ გამოიყენება მხოლოდ გზის დასასრულის აღსანიშნავად. თუ ის სხვა ადგილას იქნება გამოყენებული, გამოჩნდება შეცდომა: "გამოიყენეთ $ მხოლოდ წესის გზის ბოლოში".
    3. დუბლირების თავიდან ასაცილებლად, თუ ერთი და იგივე წესი განმეორდება ერთი აგენტისთვის, ვალიდატორი მონიშნავს მას შეტყობინებით: "ეს წესი მეორდება იგივე user-agent-ისთვის".

    როდესაც Allow და Disallow წესები მიმართულია ერთი და იმავე გზისკენ, წარმოიქმნება კონფლიქტი. ვალიდატორი ამ დროს გამოსცემს გაფრთხილებას: "Allow და Disallow იყენებენ ერთსა და იმავე გზას. Google იყენებს Allow-ს, როდესაც ორივე თანაბრად სპეციფიკურია".

    საიტის რუკის (Sitemap) მნიშვნელობა

    საიტის რუკის URL-ის მითითება robots.txt ფაილში ეხმარება საძიებო რობოტებს ვებგვერდის სტრუქტურის სწრაფად აღმოჩენასა და ინდექსაციაში.

    გენერატორში საიტის რუკის დამატებისას აუცილებელია სრული მისამართის მითითება. URL უნდა იწყებოდეს http:// ან https:// პროტოკოლით. არასრული მისამართის შეყვანის შემთხვევაში, ვალიდატორი აჩვენებს შეცდომას: "საიტის რუკის URL-ს სჭირდება სრული http:// ან https:// მისამართი".

    Google-ის წესების შესაბამისობის პრინციპი

    როდესაც საძიებო რობოტი ამოწმებს კონკრეტულ URL-ს, ის მიჰყვება Google-ის შესაბამისობის წესებს:

    • ყველაზე გრძელი გზის პრინციპი: პრიორიტეტი ენიჭება იმ წესს, რომლის გზის სიმბოლოების რაოდენობაც ყველაზე გრძელია და შეესაბამება მოთხოვნილ URL-ს.
    • თანაბარი სიგრძის წესები: თუ შესაბამისი Allow და Disallow წესები თანაბრად სპეციფიკურია (აქვთ ერთნაირი სიგრძე), მაშინ უპირატესობა ენიჭება Allow წესს.

    თუ შემოწმებული გზისთვის არცერთი წესი არ არის განსაზღვრული, ინსტრუმენტი აჩვენებს შედეგს: "შესაბამისი წესი არ არსებობს. Google ამ გზას ნაგულისხმევად უშვებს.".

    Robots.txt-ის შეზღუდვები ინდექსაციის კონტროლში

    მნიშვნელოვანია გვახსოვდეს, რომ robots.txt ფაილი არ არის განკუთვნილი გვერდების საძიებო სისტემებიდან სრული გაქრობისთვის.

    • ბმულების გავლენა: Disallow წესით დაბლოკილი გვერდი მაინც შეიძლება გამოჩნდეს ძიების შედეგებში, თუ მასზე სხვა გვერდები მიუთითებენ (ბმულების მეშვეობით).
    • უსაფრთხოება და წვდომა: ეს ინსტრუმენტი არ ამოწმებს noindex დირექტივებს, ვებგვერდზე წვდომის კონტროლს (ავტორიზაციას) ან გვერდის სრულად წაშლის სტატუსს. გვერდის ძიებიდან სრულიად გამოსარიცხად საჭიროა ალტერნატიული მეთოდების გამოყენება.
    • ფაილის ზომის ლიმიტი: თუ გენერირებული robots.txt ფაილის ზომა აჭარბებს 100,000 სიმბოლოს, ვალიდატორი შეწყვეტს მის ანალიზს და აჩვენებს შეტყობინებას: "ეს robots.txt ძალიან დიდია აქ გადასახედად".

    ხშირად დასმული კითხვები (FAQ)

    რისი დამატება შეუძლია ამ გენერატორს robots.txt-ში?
    დაამატეთ user-agent ჯგუფი, Allow და Disallow გზები და საიტის რუკის (sitemap) ერთი ან მეტი URL-ი. წინასწარ ნაჩვენები კოდი მზადაა robots.txt ფაილში ჩასაწერად.

    როგორ ირჩევს გზის შემმოწმებელი წესს?
    ის მიჰყვება Google-ის შესაბამისობის წესს: ყველაზე გრძელი შესაბამისი გზა იმარჯვებს. თუ შესაბამისი Allow და Disallow წესები თანაბრად სპეციფიკურია, იმარჯვებს Allow.

    აშორებს თუ არა Disallow გვერდს Google Search-იდან?
    არა. დაბლოკილი გვერდი მაინც შეიძლება გამოჩნდეს ძიების შედეგებში, თუ მასზე სხვა გვერდები მიუთითებენ. გამოიყენეთ noindex, წვდომის კონტროლი ან წაშალეთ გვერდი, თუ გსურთ მისი ძიებიდან სრულიად გამორიცხვა.

    სად ინახება ჩემ მიერ შეყვანილი მონაცემები შემოწმებისას?
    თქვენი ინდექსაციის წესები იქმნება და მოწმდება თქვენს ბრაუზერში. BroBroGo-ზე არაფერი იტვირთება, რაც უზრუნველყოფს მონაცემთა ლოკალურ დამუშავებას.