Stimatore del budget di scansione dei robot

Confronta la domanda di scansione con una stima della capacità giornaliera sicura per il server.

Domanda del sito

Presupposti sulla capacità del server

Modifica le ipotesi della formula
Stima giornaliera
Domanda coperta
Domanda di scansione/giorno
Capacità sicura/giorno
Scansioni realizzabili stimate al giorno
Giorni per coprire tutte le pagine
Collo di bottiglia in termini di capacità
Formule modificabili con valori correnti
Modifica qualsiasi ipotesi per ricalcolare.

Le ipotesi relative al sito e al server vengono calcolate nel tuo browser. Non è stato caricato nulla su BroBroGo.

FAQ

Prevede la frequenza con cui Googlebot eseguirà la scansione del mio sito?

No. I motori di ricerca impostano la domanda e la capacità di scansione da segnali che non sono completamente pubblici. Questa stima serve per la pianificazione e il confronto; calibrarlo con i log del server e i report di scansione.

Come viene calcolato il preventivo?

La domanda giornaliera corrisponde al numero di pagine diviso per l'intervallo di aggiornamento target, quindi moltiplicato per il fattore di domanda. La capacità sicura è il minore tra i limiti di frequenza delle richieste e di concorrenza, ridotto dall'utilizzo della sicurezza.

Comprendere il budget di scansione e la capacità del server

Il budget di scansione rappresenta la quantità di risorse che i motori di ricerca dedicano alla navigazione e all'indicizzazione delle pagine di un sito web. Per i professionisti della SEO tecnica e per i gestori dei siti, comprendere questo valore è fondamentale per assicurare che i contenuti nuovi o aggiornati vengano rilevati tempestivamente.

La capacità di un server di supportare l'attività dei crawler senza subire rallentamenti dipende da un equilibrio tra la domanda di scansione (quante pagine devono essere lette e con quale frequenza) e la capacità sicura del server stesso (quante richieste al secondo il sistema può gestire senza compromettere l'esperienza degli utenti reali). Lo strumento "Stimatore del budget di scansione dei robot" permette di modellare queste variabili per identificare potenziali colli di bottiglia e pianificare l'infrastruttura tecnica.

Calcolo della domanda di scansione giornaliera

La domanda di scansione stimata indica il numero di richieste giornaliere necessarie per mantenere aggiornato l'indice dei motori di ricerca in base alla dimensione del sito e alla frequenza di aggiornamento dei contenuti.

Per calcolare questo valore, lo strumento richiede i seguenti dati d'ingresso nella sezione "Domanda del sito":

  • Pagine scansionabili: Il numero totale di URL univoci che devono essere indicizzati.
  • Intervallo di aggiornamento medio: Un valore numerico che definisce la frequenza con cui i contenuti cambiano.
  • Unità di intervallo di aggiornamento: L'unità di misura temporale associata all'intervallo, selezionabile tra "giorni", "settimane" o "mesi".

La formula applicata dallo strumento determina la domanda giornaliera dividendo il numero totale di pagine per l'intervallo di aggiornamento target espresso in giorni, moltiplicando poi il risultato per il "Moltiplicatore della domanda" (il cui valore predefinito è 1.2). Questo moltiplicatore simula le scansioni ripetute o non lineari tipiche dei crawler reali.

Valutazione della capacità del server per il crawling

La capacità di un server di tollerare il traffico dei crawler si basa su parametri prestazionali e di configurazione. Nella sezione "Presupposti sulla capacità del server", lo stimatore analizza i seguenti fattori:

  • Tempo medio di risposta (ms): Il tempo impiegato dal server per rispondere a una singola richiesta, espresso in millisecondi.
  • Capacità del server (requests/second): Il throughput massimo del server espresso in richieste al secondo.
  • Capacità disponibile per i crawler (%): La quota percentuale di risorse del server che si sceglie di allocare ai robot, preservando il resto per gli utenti umani.
  • Concorrenza dei crawler consentita: Il numero massimo di connessioni simultanee che i crawler possono stabilire.

La capacità sicura viene calcolata determinando il valore minore tra il limite basato sul tasso di richiesta (derivato dalla capacità del server e dalla quota disponibile per i crawler) e il limite basato sulla concorrenza (influenzato dal tempo di risposta e dalle connessioni simultanee). Questo valore limite viene infine ridotto applicando la percentuale definita in "Utilizzo sicuro (%)" (il cui valore predefinito è 70%) per garantire un margine di sicurezza operativo.

Identificazione dei colli di bottiglia e analisi dei risultati

Una volta inseriti tutti i dati, lo strumento elabora i valori per fornire un quadro chiaro della situazione attraverso i seguenti output:

  • Domanda di scansione/giorno: Il volume di scansioni giornaliere teoricamente necessarie.
  • Capacità sicura/giorno: Il numero massimo di richieste giornaliere che il server può gestire in sicurezza.
  • Scansioni realizzabili stimate al giorno: Il numero effettivo di scansioni che si prevede possano essere completate.
  • Domanda coperta: La percentuale di domanda di scansione soddisfatta dalla capacità sicura, limitata visivamente a un intervallo compreso tra 0 e 100%.
  • Giorni per coprire tutte le pagine: Il tempo stimato necessario per completare la scansione dell'intero archivio di pagine.
  • Collo di bottiglia in termini di capacità: Indica quale fattore limita le prestazioni, mostrando "Tasso di richiesta disponibile" oppure "Concorrenza e tempo di risposta".

Se il valore di "Domanda coperta" è inferiore al 100%, lo strumento mostra lo stato "La domanda modellata è superiore alla stima della capacità sicura". Se invece la capacità è sufficiente a coprire o superare la domanda, viene visualizzato lo stato "La stima della capacità sicura copre la domanda modellata".

Regole di validazione dei dati e privacy

Per garantire l'accuratezza dei calcoli, lo stimatore applica regole rigide per la validazione dei dati inseriti:

  • Tutti i campi di input devono essere completati; in caso contrario, viene visualizzato l'errore "Completa ogni input per calcolare il preventivo.".
  • I valori inseriti devono essere numeri finiti ordinari non superiori a 1e12, altrimenti viene mostrato l'errore "Inserisci i numeri finiti ordinari nell'intervallo supportato.".
  • Ogni valore inserito deve essere strettamente maggiore di zero, pena la visualizzazione dell'errore "Ogni input deve essere maggiore di zero.".
  • Le percentuali relative a "Capacità disponibile per i crawler (%)" e "Utilizzo sicuro (%)" non devono superare il 100%, altrimenti viene generato l'errore "Le ipotesi percentuali non devono essere superiori a 100%.".

Per quanto riguarda la gestione dei dati, le ipotesi relative al sito e al server vengono calcolate nel tuo browser. Non è stato caricato nulla su BroBroGo, garantendo che le informazioni sulla tua infrastruttura rimangano locali.

Domande frequenti (FAQ)

Prevede la frequenza con cui Googlebot eseguirà la scansione del mio sito? No. I motori di ricerca impostano la domanda e la capacità di scansione da segnali che non sono completamente pubblici. Questa stima serve per la pianificazione e il confronto; calibrarlo con i log del server e i report di scansione.

Come viene calcolato il preventivo? La domanda giornaliera corrisponde al numero di pagine diviso per l'intervallo di aggiornamento target, quindi moltiplicato per il fattore di domanda. La capacità sicura è il minore tra i limiti di frequenza delle richieste e di concorrenza, ridotto dall'utilizzo della sicurezza.

Quali sono i limiti fisici che determinano il collo di bottiglia? Il collo di bottiglia viene identificato confrontando la velocità massima di richiesta consentita sul server con il limite imposto dal tempo di risposta medio combinato con il numero di connessioni simultanee (concorrenza). Lo strumento evidenzia se il fattore limitante è il "Tasso di richiesta disponibile" o la "Concorrenza e tempo di risposta".

Cosa succede se la capacità sicura stimata non copre la domanda? In questo caso lo strumento mostrerà lo stato "La domanda modellata è superiore alla stima della capacità sicura". Per risolvere questo squilibrio è possibile intervenire riducendo il tempo di risposta del server, aumentando la capacità complessiva del server o ottimizzando la struttura del sito per ridurre il numero di pagine scansionabili necessarie.