Vai al contenuto
TextArray
100% locale

Generatore di robots.txt

Crea un robots.txt corretto con preimpostazioni, regole personalizzate, ritardo di scansione e un collegamento alla mappa del sito.

Uscita

Generatore di robots.txt

Genera un robots.txt sintatticamente corretto in pochi secondi. Scegli una preimpostazione (consenti tutto, non consenti tutto o percorsi personalizzati) imposta lo user-agent e il file apparirà pronto per essere copiato o scaricato come robots.txt per la root del tuo sito. Le due preimpostazioni producono le esatte forme canoniche: una riga Disallow vuota che consente tutta la scansione, o Disallow: / che blocca l'intero sito, che è ciò che desideri su un dominio di staging.

Il campo user-agent accetta diversi nomi di bot separati da virgole, ciascuno emesso come propria riga user-agent nello stesso gruppo. Ciò rende le policy del crawler AI veloci da scrivere: inserisci GPTBot, ClaudeBot, Google-Extended, scegli l'impostazione predefinita "Non consentire tutto" e le regole si applicano a tutti. Lascia il campo vuoto e il gruppo prende di mira ogni crawler con *.

Con la preimpostazione personalizzata elenchi i percorsi Non consentire e Consenti separati da virgole. Una barra iniziale mancante viene aggiunta automaticamente, i caratteri jolly come /*.pdf passano senza modifiche e le righe Consenti vengono prima in modo che le eccezioni ai blocchi più ampi vengano lette in modo naturale. Un ritardo di scansione opzionale aggiunge il suggerimento di limitazione che alcuni crawler come Bing rispettano e il campo della mappa del sito aggiunge una riga della mappa del sito con l'URL assoluto che i motori di ricerca si aspettano.

Il file viene generato interamente nel tuo browser: nulla della struttura del tuo sito viene inviato a un server. Tieni presente che robots.txt controlla la scansione, non l'accesso: i bot obbedienti lo seguono, ma non è un meccanismo di sicurezza, quindi usa l'autenticazione per qualsiasi cosa veramente privata.

FAQ

Come posso bloccare i crawler AI come GPTBot?
Inserisci i nomi dei bot separati da virgole nel campo user-agent (GPTBot, ClaudeBot, Google-Extended), scegli la preimpostazione disallow-everything e ognuno ottiene la propria riga user-agent sopra Disallow: /.
Dove metto il file generato?
Salvalo come robots.txt nella radice del tuo dominio, quindi è raggiungibile su https://tuodominio.com/robots.txt. I crawler lo cercano solo lì.
Robots.txt mantiene effettivamente le pagine private?
No. Si tratta di una convenzione di cortesia per i crawler, non di un controllo degli accessi. I bot ben educati obbediscono, ma qualsiasi cosa veramente sensibile necessita di autenticazione.
Tutti i motori di ricerca rispettano il Crawl-delay?
No. Bing e alcuni altri lo rispettano, mentre Google ignora la direttiva e utilizza invece le impostazioni di Search Console. La linea è innocua in ogni caso.
Viene inviato qualcosa a un server?
No. Il file viene assemblato interamente nel tuo browser; i tuoi percorsi e gli elenchi di bot non lasciano mai il tuo dispositivo.