Generatore di robots.txt

Crea un robots.txt valido con preset, regole personalizzate, blocco dei crawler AI e la riga del sitemap.

Come si usa

  1. Scegli un preset — consenti tutto, blocca tutto o blocca le cartelle CMS più comuni — oppure digita i tuoi percorsi, uno per riga.
  2. Aggiungi eccezioni sotto Allow, un crawl delay se ti serve e l'URL completo del tuo sitemap.
  3. Spunta l'opzione dei crawler AI se la vuoi, poi scarica robots.txt e caricalo nella root del tuo dominio.

Informazioni su questo strumento

robots.txt è un file di testo semplice nella root di un dominio che dice ai crawler automatici quali percorsi possono richiedere. Segue il Robots Exclusion Protocol, standardizzato come RFC 9309, e la sua struttura è semplice: gruppi che iniziano con una o più righe User-agent seguite da regole Disallow e Allow, più righe Sitemap indipendenti che valgono per l'intero file. I percorsi vengono confrontati per prefisso, * sta per qualsiasi sequenza di caratteri e $ ancora la fine di un URL, quindi /*.pdf$ blocca ogni PDF. Un "Disallow:" vuoto è il modo canonico di dire "scansiona pure tutto".

Questo generatore scrive quella sintassi per te e ripulisce l'input strada facendo: ogni percorso riceve una barra iniziale se te la sei dimenticata, le righe che iniziano con # vengono mantenute come commenti, un elenco di regole vuoto diventa il gruppo canonico che consente tutto, e il crawl delay viene scritto solo quando è un numero positivo. L'opzione dei crawler AI aggiunge un gruppo separato che elenca GPTBot, ChatGPT-User, OAI-SearchBot, CCBot, anthropic-ai, ClaudeBot, Claude-Web, Google-Extended, PerplexityBot, Applebot-Extended, Bytespider, Amazonbot, Meta-ExternalAgent e cohere-ai sotto un unico Disallow: /, che è il modo per rinunciare all'addestramento AI e alla scansione dei motori di risposta senza toccare Googlebot. La riga Sitemap viene validata come URL assoluto, perché i percorsi sitemap relativi vengono ignorati dai motori di ricerca.

Vale la pena ripetere due limiti onesti. Primo, robots.txt è una richiesta, non un muro: i crawler ben educati lo rispettano, gli scraper lo ignorano e tutto ciò che elenchi lì è pubblicamente leggibile — non usarlo mai per nascondere percorsi sensibili. Secondo, vietare un URL ferma la scansione, non l'indicizzazione; una pagina bloccata verso cui altri siti puntano può comunque comparire nei risultati senza descrizione, quindi usa un meta tag noindex sulla pagina stessa quando la vuoi fuori dall'indice. Il file viene generato interamente nel tuo browser e scaricato localmente — nulla del tuo sito viene caricato qui.

La formula

User-agent: / Disallow: / Allow: / Crawl-delay: — ripetuti per ogni gruppo, con Sitemap: su una riga a sé.

Domande frequenti

Dove va messo il file robots.txt?

Nella root del dominio, raggiungibile su https://tuosito.com/robots.txt. I crawler guardano solo lì — un file in una sottocartella viene ignorato, e ogni sottodominio ha bisogno del proprio.

Disallow rimuove una pagina da Google?

No. Impedisce che la pagina venga scansionata, ma un URL bloccato può comunque essere indicizzato a partire da link esterni. Per tenere una pagina fuori dai risultati, consenti la scansione e aggiungi un meta tag noindex alla pagina.

I crawler AI rispettano davvero robots.txt?

Alcuni sì e altri no. OpenAI, Google e Anthropic documentano i loro user-agent e rispettano il file; molti scraper lo ignorano del tutto. Bloccare è un segnale chiaro, non un'imposizione.

Google supporta Crawl-delay?

No — Googlebot ignora la direttiva e regola da sé la propria frequenza, mentre Bing e Yandex la leggono. Usa Search Console se hai bisogno di rallentare Google.

Devo bloccare il mio sitemap o i miei file CSS e JavaScript?

No. Bloccare i file CSS o JS impedisce ai motori di ricerca di renderizzare le tue pagine come le vedono gli utenti, il che può danneggiare il posizionamento, e il sitemap deve restare raggiungibile.

Qualcosa di ciò che digito viene caricato online?

No. Il file viene assemblato da JavaScript sul tuo dispositivo e salvato direttamente nella tua cartella dei download.

Strumenti correlati

Link lunghi? Accorciali gratis

Vai.la trasforma qualsiasi URL in un link breve con statistiche dei clic, QR Code e il tuo biolink personale.

Vai.la non è responsabile dell'uso degli strumenti né delle decisioni prese in base ai loro risultati.