Crawlers van Google

Google gebruikt 5 crawlers die je site kunnen bereiken. Ze doen verschillende taken, dus één algemene regel is bijna altijd de verkeerde keuze.

User-agentTypeWat hij doet
Google-ExtendedTrainingVerzamelt pagina's om toekomstige modellen te trainen.
Google-AgentZoekenBouwt de index die een assistent doorzoekt bij een antwoord.
Gemini-Deep-ResearchZoekenBouwt de index die een assistent doorzoekt bij een antwoord.
Google-CloudVertexBotOverigCrawlt voor een verwant product en voedt geen openbare assistent.
CloudVertexBotOverigCrawlt voor een verwant product en voedt geen openbare assistent.

Wat het blokkeren kost

Training
Blokkeren kost vandaag niets, maar betekent dat het volgende model je niet kent.
Zoeken
Blokkeren verwijdert je uit antwoorden van nu.
Overig
Zelden bepalend voor AI-zichtbaarheid; beoordeel op bandbreedte, niet op citaties.

robots.txt

Om elke crawler van Google toe te laten:

User-agent: Google-Extended
Allow: /

User-agent: Google-Agent
Allow: /

User-agent: Gemini-Deep-Research
Allow: /

User-agent: Google-CloudVertexBot
Allow: /

User-agent: CloudVertexBot
Allow: /

Om ze allemaal te blokkeren:

User-agent: Google-Extended
Disallow: /

User-agent: Google-Agent
Disallow: /

User-agent: Gemini-Deep-Research
Disallow: /

User-agent: Google-CloudVertexBot
Disallow: /

User-agent: CloudVertexBot
Disallow: /

robots.txt wordt vrijwillig gerespecteerd. Het is de juiste manier om je intentie te tonen, maar het regelt geen toegang. Bescherm gevoelige inhoud met authenticatie.

Bronnen

Is Google toegestaan op je site?

We lezen je robots.txt en vertellen welke AI-crawlers worden toegelaten. Geen registratie.