Crawler von Google

Google betreibt 5 Crawler, die Ihre Website erreichen können. Sie erledigen unterschiedliche Aufgaben; eine pauschale Regel für alle ist fast immer falsch.

User-AgentTypWas er tut
Google-ExtendedTrainingSammelt Seiten zum Trainieren künftiger Modelle.
Google-AgentSucheBaut den Index auf, den ein Assistent beim Antworten durchsucht.
Gemini-Deep-ResearchSucheBaut den Index auf, den ein Assistent beim Antworten durchsucht.
Google-CloudVertexBotSonstigeCrawlt für ein verwandtes Produkt statt für einen öffentlichen Assistenten.
CloudVertexBotSonstigeCrawlt für ein verwandtes Produkt statt für einen öffentlichen Assistenten.

Was das Blockieren kostet

Training
Blockieren kostet heute nichts, bedeutet aber, dass das nächste Modell Sie nicht kennt.
Suche
Blockieren entfernt Sie aus Antworten, die gerade entstehen.
Sonstige
Selten entscheidend für KI-Sichtbarkeit; nach Bandbreite statt Zitaten beurteilen.

robots.txt

Um jeden Google-Crawler durchzulassen:

User-agent: Google-Extended
Allow: /

User-agent: Google-Agent
Allow: /

User-agent: Gemini-Deep-Research
Allow: /

User-agent: Google-CloudVertexBot
Allow: /

User-agent: CloudVertexBot
Allow: /

Um alle zu blockieren:

User-agent: Google-Extended
Disallow: /

User-agent: Google-Agent
Disallow: /

User-agent: Gemini-Deep-Research
Disallow: /

User-agent: Google-CloudVertexBot
Disallow: /

User-agent: CloudVertexBot
Disallow: /

robots.txt wird freiwillig beachtet. Damit erklären Sie Ihre Absicht. Den Zugriff sperrt die Datei nicht, schützen Sie wirklich vertrauliche Inhalte daher durch Authentifizierung.

Quellen

Darf Google auf Ihre Website?

Wir lesen Ihre robots.txt und sagen Ihnen, welche KI-Crawler sie durchlässt. Keine Anmeldung.