Crawler von Google
Google betreibt 5 Crawler, die Ihre Website erreichen können. Sie erledigen unterschiedliche Aufgaben; eine pauschale Regel für alle ist fast immer falsch.
| User-Agent | Typ | Was er tut |
|---|---|---|
Google-Extended | Training | Sammelt Seiten zum Trainieren künftiger Modelle. |
Google-Agent | Suche | Baut den Index auf, den ein Assistent beim Antworten durchsucht. |
Gemini-Deep-Research | Suche | Baut den Index auf, den ein Assistent beim Antworten durchsucht. |
Google-CloudVertexBot | Sonstige | Crawlt für ein verwandtes Produkt statt für einen öffentlichen Assistenten. |
CloudVertexBot | Sonstige | Crawlt für ein verwandtes Produkt statt für einen öffentlichen Assistenten. |
Was das Blockieren kostet
- Training
- Blockieren kostet heute nichts, bedeutet aber, dass das nächste Modell Sie nicht kennt.
- Suche
- Blockieren entfernt Sie aus Antworten, die gerade entstehen.
- Sonstige
- Selten entscheidend für KI-Sichtbarkeit; nach Bandbreite statt Zitaten beurteilen.
robots.txt
Um jeden Google-Crawler durchzulassen:
User-agent: Google-Extended
Allow: /
User-agent: Google-Agent
Allow: /
User-agent: Gemini-Deep-Research
Allow: /
User-agent: Google-CloudVertexBot
Allow: /
User-agent: CloudVertexBot
Allow: /Um alle zu blockieren:
User-agent: Google-Extended
Disallow: /
User-agent: Google-Agent
Disallow: /
User-agent: Gemini-Deep-Research
Disallow: /
User-agent: Google-CloudVertexBot
Disallow: /
User-agent: CloudVertexBot
Disallow: /robots.txt wird freiwillig beachtet. Damit erklären Sie Ihre Absicht. Den Zugriff sperrt die Datei nicht, schützen Sie wirklich vertrauliche Inhalte daher durch Authentifizierung.
Quellen
Darf Google auf Ihre Website?
Wir lesen Ihre robots.txt und sagen Ihnen, welche KI-Crawler sie durchlässt. Keine Anmeldung.