Crawlers van OpenAI
OpenAI gebruikt 3 crawlers die je site kunnen bereiken. Ze doen verschillende taken, dus één algemene regel is bijna altijd de verkeerde keuze.
| User-agent | Type | Wat hij doet |
|---|---|---|
GPTBot | Training | Verzamelt pagina's om toekomstige modellen te trainen. |
OAI-SearchBot | Zoeken | Bouwt de index die een assistent doorzoekt bij een antwoord. |
ChatGPT-User | Door gebruiker gestart | Haalt je pagina op omdat iemand er zojuist naar vroeg. |
Wat het blokkeren kost
- Training
- Blokkeren kost vandaag niets, maar betekent dat het volgende model je niet kent.
- Zoeken
- Blokkeren verwijdert je uit antwoorden van nu.
- Door gebruiker gestart
- Blokkeren betekent dat die persoon hoort dat de pagina niet gelezen kon worden.
robots.txt
Om elke crawler van OpenAI toe te laten:
User-agent: GPTBot
Allow: /
User-agent: OAI-SearchBot
Allow: /
User-agent: ChatGPT-User
Allow: /Om ze allemaal te blokkeren:
User-agent: GPTBot
Disallow: /
User-agent: OAI-SearchBot
Disallow: /
User-agent: ChatGPT-User
Disallow: /robots.txt wordt vrijwillig gerespecteerd. Het is de juiste manier om je intentie te tonen, maar het regelt geen toegang. Bescherm gevoelige inhoud met authenticatie.
Bronnen
Is OpenAI toegestaan op je site?
We lezen je robots.txt en vertellen welke AI-crawlers worden toegelaten. Geen registratie.