← Glossary
Definition
Training crawler
A training crawler gathers web content into corpora used to train foundation models. GPTBot, ClaudeBot, CCBot and meta-externalagent are examples.
Blocking training crawlers affects future model knowledge, not live answers. The effect is slow, diffuse and hard to measure.
The opt-out decision is more often about rights and policy than about visibility, and should be made on that basis rather than as an SEO tactic.
Nostimates measures training crawler across twelve AI answer surfaces. Request access →
All terms
AEO (Answer Engine Optimisation)GEO (Generative Engine Optimisation)AI OverviewsAI ModeCitation sharen-samplingQuery fan-outGroundingShare of voice (AI)Extraction success rateSurfaceAnswer engineCitationBrand mentionMention rateConfidence intervalStatistical significanceCitation volatilityNon-determinismReproducibilityIdentity-free collectionPersonalisationLocaleResidential proxyBot detectionCollection costCreditEvidence retentionAudit trailParser versionCanary promptData freshnessCadencePrompt setHead termLong-tail queryCompetitive setllms.txtrobots.txtAI crawlerRetrieval-augmented generation (RAG)HallucinationAnswer boxFeatured snippetZero-click searchEntityEntity salienceKnowledge graphStructured dataJSON-LDschema.orgFAQ schemaAnswer-first contentChunkEmbeddingSemantic searchPrompt injectionMarket coverageSentiment analysisPosition trackingWhite-label data