Bottrafik overstiger nu menneskelig trafik – og crawlerregler er ikke længere valgfrie

Illustreret infografik, der opsummerer: Bottrafik overstiger nu menneskelig trafik – og crawlerregler er ikke længere valgfrie

Af Greg Nowak. Opdateret 22. august 2026.

Automatiseret trafik har passeret en væsentlig tærskel. I juni viste Cloudflare-data omtalt af Tom’s Hardware, at bots stod for 57.5% af HTTP-forespørgslerne og mennesker for 42.5%. Det betyder ikke, at AI-systemer nu udgør størstedelen af internetbrugerne: Målingen tæller forespørgsler, ikke personer, opmærksomhed eller omsætning. Den omfatter desuden bottrafik generelt og giver ikke en entydig subtotal for AI alene.

Den forretningsmæssige betydning er stadig væsentlig. Websites bliver i stigende grad læst af søgecrawlere, træningscrawlere, AI-assistenter, shoppingagenter og mindre velkommen automatisering. En generel tilgang, hvor man enten ”tillader alt” eller ”blokerer al AI”, vil næppe gavne alle dele af et kommercielt website.

En brugbar crawlerpolitik besvarer tre spørgsmål: Hvilke automatiserede besøgende må tilgå hvilket indhold, hvilken værdi forventer virksomheden til gengæld, og hvordan håndhæves og revideres beslutningen?

Tag udgangspunkt i forretningsværdien, ikke botnavnene

Begynd ikke med at kopiere en andens blokeringsliste for crawlere. Begynd med at klassificere sitet. Offentlig dokumentation, leadgenererende sider, produktdata og licensbelagt research har forskellig økonomi, selv når de ligger på samme domæne.

Indholdsområde Fornuftigt udgangspunkt Dokumentation, der bør gennemgås
Marketing- og servicesider Tillad anerkendte søge- og assistentcrawlere Kvalificerede henvisninger, omtaler og konverteringer
Dokumentation og support Tillad selektivt, og overvåg omfanget Henvisningsdestinationer, supportresultater og båndbredde
Produkt-, pris- eller lagerdata Gennemgå hver sti individuelt Kommerciel synlighed over for genbrug eller overdreven polling
Original research eller premiumarkiver Bloker som udgangspunkt, eller vurder licensering Efterspørgsel fra crawlere, indholdsomkostninger og eksisterende aftaler
Login-, søge- og kontoområder Begræns unødvendig crawling Sikkerhedslogs, serverbelastning og mislykkede forespørgsler
En beslutningsmatrix for crawlere bør afspejle værdien og risikoen i hvert indholdsområde frem for at pålægge hele sitet én regel.

Registrér en ansvarlig og en begrundelse for hver undtagelse. ”Tilladt, fordi det måske kan være nyttigt” er ikke en holdbar politik; det er ”tilladt i offentlig dokumentation, mens henvisninger og forespørgselsvolumen gennemgås månedligt” derimod.

Gennemfør en crawleraudit, før reglerne ændres

Cloudflares AI Crawl Control er tilgængelig på tværs af virksomhedens abonnementer og kan vise crawleraktivitet efter operatør, hostname og sti. Den aktuelle dokumentation fremhæver også en vigtig begrænsning: På gratisabonnementet bygger registreringen på selvdeklarerede user-agent-strenge, mens mere avanceret registrering kræver Bot Management. Betragt dashboardet som operationel dokumentation, ikke som en fuldstændig optælling af alle automatiserede forespørgsler.

  1. Kontrollér, at hvert hostname i produktion leverer en gyldig /robots.txt.
  2. Eksportér eller registrér de mest aktive crawlere, de forespurgte stier, svarkoder og overførte bytes.
  3. Adskil AI-træningscrawlere, AI-assistenter, søgecrawlere og uidentificeret automatisering, hvor de tilgængelige data gør det muligt.
  4. Sammenhold tilladt crawling med henvisninger, leads eller andre nyttige resultater.
  5. Undersøg pludselige stigninger i antallet af forespørgsler, gentagen hentning og adgang til omkostningstunge eller kommercielt følsomme endpoints.

AI Crawl Control-målinger på gratisabonnementet dækker i øjeblikket højst et vindue på 24 timer. Virksomheder, der har brug for et længere sammenligningsgrundlag, bør derfor supplere dem med eksisterende data fra CDN, webserver eller analytics. Når disse data er tilgængelige, er 30 dage en praktisk første analyseperiode.

Robots.txt er beskeden; edge-regler står for håndhævelsen

Et direktiv i robots.txt meddeler dine præferencer til en navngiven crawler. Det autentificerer ikke afsenderen og gennemtvinger ikke efterlevelse. Cloudflare kan overvåge forespørgsler til stier, der ikke er tilladt, og håndhæve beslutninger via sin Web Application Firewall, herunder stispecifikke undtagelser.

Kontrollér både den offentliggjorte fil og det svar, som en identificeret crawler modtager:

curl -i https://example.com/robots.txt
curl -I -A "CrawlerUserAgent" https://example.com/research/sample-page

Erstat user agent og sti med faktiske værdier fra den relevante operatørs aktuelle dokumentation og jeres politik. En simuleret user agent tester kun det svar, der er knyttet til denne deklaration; den dokumenterer ikke, hvordan stærkere signaler til botverificering vil klassificere en reel forespørgsel.

Cloudflares rapportering af overtrædelser kræver tilsvarende omhyggelig fortolkning. Den sammenholder de nuværende direktiver med historiske forespørgsler, så en regelændring i dag kan få ældre forespørgsler, som tidligere var tilladt, til at fremstå som overtrædelser. Kontrollér tidsforløbet, før en tilsyneladende overtrædelse eskaleres.

Mål, hvad den tilladte adgang giver til gengæld

Det samlede antal forespørgsler fortæller ikke i sig selv, om adgangen er umagen værd. Gennemgå de mest efterspurgte stier, båndbredde, statuskoder og crawleroperatører sammen med henvisninger og efterfølgende forretningsaktivitet. Cloudflares betalingsabonnementer kan levere analytics for AI-henvisninger, men almindelig webanalyse og CRM-attribution er fortsat nyttige til at kontrollere, om besøg fører til henvendelser, salg eller produktbrug.

Det forebygger to kostbare fejl: at blokere en assistent, som hjælper potentielle kunder med at finde jeres ydelser, eller at levere store mængder værdifuldt indhold til en crawler uden noget synligt afkast. Ikke alle gevinster viser sig som et almindeligt klik, så kombinér kvantitative data med kommercielle aftaler, synlighed gennem omtaler og indholdets strategiske formål.

Behold Pay Per Crawl i kategorien for eksperimenter

Cloudflares Pay Per Crawl udvider valgmulighederne fra tillad eller bloker til tillad, opkræv betaling eller bloker. I august 2026 er løsningen dog stadig i lukket beta – ikke en pålidelig indtægtskilde, som en crawlerstrategi bør baseres på.

For kvalificerede sites vil en fornuftig test begynde med en klart afgrænset sektion af høj værdi, mens sider til opdagelse fortsat er tilgængelige. Fastlæg det omfattede indhold, prishypotesen, hvilke crawlere der er kvalificerede, den regnskabsansvarlige og succeskriterierne, før betalingssvar aktiveres. Eksisterende WAF-blokeringer har fortsat forrang, så betalingsmodellen skal udformes som en del af det samlede regelsæt.

Gør crawler-governance til en løbende vedligeholdt forretningspolitik

Udpeg én ansvarlig ejer, underlæg reglerne ændringskontrol, og gennemgå dem hvert kvartal eller efter en væsentlig ændring i trafikken. Marketing bør definere værdien af synlighed, redaktionelle teams eller produktteams bør klassificere indholdet, og den tekniske drift bør implementere og overvåge kontrollerne. Juridisk bistand kan være nødvendig til formuleringer om licensering, men bør ikke erstatte teknisk håndhævelse.

Hvis dashboardet er fyldt med botnavne, men ingen kan forklare, hvad der bør tillades, kan Greg hjælpe med at omsætte dataene til en politik på stiniveau, implementere kontrollerne i Cloudflare og robots.txt og etablere en reviewproces, der er knyttet til forretningsresultater. Drøft sitet og dets crawlerpolitik.

Relateret indhold på GrN.dk

Har I brug for hjælp til denne type opgave?

Drøft jeres crawlerpolitik med Greg Kontakt Greg.

Kilder

Seneste artikler

AI kan finde opsigelsesfrister og prisreguleringer i leverandørkontrakter, sende usikre fund til godkendelse og oprette de rette påmindelser.

Sådan automatiserer danske virksomheder Gmail og Microsoft 365 med hurtig sortering, begrænsede rettigheder og menneskelig godkendelse.

Samme kunde på flere kort i HubSpot? Se, hvordan CVR-match, AI-forslag og menneskelig godkendelse kan bruges til at rydde op med styr på felter, relationer og kundehistorik.

Få en ugentlig marketingrapport fra GA4 og Google Ads med kontrollerede beregninger, tydelige dataforbehold og et kort AI-udkast, der hjælper jer på mandagsmødet.

Brug AI til webshoppens alt-tekster med en overskuelig pilot: kortlæg billederne, få danske forslag, og kontrollér resultatet i WordPress og WooCommerce.

AI-baseret ticketanalyse kan afsløre gentagne klager, produktfejl og huller i dokumentationen – uden at virksomheden behøver endnu en chatbot.

OpenSSH 10 fjerner DSA og advarer om nøgleudveksling, der ikke er post-kvantesikker. Her får du en metode til at afgrænse SFTP-oprydningen uden at svække alle SSH-forbindelser.

Botforespørgsler overstiger nu menneskelig webtrafik. Lær at auditere AI-crawlere, fastsætte regler på stiniveau, håndhæve robots.txt og måle det forretningsmæssige afkast.

Cloudflares Tunnel-opdateringer fra 2026 forbedrer kortlægning, overvågning af replikaer, logstreaming og overdragelse – men synliggør samtidig svagt ejerskab og mangelfuld praksis for failover og logging.

Sådan bruger du AI til mødenoter og opfølgning, mens faste regler beskytter CRM-data, kundematch og pipeline mod fejl og forhastede ændringer.