Bijgewerkt op
Zoekmachines: hoe werken ze?

Dankzij zoekmachines (search engine) kunnen internetgebruikers zich documenteren, een restaurant lokaliseren of een trendy schoen vinden in één klik. Deze applicaties geven dus toegang tot een aanzienlijke massa informatie via diverse zoekopdrachten. Weet u evenwel hoe een zoekmachine werkt? Dit artikel maakt de stand van zaken op over de werking van Google, van Qwant (Frans zoekhulpmiddel), Bing, DuckDuckGo, en sluit af met een stand van zaken van de markt van zoekmachines.
Wat is een zoekmachine?
Definitie van een zoekmachine
Zoekmachines (search engine) zijn webapplicaties gemaakt om op het web te zoeken. De resultaten verschijnen volgens de uitdrukkingen die internetgebruikers vragen. Vandaag blijft Google de bekendste van allemaal. Maar er bestaan veel doeltreffende zoekmachines zoals DuckDuckGo, Bing, Qwant, Yahoo… U vindt ook gespecialiseerde zoekmachines zoals: Google Scholar voor onderwijs, Yahoo kids voor kinderen, Ecosia voor het milieu…
Wat kunt u vinden met zoekmachines?
Men kan zoekmachines gebruiken om in een precies domein te zoeken. Google laat bijvoorbeeld toe om informatieve webgegevens, beelden, e-commerces, documenten of video’s te vinden.
De MAP-functie speelt de rol van wereldkaart en gebruikt satellietbeelden om een plaats precies te lokaliseren. De andere alternatieven voor Google zoals Bing, DuckDuckGo, Yahoo of Qwant zijn eveneens krachtige zoekmachines. Elk hulpmiddel schuift een argument naar voren om zich te onderscheiden. Qwant is bijvoorbeeld een zoekmachine die het privéleven respecteert. Het probeert niet te weten wie u bent en waar u bent om u zijn resultaten voor te stellen.
Hoe krijgt u toegang tot een zoekmachine?
Zoekmachines zijn toegankelijk via een browser. Meestal gebruiken die een omnibox om de gebruiker een zoekopdracht te laten uitvoeren. De omnibox is de nieuwe naam voor de oude adresbalk van browsers.
Hoe slaagt u met zoekmachines?
Dat is de vraag die elk bureau voor organische ranking zich stelt. Gepositioneerd staan op de eerste resultaten van de SERP heeft een echte financiële inzet. Organische ranking is een strategische en technische discipline. Er bestaan evenwel enkele eenvoudige optimalisaties om door zoekmachines te worden gewaardeerd.
U kunt bijvoorbeeld:
-
« Cloaking » vermijden. Ook bekend onder de Engelse uitdrukking « cloaking », duidt deze term het feit aan om twee verschillende pagina’s voor te stellen aan de Googlebot en aan menselijke bezoekers om een betere ranking te verkrijgen. De webserver is zo geprogrammeerd dat hij een andere webpagina toont volgens de initiatiefnemer van de zoekopdracht (Google-robot of mens).
-
Een site maken met een heldere hiërarchie en een plan van uw site geven (SiteMap).
-
Een relevante interne linking creëren.
-
Een nuttige, informatie-rijke site creëren. Uw content moet dus worden gestructureerd met H1, H2, H3. Uw tags en uw tekst moeten het zoekwoord bevatten waarop u in de SERP wilt verschijnen.
-
De ALT-attributen en meta descriptions niet verwaarlozen. Deze elementen moeten precies zijn en uw zoekwoord bevatten.
-
Kwalitatieve backlinks creëren om uw site kracht te geven.
Wat Bing suggereert:
-
Uw zoekwoorden in de url invoegen. Het lijkt erop dat domeinnamen die de zoekwoorden bevatten, door Bing worden gewaardeerd. Zorg voor korte URL’s. Bing steunt immers op de gebruikerservaring. Een korte URL is makkelijker te onthouden voor internetgebruikers. Bing zal dus geneigd zijn uw ranking te bevoordelen als u die logica toepast.
-
Een relevante interne linking realiseren.
-
Een kwalitatieve backlinkstrategie opzetten. Net als bij Google geldt: hoe meer uw links van bekendheidssites komen, hoe beter de SEO-kracht van uw site.
-
Gethematiseerde content creëren. Het principe van Bing is eenvoudig: één pagina = één onderwerp!
-
Een heldere arborescentie creëren, zonder complexiteit. Bing beveelt 3 niveaus aan. Uw pagina’s mogen niet meer dan 3 klikken van de startpagina liggen. Net als bij Google is het aanbevolen om een SiteMap te hebben.
-
Zich ervan vergewissen dat de content niet is begraven in rich-mediasystemen (Adobe Flash Player, JavaScript, Ajax, enz.)
-
Vermijden om de zoekwoorden in de beelden te zetten. Als u bijvoorbeeld wilt dat de naam van uw bedrijf wordt geïndexeerd, verzekert u dat die niet alleen binnen uw logo wordt weergegeven.

Werking van zoekmachines
Crawling en indexing
Zoekmachines (search engine) dienen voor één ding: antwoorden geven op de vragen van gebruikers. Om relevante zoekresultaten te leveren, gaan deze tools door twee stappen:
-
het crawlen: het zoeken naar pagina’s op internet
-
de indexatie: het rangschikken van de resultaten in volgorde van relevantie
Crawling
Crawling is de eerste functie van zoekmachines. Het is een soort systematische inspectie van websites op internet. Uitgevoerd vóór de zoekopdracht van de gebruiker, bestaat deze stap erin zoveel mogelijk informatie bij webplatforms te verzamelen. Ze wordt uitgevoerd door robots die « spiders of crawlers » worden genoemd. Aan het einde van deze stap sturen die de verzamelde informatie naar de index om wat men indexatie noemt uit te voeren.
Indexing (indexatie)
Wanneer de index (het brein van de zoekmachines) de informatie van de robots ontvangt, evalueert hij die. Zo kan hij telkens wanneer een gebruiker een zoekopdracht doet, hen relevante resultaten leveren.
Hoe bepalen zoekmachines de relevantie van een resultaat?
De evaluatie van de relevantie beperkt zich niet tot het meten van de overeenkomst tussen de zoekopdracht en het webplatform. Er zijn andere factoren om in overweging te nemen. Zoekmachines veronderstellen dat hoe populairder een site is, hoe relevanter de informatie die hij bevat. Dat postulaat laat de zoekmachines toe om de tevredenheid van gebruikers ten aanzien van de zoekresultaten te garanderen.
Mythes en realiteit rond zoekmachines
De mythes
Indiening bij zoekmachines In de jaren 90 gebruikten zoekmachines indieningsformulieren. Webmasters dienden hun sites en hun zoekwoorden in. Het ging er dan om de site te signaleren zodat de zoekmachines hem zouden doorlopen en indexeren. Dat systeem is snel herzien en verlaten. Vandaag komen de robots uit zichzelf de sites doorlopen en ze indexeren op kernuitdrukkingen.
Rangschikking via meta tag De metatags (met name de meta keywords-tag) waren cruciaal voor de ranking. Dit rankingcriterium is door alle grote zoekmachines verlaten. Vandaag hebben meta tags geen invloed meer op de ranking.
Betaalde ranking (SEA) duwt pagina’s naar de top van de SERP Sommige theorieën beweren dat sites die betalen voor advertenties op zoekmachines (SEA) vanzelf beter gerangschikt staan. Dat is een veronderstelling zonder grond. Google, Qwant (Frans hulpmiddel) en Yahoo hebben zelfs waarborgen ingesteld om dat soort uitspraken te voorkomen. Bij Google hebben adverteerders die miljoenen dollars per maand aan reclame uitgeven, vastgesteld dat ze geen enkele voorkeursbehandeling van de zoekmachine ontvangen.
Als dat de mythes over zoekmachines zijn, wat zijn dan de realiteiten?
De realiteit
Het crawlbudgetHet web bevat biljoenen gegevens. Om het werk van de robots te vergemakkelijken, hebben zoekmachines een systeem van beperking in hun crawl ingesteld. Het crawlbudget is de tijd die de robots aan uw site toekennen. Zoekmachines (search engine) moeten uw pagina’s zo snel mogelijk vinden. U begrijpt dus dat hier een belangrijke inzet ligt. Men moet het werk van de robots vergemakkelijken zodat ze uw hele site maximaal kunnen crawlen en indexeren. Als ze dat niet kunnen, zal een deel van uw site niet zichtbaar zijn voor zoekmachines en internetgebruikers.
Om het werk van de robots te vergemakkelijken, kunt u al enkele goede praktijken toepassen:
-
Vermijd gebroken links. Gebroken links worden niet gewaardeerd door de robots. Ze kunnen ertoe worden gebracht hun crawl te stoppen.
-
Vermijd content van mindere kwaliteit. Bijvoorbeeld foutpagina’s, gedupliceerde content, facetnavigaties…
-
Beperk 301/302-redirects
-
Optimaliseer de laadtijd van uw pagina. Een lange laadtijd is niet goed voor uw ranking, maar ook niet voor de bezoeker. Die zal geneigd zijn naar een andere site te gaan om het antwoord op zijn zoekopdracht te vinden als uw site te lang laadt. U verliest zo prospects.
-
Werk uw SiteMap bij. Hij zal de robots makkelijker leiden om uw pagina’s te indexeren
Een regelmatige crawl van uw site U hebt net uw site gemaakt en u stelt de indexatie ervan op de zoekmachines vast. U zegt zich dat het werk klaar is? Weet dat de robots regelmatig langs uw site komen. Een site die vaak wordt bijgewerkt, ziet de robots vaker langskomen dan een statische site. Elke dag voeren zoekmachines een zoekwoordanalyse van de pagina’s uit om ze te indexeren.
De detectie van cloaking Men noemt cloaking het feit om verschillende content te tonen aan zoekmachines en aan bezoekers. De server herkent of het een internetgebruiker of een robot is die de zoekopdracht heeft gelanceerd. Volgens dat criterium toont hij verschillende content. Voor een robot kan hij bijvoorbeeld een meer geoptimaliseerde pagina tonen die evenwel niet aangenaam is om te lezen voor een bezoeker. Deze techniek wordt door Google gesanctioneerd.
De filtering van content met lage waarde Zoekmachines gebruiken allemaal robots om de toegevoegde waarde van content voor lezers te bepalen. De vaakst gefilterde content is
-
affiliatiecontent,
-
gedupliceerde content
-
gegenereerde pagina’s met zeer weinig tekst.
Zoekmachines evalueren de waarde van een domein op zijn originaliteit en op de bezoekerservaring die ze bieden. Sites die content van slechte kwaliteit publiceren, zullen dus moeite hebben om hoog in de ranking te staan, zelfs als ze zeer goed gerangschikt zijn. Als u bijvoorbeeld een hoog bouncepercentage vanuit de SERP hebt, wordt u gedegradeerd door de zoekmachines. Dat betekent dat internetgebruikers geen antwoord op hun zoekopdracht vinden en dat de content niet relevant is.
Bovendien toont de lancering van Google Panda in 2011 de wil van de zoekmachine om kwalitatieve content te valoriseren. Dit algoritme is opgezet na een belangrijke golf van spam en sites van lage kwaliteit. Hoe wordt de sanctie toegepast? Panda bestraft content van slechte kwaliteit en soms de hele site. De betrokken pagina’s worden dan gede-indexeerd.
De ranking volgens het vertrouwen dat uw site genereert Diverse elementen dienen om uw site te evalueren om hem in de SERP te positioneren. Een van de belangrijke criteria voor de search engine zijn de backlinks. Om de betrouwbaarheid van uw site te meten, neemt Google het aantal links dat ernaar wijst in overweging. Eenvoudig gezegd: de search engine beschouwt uw site als relevant omdat veel sites ernaar verwijzen. De zoekmachine meet evenwel niet alleen de hoeveelheid backlinks. De kwaliteit van die links is een primordiaal criterium. Hoe meer uw links van autoriteitssites komen, hoe meer u door zoekmachines wordt gewaardeerd. Hebt u daarentegen « spammende » links van slechte kwaliteit, dan ziet het zoekhulpmiddel dat als fraude en past het een penaliteit toe. Het algoritme Penguin is gecreëerd om de Google-indexen te zuiveren van sites van slechte kwaliteit die SEO omleiden via frauduleuze linkingtechnieken.
De strijd tegen spam op zoekmachines Pollupostage is een praktijk die goed aanwezig is op het web. In stijging sinds het midden van de jaren 1990, laat deze praktijk spammers toe om zich meester te maken van goed geplaatste sites in de zoekmachines om er de promotie van sites van lage kwaliteit in te brengen. Weet dat één enkele dag aan de top van de ranking op Google tot 20.000 € netto-inkomsten kan opleveren. Met zulke inzetten hoeft men zich niet te verbazen dat deze praktijk zo populair is geweest. Vandaag, dankzij de technologische innovatie van Google, wordt ze steeds moeilijker om te zetten.
De actualiteit over zoekmachines
Wie heeft het grootste aandeel van de wereldmarkt van zoekmachines?
De wereldrangschikking van 2017 plaatste Google op de eerste positie met een netto-aandeel van 74,54%. Hij wordt gevolgd door de zoekmachines Yahoo, Baidu, Bing of Qwant (Frans zoekhulpmiddel) waarvan het marktaandeel rond de 7 tot 10% schommelt. Het is interessant om vast te stellen dat, hoewel Google het grootste aandeel heeft, dat langzaam is afgenomen vanaf het 2e kwartaal van 2017, terwijl het aandeel van Baidu 14,69% heeft bereikt.
Hoeveel zoekopdrachten worden elke dag op zoekmachines uitgevoerd?
In 2017, 46,8% van de wereldbevolking had toegang tot internet. Tegen 2021 zou dat cijfer 53,7% moeten bereiken. Volgens de statistieken ontvangt Google 3,5 miljard zoekopdrachten per dag, of 1,2 biljoen per jaar. Google evolueert snel. Als het Google in 1999 een maand kostte om 50 miljoen pagina’s te crawlen en te indexeren, is die taak in 2012 in minder dan een minuut volbracht!
Zoekmachines zijn dus krachtige en complexe applicaties. Elke dag worden miljoenen zoekopdrachten door internetgebruikers gevraagd. Veel meer dan een informatieve inzet hebben zoekmachines ook een marketing- en financiële inzet. Om de concurrentie het hoofd te bieden en omzet via het web te genereren, is goed gepositioneerd staan op de SERP primordiaal. Maar de gebruiken van de doelgroep kennen is dat nog meer. In 2009 werd slechts 0,7% van het webverkeer wereldwijd gegenereerd door mobiele telefoons. In 2017 vertegenwoordigt mobiel 50,3% van het wereldwijde webverkeer. In 10 landen, waaronder de Verenigde Staten en Japan, hebben zoekopdrachten op mobiel die op computer ruim overtroffen.