Een klant die ‘koptelefoon’ verkeerd typt, verwacht nog steeds relevante producten. Spellingtolerantie en fuzzy matching kunnen zulke invoerfouten opvangen. Dezelfde techniek kan echter ook correcte merknamen, modelcodes of korte technische termen veranderen. Goede typo tolerance corrigeert daarom niet maximaal, maar gecontroleerd. Ze weegt woordlengte, cataloguscontext, exacte matches en werkelijk zoekgedrag mee voordat een alternatief de oorspronkelijke query beïnvloedt.
Wat typo tolerance en fuzzy matching doen
Typo tolerance laat een zoekmachine woorden vinden die sterk lijken op de invoer, ook wanneer letters ontbreken, verwisseld of verkeerd gespeld zijn. Fuzzy matching is een bredere term voor het vergelijken op gelijkenis in plaats van alleen exacte gelijkheid. De concrete werking verschilt per zoektechnologie.
Een systeem kan meerdere signalen combineren: aantal afwijkende letters, woordlengte, toetsenbordafstand, uitspraak, populariteit van een term en aanwezigheid in de catalogus. Het hoeft de query niet altijd zichtbaar te herschrijven. Soms worden alternatieve kandidaten alleen met een lagere score toegevoegd.
Het doel is niet om iedere onbekende term in een bekend woord te veranderen. Het doel is om waarschijnlijke invoerfouten te herstellen zonder correcte en specifieke klanttaal te beschadigen.
Bescherm exacte matches voordat je corrigeert
Een onbekend woord kan een nieuw merk, model, SKU, EAN, onderdeelnummer of vakterm zijn. Als de catalogus een exacte match bevat, is dat meestal een sterk signaal dat de invoer bewust is. Geef die match voorrang voordat een populairder gelijkend woord wordt toegevoegd.
Bescherm ook combinaties. Een query kan een bekend merk en een minder bekende modelcode bevatten. Corrigeer niet automatisch het model naar een algemeen woord omdat dat vaker voorkomt. Controleer per token én als volledige query welke exacte producten of attributen beschikbaar zijn.
Maak merk- en identifierlijsten onderdeel van de index, niet alleen van een handmatige uitzonderingslijst. Zo groeit bescherming mee met het assortiment en verklein je de kans dat nieuwe producten eerst verkeerde correcties krijgen.
- Merknamen en submerken.
- Volledige en gedeeltelijke modelcodes.
- SKU’s, EAN’s en fabrikantnummers.
- Technische eenheden en vaktermen.
- Productnamen die sterk op een algemeen woord lijken.
Woordlengte en fouttype bepalen hoeveel tolerantie veilig is
Eén letter verschil heeft bij een woord van drie tekens veel meer impact dan bij een woord van twaalf tekens. Korte woorden vragen daarom een strenge drempel. Een ruime correctie kan daar gemakkelijk een volledig andere betekenis opleveren.
Niet iedere bewerking is even waarschijnlijk. Twee verwisselde letters, een ontbrekende letter of een dubbele aanslag komen vaak voor bij typen. Een groot aantal vervangingen wijst eerder op een ander woord. Gebruik zulke patronen als gewichten, niet als absolute waarheid.
Taal speelt eveneens mee. Samenstellingen, diakritische tekens, meervoudsvormen en toetsenbordindeling kunnen de waarschijnlijke fout veranderen. Test per ondersteunde taal met echte queries en laat lokale teams beoordelen of een correctie natuurlijk is.
Voorbeeld: een korte term verdient terughoudendheid
Bij ‘usb’ is één afwijkend teken al een groot deel van het woord. De invoer kan bovendien een andere afkorting of modelcode zijn. Bij een langere term als ‘koptelefoon’ is een enkele ontbrekende letter veel waarschijnlijker een tikfout. Drempels mogen daarom niet voor iedere woordlengte hetzelfde zijn.
Gebruik cataloguscontext en zoekintentie
Een correctiekandidaat is sterker wanneer de term daadwerkelijk voorkomt in verkoopbare producttitels, categorieën, merken of attributen. Een algemeen woordenboek kan suggesties opleveren die grammaticaal bestaan maar niets met het assortiment te maken hebben.
Kijk ook naar de andere woorden in de query. ‘Rode nik schoenen’ kan binnen een sportcatalogus richting een merk wijzen; dezelfde lettercombinatie kan elders iets anders betekenen. Context verkleint de kandidaatset en maakt terughoudende correctie mogelijk.
Combineer spelling met queryanalyse zonder begrippen door elkaar te halen. Een typefout is iets anders dan een synoniem, woordvorm of semantisch gerelateerde term. Houd die lagen afzonderlijk meetbaar, zodat je kunt zien welke uitbreiding resultaat oplevert en welke ruis veroorzaakt.
- Geef kandidaten uit de actieve winkel en taal voorrang.
- Weeg producttype, categorie en andere querytokens mee.
- Sluit niet-verkoopbare of verouderde termen bewust in of uit.
- Behandel spelling, synoniemen en semantische uitbreiding als verschillende regels.
- Bewaar de oorspronkelijke query voor analyse en transparantie.
Kies tussen automatisch corrigeren en een suggestie tonen
Bij een zeer waarschijnlijke fout kan automatisch zoeken op de correctie prettig zijn. Toon wel duidelijk wat is gebruikt en bied waar relevant een route terug naar de oorspronkelijke invoer. Dat is belangrijk wanneer het systeem een nieuw merk of technische term niet kent.
Bij twijfel is ‘Bedoelde je…?’ veiliger. De bezoeker houdt controle en de klik op de suggestie levert tegelijk feedback over de kandidaat. Zorg dat de suggestie niet de enige route is wanneer de oorspronkelijke query wel relevante exacte matches heeft.
Een derde mogelijkheid is zachte uitbreiding: behoud exacte resultaten en voeg fuzzy kandidaten met lagere score toe. Dit kan no-results voorkomen zonder de query zichtbaar te veranderen. Controleer dan zorgvuldig of zwakke kandidaten niet boven sterke matches komen.
Maak lege staten behulpzaam
Als geen betrouwbare correctie bestaat, toon dan geen willekeurig alternatief. Help de klant met de oorspronkelijke query aanpassen, categorieën bekijken of contact opnemen bij specialistische producten. Een eerlijke lege staat is beter dan een volle maar irrelevante resultaatpagina.
Meet correcties op uitkomst, niet op gebruik alleen
Een vaak toegepaste correctie is niet automatisch goed. Analyseer of bezoekers daarna relevante producten aanklikken, de query opnieuw wijzigen, filters gebruiken of alsnog zonder resultaat eindigen. Vergelijk waar mogelijk met dezelfde query zonder correctie.
Maak een overzicht van correctieparen met volume en uitkomst. Bekijk vooral veelgebruikte paren, correcties met lage klikratio en termen die onverwacht naar een merk of categorie veranderen. Laat merchandisers of categorie-experts twijfelgevallen beoordelen.
Regressietests zijn essentieel. Voeg bekende merken, codes, korte termen en succesvolle typefouten toe aan een vaste set. Test die set na wijzigingen in algoritme, drempels, taalconfiguratie en productdata.
- Aantal queries waarop een correctie of fuzzy uitbreiding is toegepast.
- Productklik en eerste klikpositie na correctie.
- Aantal bezoekers dat de originele query opnieuw gebruikt.
- Herformuleringen direct na de correctie.
- Conversie waar die betrouwbaar aan de zoekinteractie is gekoppeld.
- Nieuwe foutcorrecties op beschermde merken en identifiers.
Beheer uitzonderingen zonder een onbeheersbare lijst te bouwen
Handmatige bescherming kan nodig zijn, maar iedere uitzondering maakt beheer complexer. Onderzoek eerst of de term als merk, model of attribuut correct in de productdata kan worden opgenomen. Structurele cataloguscontext schaalt beter dan een losse lijst naast de index.
Leg bij een uitzondering reden, taal, winkel, eigenaar en evaluatiedatum vast. Een tijdelijk nieuw merk hoeft niet eeuwig handmatig beschermd te blijven wanneer de index het later zelf herkent. Ruim regels op en controleer of wijzigingen elders effect hebben.
Geef support- en e-commerceteams een eenvoudige manier om verkeerde correcties te melden, inclusief query, getoonde correctie en resultaat. Zo wordt praktijkfeedback onderdeel van het kwaliteitsproces in plaats van een losse klacht.
Goede spellingtolerantie weet wanneer zij niets moet veranderen
Typo tolerance verbetert webshopsearch wanneer zij waarschijnlijke invoerfouten opvangt en sterke exacte signalen beschermt. Gebruik woordlengte, fouttype, taal en cataloguscontext, en kies bij twijfel voor een suggestie of zachte uitbreiding in plaats van een onzichtbare harde correctie.
Findoviq kan typefouten tolerant verwerken en correctiegedrag in zoekanalytics zichtbaar maken. De kwaliteit ontstaat door echte klantqueries te testen, uitzonderingen bij de bron op te lossen en iedere correctie te beoordelen op het resultaat dat de klant daarna krijgt.
Veelgestelde vragen
Wat is typo tolerance?
Typo tolerance is het vermogen van een zoekfunctie om waarschijnlijke invoerfouten te herkennen en toch relevante resultaten te tonen. De techniek kan automatisch corrigeren, een suggestie geven of vergelijkbare kandidaten met lagere prioriteit toevoegen.
Wat is het verschil tussen spellingcorrectie en synoniemen?
Spellingcorrectie herstelt vermoedelijke invoerfouten. Synoniemen verbinden verschillende geldige termen met dezelfde of vergelijkbare betekenis. Houd deze mechanismen apart, omdat de risico’s en tests verschillen.
Moet een webshop iedere typefout automatisch corrigeren?
Nee. Bij korte woorden, merken, modelcodes en technische termen is terughoudendheid belangrijk. Toon bij twijfel een suggestie of behoud de oorspronkelijke exacte matches.
Hoe test je fuzzy matching?
Gebruik echte typefouten, succesvolle exacte queries, korte termen, merken, SKU’s en meertalige voorbeelden. Controleer resultaatrelevantie vóór en na de wijziging en volg klikgedrag en herformuleringen na livegang.
Meer praktische inzichten
Bekijk alle FINDOVIQ-artikelen →