Hybrid Retrieval

Combineer precisie en betekenis zonder onzichtbare rangorde.

Hybrid retrieval haalt productkandidaten uit meerdere zoekmethoden en brengt ze samen in één resultaatlijst. Exacte woorden en codes blijven sterk, terwijl semantische matching helpt bij natuurlijke taal. De waarde zit in de gecontroleerde combinatie.

Waarom meerdere retrievalmethoden?

Geen enkele zoektechniek is overal het sterkst. Lexical retrieval is nauwkeurig bij modelcodes, merken en specifieke termen. Semantic retrieval vindt betekenisverwante producten bij toepassingen en lange omschrijvingen. Hybrid retrieval gebruikt beide kwaliteiten zonder één methode blind leidend te maken.

Het systeem verzamelt eerst kandidaten per bron. Daarna worden duplicaten samengevoegd, scores vergelijkbaar gemaakt, harde filters toegepast en de overgebleven producten opnieuw gerangschikt.

Kandidaten uit verschillende bronnen

  • Lexical kandidaten op basis van termen, velden, synoniemen en exacte waarden.
  • Semantische kandidaten op basis van betekenisovereenkomst.
  • Categorie- of navigatiekandidaten wanneer de query duidelijk naar een assortimentsonderdeel wijst.
  • Zakelijke kandidaten die door gecontroleerde merchandisingregels extra aandacht krijgen.

Iedere bron levert een beperkte kandidaatset. Het is niet nodig om de volledige catalogus in elke vervolgstap te verwerken. Dat houdt de zoekroute sneller en beter uitlegbaar.

Scores zijn niet direct vergelijkbaar

Een lexical score en vectorafstand betekenen niet hetzelfde. Ze kunnen daarom niet zonder normalisatie bij elkaar worden opgeteld. Scorefusie gebruikt een expliciete methode om bronnen te combineren, bijvoorbeeld op basis van positie, gekalibreerde score of querytype.

De gekozen aanpak moet stabiel blijven bij catalogusgroei en wijzigingen in één bron. Anders kan een technische scoreverschuiving onverwacht de hele resultaatvolgorde veranderen.

Deduplicatie en varianten

Hetzelfde product kan uit meerdere bronnen komen. Deduplicatie voorkomt dubbele tegels en combineert de beschikbare signalen. Bij productvarianten is een aanvullende keuze nodig: toon je iedere variant, groepeer je op hoofdproduct of kies je de best passende variant voor de zoekvraag?

Die beslissing hangt af van assortiment en gebruikerservaring. Een maat- of kleurvraag kan juist om een specifieke variant vragen, terwijl een brede categoriezoekopdracht overzichtelijker wordt met gegroepeerde producten.

Filters vóór de eindrangschikking

Harde voorwaarden zoals maat, voorraad, land, klantrechten of compatibiliteit mogen niet verdwijnen in scorefusie. Ze worden als filters of constraints toegepast. Een kandidaat die goed lijkt maar niet geleverd mag worden, hoort niet in de eindlijst.

Daarna kan een reranker aanvullende signalen combineren: exacte veldmatches, semantische overeenkomst, productkwaliteit, beschikbaarheid en vastgelegde businessregels. Iedere factor heeft een duidelijke rol en grens.

Query-afhankelijke prioriteiten

Bij een SKU-query krijgt de lexical bron vrijwel alle ruimte. Bij een toepassingsvraag kan semantic retrieval meer kandidaten aandragen. Bij een merk plus attribuut moeten het merk en het attribuut beschermd blijven, terwijl betekenis helpt om relevante producttypen te vinden.

Intent detection en confidence sturen deze verhoudingen. Een lage zekerheid kan leiden tot een bredere combinatie of een veilige lexical fallback, in plaats van een harde semantische interpretatie.

Praktijkvoorbeeld

Voor “lichte waterdichte jas voor woon-werk fietsen” vindt lexical retrieval producten met woorden als waterdicht en jas. Semantic retrieval kan shelljassen herkennen die geschikt zijn voor fietsen, ook wanneer “woon-werk” ontbreekt. Filters bewaken maat en voorraad. De reranker zet producten hoger die meerdere gewenste eigenschappen expliciet ondersteunen.

Een modieuze lichte jas zonder waterdichte eigenschap mag niet alleen door semantische gelijkenis bovenaan verschijnen. Productdata en constraints blijven bepalend voor feitelijke geschiktheid.

Meten en beheren

Evalueer per querytype welke bron relevante kandidaten levert en waar de uiteindelijke volgorde verslechtert. Monitor overlap, no-results, latency en onverwachte categorieverschuivingen. Bescherm golden queries met regressietests.

Findoviq maakt hybrid retrieval beheersbaar door de combinatie van lexical, semantic, filters en businessregels expliciet te houden. Zo ontstaat een bredere zoekervaring zonder dat exactheid en controle verdwijnen.

Bespreek jouw zoekvragen

Wil je weten hoe deze aanpak past bij jouw assortiment, productdata en klantgedrag? We bekijken samen welke querytypen prioriteit hebben en waar exacte, semantische en zakelijke signalen elkaar moeten aanvullen.

Plan een vrijblijvende demo Terug naar AI Search