Hoe vind je de perfecte stockfoto met een zin — niet met trefwoorden

Vier echte zoekopdrachten — een vaste klant van altijd in een café, eenzaamheid in de menigte, een pure metafoor en dezelfde vraag in twee talen — waar het beschrijven van de scène het wint van welk trefwoordveld dan ook.

Een oude man aan een tafeltje op een caféterras in de ochtendzon.
Foto via Pexels

Je kunt je de foto perfect voorstellen. Warm ochtendlicht. Een gezicht getekend door de tijd. Een klein kopje, een rustige straat, de vanzelfsprekendheid dat deze persoon dit al duizend keer heeft gedaan. Dan open je een stockfotosite, en meteen moet je het beeld in je hoofd verraden en het terugbrengen tot trefwoorden die een zoekveld zal tolereren: oude man, café, koffie. De resultaten komen stijf, generiek en vals terug.

Dat is de kernfrustratie van het zoeken naar beelden, en het heeft niets te maken met hoeveel foto's er bestaan. Het draait helemaal om hoe je ze mag vragen. Laten we dat rechtzetten — en het daarna vier keer bewijzen.

Waarom zoeken op trefwoorden je in de steek laat

Traditioneel stockzoeken — dat wat achter de meeste fotobibliotheken schuilgaat, en achter het tekstveld van Google Afbeeldingen — is een systeem van labelmatching. Elke foto draagt woorden die een mens of een algoritme eraan heeft gehangen: man, tafel, koffie, buiten. Wanneer je zoekt, vergelijkt de zoekmachine jouw woorden met die woorden en rangschikt op overlap. Dit model faalt op drie voorspelbare manieren:

  • De woordenschatkloof. Jij zegt “café”, het label zegt “koffiebar”. Jij zegt “bejaard”, het label zegt “senior”. Dezelfde betekenis, andere woorden — een labelmatcher mist het.
  • De bedoelingskloof. Jouw zoekopdracht heeft een sfeer — de routine, de eenzaamheid, drie decennia gewoonte. Geen enkel label vangt dat, dus gooit de zoekmachine het idee weg en houdt alleen de zelfstandige naamwoorden over.
  • De straf op lange zoekopdrachten. Hoe meer je beschrijft, hoe slechter zoeken op trefwoorden werkt, want elk extra woord is nog iets dat de labels waarschijnlijk niet bevatten. Je wordt dus getraind om je zoekopdracht te zeer te vereenvoudigen.

Wat semantisch zoeken naar beelden werkelijk is

Semantisch zoeken naar beelden vindt afbeeldingen op hun betekenis in plaats van door trefwoorden te matchen. Een AI-model zet je zoekopdracht — en elke afbeelding in de index — om in een numerieke vingerafdruk (een vector) die vastlegt waar het ding over gaat. De zoekmachine geeft dan de afbeeldingen terug waarvan de vingerafdrukken het dichtst bij die van je zoekopdracht liggen. Omdat de vergelijking plaatsvindt in “de ruimte van betekenis”, kan een beschrijving overeenkomen met een foto die nooit met een van jouw woorden is gelabeld.

Daar volgen twee gevolgen uit, en daar draait het allemaal om:

  • Je zoekt in natuurlijke, eenvoudige taal — een volledige zin, zoals je de scène aan een vriend zou beschrijven.
  • Langere, rijkere zoekopdrachten worden beter, niet slechter. Elk extra detail scherpt de vingerafdruk aan in plaats van de match uit te hongeren.

De test: een opzettelijk onmogelijke zin

Om het verschil concreet te maken, kozen we een zoekopdracht die geen enkel trefwoordsysteem zou overleven — te lang, te precies, met een verhaal in plaats van een lijst objecten:

“Een oude man aan een tafeltje in het café waar hij al dertig jaar elke ochtend komt.”

In een trefwoordveld gebeurt een van twee dingen: het reduceert de zin tot oude, man, café en geeft een muur van generieke stock terug — of het neemt de reeks letterlijk, vindt niets dat zo gelabeld is, en geeft vrijwel niets terug. De dertig jaar, het elke ochtend, het stille gewicht van de routine — alles wordt weggegooid. Dit is wat Pexafy teruggaf voor exact deze zin, zoals hij was:

een oude man aan een tafeltje in het café waar hij al dertig jaar elke ochtend komt
Echte resultaten van de eerste pagina, over meerdere bibliotheken tegelijk. Voer deze zoekopdracht zelf uit →

Kijk naar het eerste resultaat: een oude man, alleen, aan een tafeltje op een caféterras, gevangen in precies dat vertrouwde ochtendkalm dat de zin beschreef. Niemand heeft deze foto met “dertig jaar” gelabeld. De zoekmachine begreep wat de zin betekende en vond het gevoel. Eén keer is geluk. Laten we het dus nog drie keer doen.

1 · Een emotie zonder object: “eenzaamheid in een drukke stad”

Er bestaat geen label “eenzaamheid”. Een trefwoordmachine ziet alleen stad en menigte en geeft je ansichtkaarten. Pexafy leest het gevoel — één enkele stilstaande gestalte in een waas van onbekenden:

eenzaamheid in een drukke stad
Voer deze zoekopdracht uit →

2 · Een pure metafoor: “het gewicht van ieders verwachtingen dragen”

Deze zin bevat geen enkel fotografeerbaar object. Een labelmatcher staat machteloos. Pexafy lost de metafoor op in zijn meest letterlijke, menselijke vorm — mensen die fysiek enorme lasten dragen:

het gewicht van ieders verwachtingen dragen
Voer deze zoekopdracht uit →

Emotie, metafoor, verhaal — drie verschillende soorten “onmogelijk”, drie sets foto's die echt passen. Er rest nog één capaciteit die, in alle stilte, verandert wie stockfotografie kan gebruiken.

3 · Dezelfde zoekopdracht, in elke taal

Zoeken op trefwoorden is niet meer waard dan de taal waarin de labels zijn geschreven — overwegend Engels. Pexafy projecteert betekenis in dezelfde ruimte ongeacht de taal, zodat de zoekopdracht op dezelfde plek belandt of je hem nu in het Engels of het Nederlands typt. Kijk wat er gebeurt wanneer we op twee manieren naar een visser zoeken:

EN “an old fisherman repairing his net at sunrise”

NL “een oude visser die zijn net herstelt bij zonsopgang”

Dezelfde twee foto's bovenaan, in beide talen. Geen vertaalde lijst trefwoorden — hetzelfde begrip, bereikt vanuit zowel het Nederlands als het Engels. Pexafy werkt zo in 100+ talen, op dezelfde ene index.

Hoe dit zich verhoudt tot Google Afbeeldingen, Unsplash & Pexels

Laten we duidelijk zijn: Unsplash, Pexels en Pixabay herbergen prachtige en werkelijk vrij te gebruiken fotografie — Pexafy doorzoekt ze allemaal en meer. Google Afbeeldingen is ongeëvenaard in het indexeren van het open web. Het verschil zit niet in de afbeeldingen; het zit in de manier waarop je mag vragen.

Zoeken op trefwoorden / labels
Unsplash · Pexels · Pixabay
Google AfbeeldingenPexafy
Matcht opTrefwoordenPaginatekst & labelsVisuele betekenis
Zoekopdracht in volledige zinWordt slechterWordt slechterWordt beter
Emotie & metafoorWeggegooidWeggegooidBegrepen
Niet-Engelstalige zoekopdrachtAlleen Engelse labelsGedeeltelijk100+ talen, één index
Bronnen per zoekopdrachtEén bibliotheekHet open web9 bibliotheken tegelijk
Duidelijke vrije licentieJaJe moet elke site nagaanJa — elk resultaat gekoppeld aan zijn bron

Onder de motorkap leest Pexafy elke foto zoals een mens dat zou doen — niet door af te gaan op de labels, maar door naar de pixels te kijken. Een neuraal netwerk bestudeert de werkelijke inhoud van elke afbeelding en de betekenis van jouw woorden, en plaatst beide in één gedeelde ruimte. De juiste foto vinden wordt een kwestie van de afbeeldingen vinden die het dichtst bij je zin liggen — over 9 bibliotheken, in minder dan 100 milliseconden.

Hoe zoek je op een zin: 4 tips

Om het meeste uit semantisch zoeken te halen, verleer je een paar trefwoordgewoonten:

  1. Beschrijf de scène, som geen zelfstandige naamwoorden op. Schrijf “een vermoeide verpleegkundige die 's nachts een rustige pauze neemt in een ziekenhuisgang”, niet “verpleegkundige ziekenhuis”.
  2. Voeg de sfeer toe. Woorden als rustig, chaotisch, nostalgisch, minimalistisch sturen de resultaten echt bij — ze maken deel uit van de betekenis, niet van de ruis.
  3. Gebruik je eigen taal. Je hoeft niet eerst te vertalen. Typ de zin in de taal waarin je denkt.
  4. Verfijn met woorden, niet met filters. Te zakelijk? Voeg toe: “spontaan, natuurlijk licht, documentaire”. Verfijn door te beschrijven, niet door te klikken.

Dat is de hele verschuiving: stop met je idee te vertalen naar trefwoorden die een machine tolereert, en beschrijf gewoon het beeld dat je al voor je ziet. Het was het zoeken dat de flessenhals was — nooit de bibliotheek.

Veelgestelde vragen

Wat is semantisch zoeken naar beelden?
Semantisch zoeken naar beelden vindt afbeeldingen op hun betekenis in plaats van door trefwoorden te matchen. Het zet je zoekopdracht en elke afbeelding om in numerieke vectoren met behulp van een AI-model, en geeft daarna de afbeeldingen terug waarvan de vectoren het dichtst bij die van je zoekopdracht liggen — zo kan een beschrijving in een volledige zin als “een oude man in zijn vaste café” overeenkomen met een foto die nooit met die woorden is gelabeld.
Kan ik stockfoto's zoeken met een volledige zin?
Ja. Op Pexafy typ je de scène zoals je die aan iemand zou beschrijven — een hele zin, in een van de 100+ talen — en de zoekmachine rangschikt de foto's op hoe goed ze die bedoeling vastleggen. Langere en beschrijvendere zoekopdrachten leveren doorgaans betere resultaten op, in tegenstelling tot zoeken op trefwoorden.
Waarin verschilt Pexafy van Pexels, Unsplash of Pixabay?
Deze bibliotheken zijn uitstekende bronnen van foto's, maar hun zoekfunctie matcht je woorden met door mensen geschreven labels. Pexafy indexeert op één plek de afbeeldingen van Unsplash, Pexels, Pixabay en 6 andere bibliotheken, en doorzoekt ze op visuele betekenis met een neuraal model — één zoekopdracht, één set resultaten, gerangschikt op relevantie en niet op labels.
Is Pexafy gratis?
Ja. Pexafy is een gratis zoekmachine die door vrij te gebruiken afbeeldingen bladert, en elk resultaat verwijst naar de oorspronkelijke bron met een duidelijke licentie. Er is ook een API voor ontwikkelaars, voor teams die de selectie van beelden willen automatiseren.

Stop met jagen op trefwoorden. Beschrijf wat je bedoelt.

Doorzoek 9M+ vrij te gebruiken afbeeldingen op betekenis — in elke taal, in minder dan 100 ms.