Image Search Infrastructure para sa AI Agents: Ano ang Talagang Naibibigay ng Market

Naglunsad ang Getty ng MCP server ngayong buwan; hindi pa naglabas nito ang mga libreng library kahit isa. Isang reproducible na benchmark, isang sensus ng registry, at ang mga terms ng apat na malaking photo API — basahin na parang ikaw ang makinang kailangang sumunod dito.

Isang puting 3D-rendered na robot na may hawak na magnifying glass sa itaas ng ulo nito, sa isang pink na background.
Larawan sa pamamagitan ng Unsplash

Bawat agent framework na inilabas ngayong taon ay kayang magsulat, magplano, tumawag ng mga tool at magbukas ng pull request. Hilingin sa isa ang isang larawan at ang buong bagay ay babagsak sa isang balikat-angat: isang stock URL na inimbento mula sa memorya, isang sirang hotlink, o isang larawang ginawa dahil mas mahirap maghanap ng totoo kaysa gumawa ng isa. Hindi ang mga modelo ang mahinang link. Ang image layer sa ilalim nila ang problema — at ito ay nawawala sa isang napaka-tiyak, masusukat na paraan.

Ito ay isang pag-aaral ng merkado, hindi isang manifesto. Lahat ng nakasaad sa ibaba ay sinukat o binasa mula sa isang primary source noong 18 Agosto 2026: isang census ng opisyal na MCP registry, ang publikadong tuntunin ng apat na malalaking libreng photo API, ang mga kondisyon ng access ng dalawang bayad na incumbent na naglabas ng agent connector ngayong buwan, at isang maliit na reproducible benchmark na maaari mong patakbuhin ulit sa isang minuto na walang kinakailangang API key.

Isang hangganan, para huminto kang magbasa maaga kung ito ay hindi ang iyong tanong: ang artikulong ito ay tungkol sa access layer — retrieval, reachability, mga tuntunin, quota. Hindi ito ang publishing pipeline. Kung ang kailangan mo ay kung paano gawing draft na nailustrasyon, may credit, at may markup na pahina — ang router prompt, ang mga visual brief, ang assembly, ang ImageObject markup — nailathala iyon nang hiwalay sa ang pipeline na naglalarawan ng mga artikulong isinulat ng AI.

Ano ang nagbabago kapag ang caller ay isang makina

Ang isang tao na naghahanap ng larawan ay nagta-type ng dalawa o tatlong salita, minamasdan ang isang grid, at nakikilala kung magandang larawan ang nakikita niya. Bawat search engine ng stock photo na naitayo ay ipinagpapalagay ang loop na ito. Sinisira ng isang agent ang tatlong palagay na ito nang sabay-sabay:

  1. Nagsusulat ito ng mga pangungusap, hindi mga keyword. Isang modelo na kababalangkas lang ng isang seksyon tungkol sa mga papeles ng mortgage ay hindi maglalabas ng mortgage; maglalabas ito ng "isang babaeng pumipirma ng dokumento ng mortgage sa isang lamesa sa kusina habang ipinaliwanag ng isang tagapayo ng bangko ang mga tuntunin". Iyan ang natural na output ng isang language model, at eksaktong iyan ang hindi kayang serbisyuhan ng isang index na tumutugma sa mga token.
  2. Hindi ito kayang mag-scan ng grid. Anuman ang ibalik ng tool ay iyon ang alam ng agent. Kung ang tugon ay isang listahan ng URL na walang deskripsyon, dimensyon o credit, kinakailangan ng agent na kunin at tingnan ang bawat larawan — o, mas madalas, humula.
  3. Walang kamay ito. Hindi ito kayang mag-upload ng mga screenshot sa isang review queue, tanggapin ang mga tuntunin, i-rotate ang isang key, o maghintay ng tatlong araw ng negosyo para sa approval sa production. Bawat hakbang ng tao sa onboarding ng isang API ay isang pader na kinatitigilan ng agent.

Kaya ang "infrastructure ng image search para sa mga AI agent" ay hindi isang marketing na parirala. Ito ay isang checklist: retrieval na natural-language, mga resultang machine-readable na sapat ang kayamanan para mangatwiran, at isang modelo ng authentication at quota na kayang kumpletuhin ng isang programa nang mag-isa.

Ang pagsubok: isang pangungusap laban sa isang keyword index

Ang pinakamurang paraan upang makita ang problema ay ipadala ang mismong mga salita ng isang agent sa isang keyword engine. Ang pagsubok sa ibaba ay gumagamit ng Openverse, ang media search na openly licensed na pinapatakbo ng WordPress.org, dahil ang API nito ay pampubliko, hindi nangangailangan ng key, at kaya itong patakbuhin ulit ng sinumang nagbabasa nito sa loob ng isang minuto. Apat na brief, ng klase na isinusulat ng isang modelo kapag nag-iilustrate ito ng bagong balangkas nito:

openverse_briefs.py — walang key, walang signup, 20 linya
import json, urllib.request, urllib.parse

BRIEFS = [
  "a woman signing a mortgage document at a kitchen table while a bank"
  " adviser explains the terms, warm morning light",
  "An elderly couple enjoying a peaceful retirement together",
  "a child discovering snow for the first time in a suburban garden",
  "a delivery cyclist waiting at a red light in heavy rain",
]

def count(q):
    u = "https://api.openverse.org/v1/images/?" + urllib.parse.urlencode({"q": q})
    r = urllib.request.Request(u, headers={"User-Agent": "benchmark/1.0"})
    return json.load(urllib.request.urlopen(r))["result_count"]

for b in BRIEFS:
    print(count(b), "|", b[:48])
# 0 | a woman signing a mortgage document at a kitchen
# 0 | An elderly couple enjoying a peaceful retirement
# 0 | a child discovering snow for the first time in a
# 0 | a delivery cyclist waiting at a red light in hea

Apat na brief, apat na walang lamang resulta. Ngayon bawasan ang bawat brief sa dalawang keyword na sana itype ng isang tao — signing document, elderly couple, child snow, cyclist rain — at bawat isa sa mga ito ay nagbabalik ng isang buong pahina ng mga litrato (ang API ay nag-uulat ng 240, kung saan ito ang cap para sa mga anonymous caller). Hawak ng katalogo ang mga litrato. Ang pangungusap ang hindi nito kayang pag-parse.

Ang brief na aktuwal na isinusulat ng isang agent Keyword engineOpenverse, buong pangungusap Keyword enginebinawasan sa 2 keyword Semantic enginePexafy, buong pangungusap
"a woman signing a mortgage document at a kitchen table while a bank adviser explains the terms…" 0 resulta 240 (may cap) 16 resulta · 148 ms
"An elderly couple enjoying a peaceful retirement together" 0 resulta 240 (may cap) 16 resulta · 135 ms
"a child discovering snow for the first time in a suburban garden" 0 resulta 240 (may cap) 16 resulta · 147 ms
"a delivery cyclist waiting at a red light in heavy rain" 0 resulta 240 (may cap) 16 resulta · 149 ms

Ang column ng Pexafy ay ang parehong apat na pangungusap na ipinadala nang walang binago sa search_photos sa hosted MCP server, kasama ang latency na iniulat ng server mismo. Ito ay isang paghambing ng hugis ng query, hindi ng kalidad ng katalogo — at hindi ang katalogo ang problema, malinaw at tuwiran. Ang statistics endpoint ng Openverse mismo ay nag-uulat ng 915 milyong larawan mula sa 52 na pinagmumulan sa araw ng pagsubok, at mahusay ito sa ginawa itong gawin: keyword search, para sa mga tao. Walang sira dito. Hindi lang ito talaga idinisenyo para sa isang caller na nag-iisip sa mga pangungusap. Bakit nasisira ang tag matching sa isang inilarawang tagpo — at ano ang gagawin ng semantic retrieval sa ganitong sitwasyon — ay ipinaliwanag mula sa panig ng mambabasa sa paghahanap gamit ang isang pangungusap sa halip na mga keyword; ang bago dito ay ang sukatan, at ang kahulugan nito kapag ang caller ay isang programa sa halip na isang tao.

"An elderly couple enjoying a peaceful retirement together" · 16 resulta sa 135 ms · tatlo sa mga ito
Isang query, tatlong iba't ibang library, may credit. Walang salita sa pangungusap na iyon ang isang tag: peaceful at together ang naglagay ng mga bangko, hardin at tahimik na tubig sa unahan sa halip na isang stock portrait ng dalawang tao na may edad na higit sa animnapu.

Ang merkado, hanggang 18 Agosto 2026

Ang retrieval ay kalahati. Ang kabilang kalahati ay ang reachability: kaya ba ng isang agent na maabot ang katalogo sa unang lugar, at sa anong mga tuntunin? Mula noong nagiging paraan ang Model Context Protocol para sa mga assistant na mag-attach sa mga panlabas na sistema — ang kasalukuyang specification nito, may petsang 28 Hulyo 2026, ay lumipat ang protocol sa isang stateless request/response core kaya nakaupo ang mga server sa likod ng ordinaryong load balancer1 — ang tapat na paraan upang suriin ang merkadong ito ay tingnan ang aktuwal na nailathala, hindi ang inanunsyo.

Dumating ngayong buwan ang mga bayad na incumbent

Naglunsad ang Getty Images ng MCP server nito noong 12 Agosto 2026, anim na araw bago ang artikulong ito, na nagbubukas ng creative, editorial at archival search at download sa mga AI workflow.2 Nakatuon ito sa mga enterprise team at platform builder, at ang sariling access page nito ay malinaw sa entry price: kailangan mo ng aktibong kasunduan sa Getty Images, tulad ng Premium Access, kasama ang pagtanggap sa mga tuntunin ng Web Service. Walang libreng tier. Maaabot din ang content ng Shutterstock sa pamamagitan ng isang MCP server — 24 na tool na sumasaklaw sa search, koleksyon at lisensya — na may pag-download na naka-gate sa likod ng isang account na may aktibong subscription.3

Ang dalawang galaw ay makatwiran at nakatuon ang bawat isa sa isang tiyak na bumibili. Nakuha ng Getty ang $981.3 milyon na kita noong 20254 sa isang merkado ng stock photography na tinatayang $5.4 bilyon para sa 20265; mga connector na nangangailangan ng kontrata ay pinoprotektahan ang kita na iyon sa halip na buksan ito. Kung ikaw ay isang bangko o isang broadcaster, eksakto itong ang kailangan mo. Kung ikaw ay isang developer na nag-wiring ng side project — o isang agent na hindi kayang huminto at humingi sa isang tao na pumirma ng kung ano man — isang sarado itong pinto.

Hindi pa naglabas ng anuman ang mga libreng library

Ang Unsplash, Pexels at Pixabay ay ang tatlong katalogo na pinagpupuntahan ng karamihan sa mga builder, at wala sa kanila ang naglathala ng opisyal na MCP server. Ang umiiral sa halip ay isang istante ng mga community wrapper. Sinuri namin ang opisyal na MCP registry nang buo — 22,607 na server, 75,487 nailathalang bersyon — at itinira ang bawat entry na ang pangalan o deskripsyon ay tungkol sa photo o stock-image search. Pare-pareho ang pattern:

Opisyal na MCP registry, 18 Ago 2026 Bilang Ang kahulugan nito para sa isang agent
Mga server na nakalista sa registry, lahat ng kategorya 22,607 Ang buong ecosystem na maaaring kunan ng tool ng isang agent
Mga server na tumutugma sa photo / image / stock / picture at ang mga pangalan ng library 137 Kadalasan mga editor, generator o personal photo tool, hindi search
…na aktuwal na naghahanap ng stock o free-licence photography 11 Ang buong maaabot na istante
…nailathala ng Unsplash, Pexels, Pixabay o Openverse mismo 0 Ang bawat isa ay isang third-party wrapper; isa ang naka-label na "Unofficial" sa sariling deskripsyon nito
…na tumatakbo nang lokal at nangangailangan ng iyong third-party API key 7 UNSPLASH_ACCESS_KEY, PEXELS_API_KEY, PIXABAY_API_KEY… kailangan munang kumuha ng isang tao ng bawat isa
…na maaabot bilang isang hosted remote server 4 Lahat ng apat ay single-source gateway mula sa isang third-party operator, sa harap ng parehong mga keyword API
Mga entry para sa Getty o Shutterstock 0 Umiiral ang mga server nila, ngunit ipinamamahagi sa labas ng pampublikong registry, sa mga may account
census.py — ang registry crawl sa likod ng table na iyon
import json, urllib.request, urllib.parse

def crawl(term):                      # nag-page ang registry gamit ang `nextCursor`
    out, cursor = {}, None
    while True:
        p = {"limit": "100", "search": term} | ({"cursor": cursor} if cursor else {})
        d = json.load(urllib.request.urlopen(
            "https://registry.modelcontextprotocol.io/v0/servers?" + urllib.parse.urlencode(p)))
        for e in d["servers"]: out[e["server"]["name"]] = e["server"]
        cursor = (d.get("metadata") or {}).get("nextCursor")
        if not cursor or not d["servers"]: return out

servers = {}
for t in ["photo", "image", "stock", "picture", "unsplash",
          "pexels", "pixabay", "getty", "shutterstock", "openverse"]:
    servers |= crawl(t)

# 137 na natatanging server · remote laban sa local ay `server["remotes"]`
# ang kinakailangang mga third-party key ay sa packages[].environmentVariables

Ang bawat isa sa mga wrapper na iyon ay isang manipis na client ng parehong tatlong keyword API, na nangangahulugang ang benchmark sa itaas ay naaangkop sa lahat ng ito: nagbago ang transport, hindi ang retrieval. Hindi kayang gawin ng isang wrapper na maintindihan ng isang tag index ang isang pangungusap.

Ang clause na pumipigil sa isang makina ay hindi ang quota

Ang quota at tuntunin ng mga libreng library ay ihinambing tabi-tabi, sa isang karaniwang yunit, sa ang paghambing ng free stock photo API — ang mga approval queue, ang sapilitang download call, ang obligasyong caching ng 24-oras, ang mga panuntunan sa attribution. Ang artikulong iyon ay binabasa ang mga ito bilang isang developer na pumipili ng provider. Basahin ulit ito bilang ang programa na sinusundan ang mga ito at may isang linya na namumukod na walang kinalaman sa dami:

Tumatanggap ang query field ng Pixabay ng 100 karakter. Ang apat na brief sa benchmark sa itaas ay may average na 72, at ang mortgage ay umaabot sa 114 — matinding tatanggihan agad, hindi mahinang mararanggo. Hindi naglalathala ang Pexels at Unsplash ng limitasyon sa haba dahil hindi nila inaasahan ang kailangan nito: ang mga dokumentadong halimbawa nila ay Ocean, Tigers, Pears. Isang field na sinukat para sa dalawang salita ay isang pahayag tungkol sa sinong inaasahan ang caller, at walang halaga ng quota ang aayos nito. Ang semantic endpoint na kinakausap ng isang agent ay tumatanggap ng 500, dahil ang huling clause — "…while a bank adviser explains the terms" — ang bahagi na ginagawang mahusay ang retrieval.

Ang parehong pagbasa ay naaangkop sa onboarding. Isang demo tier na naging production lamang matapos suriin ng isang tao ang mga screenshot ng iyong app ay hindi isang rate limit na maaaring bawasan ng isang agent; isang hakbang ito na hindi nito kayang gawin sa lahat. Ipinapahayag ng Pixabay nang malinaw ang layunin — ang API ay para sa lehitimong gamit ng tao, at ipinagbabawal ang mass automated downloading. Walang sa mga ito ang hindi makatwiran — ibinibigay ng mga photographer ang kanilang trabaho at may nagbabayad ng bandwidth. Ito lang ay naglalarawan ng isang API na inasahan ang caller nito na may screen at may pares ng kamay.

Apat na kailangan, at sino ang tumutupad sa mga ito

Ilagay ang dalawang kalahati nang sabay at ang specification para sa isang image layer na aktuwal na kayang gamitin ng isang agent ay maiksi at masusubok. Sinasadya itong hindi paghambing ng provider — ang laki ng katalogo, presyo at mga tuntunin ng lisensya ay inihanay sa ang artikulo ng paghambing. Ang apat na ito ay tungkol lamang sa kung kaya ng isang programa na maabot ang mga litrato sa unang lugar:

  1. Semantic retrieval — isang buong pangungusap ay nagbabalik ng isang naka-rank na pahina, hindi isang walang lamang set.
  2. Libreng lisensya, ilang pinagmumulan — walang lisensyahin bawat larawan, at walang panlasang isang library lang na tumutukoy sa bawat pahina na ilalathala mo.
  3. Isang hosted server na may sariling sign-in — remote, OAuth, walang lokal na proseso na kakailanganing i-install at walang API key ng third party na ipapaskil sa isang config file.
  4. Isang libreng tier na kayang kumpletuhin ng isang makina nang mag-isa — walang review ng screenshot, walang kontrata, isang buwanang quota at isang per-minute rate limit na kayang pacing-in ng isang worker sa kanyang sarili.
Hanggang 18 Ago 2026 Semantic Libreng lisensya, multi-source Hosted server + OAuth Self-serve na libreng tier
Getty Images MCP Natural-language search Lisensyadong katalogo, per-kontrata Oo, para sa mga may account Hindi — kailangan ng aktibong kasunduan
Shutterstock sa pamamagitan ng MCP Keyword-led Lisensyadong katalogo, subscription Oo, may account auth Hindi — subscription para makapag-download
Unsplash / Pexels / Pixabay na mga wrapper Hindi — mga keyword API sa ilalim Isang pinagmumulan sa bawat isa Hindi — lokal na proseso, sariling key mo Namamana ang human onboarding ng host API
Openverse Hindi — keyword index Oo, malawak na CC catalogue Walang opisyal na MCP server Oo, bukas na API
Pexafy Oo — mga pangungusap, hanggang 500 karakter 9 na free-licence na pinagmumulan, 9M+ na litrato Oo — mcp.pexafy.com/mcp, OAuth 2.1 Oo — 5,000 requests/buwan, 20/min, walang card

Ginagawa namin ang Pexafy, kaya basahin ang huling hilera na iyon nang may pagdududa na nararapat dito — at pagkatapos ay suriin: ang census ng registry ay reproducible sa isang script, ang mga kondisyon ng access ng Getty at Shutterstock ay sa sariling pahina nila, at ang mga limitasyon ng tatlong photo API ay sa sariling dokumentasyon nila, lahat ay naka-link sa ibaba. Ang claim ay makitid at falsifiable: noong 18 Agosto 2026 hindi kami nakahanap ng ikalawang serbisyo na tumutupad sa lahat ng apat. Kung may nalalaman ka, idadagdag namin ito sa table na ito — ang layunin ng pagsulat ng mga kailangan ay kaya ng sinuman na patakbuhin ang mga ito laban sa anumang produkto, kasama ang amin.

Ano ang gagawin ng isang magandang image server sa MCP

Ang isang connector ay hindi isang REST endpoint na may bagong pintura. Dalawang gamit ng layer na ito ay nailathala na sa ibang lugar at hindi na uulitin dito — ang paglalarawan ng isang draft, sa artikulo ng pipeline, at ang pagpapanatili ng isang mahabang serye na visually coherent, sa ang isa tungkol sa dami. Ang nauukol sa infrastructure ay ang bagay na umaasa ang dalawa dito at wala sa kanila ang kayang idagdag mamaya: tatlong desisyon sa panig ng server, ginawa isang beses, para sa bawat agent na kumonekta.

1. Ibalik ang mga object na kayang pangatwiranan ng isang agent. Anuman ang ibalik ng tool ay ang lahat na alam ng modelo — hindi ito kayang mag-scan ng grid. Ang pagkakaiba sa pagitan ng dalawang hugis sa ibaba ay ang pagkakaiba sa pagitan ng isang assistant na nangangatwiran tungkol sa mga litrato at isang nagpapasa lang ng mga link:

Ang parehong litrato, bilang dalawang iba't ibang resulta ng tool
# Karaniwang keyword wrapper: kailangan kunin at tingnan ng agent, o humula
[{ "url": "https://…/photo-8795398.jpeg" }, { "url": "https://…/366611.jpg" }]

# Isang resulta, kung paano ito ibinalik — pinaikli dito, walang idinagdag
{
  "rank": 1,                       // ang handle na gamit ng isang tao: "more like #1"
  "photo_id": "019e14d9-e821-…",   // ang kinukuha ng get_similar_photos
  "width": 6424, "height": 4283, "orientation": "landscape",
  "color_hex": "#918872", "blur_hash": "LPI#Px?aDikCGwW?M{kD-VR*s.fl",
  "source": "Pexels", "license_type": "free",
  "alt_description": "Older couple sits together on wooden bench in a park",
  "attribution": { "plain": "Photo by Anastasia Shuraeva on Pexels", "html": "…" },
  "urls": { "thumb": "…", "small": "…", "regular": "…", "large": "…" }
}

Sa ikalawang hugis kaya sabihin ng isang agent na "portrait ang #3, sisirain nito ang iyong hero slot", tanggalin ang isang doble na photographer, ilabas ang credit line, at ibigay sa iyong template ang isang width/height na pares na pumapatay ng layout shift — nang hindi kinukuha ang kahit isang larawan. Sa una, ang bawat isa sa mga desisyong iyon ay isang hula o isang round trip.

2. Bilangin ang mga resulta, para kaya ng isang tao na ituro. Nagbabalik ang mga resulta nang naka-rank #1, #2, #3…, na kung paano tumutukoy ang sinuman sa isang larawan sa pag-uusap — "more like #3" — na walang identifier na kinopya nang manwal. Sa mga client na sumusuporta sa MCP Apps ang mga thumbnail ay nagre-render nang inline, at ang pagbukas ng isa ay nagpapakita ng metadata na nasa resulta na ng tool, walang dagdag na tawag.

3. Manatiling read-only, at maging malinaw dito. Tatlong tool, walang write scope, walang account mutation. Isa sa mga ito ang walang katumbas sa keyword saanman: search_photos_by_image ay kinukuha ang isang reference image — ang umiiral na hero ng isang client, isang screenshot na naidikit sa chat — kasama ang isang opsyonal na pangungusap na baluktutin ito ("like this, but at night"). Walang field sa isang tag-matching API kung saan maaaring i-type ang hiling na iyon. At isang agent na hindi kayang baguhin ang kahit ano ay isang agent na ang pinakamasamang kalalabasan ay isang walang lamang set ng resulta sa halip na isang support ticket.

Ang dalawang surface, at alin ang gugustuhin mo

May eksaktong dalawang paraan ng pagpasok, at ang pagpili ay tungkol sa sino ang nasa loop kaysa sa kapasidad — ang mga tool at ang katalogo ay pareho sa dalawa.

Ang connector, kapag isang tao ang nasa loop. Isang URL, https://mcp.pexafy.com/mcp, idinagdag isang beses sa mga setting ng connector ng isang assistant; nangyayari ang sign-in sa isang browser window at nakakuha ang client ng sariling kredensyal, kaya walang key na ipapaskil sa isang config file at walang i-rotate mamaya. Mga client na hindi nag-implement ng OAuth ay nagpapadala ng isang API key ng Pexafy bilang isang bearer token laban sa parehong endpoint — na ginagawang gamit-in ang connector mula sa isang cron job sa isang build server, kung saan walang taong nakaikot para pindutin ang "Allow". Ang step-by-step na wiring para sa Claude, ChatGPT at isang fleet config file ay sa artikulo ng pipeline; hindi ito nagbago.

Ang HTTP API, kapag walang tao. Isang batch job na pinupuno ang isang pool para sa 800 topic cluster ay hindi dapat magpanggap na isang chat client: parehong account, parehong key, plain HTTP, 100 resulta bawat tawag. Ang mga panuntunan sa pacing na kasama nito — ang mga rate-limit header, kung bakit ang isang per-minute 429 ay sulit na subukan ulit at ang isang monthly-quota 429 ay hindi, magkano ang gastos ng isang worker sa dami — nauukol sa ang artikulo tungkol sa paglalarawan sa malaking dami, kung saan naisulat nang buo ang worker na iyon.

Ang punto na nararapat panatilihin dito ay mas makitid, at ito ang punto na inaasahan ng pag-aaral ng merkado: ang dalawang surface ay maaabot ng isang programa sa mismong araw na naisulat ito, walang queue at walang kontrata.

Ano ang hindi nito nalulutas

Isang tapat na listahan, dahil ang bawat isa sa mga ito ay nagkaroon ng gastos sa isang tao ng rollback.

  • Pinamamahalaan pa rin ng lisensya ang larawan. Hindi kinakailangan ang attribution ng mga tuntunin ng Pexafy API at ang bawat resulta ay may attribution string na handa nang mag-render — ngunit ang lisensyang naidugtong ng pinagmulang library ay naaangkop sa iyong paggamit ng litratong iyon. I-render ang credit nang automatic; mas mura ito kaysa mag-audit mamaya.
  • Hindi archive ng editoryal ang mga katalogong may libreng lisensya. Walang balita, walang isports, walang makikilalang tatak o pampublikong pigura on-demand. Kung kailangan ng iyong pahina ng isang litrato ng isang tiyak na kaganapan o tao, iyon ang gamit ng mga lisensyadong incumbent, at umiiral na ngayon ang mga connector nila.
  • Retrieval ito, at retrieval lamang. Ang mga diagram, chart at screenshot ay nagagawa mula sa code, hindi hinahanap; ang deduplication sa iyong mga pahina ay isang column sa iyong database, hindi isang parameter sa endpoint; at walang litrato na nagpapataas ng ranking ng isang manipis na pahina — pinapakita ng mga patakaran ng Google laban sa spam na parehong tratamento ang scaled content abuse kahit may ilustrasyon man ang mga pahina o wala.6 Ang tatlong ito ay mga problema ng pipeline na may mga sagot ng pipeline, na nasusuri sa artikulo ng pipeline at sa ang isa tungkol sa dami.

Saan magsisimula

  1. Patakbuhin ulit ang benchmark. Dalawampung linya, walang key. Anumang image API ang ginagamit mo ngayon, ipadala rito ang tatlo sa mga brief ng iyong sariling agent nang verbatim at bilangin ang mga walang lamang resulta.
  2. I-attach ang isang connector sa assistant na ginagamit mo na at hilingin dito, sa isang pangungusap, ang isang litratong kailangan mo talaga ngayong linggo. Iyon lang ang buong ebalwasyon.
  3. Ilipat ang mga brief sa loob ng agent — isang tagpo bawat slot, isinulat mula sa draft, hindi kailanman mula sa titulo.
  4. Idagdag ang column ng photo_id bago ilathala ang anuman sa malaking dami.
  5. Patakbuhin ito sa libreng tier — 5,000 na paghahanap bawat buwan sa 20 bawat minuto hanggang sa pilitin ka ng isang build window, hindi ng isang bill, na tumaas.

Mga sanggunian & footnote

1 Ang Model Context Protocol specification ng 28 Hulyo 2026: stateless request/response core, issuer validation sa bawat RFC 9207, mga Client ID Metadata Document na pumapalit sa Dynamic Client Registration, at mga pangalan ng method/tool na dala sa mga HTTP header para sa gateway routing.

2 Getty Images newsroom, 12 Agosto 2026 — "Getty Images Launches MCP Server to Connect Creative and Editorial Content to AI Workflows and Products". Sinasaad ng access page na ang paggamit ay nangangailangan ng aktibong kasunduan sa Getty Images, tulad ng Premium Access, at ang pagtanggap sa mga tuntunin ng Web Service.

3 Ang katalogo ng Shutterstock ay ibinubunyag sa pamamagitan ng isang MCP server na nag-aalok ng 24 na tool (search, koleksyon, lisensya), ipinamamahagi sa pamamagitan ng isang third-party MCP platform kaysa ianunsyo sa sariling developer portal ng Shutterstock sa oras ng pagsulat nito; kinakailangan ng lisensya at pag-download ng isang account na may aktibong subscription.

4 Getty Images Holdings, buong-taon 2025 na resulta (iniulat noong 16 Marso 2026): kita na $981.3 milyon, tumaas ng 4.5% taon sa taon.

5 Mordor Intelligence, merkado ng stock photography: USD 5.44 bilyon noong 2026, lumalaki nang 6.86% CAGR. Nagkakaiba ang mga pagtatantya ng laki ng merkado depende sa metodolohiya; naisulat dito lamang upang ipakita ang order of magnitude.

6 Mga patakaran laban sa spam ng Google Search — scaled content abuse: ang paggawa ng maraming pahina na pangunahing layunin ay manipulahin ang mga ranking at maliit na halaga ang ibinibigay sa mga user, kahit ginawa man sa pamamagitan ng automation, pagsisikap ng tao o kombinasyon ng dalawa.

Mga madalas na tanong

Bakit walang naibabalik na resulta ang mga stock photo API kapag hinanap ito ng isang AI agent?
Dahil nagpapadala ang agent ng isang buong pangungusap habang nag-i-index naman ang API ng mga tag. Nang isumite nang buo sa isang keyword-based image API, apat na agent-style brief — halimbawa, “An elderly couple enjoying a peaceful retirement together” — bawat isa ay nagbalik ng zero na resulta; nang paikliin sa dalawang keyword lamang (elderly couple), nagbalik ang parehong catalogue ng daan-daang resulta. Pinuputol ng Pixabay ang query nito sa 100 karakter, na kadalasan nang lumalagpas ng mga agent-style brief sa kanilang sarili. Ang isang semantic engine naman ay nag-e-embed ng buong pangungusap, kaya ang mga clause tulad ng “tired” o “at night” ay nagbabago ng ranking sa halip na sirain ang pagtutugma.
May opisyal bang MCP server para sa Unsplash, Pexels, o Pixabay?
Wala. Isang kumpletong crawl ng opisyal na MCP registry noong Agosto 18, 2026 ang nakahanap ng 11 server na naghahanap ng stock o free-licence na larawan, at wala sa mga ito ang nailathala mismo ng Unsplash, Pexels, Pixabay, o Openverse — may isa pang wrapper na tahasang minarkahang “Unofficial.” Pito rito ang tumatakbo nang lokal sa pamamagitan ng stdio at kailangan mong ibigay ang sariling API key ng library na iyon; ang apat naman na remote ay mga single-source gateway na pinapatakbo ng ikatlong partido sa harap ng iisang mga keyword API.
Magkano ang MCP server ng Getty Images, at maaari bang gamitin ito ng kahit sino?
Inilunsad ng Getty ang MCP server nito noong Agosto 12, 2026 para sa mga developer, enterprise team, at gumagawa ng AI platform, na sumasaklaw sa paghahanap at pag-download ng creative, editorial, at archival na content. Kailangan ng aktibong kasunduan sa Getty Images, tulad ng Premium Access, kasama ang pagsang-ayon sa Web Service terms; walang libreng tier na inaalok at hinahawakan ng isang account representative ang pagpepresyo. Naaabot din ang content ng Shutterstock sa pamamagitan ng MCP sa katulad na paraan, kung saan ang lisensya ay nakakandado sa likod ng isang aktibong subscription.
Ano ang kailangan ng isang image search API para magamit ito ng isang AI agent?
Apat na bagay. Semantic retrieval, kaya ang isang buong pangungusap ay nagbabalik ng isang naka-rank na pahina sa halip na isang walang laman na resulta. Mga resultang sapat ang detalye para mangatwiran dito — id, mga sukat, dimensyon, orientation, kulay, lisensya, litratista, at handa nang credit — dahil kung ano ang ibinabalik ng tool ay siya na lamang lahat ng alam ng agent. Isang hosted server na may sariling sign-in, kaya walang lokal na proseso na kailangang i-install at walang ikatlong-partidong key na kailangang idikit. At isang libreng tier na kayang tapusin ng isang makina nang mag-isa: walang pag-review ng screenshot, walang kontrata, isang buwanang quota kasama ang isang per-minute rate limit na maaaring pacingin ng isang worker para sa sarili nito.
Maaari bang gamitin ng isang CI job o headless worker ang isang MCP image server na nangangailangan ng OAuth?
Depende ito sa server, at karapat-dapat itong suriin bago ka bumuo gamit ito. Ang server ng Pexafy sa mcp.pexafy.com/mcp ay dual-mode: may browser sign-in para sa mga interactive na client, at tinatanggap din ng parehong endpoint ang isang Pexafy API key bilang Authorization: Bearer <key> o x-api-key para sa mga client na walang ipinapatupad na OAuth flow — kaya nagiging magagamit ito mula sa isang cron job o build runner kung saan walang sinumang makakapag-click ng “Allow.” Read-only ang tatlong tool, kaya hindi makakapag-mutate ng account ang isang nakompromisong runner key. Ang isang server na interactive OAuth lamang ang sinasalita ay hindi maaaring patakbuhin nang headless.”
Paano ko malalaman kung anong mga image MCP server ang umiiral at ano ang kinakailangan ng bawat isa?
Mag-query sa opisyal na registry at basahin ang dalawang field. GET registry.modelcontextprotocol.io/v0/servers?search=photo&limit=100 ang nagbabalik ng mga server na tumutugma sa isang termino; mag-paginate gamit ang nextCursor na value sa loob ng metadata (pansinin ang camel case — tahimik na nagbabalik ng iisang pahina lamang ang next_cursor). Sa bawat entry, sinasabi sa iyo ng remotes kung ito ba ay isang hosted server o lokal na proseso, at ang packages[].environmentVariables ang naglilista ng mga ikatlong-partidong API key na kailangan mong kunin mismo. Ang pag-uulit nito sa photo, image, stock, at mga pangalan ng library noong Agosto 18, 2026 ay nagbalik ng kabuuang 22,607 server, 11 sa mga ito ay gumagawa ng stock photo search.

Itigil ang paghahanap ng mga keyword. Ilarawan kung ano ang ibig mong sabihin.

Maghanap ng 9M+ libreng gamitin na larawan ayon sa kahulugan — sa anumang wika, sa loob ng wala pang 100 ms.