Infrastruktura wyszukiwania obrazów dla agentów AI: co naprawdę dostarcza rynek

Getty wypuściło serwer MCP w tym miesiącu; darmowe biblioteki nie wypuściły żadnego. Powtarzalny benchmark, spis rejestru i warunki czterech dużych API zdjęciowych — czytane tak, jak musiałaby je odczytać maszyna zobowiązana do ich przestrzegania.

Udostępnij
Biały, wyrenderowany w 3D robot trzymający nad głową szkło powiększające, na różowym tle.
Zdjęcie za pośrednictwem Unsplash

Każdy framework agentowy wypuszczony w tym roku potrafi pisać, planować, wywoływać narzędzia i otwierać pull requesty. Poproś go o fotografię, a całość rozpada się do wzruszenia ramion: adres URL zdjęcia stockowego zmyślony z pamięci, uszkodzony hotlink albo obraz wygenerowany, bo wyszukanie prawdziwego było trudniejsze niż wymyślenie jednego. Modele nie są najsłabszym ogniwem. Warstwa obrazów pod nimi jest — i brakuje jej w bardzo konkretny, mierzalny sposób.

To jest analiza rynku, nie manifest. Wszystko poniżej zostało zmierzone lub odczytane ze źródła pierwotnego 18 sierpnia 2026: spis oficjalnego rejestru MCP, opublikowane regulaminy czterech dużych darmowych API do zdjęć, warunki dostępu dwóch płatnych graczy, którzy w tym miesiącu wypuścili konektory agentowe, oraz mały, powtarzalny benchmark, który możesz uruchomić ponownie w minutę bez żadnego klucza API.

Jedno zastrzeżenie, żebyś mógł przerwać lekturę wcześniej, jeśli to nie jest twoje pytanie: ten artykuł dotyczy warstwy dostępu — wyszukiwania, dostępności, regulaminów, limitów. Nie jest to pipeline publikacji. Jeśli potrzebujesz informacji, jak zamienić szkic w zilustrowane, opatrzone przypisami, oznaczone znacznikami strony — prompt routera, briefy wizualne, montaż, znaczniki ImageObject — to jest opisane osobno w pipeline, który ilustruje artykuły napisane przez AI.

Co się zmienia, gdy wywołującym jest maszyna

Człowiek szukający zdjęcia wpisuje dwa lub trzy słowa, przegląda siatkę i wie, że dobre zdjęcie poznaje, gdy je zobaczy. Każda wyszukiwarka zdjęć stockowych kiedykolwiek zbudowana zakłada tę pętlę. Agent łamie wszystkie trzy założenia naraz:

  1. Pisze zdania, nie słowa kluczowe. Model, który właśnie napisał sekcję o dokumentach kredytu hipotecznego, nie wygeneruje kredyt hipoteczny; wygeneruje „kobieta podpisująca dokument kredytu hipotecznego przy stole kuchennym, podczas gdy doradca bankowy wyjaśnia warunki”. To jest naturalny wynik działania modelu językowego, i to jest dokładnie to, czego indeks dopasowujący tokeny nie umie obsłużyć.
  2. Nie potrafi przejrzeć siatki. Cokolwiek zwróci narzędzie, to jest wszystko, co agent wie. Jeśli odpowiedź to lista adresów URL bez opisu, wymiarów czy podpisu, agent musi pobrać i obejrzeć każdy obraz — albo, znacznie częściej, zgadywać.
  3. Nie ma rąk. Nie może wgrać zrzutów ekranu do kolejki przeglądu, zaakceptować regulaminu, obrócić klucza ani czekać trzy dni robocze na zatwierdzenie produkcyjne. Każdy ludzki krok w procesie wdrożenia API to ściana, o którą agent się zatrzymuje.

Zatem „infrastruktura wyszukiwania obrazów dla agentów AI” to nie jest fraza marketingowa. To jest lista kontrolna: wyszukiwanie w języku naturalnym, wyniki czytelne dla maszyny, na tyle bogate, by można było na nich rozumować, oraz model uwierzytelniania i limitów, który program może zrealizować samodzielnie.

Test: zdanie kontra indeks słów kluczowych

Najtańszy sposób, by zobaczyć problem, to wysłać własne słowa agenta do silnika opartego na słowach kluczowych. Poniższy test korzysta z Openverse, wyszukiwarki mediów na otwartych licencjach prowadzonej przez WordPress.org, ponieważ jej API jest publiczne, nie wymaga klucza i każdy czytelnik może je uruchomić ponownie w niecałą minutę. Cztery briefy, w rodzaju tych, które pisze model, ilustrując to, co właśnie napisał:

openverse_briefs.py — bez klucza, bez rejestracji, 20 linii
import json, urllib.request, urllib.parse

BRIEFS = [
  "a woman signing a mortgage document at a kitchen table while a bank"
  " adviser explains the terms, warm morning light",
  "An elderly couple enjoying a peaceful retirement together",
  "a child discovering snow for the first time in a suburban garden",
  "a delivery cyclist waiting at a red light in heavy rain",
]

def count(q):
    u = "https://api.openverse.org/v1/images/?" + urllib.parse.urlencode({"q": q})
    r = urllib.request.Request(u, headers={"User-Agent": "benchmark/1.0"})
    return json.load(urllib.request.urlopen(r))["result_count"]

for b in BRIEFS:
    print(count(b), "|", b[:48])
# 0 | a woman signing a mortgage document at a kitchen
# 0 | An elderly couple enjoying a peaceful retirement
# 0 | a child discovering snow for the first time in a
# 0 | a delivery cyclist waiting at a red light in hea

Cztery briefy, cztery puste zestawy wyników. Teraz skróć każdy brief do dwóch słów kluczowych, które wpisałby człowiek — signing document, elderly couple, child snow, cyclist rain — i każdy z nich zwraca pełną stronę zdjęć (API raportuje 240, co jest limitem liczby wyników dla anonimowych wywołań). Katalog zawiera te zdjęcia. To zdanie jest tym, czego indeks nie potrafi sparsować.

Brief, jaki faktycznie pisze agent Silnik słów kluczowychOpenverse, pełne zdanie Silnik słów kluczowychskrócone do 2 słów kluczowych Silnik semantycznyPexafy, pełne zdanie
„kobieta podpisująca dokument kredytu hipotecznego przy stole kuchennym, podczas gdy doradca bankowy wyjaśnia warunki…” 0 wyników 240 (limit) 16 wyników · 148 ms
„Starsza para cieszy się razem spokojną emeryturą” 0 wyników 240 (limit) 16 wyników · 135 ms
„dziecko odkrywające śnieg po raz pierwszy w przydomowym ogrodzie” 0 wyników 240 (limit) 16 wyników · 147 ms
„rowerzysta dostawczy czekający na czerwonym świetle w ulewnym deszczu” 0 wyników 240 (limit) 16 wyników · 149 ms

Kolumna Pexafy to te same cztery zdania wysłane bez zmian do search_photos na hostowanym serwerze MCP, z opóźnieniem raportowanym przez sam serwer. To jest porównanie kształtów zapytań, nie jakości katalogu — a katalog zdecydowanie nie jest problemem. Własny endpoint statystyk Openverse raportuje 915 milionów obrazów z 52 źródeł w dniu testu, i jest doskonały w tym, do czego został zbudowany: wyszukiwaniu słów kluczowych, dla ludzi. Nic w nim nie jest zepsute. Po prostu nigdy nie był zaprojektowany dla wywołującego, który myśli w zdaniach. Dlaczego dopasowywanie tagów zawodzi przy opisanej scenie — i co robi w zamian wyszukiwanie semantyczne — jest omówione z perspektywy czytelnika w wyszukiwaniu zdaniem zamiast słowami kluczowymi; nowością jest tu pomiar i to, co znaczy, gdy wywołującym jest program, a nie osoba.

„Starsza para cieszy się razem spokojną emeryturą” · 16 wyników w 135 ms · trzy z nich
Jedno zapytanie, trzy różne biblioteki, dołączone podpisy autorskie. Żadne słowo w tym zdaniu nie jest tagiem: spokojną i razem to właśnie to, co umieszcza ławki, ogrody i spokojną wodę na górze listy, zamiast stockowego portretu dwóch osób po sześćdziesiątce.

Rynek na 18 sierpnia 2026

Wyszukiwanie to jedna połowa. Druga to dostępność: czy agent może w ogóle dotrzeć do katalogu, i na jakich warunkach? Odkąd Model Context Protocol stał się sposobem, w jaki asystenci łączą się z systemami zewnętrznymi — jego aktualna specyfikacja, datowana na 28 lipca 2026, przeniosła protokół na bezstanowy rdzeń żądanie/odpowiedź, dzięki czemu serwery mogą stać za zwykłymi load balancerami1 — uczciwym sposobem przeglądu tego rynku jest spojrzenie na to, co faktycznie jest opublikowane, a nie na zapowiedzi.

Płatni gracze pojawili się w tym miesiącu

Getty Images uruchomiło swój serwer MCP 12 sierpnia 2026, sześć dni przed tym artykułem, udostępniając wyszukiwanie i pobieranie treści kreatywnych, redakcyjnych i archiwalnych na potrzeby workflow AI.2 Jest skierowany do zespołów korporacyjnych i budowniczych platform, a jego strona dostępu jednoznacznie określa próg wejścia: potrzebna jest aktywna umowa z Getty Images, taka jak Premium Access, plus akceptacja regulaminu Web Service. Nie ma darmowego planu. Treści Shutterstock są również dostępne przez serwer MCP — 24 narzędzia obejmujące wyszukiwanie, kolekcje i licencjonowanie — z pobieraniem zablokowanym za kontem z aktywną subskrypcją.3

Oba ruchy są racjonalne i oba są skierowane do konkretnego nabywcy. Getty zaksięgowało 981,3 mln USD przychodu w 2025 roku4 na rynku fotografii stockowej wycenianym na około 5,4 mld USD na 2026 rok5; konektory wymagające umowy chronią ten przychód, zamiast go otwierać. Jeśli jesteś bankiem lub nadawcą telewizyjnym, to dokładnie tego chcesz. Jeśli jesteś programistą podpinającym projekt poboczny — albo agentem, który nie może się zatrzymać i poprosić człowieka o podpisanie czegoś — to jest zamknięte drzwi.

Darmowe biblioteki nie wypuściły żadnego

Unsplash, Pexels i Pixabay to trzy katalogi, po które sięga większość twórców, i żaden z nich nie publikuje oficjalnego serwera MCP. To, co istnieje zamiast tego, to półka wrapperów społecznościowych. Przeszukaliśmy w całości oficjalny rejestr MCP — 22 607 serwerów, 75 487 opublikowanych wersji — i zachowaliśmy każdy wpis, którego nazwa lub opis dotyczy wyszukiwania zdjęć lub obrazów stockowych. Wzorzec jest jednolity:

Oficjalny rejestr MCP, 18 sierpnia 2026 Liczba Co to oznacza dla agenta
Serwery wymienione w rejestrze, wszystkie kategorie 22 607 Cały ekosystem, z którego agent może czerpać narzędzia
Serwery pasujące do photo / image / stock / picture i nazw bibliotek 137 Większość to edytory, generatory lub osobiste narzędzia do zdjęć, nie wyszukiwarki
…które faktycznie wyszukują zdjęcia stockowe lub na darmowej licencji 11 Cała dostępna oferta
…opublikowane przez samych Unsplash, Pexels, Pixabay czy Openverse 0 Każdy jest wrapperem zewnętrznym; jeden jest oznaczony jako „Unofficial” we własnym opisie
…które działają lokalnie i wymagają twojego zewnętrznego klucza API 7 UNSPLASH_ACCESS_KEY, PEXELS_API_KEY, PIXABAY_API_KEY… człowiek musi najpierw zdobyć każdy z nich
…dostępne jako hostowany serwer zdalny 4 Wszystkie cztery to bramki jednoźródłowe od jednego zewnętrznego operatora, stojące przed tymi samymi API słów kluczowych
Wpisy dla Getty lub Shutterstock 0 Ich serwery istnieją, ale są dystrybuowane poza publicznym rejestrem, do posiadaczy kont
census.py — przeszukanie rejestru stojące za tą tabelą
import json, urllib.request, urllib.parse

def crawl(term):                      # rejestr paginuje przez `nextCursor`
    out, cursor = {}, None
    while True:
        p = {"limit": "100", "search": term} | ({"cursor": cursor} if cursor else {})
        d = json.load(urllib.request.urlopen(
            "https://registry.modelcontextprotocol.io/v0/servers?" + urllib.parse.urlencode(p)))
        for e in d["servers"]: out[e["server"]["name"]] = e["server"]
        cursor = (d.get("metadata") or {}).get("nextCursor")
        if not cursor or not d["servers"]: return out

servers = {}
for t in ["photo", "image", "stock", "picture", "unsplash",
          "pexels", "pixabay", "getty", "shutterstock", "openverse"]:
    servers |= crawl(t)

# 137 unikalnych serwerów · zdalny vs lokalny to `server["remotes"]`
# wymagane klucze zewnętrzne są w packages[].environmentVariables

Każdy z tych wrapperów jest cienkim klientem tych samych trzech API opartych na słowach kluczowych, co oznacza, że powyższy benchmark odnosi się do wszystkich z nich: transport się zmienił, wyszukiwanie nie. Wrapper nie może sprawić, że indeks tagów zrozumie zdanie.

Klauzula, która zatrzymuje maszynę, to nie limit

Limity i regulaminy darmowych bibliotek są porównane obok siebie, we wspólnej jednostce, w porównaniu darmowych API do zdjęć stockowych — kolejki zatwierdzeń, obowiązkowe wywołanie pobierania, obowiązek cache'owania na 24 godziny, zasady podpisów autorskich. Ten artykuł czyta je z perspektywy programisty wybierającego dostawcę. Przeczytaj je ponownie z perspektywy programu, który musi je respektować, a wyróżni się jedna linijka, niemająca nic wspólnego z limitem objętości:

Pole zapytania Pixabay akceptuje 100 znaków. Cztery briefy z powyższego benchmarku mają średnio 72 znaki, a brief o kredycie hipotecznym sięga 114 — zostałby odrzucony od razu, a nie źle sklasyfikowany. Pexels i Unsplash nie publikują limitu długości, ponieważ nigdy się nie spodziewali, że będzie potrzebny: ich udokumentowane przykłady to Ocean, Tigers, Pears. Pole dopasowane do dwóch słów to stwierdzenie o tym, kim miał być wywołujący, i żadna ilość limitów tego nie naprawi. Endpoint semantyczny, z którym rozmawia agent, przyjmuje 500 znaków, ponieważ końcowa klauzula — „…podczas gdy doradca bankowy wyjaśnia warunki” — to część, która sprawia, że wyszukiwanie jest dobre.

To samo dotyczy procesu wdrażania. Poziom demo, który staje się produkcyjny dopiero po tym, jak człowiek przejrzy zrzuty ekranu twojej aplikacji, to nie jest limit szybkości, od którego agent może się odsunąć; to jest krok, którego w ogóle nie może wykonać. Pixabay wprost formułuje ten cel — API jest przeznaczone do uzasadnionego użytku przez człowieka, a masowe automatyczne pobieranie jest zabronione. Nic z tego nie jest nierozsądne: fotografowie oddają swoją pracę za darmo, a ktoś płaci za transfer danych. To po prostu opisuje API, którego wywołujący miał, zgodnie z założeniem, ekran i parę rąk.

Cztery wymagania i kto je spełnia

Zestawiając obie połowy, otrzymujemy krótką i testowalną specyfikację warstwy obrazów, którą agent może faktycznie wykorzystać. To celowo nie jest porównanie dostawców — wielkość katalogu, ceny i warunki licencji są zestawione w artykule porównawczym. Te cztery punkty dotyczą wyłącznie tego, czy program w ogóle może dotrzeć do zdjęć:

  1. Wyszukiwanie semantyczne — pełne zdanie zwraca stronę uszeregowanych wyników, a nie pusty zbiór.
  2. Darmowe licencje, wiele źródeł — nic do licencjonowania per zdjęcie i żadna pojedyncza biblioteka nie narzuca gustu każdej publikowanej stronie.
  3. Hostowany serwer z własnym logowaniem — zdalny, OAuth, bez lokalnego procesu do instalacji i bez klucza API od zewnętrznego dostawcy do wklejenia w plik konfiguracyjny.
  4. Darmowy plan, który maszyna może zrealizować samodzielnie — bez przeglądu zrzutów ekranu, bez umowy, z miesięcznym limitem i limitem szybkości na minutę, do którego worker może dostosować tempo.
Stan na 18 sierpnia 2026 Semantyczne Darmowe licencje, wiele źródeł Hostowany serwer + OAuth Samoobsługowy darmowy plan
Getty Images MCP Wyszukiwanie w języku naturalnym Katalog licencjonowany, w ramach umowy Tak, dla posiadaczy kont Nie — wymagana aktywna umowa
Shutterstock przez MCP Oparte na słowach kluczowych Katalog licencjonowany, subskrypcja Tak, z uwierzytelnianiem konta Nie — subskrypcja wymagana do pobierania
Wrappery Unsplash / Pexels / Pixabay Nie — pod spodem API oparte na słowach kluczowych Pojedyncze źródło każdy Nie — proces lokalny, twój własny klucz Dziedziczy ludzki proces wdrożenia hostowanego API
Openverse Nie — indeks słów kluczowych Tak, bardzo szeroki katalog CC Brak oficjalnego serwera MCP Tak, otwarte API
Pexafy Tak — zdania, do 500 znaków 9 źródeł na darmowej licencji, ponad 9 mln zdjęć Tak — mcp.pexafy.com/mcp, OAuth 2.1 Tak — 5,000 zapytań/miesiąc, 20/min, bez karty

Budujemy Pexafy, więc czytaj ten ostatni wiersz ze sceptycyzmem, na jaki zasługuje — a potem to sprawdź: spis rejestru da się odtworzyć jednym skryptem, warunki dostępu Getty i Shutterstock są na ich własnych stronach, a limity trzech API do zdjęć są w ich własnej dokumentacji, wszystko zalinkowane na dole. Twierdzenie jest wąskie i możliwe do obalenia: 18 sierpnia 2026 nie znaleźliśmy drugiej usługi, która spełnia wszystkie cztery warunki. Jeśli znasz taką, dodamy ją do tej tabeli — sensem spisania tych wymagań jest to, że każdy może je zastosować do dowolnego produktu, łącznie z naszym.

Co robi dobry serwer obrazów przez MCP

Konektor to nie jest endpoint REST w nowym opakowaniu. Dwa zastosowania tej warstwy są opisane gdzie indziej i nie są tu powtarzane — ilustrowanie szkicu, w artykule o pipeline, oraz utrzymanie spójności wizualnej długiej serii, w artykule o skali. Do infrastruktury należy to, od czego zależą oba te zastosowania i czego nie da się dodać później: trzy decyzje po stronie serwera, podjęte raz, dla każdego agenta, który kiedykolwiek się połączy.

1. Zwracaj obiekty, na których agent może rozumować. Cokolwiek zwróci narzędzie, to jest wszystko, co wie model — nie potrafi przejrzeć siatki. Różnica między dwoma poniższymi kształtami to różnica między asystentem, który rozumuje na temat fotografii, a takim, który przekazuje linki:

To samo zdjęcie, jako dwa różne wyniki narzędzia
# Typowy wrapper słów kluczowych: agent musi pobrać i obejrzeć, albo zgadywać
[{ "url": "https://…/photo-8795398.jpeg" }, { "url": "https://…/366611.jpg" }]

# Jeden wynik, tak jak jest zwracany — skrócony tutaj, nic nie dodane
{
  "rank": 1,                       // uchwyt, którego używa człowiek: "more like #1"
  "photo_id": "019e14d9-e821-…",   // to, co przyjmuje get_similar_photos
  "width": 6424, "height": 4283, "orientation": "landscape",
  "color_hex": "#918872", "blur_hash": "LPI#Px?aDikCGwW?M{kD-VR*s.fl",
  "source": "Pexels", "license_type": "free",
  "alt_description": "Older couple sits together on wooden bench in a park",
  "attribution": { "plain": "Photo by Anastasia Shuraeva on Pexels", "html": "…" },
  "urls": { "thumb": "…", "small": "…", "regular": "…", "large": "…" }
}

Przy drugim kształcie agent może powiedzieć „#3 jest w pionie, zepsuje twój slot na hero”, odrzucić zdublowanego fotografa, wygenerować linijkę z podpisem autorskim i przekazać twojemu szablonowi parę width/height, która eliminuje przesunięcie układu — bez pobierania choćby jednego obrazu. Przy pierwszym kształcie każda z tych decyzji to zgadywanie albo dodatkowe zapytanie.

2. Numeruj wyniki, żeby człowiek mógł wskazać. Wyniki wracają uszeregowane jako #1, #2, #3…, co jest sposobem, w jaki każdy odnosi się do zdjęcia w rozmowie — „więcej jak #3” — bez ręcznego kopiowania identyfikatorów. W klientach obsługujących MCP Apps miniatury renderują się w linii, a otwarcie jednej pokazuje metadane, które już były w wyniku narzędzia, bez dodatkowego wywołania.

3. Pozostań tylko-do-odczytu i mów o tym wprost. Trzy narzędzia, brak zakresu zapisu, brak modyfikacji konta. Jedno z nich nie ma odpowiednika w żadnym API opartym na słowach kluczowych: search_photos_by_image przyjmuje obraz referencyjny — istniejące hero klienta, zrzut ekranu wklejony do czatu — plus opcjonalne zdanie, które je modyfikuje („jak to, ale w nocy”). Nie ma pola w API dopasowującym tagi, w którym takie żądanie dałoby się w ogóle wpisać. A agent, który nie może niczego zmienić, to agent, którego najgorszym wynikiem jest pusty zbiór wyników, a nie zgłoszenie do supportu.

Dwie powierzchnie i którą wybrać

Istnieją dokładnie dwa sposoby dostępu, a wybór dotyczy tego, kto jest w pętli, a nie możliwości — narzędzia i katalog są identyczne w obu przypadkach.

Konektor, gdy w pętli jest człowiek. Jeden adres URL, https://mcp.pexafy.com/mcp, dodany raz w ustawieniach konektorów asystenta; logowanie odbywa się w oknie przeglądarki, a klient otrzymuje własne poświadczenia, więc nie ma klucza do wklejenia w plik konfiguracyjny ani żadnego do obracania później. Klienci, którzy nie implementują OAuth, wysyłają klucz API Pexafy jako token bearer do tego samego endpointu — co sprawia, że konektor jest użyteczny z zadania cron na serwerze budowania, gdzie nie ma nikogo, kto kliknąłby „Zezwól”. Krok po kroku konfiguracja dla Claude, ChatGPT i pliku konfiguracyjnego floty jest w artykule o pipeline; nie zmieniła się.

API HTTP, gdy nikogo nie ma. Zadanie wsadowe wypełniające pulę dla 800 klastrów tematycznych nie powinno udawać klienta czatu: to samo konto, ten sam klucz, zwykłe HTTP, 100 wyników na wywołanie. Zasady tempa, które temu towarzyszą — nagłówki limitów szybkości, dlaczego 429 na minutę warto ponowić, a 429 od miesięcznego limitu nie warto, ile kosztuje worker przy dużej skali — należą do artykułu o ilustrowaniu na dużą skalę, gdzie ten worker jest opisany w pełni.

Wartą zapamiętania kwestią jest tu coś węższego, i to jest to, na czym opiera się cała analiza rynku: obie powierzchnie są dostępne dla programu w dniu, w którym powstaje, bez kolejki i bez umowy.

Czego to nie rozwiązuje

Uczciwa lista, ponieważ każdy z tych punktów kosztował kogoś rollback.

  • Licencja nadal reguluje zdjęcie. Podpis autorski nie jest wymagany przez regulamin API Pexafy, a każdy wynik dostarczany jest z ciągiem znaków podpisu gotowym do wyrenderowania — ale licencja dołączona przez bibliotekę źródłową obowiązuje w odniesieniu do twojego użycia tego zdjęcia. Renderuj podpis automatycznie; to taniej niż audytować później.
  • Katalogi na darmowej licencji to nie archiwa redakcyjne. Brak wiadomości, brak sportu, brak rozpoznawalnych marek czy osób publicznych na żądanie. Jeśli twoja strona potrzebuje fotografii konkretnego wydarzenia lub osoby, od tego są licencjonowani gracze, a ich konektory już istnieją.
  • To jest wyszukiwanie, i tylko wyszukiwanie. Diagramy, wykresy i zrzuty ekranu są renderowane z kodu, nie wyszukiwane; deduplikacja na twoich stronach to kolumna w twojej bazie danych, nie parametr na endpoincie; a żadne zdjęcie nie sprawia, że cienka strona zajmuje wysoką pozycję — polityki antyspamowe Google traktują nadużycie treści na dużą skalę tak samo, niezależnie od tego, czy strony są zilustrowane.6 Te trzy sprawy to problemy pipeline'u z rozwiązaniami właściwymi dla pipeline'u, opracowane w artykule o pipeline i artykule o skali.

Od czego zacząć

  1. Powtórz benchmark. Dwadzieścia linii, bez klucza. Niezależnie od tego, jakiego API do obrazów używasz dziś, wyślij mu trzy briefy swojego agenta dosłownie i policz puste zestawy wyników.
  2. Podłącz jeden konektor do asystenta, którego już używasz, i poproś go, jednym zdaniem, o zdjęcie, którego naprawdę potrzebujesz w tym tygodniu. To cała ocena.
  3. Przenieś briefy do agenta — jedna scena na slot, napisana na podstawie szkicu, nigdy tytułu.
  4. Dodaj kolumnę photo_id, zanim zaczniesz publikować cokolwiek na dużą skalę.
  5. Uruchom to na darmowym planie — 5,000 wyszukiwań miesięcznie przy 20 na minutę, dopóki nie zmusi cię do przejścia wyżej okno budowania, a nie rachunek.

Źródła i przypisy

1 Specyfikacja Model Context Protocol z 28 lipca 2026: bezstanowy rdzeń żądanie/odpowiedź, walidacja wydawcy zgodna z RFC 9207, Client ID Metadata Documents zastępujące Dynamic Client Registration oraz nazwy metod/narzędzi przenoszone w nagłówkach HTTP do routingu bramy.

2 Newsroom Getty Images, 12 sierpnia 2026 — „Getty Images Launches MCP Server to Connect Creative and Editorial Content to AI Workflows and Products”. Strona dostępu stwierdza, że użytkowanie wymaga aktywnej umowy z Getty Images, takiej jak Premium Access, oraz akceptacji regulaminu Web Service.

3 Katalog Shutterstock jest udostępniony przez serwer MCP oferujący 24 narzędzia (wyszukiwanie, kolekcje, licencjonowanie), dystrybuowany przez zewnętrzną platformę MCP, a nie ogłoszony na własnym portalu deweloperskim Shutterstock w chwili pisania tego tekstu; licencjonowanie i pobieranie wymagają konta z aktywną subskrypcją.

4 Getty Images Holdings, wyniki za pełny rok 2025 (opublikowane 16 marca 2026): przychód 981,3 mln USD, wzrost o 4,5% rok do roku.

5 Mordor Intelligence, rynek fotografii stockowej: 5,44 mld USD w 2026 roku, wzrost przy CAGR na poziomie 6,86%. Szacunki wielkości rynku różnią się w zależności od metodologii; jest tu przytoczony wyłącznie, by pokazać rząd wielkości.

6 Polityki antyspamowe Google Search — nadużycie treści na dużą skalę: generowanie wielu stron przede wszystkim w celu manipulowania rankingiem i oferujących niewielką wartość dla użytkowników, niezależnie od tego, czy są tworzone za pomocą automatyzacji, pracy ludzkiej czy kombinacji obu.

Najczęściej zadawane pytania

Czemu API zdjęć stockowych nie zwracają nic, gdy szuka w nich agent AI?
Bo agent wysyła zdanie, a API indeksuje tagi. Wysłane dosłownie do API obrazów opartego na słowach kluczowych, cztery briefy w stylu agenta — na przykład „An elderly couple enjoying a peaceful retirement together” — każdy zwrócił zero wyników; ograniczone do dwóch słów kluczowych (elderly couple), ten sam katalog zwrócił setki. Pixabay ogranicza zapytanie do 100 znaków, co większość briefów agentów przekracza już samodzielnie. Silnik semantyczny osadza całe zdanie, więc frazy jak „tired” czy „at night” zmieniają ranking, a nie łamią dopasowania.
Czy istnieje oficjalny serwer MCP dla Unsplash, Pexels lub Pixabay?
Nie. Pełne przeszukanie oficjalnego rejestru MCP 18 sierpnia 2026 wykazało 11 serwerów wyszukujących zdjęcia stockowe lub na wolnej licencji, i żaden nie został opublikowany przez samych Unsplash, Pexels, Pixabay czy Openverse — jeden z wrapperów wprost oznacza się jako „Unofficial”. Siedem działa lokalnie przez stdio i wymaga podania własnego klucza API danej biblioteki; cztery zdalne to jednosourcowe bramy obsługiwane przez podmiot trzeci przed tymi samymi API opartymi na słowach kluczowych.
Ile kosztuje serwer MCP Getty Images i kto może z niego korzystać?
Getty uruchomiło swój serwer MCP 12 sierpnia 2026 dla developerów, zespołów enterprise i twórców platform AI, obejmując wyszukiwanie i pobieranie treści kreatywnych, redakcyjnych i archiwalnych. Dostęp wymaga aktywnej umowy z Getty Images, np. Premium Access, oraz zaakceptowania warunków Web Service; nie ma darmowego poziomu, a cennik ustala przedstawiciel konta. Treści Shutterstock są podobnie dostępne przez MCP, z licencjonowaniem uzależnionym od aktywnej subskrypcji.
Czego potrzebuje API wyszukiwania obrazów, aby było użyteczne dla agenta AI?
Cztery rzeczy. Wyszukiwanie semantyczne, tak aby całe zdanie zwracało uszeregowaną stronę wyników, a nie pusty zbiór. Wyniki wystarczająco bogate, by móc na nich rozumować — id, rozmiary, wymiary, orientacja, kolor, licencja, autor, gotowe podpisy — bo to, co zwróci narzędzie, jest wszystkim, co wie agent. Hostowany serwer z własnym logowaniem, tak aby nie trzeba było instalować lokalnego procesu ani wklejać klucza podmiotu trzeciego. Oraz darmowy poziom, który maszyna może wykorzystać samodzielnie: bez przeglądu zrzutów ekranu, bez umowy, z miesięcznym limitem oraz limitem szybkości na minutę, wobec którego worker może się rozliczać.
Czy zadanie CI lub bezgłowy worker może użyć serwera MCP do obrazów wymagającego OAuth?
To zależy od serwera i warto to sprawdzić, zanim zbudujesz na nim rozwiązanie. Serwer Pexafy pod adresem mcp.pexafy.com/mcp jest dwutrybowy: logowanie przez przeglądarkę dla klientów interaktywnych, oraz ten sam endpoint akceptujący klucz API Pexafy jako Authorization: Bearer <key> lub x-api-key dla klientów, które nie implementują żadnego flow OAuth — właśnie to umożliwia użycie go z zadania cron albo z runnera buildu, gdzie nikt nie może kliknąć „Allow”. Trzy narzędzia są tylko do odczytu, więc przejęty klucz runnera nie może zmodyfikować konta. Serwer obsługujący wyłącznie interaktywny OAuth nie może być prowadzony bezgłowo w żaden sposób.
Jak sprawdzić, jakie serwery MCP do obrazów istnieją i czego każdy z nich wymaga?
Zapytaj oficjalny rejestr i przeczytaj dwa pola. GET registry.modelcontextprotocol.io/v0/servers?search=photo&limit=100 zwraca serwery odpowiadające danemu terminowi; paginuj przy użyciu wartości nextCursor w metadata (zwróć uwagę na wielkość liter — next_cursor po cichu zwraca tylko jedną stronę). W każdym wpisie remotes mówi, czy jest to serwer hostowany, czy proces lokalny, a packages[].environmentVariables wskazuje klucze API podmiotów trzecich, które musiałbyś zdobyć samodzielnie. Powtórzenie tego dla „photo”, „image”, „stock” i nazw bibliotek 18 sierpnia 2026 dało łącznie 22 607 serwerów, z czego 11 zajmowało się wyszukiwaniem zdjęć stockowych.

Przestań szukać słów kluczowych. Opisz, o co Ci chodzi.

Przeszukuj 9M+ darmowych obrazów według znaczenia — w dowolnym języku, w mniej niż 100 ms.