Infrastruttura di ricerca immagini per agenti AI: cosa offre davvero il mercato

Getty ha lanciato un server MCP questo mese; le librerie gratuite non ne hanno lanciato nessuno. Un benchmark riproducibile, un censimento del registro e i termini delle quattro grandi API fotografiche — letti come se fossi la macchina che deve rispettarli.

Condividi
Un robot bianco renderizzato in 3D che tiene una lente d'ingrandimento sopra la testa, su sfondo rosa.
Foto via Unsplash

Ogni framework di agenti uscito quest'anno sa scrivere, pianificare, chiamare strumenti e apri una pull request. Chiedigli una fotografia e l'intero sistema si riduce a un'alzata di spalle: un URL stock inventato a memoria, un hotlink rotto, o un'immagine generata perché cercarne una vera era più difficile che inventarsene una. I modelli non sono l'anello debole. Il livello immagini sottostante lo è — e manca in un modo molto specifico e misurabile.

Questo è uno studio di mercato, non un manifesto. Tutto ciò che segue è stato misurato o letto da una fonte primaria il 18 agosto 2026: un censimento del registro MCP ufficiale, i termini pubblicati delle quattro grandi API di foto gratuite, le condizioni di accesso dei due operatori a pagamento consolidati che hanno lanciato connettori per agenti questo mese, e un piccolo benchmark riproducibile che puoi ripetere in un minuto senza alcuna chiave API.

Un confine, così puoi smettere di leggere in anticipo se non è la tua domanda: questo articolo riguarda il livello di accesso — recupero, raggiungibilità, termini, quote. Non è la pipeline di pubblicazione. Se ti serve capire come trasformare una bozza in pagine illustrate, accreditate, marcate — il prompt del router, i brief visivi, l'assemblaggio, il markup ImageObject — questo è trattato separatamente in la pipeline che illustra articoli scritti dall'IA.

Cosa cambia quando chi chiama è una macchina

Un umano che cerca una foto digita due o tre parole, scorre una griglia e riconosce una buona immagine quando la vede. Ogni motore di ricerca stock mai costruito presuppone questo ciclo. Un agente rompe tutte e tre le ipotesi contemporaneamente:

  1. Scrive frasi, non parole chiave. Un modello che ha appena scritto una sezione sui documenti di mutuo non emette mutuo; emette “una donna che firma un documento di mutuo su un tavolo di cucina mentre un consulente bancario spiega le condizioni”. Questo è l'output naturale di un modello linguistico, ed è esattamente ciò che un indice basato su corrispondenza di token non può servire.
  2. Non può scorrere una griglia. Qualunque cosa restituisca lo strumento è ciò che l'agente sa. Se la risposta è un elenco di URL senza descrizione, dimensioni o credito, l'agente deve scaricare e osservare ogni immagine — o, molto più spesso, indovinare.
  3. Non ha mani. Non può caricare screenshot in una coda di revisione, accettare termini, ruotare una chiave o attendere tre giorni lavorativi per l'approvazione in produzione. Ogni passaggio umano nell'onboarding di un'API è un muro contro cui l'agente si ferma.

Quindi "infrastruttura di ricerca immagini per agenti IA" non è una frase di marketing. È una checklist: recupero in linguaggio naturale, risultati leggibili da una macchina abbastanza ricchi da poterci ragionare, e un modello di autenticazione e quote che un programma possa completare da solo.

Il test: una frase contro un indice a parole chiave

Il modo più economico per vedere il problema è inviare le parole di un agente a un motore a parole chiave. Il test qui sotto usa Openverse, il motore di ricerca media a licenza aperta gestito da WordPress.org, perché la sua API è pubblica, non richiede chiave, e chiunque leggendo questo può ripeterlo in meno di un minuto. Quattro brief, del tipo che un modello scrive quando illustra ciò che ha appena scritto:

openverse_briefs.py — nessuna chiave, nessuna registrazione, 20 righe
import json, urllib.request, urllib.parse

BRIEFS = [
  "a woman signing a mortgage document at a kitchen table while a bank"
  " adviser explains the terms, warm morning light",
  "An elderly couple enjoying a peaceful retirement together",
  "a child discovering snow for the first time in a suburban garden",
  "a delivery cyclist waiting at a red light in heavy rain",
]

def count(q):
    u = "https://api.openverse.org/v1/images/?" + urllib.parse.urlencode({"q": q})
    r = urllib.request.Request(u, headers={"User-Agent": "benchmark/1.0"})
    return json.load(urllib.request.urlopen(r))["result_count"]

for b in BRIEFS:
    print(count(b), "|", b[:48])
# 0 | a woman signing a mortgage document at a kitchen
# 0 | An elderly couple enjoying a peaceful retirement
# 0 | a child discovering snow for the first time in a
# 0 | a delivery cyclist waiting at a red light in hea

Quattro brief, quattro insiemi di risultati vuoti. Ora riduci ogni brief alle due parole chiave che un umano avrebbe digitato — signing document, elderly couple, child snow, cyclist rain — e ognuna restituisce una pagina completa di fotografie (l'API riporta 240, che è il tetto del conteggio per chiamanti anonimi). Il catalogo contiene le immagini. È la frase che non riesce a interpretare.

Il brief che un agente scrive davvero Motore a parole chiaveOpenverse, frase completa Motore a parole chiaveridotto a 2 parole chiave Motore semanticoPexafy, frase completa
“a woman signing a mortgage document at a kitchen table while a bank adviser explains the terms…” 0 risultati 240 (limite massimo) 16 risultati · 148 ms
“An elderly couple enjoying a peaceful retirement together” 0 risultati 240 (limite massimo) 16 risultati · 135 ms
“a child discovering snow for the first time in a suburban garden” 0 risultati 240 (limite massimo) 16 risultati · 147 ms
“a delivery cyclist waiting at a red light in heavy rain” 0 risultati 240 (limite massimo) 16 risultati · 149 ms

La colonna Pexafy corrisponde alle stesse quattro frasi inviate senza modifiche a search_photos sul server MCP ospitato, con la latenza riportata dal server stesso. Questo è un confronto tra forme di query, non tra qualità del catalogo — e il catalogo non è affatto il problema. L'endpoint statistico di Openverse riporta 915 milioni di immagini da 52 fonti il giorno del test, ed è eccellente per ciò per cui è stato costruito: ricerca a parole chiave, per persone. Non c'è nulla di rotto in esso. Semplicemente non è mai stato progettato per un chiamante che pensa in frasi. Perché la corrispondenza a tag si rompe su una scena descritta — e cosa fa invece il recupero semantico — è argomentato dal punto di vista del lettore in cercare con una frase invece che con parole chiave; ciò che è nuovo qui è la misurazione, e cosa significa quando il chiamante è un programma piuttosto che una persona.

“An elderly couple enjoying a peaceful retirement together” · 16 risultati in 135 ms · tre di essi
Una query, tre librerie diverse, crediti inclusi. Nessuna parola in quella frase è un tag: peaceful e together sono ciò che porta in cima panche, giardini e acque tranquille invece di un ritratto stock di due persone oltre i sessant'anni.

Il mercato, al 18 agosto 2026

Il recupero è metà del problema. L'altra metà è la raggiungibilità: un agente riesce ad arrivare al catalogo, e a quali condizioni? Da quando il Model Context Protocol è diventato il modo in cui gli assistenti si collegano a sistemi esterni — la sua specifica attuale, datata 28 luglio 2026, ha spostato il protocollo verso un nucleo richiesta/risposta stateless così che i server possano stare dietro normali load balancer1 — il modo onesto di sondare questo mercato è guardare cosa è effettivamente pubblicato, non ciò che è annunciato.

Gli operatori a pagamento consolidati sono arrivati questo mese

Getty Images ha lanciato il suo server MCP il 12 agosto 2026, sei giorni prima di questo articolo, esponendo la ricerca creativa, editoriale e d'archivio e il download ai workflow IA.2 È rivolto a team aziendali e costruttori di piattaforme, e la sua stessa pagina di accesso è inequivocabile sul prezzo d'ingresso: serve un accordo attivo con Getty Images, come Premium Access, oltre all'accettazione dei termini del Web Service. Non esiste alcun livello gratuito. I contenuti Shutterstock sono raggiungibili anch'essi tramite un server MCP — 24 strumenti che coprono ricerca, collezioni e licenze — con i download bloccati dietro un account con abbonamento attivo.3

Entrambe le mosse sono razionali ed entrambe sono destinate a un acquirente specifico. Getty ha registrato 981,3 milioni di dollari di fatturato nel 20254 in un mercato della fotografia stock stimato a circa 5,4 miliardi di dollari per il 20265; connettori che richiedono un contratto proteggono quel fatturato piuttosto che aprirlo. Se sei una banca o un'emittente televisiva, questo è esattamente ciò che vuoi. Se sei uno sviluppatore che collega un progetto secondario — o un agente che non deve fermarsi a chiedere a un umano di firmare qualcosa — è una porta chiusa.

Le librerie gratuite non ne hanno lanciato nessuno

Unsplash, Pexels e Pixabay sono i tre catalogli a cui ricorre la maggior parte degli sviluppatori, e nessuno di essi pubblica un server MCP ufficiale. Ciò che esiste invece è uno scaffale di wrapper della comunità. Abbiamo scansionato il registro MCP ufficiale per intero — 22.607 server, 75.487 versioni pubblicate — e conservato ogni voce il cui nome o descrizione riguardasse la ricerca di foto o immagini stock. Il pattern è uniforme:

Registro MCP ufficiale, 18 ago 2026 Conteggio Cosa significa per un agente
Server elencati nel registro, tutte le categorie 22.607 L'intero ecosistema da cui un agente può attingere strumenti
Server corrispondenti a photo / image / stock / picture e ai nomi delle librerie 137 La maggior parte sono editor, generatori o strumenti per foto personali, non ricerca
…che effettivamente cercano fotografie stock o a licenza gratuita 11 L'intero scaffale rilevante
…pubblicati da Unsplash, Pexels, Pixabay o Openverse stessi 0 Ognuno è un wrapper di terze parti; uno è etichettato "Unofficial" nella propria descrizione
…che girano localmente e richiedono la tua chiave API di terze parti 7 UNSPLASH_ACCESS_KEY, PEXELS_API_KEY, PIXABAY_API_KEY… un umano deve prima ottenere ciascuna
…raggiungibili come server remoto ospitato 4 Tutti e quattro sono gateway a fonte unica di un solo operatore terzo, davanti alle stesse API a parole chiave
Voci per Getty o Shutterstock 0 I loro server esistono, ma sono distribuiti fuori dal registro pubblico, ai titolari di account
census.py — la scansione del registro dietro quella tabella
import json, urllib.request, urllib.parse

def crawl(term):                      # il registro pagina con `nextCursor`
    out, cursor = {}, None
    while True:
        p = {"limit": "100", "search": term} | ({"cursor": cursor} if cursor else {})
        d = json.load(urllib.request.urlopen(
            "https://registry.modelcontextprotocol.io/v0/servers?" + urllib.parse.urlencode(p)))
        for e in d["servers"]: out[e["server"]["name"]] = e["server"]
        cursor = (d.get("metadata") or {}).get("nextCursor")
        if not cursor or not d["servers"]: return out

servers = {}
for t in ["photo", "image", "stock", "picture", "unsplash",
          "pexels", "pixabay", "getty", "shutterstock", "openverse"]:
    servers |= crawl(t)

# 137 server unici · remoto vs locale è `server["remotes"]`
# le chiavi di terze parti richieste sono in packages[].environmentVariables

Ognuno di quei wrapper è un client leggero delle stesse tre API a parole chiave, il che significa che il benchmark sopra si applica a tutti loro: il trasporto è cambiato, il recupero no. Un wrapper non può far comprendere una frase a un indice a tag.

La clausola che ferma una macchina non è la quota

Le quote e i termini delle librerie gratuite sono confrontati fianco a fianco, in un'unità comune, in il confronto tra API di foto stock gratuite — le code di approvazione, la chiamata di download obbligatoria, l'obbligo di cache di 24 ore, le regole di attribuzione. Quell'articolo le legge dal punto di vista di uno sviluppatore che scelga un fornitore. Rilette dal punto di vista del programma che deve obbedirle, spicca una riga che non ha nulla a che fare con il volume:

Il campo di query di Pixabay accetta 100 caratteri. I quattro brief nel benchmark sopra misurano in media 72 caratteri, e quello sul mutuo arriva a 114 — sarebbe rifiutato del tutto, non classificato male. Pexels e Unsplash non pubblicano alcun limite di lunghezza perché non si sono mai aspettati di averne bisogno: i loro esempi documentati sono Ocean, Tigers, Pears. Un campo dimensionato per due parole è un'affermazione su chi si aspettava fosse il chiamante, e nessuna quantità di quota lo risolve. L'endpoint semantico con cui parla un agente accetta 500 caratteri, perché la clausola finale — “…while a bank adviser explains the terms” — è la parte che rende buono il recupero.

La stessa lettura si applica all'onboarding. Un livello demo che diventa produzione solo dopo che un umano revisiona gli screenshot della tua app non è un limite di frequenza da cui un agente possa ritirarsi; è un passaggio che non può eseguire affatto. Pixabay dichiara l'intento esplicitamente — l'API è per uso umano legittimo, e il download automatizzato massivo è proibito. Nulla di tutto ciò è irragionevole: i fotografi cedono il lavoro gratuitamente e qualcuno paga per la banda. Descrive semplicemente un'API il cui chiamante si presumeva avesse uno schermo e un paio di mani.

Quattro requisiti, e chi li soddisfa

Metti insieme le due metà e la specifica per un livello immagini che un agente possa effettivamente usare si rivela breve e verificabile. Non è deliberatamente un confronto tra fornitori — dimensione del catalogo, prezzi e termini di licenza sono allineati in l'articolo di confronto. Questi quattro punti riguardano solo se un programma possa raggiungere del tutto le immagini:

  1. Recupero semantico — una frase completa restituisce una pagina classificata, non un insieme vuoto.
  2. Licenze gratuite, più fonti — nulla da concedere in licenza per ogni immagine, e nessun singolo gusto di una libreria che definisca ogni pagina che pubblichi.
  3. Un server ospitato con accesso proprio — remoto, OAuth, nessun processo locale da installare e nessuna chiave API di terze parti da incollare in un file di configurazione.
  4. Un piano gratuito che una macchina possa completare da sola — nessuna revisione di screenshot, nessun contratto, una quota mensile e un limite di frequenza al minuto contro cui un worker possa regolare il proprio ritmo.
Al 18 ago 2026 Semantico Licenze gratuite, multi-fonte Server ospitato + OAuth Piano gratuito self-serve
Getty Images MCP Ricerca in linguaggio naturale Catalogo su licenza, per contratto Sì, per i titolari di account No — richiede accordo attivo
Shutterstock via MCP Basata su parole chiave Catalogo su licenza, abbonamento Sì, con autenticazione dell'account No — abbonamento richiesto per scaricare
Wrapper Unsplash / Pexels / Pixabay No — API a parole chiave sottostanti Una sola fonte ciascuno No — processo locale, chiave propria Eredita l'onboarding umano dell'API sottostante
Openverse No — indice a parole chiave Sì, catalogo CC molto ampio Nessun server MCP ufficiale Sì, API aperta
Pexafy Sì — frasi, fino a 500 caratteri 9 fonti a licenza gratuita, 9M+ foto Sì — mcp.pexafy.com/mcp, OAuth 2.1 Sì — 5,000 richieste/mese, 20/min, nessuna carta

Costruiamo noi Pexafy, quindi leggi quest'ultima riga con lo scetticismo che merita — e poi verificala: il censimento del registro è riproducibile con uno script, le condizioni di accesso di Getty e Shutterstock sono sulle rispettive pagine, e i limiti delle tre API di foto sono nella loro documentazione, tutti collegati in fondo. L'affermazione è ristretta e falsificabile: al 18 agosto 2026 non abbiamo trovato un secondo servizio che soddisfi tutti e quattro i requisiti. Se ne conosci uno, lo aggiungeremo a questa tabella — il senso di scrivere i requisiti è che chiunque possa verificarli su qualsiasi prodotto, incluso il nostro.

Cosa fa un buon server immagini via MCP

Un connettore non è un endpoint REST con una nuova veste. Due usi di questo livello sono trattati altrove e non vengono ripetuti qui — illustrare una bozza, in l'articolo sulla pipeline, e mantenere coerente visivamente una lunga serie, in quello sul volume. Ciò che appartiene all'infrastruttura è ciò da cui entrambi dipendono e che nessuno dei due può aggiungere in seguito: tre decisioni lato server, prese una volta, per ogni agente che si connetterà.

1. Restituire oggetti su cui un agente possa ragionare. Qualunque cosa restituisca lo strumento è tutto ciò che il modello sa — non può scorrere una griglia. La differenza tra le due forme qui sotto è la differenza tra un assistente che ragiona sulle fotografie e uno che smista link:

La stessa foto, come due diversi risultati di strumento
# Wrapper tipico a parole chiave: l'agente deve scaricare e guardare, o indovinare
[{ "url": "https://…/photo-8795398.jpeg" }, { "url": "https://…/366611.jpg" }]

# Un risultato, come restituito — accorciato qui, nulla è stato aggiunto
{
  "rank": 1,                       // il riferimento che usa un umano: "come la #1"
  "photo_id": "019e14d9-e821-…",   // ciò che accetta get_similar_photos
  "width": 6424, "height": 4283, "orientation": "landscape",
  "color_hex": "#918872", "blur_hash": "LPI#Px?aDikCGwW?M{kD-VR*s.fl",
  "source": "Pexels", "license_type": "free",
  "alt_description": "Older couple sits together on wooden bench in a park",
  "attribution": { "plain": "Photo by Anastasia Shuraeva on Pexels", "html": "…" },
  "urls": { "thumb": "…", "small": "…", "regular": "…", "large": "…" }
}

Con la seconda forma un agente può dire "la #3 è verticale, romperà il tuo slot hero", scartare un fotografo duplicato, emettere la riga di credito e passare al tuo template una coppia width/height che elimina lo scatto di layout — senza scaricare una sola immagine. Con la prima, ognuna di quelle decisioni è un'ipotesi o un giro di rete aggiuntivo.

2. Numerare i risultati, così una persona possa indicarli. I risultati tornano classificati #1, #2, #3…, che è il modo in cui chiunque si riferisce a una foto in una conversazione — "più come la #3" — senza identificatori copiati a mano. Nei client che supportano MCP Apps le miniature vengono rese inline, e apendone una si mostrano metadati che erano già nel risultato dello strumento, senza chiamate aggiuntive.

3. Rimanere di sola lettura, ed esserlo esplicitamente. Tre strumenti, nessun ambito di scrittura, nessuna modifica dell'account. Uno di essi non ha alcun equivalente a parole chiave in nessun luogo: search_photos_by_image accetta un'immagine di riferimento — la hero esistente di un cliente, uno screenshot incollato nella chat — più una frase opzionale per modificarla (“come questa, ma di notte”). Non esiste alcun campo in un'API a corrispondenza di tag dove quella richiesta possa nemmeno essere digitata. E un agente che non può cambiare nulla è un agente il cui peggior risultato è un insieme di risultati vuoto piuttosto che un ticket di supporto.

Le due interfacce, e quale scegliere

Esistono esattamente due modi per accedere, e la scelta riguarda chi è coinvolto piuttosto che la capacità — gli strumenti e il catalogo sono identici in entrambi i casi.

Il connettore, quando c'è una persona. Un solo URL, https://mcp.pexafy.com/mcp, aggiunto una volta nelle impostazioni dei connettori di un assistente; l'accesso avviene in una finestra del browser e il client riceve le proprie credenziali, quindi non c'è alcuna chiave da incollare in un file di configurazione né alcuna da ruotare in seguito. I client che non implementano OAuth invia una chiave API Pexafy come token bearer sullo stesso endpoint — il che è ciò che rende il connettore utilizzabile da un cron job su un server di build, dove non c'è nessuno a cliccare "Allow". La configurazione passo per passo per Claude, ChatGPT e un file di configurazione per una flotta è in l'articolo sulla pipeline; non è cambiata.

L'API HTTP, quando non c'è nessuno. Un job batch che riempie un pool per 800 cluster di argomenti non dovrebbe fingersi un client di chat: stesso account, stessa chiave, HTTP semplice, 100 risultati per chiamata. Le regole di pacing che vi si accompagnano — gli header di rate limit, perché un 429 al minuto vale la pena riprovarlo mentre uno di quota mensile no, quanto costa un worker a volume — appartengono a l'articolo su illustrare a scala, dove quel worker è scritto per intero.

Il punto da tenere presente qui è più ristretto, ed è quello su cui ruota lo studio di mercato: entrambe le interfacce sono raggiungibili da un programma il giorno in cui viene scritto, senza coda e senza contratto.

Cosa non risolve tutto questo

Un elenco onesto, perché ognuno di questi punti è costato a qualcuno un rollback.

  • La licenza continua a governare l'immagine. L'attribuzione non è richiesta dai termini dell'API Pexafy e ogni risultato è accompagnato da una stringa di attribuzione pronta per essere renderizzata — ma la licenza associata dalla libreria originale si applica al tuo uso di quella foto. Fai renderizzare il credito automaticamente; è più economico che fare un audit successivamente.
  • I catalogli a licenza gratuita non sono archivi editoriali. Nessuna notizia, nessuno sport, nessun marchio riconoscibile o personaggio pubblico su richiesta. Se la tua pagina ha bisogno di una fotografia di un evento o di una persona specifica, è a questo che servono gli operatori consolidati su licenza, e i loro connettori ora esistono.
  • È recupero, e solo recupero. Diagrammi, grafici e screenshot vengono renderizzati da codice, non ricercati; la deduplicazione tra le tue pagine è una colonna del tuo database, non un parametro dell'endpoint; e nessuna fotografia fa posizionare una pagina scarna — le politiche antispam di Google trattano l'abuso di contenuti su scala nello stesso modo indipendentemente dal fatto che le pagine siano illustrate.6 Questi tre punti sono problemi di pipeline con risposte di pipeline, sviluppati in l'articolo sulla pipeline e quello sul volume.

Da dove partire

  1. Ripeti il benchmark. Venti righe, nessuna chiave. Qualunque API di immagini usi oggi, inviale letteralmente tre brief del tuo agente e conta gli insiemi di risultati vuoti.
  2. Collega un connettore all'assistente che già usi e chiedigli, in una frase, una foto di cui hai davvero bisogno questa settimana. Questa è tutta la valutazione.
  3. Sposta i brief nell'agente — una scena per slot, scritta dalla bozza, mai dal titolo.
  4. Aggiungi la colonna photo_id prima di pubblicare qualcosa a volume.
  5. Fallo girare sul piano gratuito — 5,000 ricerche al mese a 20 al minuto finché non sarà una finestra di build, non una bolletta, a spingerti oltre.

Riferimenti e note

1 Specifica del Model Context Protocol del 28 luglio 2026: nucleo richiesta/risposta stateless, validazione dell'emittente secondo RFC 9207, Client ID Metadata Documents che sostituiscono la Dynamic Client Registration, e nomi di metodo/strumento trasportati negli header HTTP per il routing dei gateway.

2 Newsroom di Getty Images, 12 agosto 2026 — “Getty Images Launches MCP Server to Connect Creative and Editorial Content to AI Workflows and Products”. La pagina di accesso afferma che l'uso richiede un accordo attivo con Getty Images, come Premium Access, e l'accettazione dei termini del Web Service.

3 Il catalogo Shutterstock è esposto tramite un server MCP che offre 24 strumenti (ricerca, collezioni, licenze), distribuito tramite una piattaforma MCP di terze parti piuttosto che annunciato sul proprio portale sviluppatori Shutterstock al momento della stesura; le licenze e il download richiedono un account con abbonamento attivo.

4 Getty Images Holdings, risultati dell'intero anno 2025 (riportati il 16 marzo 2026): fatturato di 981,3 milioni di dollari, in crescita del 4,5% su base annua.

5 Mordor Intelligence, mercato della fotografia stock: 5,44 miliardi di dollari USA nel 2026, in crescita con un CAGR del 6,86%. Le stime di dimensionamento del mercato variano in base alla metodologia; è citato qui solo per dare l'ordine di grandezza.

6 Politiche antispam di Google Search — abuso di contenuti su scala: generare molte pagine principalmente per manipolare il posizionamento e offrire poco valore agli utenti, che siano create tramite automazione, sforzo umano o una combinazione dei due.

Domande frequenti

Perché le API di foto stock non restituiscono nulla quando un agente AI le interroga?
Perché l'agente invia una frase e l'API indicizza tag. Inviati alla lettera a un'API di immagini basata su parole chiave, quattro brief in stile agente — ad esempio “An elderly couple enjoying a peaceful retirement together” — hanno restituito ciascuno zero risultati; ridotti a due parole chiave (elderly couple), lo stesso catalogo ha restituito centinaia di risultati. Pixabay limita la query a 100 caratteri, un limite che la maggior parte dei brief per agenti supera già di per sé. Un motore semantico incorpora l'intera frase, quindi clausole come “tired” o “at night” modificano il ranking invece di rompere la corrispondenza.
Esiste un server MCP ufficiale per Unsplash, Pexels o Pixabay?
No. Una scansione completa del registro MCP ufficiale del 18 agosto 2026 ha individuato 11 server che effettuano ricerche di foto stock o a licenza libera, e nessuno pubblicato direttamente da Unsplash, Pexels, Pixabay o Openverse — un wrapper si autodefinisce persino “Unofficial”. Sette funzionano localmente via stdio e richiedono di fornire la propria chiave API di quella libreria; i quattro remoti sono gateway a fonte singola gestiti da terze parti davanti alle stesse API a parole chiave.
Quanto costa il server MCP di Getty Images, e chi può usarlo?
Getty ha lanciato il suo server MCP il 12 agosto 2026 per sviluppatori, team enterprise e costruttori di piattaforme AI, coprendo ricerca e download creativo, editoriale e d'archivio. L'accesso richiede un contratto Getty Images attivo, come Premium Access, oltre all'accettazione dei termini del Web Service; non è previsto alcun piano gratuito e i prezzi sono gestiti da un referente commerciale. I contenuti Shutterstock sono raggiungibili in modo simile via MCP, con le licenze subordinate a un abbonamento attivo.
Cosa deve avere un'API di ricerca immagini per essere utilizzabile da un agente AI?
Quattro cose. Recupero semantico, in modo che una frase completa restituisca una pagina ordinata per rilevanza invece di un insieme vuoto. Risultati sufficientemente ricchi da poter essere ragionati — id, dimensioni, orientamento, colore, licenza, fotografo, credito già pronto — perché tutto ciò che l'agente conosce è ciò che lo strumento restituisce. Un server ospitato con un proprio login, così non c'è nessun processo locale da installare né alcuna chiave di terze parti da incollare. E un piano gratuito che una macchina possa completare da sola: nessuna revisione tramite screenshot, nessun contratto, una quota mensile più un limite di frequenza al minuto su cui un worker possa regolarsi.
Un job di CI o un worker headless possono usare un server MCP per immagini che richiede OAuth?
Dipende dal server, e vale la pena verificarlo prima di costruirci sopra. Il server di Pexafy su mcp.pexafy.com/mcp è dual-mode: un login via browser per i client interattivi, e lo stesso endpoint che accetta una chiave API Pexafy come Authorization: Bearer <key> o x-api-key per i client che non implementano alcun flusso OAuth — ed è proprio questo che lo rende utilizzabile da un cron job o da un build runner dove nessuno può cliccare “Allow”. I tre strumenti sono di sola lettura, quindi una chiave di runner compromessa non può alterare un account. Un server che parla solo OAuth interattivo non può essere pilotato in modalità headless in nessun caso.
Come posso scoprire quali server MCP per immagini esistono e cosa richiede ciascuno?
Interroga il registro ufficiale e leggi due campi. GET registry.modelcontextprotocol.io/v0/servers?search=photo&limit=100 restituisce i server che corrispondono a un termine; pagina i risultati con il valore nextCursor presente in metadata (attenzione al camel case — next_cursor restituisce silenziosamente una sola pagina). Per ogni voce, remotes indica se si tratta di un server ospitato o di un processo locale, e packages[].environmentVariables elenca le chiavi API di terze parti che dovresti procurarti autonomamente. Ripetendo la query su photo, image, stock e i nomi delle librerie, il 18 agosto 2026 il totale è stato di 22.607 server, di cui 11 dedicati alla ricerca di foto stock.

Basta cercare parole chiave. Descrivi ciò che intendi.

Cerca 9M+ immagini libere per significato — in qualsiasi lingua, in meno di 100 ms.