एआई एजेंट्स के लिए इमेज सर्च इंफ्रास्ट्रक्चर: बाज़ार वास्तव में क्या देता है
Getty ने इस महीने एक MCP सर्वर लॉन्च किया; फ्री लाइब्रेरीज़ ने अभी तक कोई नहीं भेजा है। एक दोहराया जा सकने वाला बेंचमार्क, एक रजिस्ट्री गणना और चार बड़े फोटो APIs की शर्तें — इस तरह पढ़ें जैसे आप वह मशीन हों जिसे इनका पालन करना है।
इस साल जितने भी एजेंट फ्रेमवर्क शिप हुए हैं, वे लिख सकते हैं, योजना बना सकते हैं, टूल्स कॉल कर सकते हैं और पुल रिक्वेस्ट खोल सकते हैं। लेकिन उनसे कोई फ़ोटोग्राफ़ माँगिए, तो पूरी बात कंधे उचकाने पर आ जाती है: याददाश्त से गढ़ी गई स्टॉक URL, टूटा हुआ हॉटलिंक, या ऐसी छवि जो इसलिए जनरेट कर दी गई क्योंकि असली छवि खोजना उसे बना लेने से कठिन था। यहाँ मॉडल कमज़ोर कड़ी नहीं हैं। कमज़ोर कड़ी है उनके नीचे की इमेज लेयर — और यह एक बहुत ख़ास, मापने योग्य तरीक़े से गायब है।
यह एक बाज़ार अध्ययन है, घोषणापत्र नहीं। नीचे लिखी हर बात 18 अगस्त 2026 को किसी प्राथमिक स्रोत से मापी या पढ़ी गई थी: आधिकारिक MCP रजिस्ट्री की जनगणना, चार बड़े फ़्री फ़ोटो API के प्रकाशित नियम, इस महीने एजेंट कनेक्टर शिप करने वाले दो पेड incumbents की एक्सेस शर्तें, और एक छोटा पुनरुत्पादनीय बेंचमार्क जिसे आप बिना किसी API key के एक मिनट में फिर से चला सकते हैं।
एक सीमा-रेखा, ताकि अगर यह आपका सवाल नहीं है तो आप जल्दी पढ़ना छोड़ सकें: यह लेख
एक्सेस लेयर — रिट्रीवल, पहुँच, शर्तें, कोटा — के बारे में है। यह प्रकाशन पाइपलाइन के बारे
में नहीं है। अगर आपको यह जानना है कि ड्राफ़्ट को इलस्ट्रेटेड, क्रेडिटेड, मार्कअप किए गए पन्नों में कैसे बदलें
— राउटर प्रॉम्प्ट, विज़ुअल ब्रीफ़, असेंबली, ImageObject मार्कअप — वह अलग से
AI-लिखित लेखों को इलस्ट्रेट करने वाली
पाइपलाइन में लिखा गया है।
जब कॉलर एक मशीन हो तो क्या बदलता है
फ़ोटो खोज रहा एक इंसान दो-तीन शब्द टाइप करता है, ग्रिड को स्कैन करता है, और जब कोई अच्छी तस्वीर दिखे तो उसे पहचान लेता है। अब तक बनाया गया हर स्टॉक सर्च इंजन इसी चक्र को मानकर चलता है। एक एजेंट इन तीनों मान्यताओं को एक साथ तोड़ देता है:
- यह कीवर्ड नहीं, वाक्य लिखता है। जिस मॉडल ने अभी-अभी मॉर्गेज कागज़ी कार्रवाई पर एक
सेक्शन लिखा है, वह
mortgageनहीं देगा; वह देगा “a woman signing a mortgage document at a kitchen table while a bank adviser explains the terms”। यह किसी भाषा मॉडल का स्वाभाविक आउटपुट है, और यह ठीक वही है जिसे एक टोकन-मिलान इंडेक्स सर्व नहीं कर सकता। - यह ग्रिड स्कैन नहीं कर सकता। टूल जो भी लौटाता है, एजेंट उतना ही जानता है। अगर रिस्पॉन्स बिना विवरण, आयाम या क्रेडिट के URL की सूची भर हो, तो एजेंट को हर तस्वीर फ़ेच करके देखनी पड़ती है — या, अक्सर, अंदाज़ा लगाना पड़ता है।
- इसके हाथ नहीं हैं। यह स्क्रीनशॉट को रिव्यू क्यू में अपलोड नहीं कर सकता, शर्तें स्वीकार नहीं कर सकता, key रोटेट नहीं कर सकता, या प्रोडक्शन अप्रूवल के लिए तीन कार्यदिवस इंतज़ार नहीं कर सकता। किसी भी API के ऑनबोर्डिंग में हर मानवीय क़दम वह दीवार है जहाँ एजेंट रुक जाता है।
इसलिए “AI एजेंट के लिए इमेज सर्च इंफ्रास्ट्रक्चर” कोई मार्केटिंग वाक्यांश नहीं है। यह एक चेकलिस्ट है: नेचुरल-लैंग्वेज रिट्रीवल, इतने समृद्ध मशीन-रीडेबल परिणाम कि उन पर तर्क किया जा सके, और एक ऐसा ऑथेंटिकेशन व कोटा मॉडल जिसे कोई प्रोग्राम अकेले पूरा कर सके।
परीक्षण: कीवर्ड इंडेक्स के सामने एक वाक्य
समस्या देखने का सबसे सस्ता तरीक़ा है किसी एजेंट के अपने शब्दों को एक कीवर्ड इंजन को भेजना। नीचे दिया गया टेस्ट Openverse का इस्तेमाल करता है, जो WordPress.org द्वारा चलाया जाने वाला ओपनली लाइसेंस्ड मीडिया सर्च है, क्योंकि इसका API सार्वजनिक है, किसी key की ज़रूरत नहीं और इसे पढ़ने वाला कोई भी व्यक्ति इसे एक मिनट से भी कम में फिर से चला सकता है। चार ब्रीफ़, जैसे कोई मॉडल तब लिखता है जब वह अभी-अभी ड्राफ़्ट की गई चीज़ को इलस्ट्रेट कर रहा हो:
import json, urllib.request, urllib.parse
BRIEFS = [
"a woman signing a mortgage document at a kitchen table while a bank"
" adviser explains the terms, warm morning light",
"An elderly couple enjoying a peaceful retirement together",
"a child discovering snow for the first time in a suburban garden",
"a delivery cyclist waiting at a red light in heavy rain",
]
def count(q):
u = "https://api.openverse.org/v1/images/?" + urllib.parse.urlencode({"q": q})
r = urllib.request.Request(u, headers={"User-Agent": "benchmark/1.0"})
return json.load(urllib.request.urlopen(r))["result_count"]
for b in BRIEFS:
print(count(b), "|", b[:48])
# 0 | a woman signing a mortgage document at a kitchen
# 0 | An elderly couple enjoying a peaceful retirement
# 0 | a child discovering snow for the first time in a
# 0 | a delivery cyclist waiting at a red light in hea
चार ब्रीफ़, चार खाली परिणाम-सेट। अब हर ब्रीफ़ को उन दो कीवर्ड तक छोटा कीजिए जो कोई इंसान टाइप करता —
signing document, elderly couple, child snow,
cyclist rain — और इनमें से हर एक पूरे पेज-भर फ़ोटोग्राफ़ लौटाता है (API 240 रिपोर्ट करता है,
जहाँ यह अनाम कॉलर के लिए गिनती कैप करता है)। कैटलॉग में तस्वीरें मौजूद हैं। जिसे यह पार्स नहीं कर पाता,
वह है वाक्य।
| वह ब्रीफ़ जो एक एजेंट वाक़ई लिखता है | कीवर्ड इंजनOpenverse, पूरा वाक्य | कीवर्ड इंजन2 कीवर्ड तक छोटा किया गया | सिमैंटिक इंजनPexafy, पूरा वाक्य |
|---|---|---|---|
| “a woman signing a mortgage document at a kitchen table while a bank adviser explains the terms…” | 0 परिणाम | 240 (कैप्ड) | 16 परिणाम · 148 ms |
| “An elderly couple enjoying a peaceful retirement together” | 0 परिणाम | 240 (कैप्ड) | 16 परिणाम · 135 ms |
| “a child discovering snow for the first time in a suburban garden” | 0 परिणाम | 240 (कैप्ड) | 16 परिणाम · 147 ms |
| “a delivery cyclist waiting at a red light in heavy rain” | 0 परिणाम | 240 (कैप्ड) | 16 परिणाम · 149 ms |
Pexafy वाला कॉलम वही चार वाक्य हैं जो बिना किसी बदलाव के होस्टेड MCP सर्वर पर
search_photos को भेजे गए, और लेटेंसी वह है जो सर्वर ने खुद रिपोर्ट की। यह
क्वेरी के स्वरूपों की तुलना है, कैटलॉग की गुणवत्ता की नहीं — और कैटलॉग निश्चित रूप से
समस्या नहीं है। Openverse का अपना statistics endpoint टेस्ट के दिन 52 स्रोतों में 915
मिलियन इमेज रिपोर्ट करता है, और यह उस काम में उत्कृष्ट है जिसके लिए इसे बनाया गया था:
लोगों के लिए, कीवर्ड सर्च। इसमें कुछ भी टूटा हुआ नहीं है। बस इसे कभी ऐसे कॉलर के लिए डिज़ाइन नहीं किया गया
जो वाक्यों में सोचता है। टैग मिलान किसी वर्णित दृश्य पर क्यों टूटता है — और सिमैंटिक रिट्रीवल इसकी
जगह क्या करता है — यह पाठक के नज़रिए से
कीवर्ड की बजाय वाक्य से
खोजना में तर्क सहित समझाया गया है; यहाँ जो नया है वह है यह माप, और इसका मतलब जब कॉलर इंसान की बजाय
एक प्रोग्राम हो।
बाज़ार, 18 अगस्त 2026 तक
रिट्रीवल आधा हिस्सा है। दूसरा आधा है पहुँच: क्या कोई एजेंट कैटलॉग तक पहुँच भी सकता है, और किन शर्तों पर? जब से Model Context Protocol वह तरीक़ा बना जिससे असिस्टेंट बाहरी सिस्टम से जुड़ते हैं — इसका वर्तमान विनिर्देश, दिनांक 28 जुलाई 2026, प्रोटोकॉल को एक stateless request/response कोर पर ले गया ताकि सर्वर सामान्य लोड बैलेंसर के पीछे बैठ सकें1 — तब से इस बाज़ार का सर्वेक्षण करने का ईमानदार तरीक़ा यह है कि जो वास्तव में प्रकाशित हुआ है उसे देखा जाए, जो घोषित हुआ है उसे नहीं।
पेड incumbents इसी महीने पहुँचे
Getty Images ने अपना MCP सर्वर 12 अगस्त 2026 को लॉन्च किया, इस लेख से छह दिन पहले, जिसमें क्रिएटिव, एडिटोरियल और आर्काइवल सर्च व डाउनलोड AI वर्कफ़्लो के लिए उपलब्ध कराए गए।2 यह एंटरप्राइज़ टीमों और प्लेटफ़ॉर्म बिल्डरों के लिए लक्षित है, और इसका अपना एक्सेस पेज प्रवेश-मूल्य पर स्पष्ट है: आपको एक सक्रिय Getty Images अग्रीमेंट चाहिए, जैसे Premium Access, साथ ही Web Service शर्तों की स्वीकृति। कोई फ़्री टियर नहीं है। Shutterstock की सामग्री भी एक MCP सर्वर के ज़रिए पहुँच योग्य है — सर्च, कलेक्शन और लाइसेंसिंग को कवर करने वाले 24 टूल — जिसमें डाउनलोड ऐसे अकाउंट के पीछे गेट किए गए हैं जिसमें सक्रिय सब्सक्रिप्शन हो।3
दोनों क़दम तर्कसंगत हैं और दोनों किसी ख़ास ख़रीदार के लिए हैं। Getty ने 2025 में $981.3 मिलियन राजस्व दर्ज किया4, ऐसे स्टॉक फ़ोटोग्राफ़ी बाज़ार में जिसका आकार 2026 के लिए लगभग $5.4 बिलियन आँका गया है5; ऐसे कनेक्टर जिनके लिए कॉन्ट्रैक्ट चाहिए, वे इस राजस्व को खोलने की बजाय उसकी रक्षा करते हैं। अगर आप कोई बैंक या ब्रॉडकास्टर हैं, तो यह ठीक वही है जो आप चाहते हैं। अगर आप कोई साइड प्रोजेक्ट जोड़ने वाले डेवलपर हैं — या ऐसा एजेंट जिसे रुककर किसी इंसान से कुछ साइन कराने के लिए नहीं कहना चाहिए — तो यह एक बंद दरवाज़ा है।
फ़्री लाइब्रेरीज़ ने अब तक एक भी नहीं शिप किया
Unsplash, Pexels और Pixabay वे तीन कैटलॉग हैं जिनकी ओर ज़्यादातर बिल्डर जाते हैं, और इनमें से कोई भी आधिकारिक MCP सर्वर प्रकाशित नहीं करता। इसके बदले जो मौजूद है वह कम्युनिटी रैपरों की एक शेल्फ़ है। हमने आधिकारिक MCP रजिस्ट्री को पूरी तरह क्रॉल किया — 22,607 सर्वर, 75,487 प्रकाशित वर्ज़न — और हर उस एंट्री को रखा जिसका नाम या विवरण फ़ोटो या स्टॉक-इमेज सर्च के बारे में है। पैटर्न एक जैसा है:
| आधिकारिक MCP रजिस्ट्री, 18 अगस्त 2026 | संख्या | एजेंट के लिए इसका क्या मतलब है |
|---|---|---|
| रजिस्ट्री में सूचीबद्ध सर्वर, सभी श्रेणियाँ | 22,607 | पूरा ecosystem जिससे एक एजेंट टूल ले सकता है |
| photo / image / stock / picture और लाइब्रेरी नामों से मेल खाने वाले सर्वर | 137 | ज़्यादातर एडिटर, जेनरेटर या पर्सनल फ़ोटो टूल हैं, सर्च नहीं |
| …जो वाक़ई स्टॉक या फ़्री-लाइसेंस फ़ोटोग्राफ़ी सर्च करते हैं | 11 | पूरा एड्रेसेबल शेल्फ़ |
| …जो Unsplash, Pexels, Pixabay या Openverse ने खुद प्रकाशित किए हों | 0 | हर एक थर्ड-पार्टी रैपर है; एक अपने ही विवरण में “Unofficial” लेबल किया गया है |
| …जो लोकली चलते हैं और आपकी थर्ड-पार्टी API key माँगते हैं | 7 | UNSPLASH_ACCESS_KEY, PEXELS_API_KEY, PIXABAY_API_KEY… हर एक को पहले किसी इंसान को हासिल करना होगा |
| …जो होस्टेड रिमोट सर्वर के रूप में पहुँच योग्य हैं | 4 | चारों एक ही थर्ड-पार्टी ऑपरेटर के सिंगल-सोर्स गेटवे हैं, उन्हीं कीवर्ड API के आगे |
| Getty या Shutterstock की एंट्रियाँ | 0 | इनके सर्वर मौजूद हैं, पर सार्वजनिक रजिस्ट्री के बाहर, अकाउंट धारकों को, बाँटे जाते हैं |
import json, urllib.request, urllib.parse
def crawl(term): # रजिस्ट्री `nextCursor` से पेजिनेट करती है
out, cursor = {}, None
while True:
p = {"limit": "100", "search": term} | ({"cursor": cursor} if cursor else {})
d = json.load(urllib.request.urlopen(
"https://registry.modelcontextprotocol.io/v0/servers?" + urllib.parse.urlencode(p)))
for e in d["servers"]: out[e["server"]["name"]] = e["server"]
cursor = (d.get("metadata") or {}).get("nextCursor")
if not cursor or not d["servers"]: return out
servers = {}
for t in ["photo", "image", "stock", "picture", "unsplash",
"pexels", "pixabay", "getty", "shutterstock", "openverse"]:
servers |= crawl(t)
# 137 यूनीक सर्वर · remote बनाम local `server["remotes"]` में है
# ज़रूरी थर्ड-पार्टी keys packages[].environmentVariables में हैं
इनमें से हर रैपर उन्हीं तीन कीवर्ड API का पतला क्लाइंट है, यानी ऊपर वाला बेंचमार्क इन सब पर लागू होता है: ट्रांसपोर्ट बदला, रिट्रीवल नहीं बदला। कोई रैपर टैग इंडेक्स को वाक्य समझना नहीं सिखा सकता।
जो क्लॉज़ मशीन को रोकती है वह कोटा नहीं है
फ़्री लाइब्रेरीज़ के कोटा और शर्तों की एक समान इकाई में साथ-साथ तुलना फ़्री स्टॉक फ़ोटो API तुलना में की गई है — अप्रूवल क्यू, ज़रूरी डाउनलोड कॉल, 24-घंटे की कैशिंग बाध्यता, अट्रीब्यूशन नियम। वह लेख उन्हें एक डेवलपर के प्रोवाइडर चुनने के नज़रिए से पढ़ता है। इन्हें उस प्रोग्राम के नज़रिए से दोबारा पढ़िए जिसे इन्हें मानना है, और एक लाइन ऐसी दिखती है जिसका वॉल्यूम से कोई लेना-देना नहीं:
Pixabay का query फ़ील्ड 100 अक्षर स्वीकार करता है। ऊपर वाले बेंचमार्क के चार ब्रीफ़ का औसत 72 है, और मॉर्गेज वाला 114 तक जाता है — इसे बुरी रैंकिंग नहीं, सीधे अस्वीकार कर दिया जाएगा। Pexels और Unsplash कोई लंबाई सीमा प्रकाशित नहीं करते क्योंकि उन्हें कभी इसकी ज़रूरत की उम्मीद ही नहीं थी: उनके दस्तावेज़ी उदाहरण हैं Ocean, Tigers, Pears। दो शब्दों के हिसाब से बनी फ़ील्ड यह बताती है कि कॉलर किसे माना गया था, और कोई भी कोटा इसे ठीक नहीं करता। जिस सिमैंटिक endpoint से एजेंट बात करता है वह 500 अक्षर लेता है, क्योंकि पीछे वाला हिस्सा — “…while a bank adviser explains the terms” — ही वह है जो रिट्रीवल को अच्छा बनाता है।
यही पठन ऑनबोर्डिंग पर भी लागू होता है। एक डेमो टियर जो किसी इंसान द्वारा आपके ऐप के स्क्रीनशॉट देखने के बाद ही प्रोडक्शन बनता है, वह ऐसी रेट लिमिट नहीं है जिससे कोई एजेंट पीछे हट सके; यह ऐसा क़दम है जो वह कर ही नहीं सकता। Pixabay इरादे को स्पष्ट रूप से बताता है — यह API वैध मानव उपयोग के लिए है, और बड़े पैमाने पर स्वचालित डाउनलोडिंग निषिद्ध है। इसमें कुछ भी अनुचित नहीं है: फ़ोटोग्राफ़र अपना काम मुफ़्त में देते हैं और बैंडविड्थ के लिए कोई और भुगतान करता है। यह बस ऐसे API का वर्णन करता है जिसका कॉलर स्क्रीन और एक जोड़ी हाथों वाला माना गया था।
चार आवश्यकताएँ, और कौन इन्हें पूरा करता है
दोनों हिस्सों को साथ रखिए, और ऐसी इमेज लेयर का विनिर्देश निकलता है जिसे एक एजेंट वाक़ई इस्तेमाल कर सके — छोटा और परीक्षण योग्य। यह जान-बूझकर प्रोवाइडर तुलना नहीं है — कैटलॉग आकार, मूल्य निर्धारण और लाइसेंस शर्तें तुलना लेख में लाइन में लगाई गई हैं। ये चार सिर्फ़ इस बारे में हैं कि क्या कोई प्रोग्राम तस्वीरों तक पहुँच भी सकता है:
- सिमैंटिक रिट्रीवल — पूरा वाक्य एक रैंक किया गया पेज लौटाता है, खाली सेट नहीं।
- फ़्री लाइसेंस, कई स्रोत — प्रति इमेज लाइसेंस लेने की ज़रूरत नहीं, और किसी एक लाइब्रेरी की पसंद हर उस पेज को परिभाषित नहीं करती जिसे आप प्रकाशित करते हैं।
- अपनी साइन-इन वाला होस्टेड सर्वर — रिमोट, OAuth, कोई लोकल प्रोसेस इंस्टॉल करने या किसी थर्ड पार्टी की API key को config फ़ाइल में पेस्ट करने की ज़रूरत नहीं।
- एक फ़्री टियर जिसे मशीन अकेले पूरा कर सके — कोई स्क्रीनशॉट रिव्यू नहीं, कोई कॉन्ट्रैक्ट नहीं, मासिक कोटा और प्रति-मिनट रेट लिमिट जिसके अनुसार कोई वर्कर अपनी गति तय कर सके।
| 18 अगस्त 2026 तक | सिमैंटिक | फ़्री लाइसेंस, मल्टी-सोर्स | होस्टेड सर्वर + OAuth | सेल्फ़-सर्व फ़्री टियर |
|---|---|---|---|---|
| Getty Images MCP | नेचुरल-लैंग्वेज सर्च | लाइसेंस्ड कैटलॉग, प्रति-कॉन्ट्रैक्ट | हाँ, अकाउंट धारकों के लिए | नहीं — सक्रिय अग्रीमेंट ज़रूरी |
| MCP के ज़रिए Shutterstock | कीवर्ड-आधारित | लाइसेंस्ड कैटलॉग, सब्सक्रिप्शन | हाँ, अकाउंट ऑथ के साथ | नहीं — डाउनलोड के लिए सब्सक्रिप्शन ज़रूरी |
| Unsplash / Pexels / Pixabay रैपर | नहीं — नीचे कीवर्ड API | हर एक सिंगल सोर्स | नहीं — लोकल प्रोसेस, आपकी अपनी key | होस्ट API की मानवीय ऑनबोर्डिंग विरासत में मिलती है |
| Openverse | नहीं — कीवर्ड इंडेक्स | हाँ, बहुत व्यापक CC कैटलॉग | कोई आधिकारिक MCP सर्वर नहीं | हाँ, खुला API |
| Pexafy | हाँ — वाक्य, 500 अक्षर तक | 9 फ़्री-लाइसेंस स्रोत, 9M+ फ़ोटो | हाँ — mcp.pexafy.com/mcp, OAuth 2.1 |
हाँ — 5,000 रिक्वेस्ट/माह, 20/मिनट, कोई कार्ड नहीं |
हम Pexafy बनाते हैं, इसलिए इस आख़िरी पंक्ति को उतने ही संदेह के साथ पढ़िए जितना यह हक़दार है — और फिर जाँच लीजिए: रजिस्ट्री जनगणना एक स्क्रिप्ट में पुनरुत्पादनीय है, Getty और Shutterstock की एक्सेस शर्तें उनके अपने पेजों पर हैं, और तीनों फ़ोटो API की सीमाएँ उनके अपने दस्तावेज़ों में हैं, सब नीचे लिंक किए गए हैं। दावा संकीर्ण और खंडन-योग्य है: 18 अगस्त 2026 को हमें दूसरी ऐसी सेवा नहीं मिली जो चारों को पूरा करती हो। अगर आपको कोई पता है, तो हम इसे इस तालिका में जोड़ देंगे — इन आवश्यकताओं को लिखकर रखने का मक़सद ही यह है कि कोई भी इन्हें किसी भी उत्पाद पर, हमारे उत्पाद सहित, आज़मा सके।
MCP पर एक अच्छा इमेज सर्वर क्या करता है
कोई कनेक्टर बस नए रंग-रोगन वाला REST endpoint नहीं है। इस लेयर के दो उपयोग कहीं और लिखे जा चुके हैं और यहाँ दोहराए नहीं गए हैं — किसी ड्राफ़्ट को इलस्ट्रेट करना, पाइपलाइन लेख में, और एक लंबी सीरीज़ को विज़ुअली सुसंगत रखना, वॉल्यूम वाले लेख में। इंफ्रास्ट्रक्चर का हिस्सा वह है जिस पर दोनों निर्भर करते हैं और जिसे बाद में कोई नहीं जोड़ सकता: तीन सर्वर-साइड निर्णय, एक बार लिए गए, हर उस एजेंट के लिए जो कभी भी जुड़ेगा।
1. ऐसे ऑब्जेक्ट लौटाएँ जिन पर एजेंट तर्क कर सके। टूल जो भी लौटाता है, मॉडल के पास उतनी ही जानकारी होती है — यह ग्रिड स्कैन नहीं कर सकता। नीचे दिए गए दो स्वरूपों के बीच का फ़र्क़ ही वह फ़र्क़ है जो एक ऐसे असिस्टेंट को बनाता है जो फ़ोटोग्राफ़ पर तर्क कर सकता है बनाम एक ऐसा जो सिर्फ़ लिंक आगे बढ़ाता है:
# सामान्य कीवर्ड रैपर: एजेंट को फ़ेच करके देखना पड़ता है, या अंदाज़ा लगाना पड़ता है
[{ "url": "https://…/photo-8795398.jpeg" }, { "url": "https://…/366611.jpg" }]
# जैसा लौटाया गया, वैसा ही एक परिणाम — यहाँ छोटा किया गया, कुछ जोड़ा नहीं गया
{
"rank": 1, // वह handle जो इंसान इस्तेमाल करता है: "more like #1"
"photo_id": "019e14d9-e821-…", // जो get_similar_photos लेता है
"width": 6424, "height": 4283, "orientation": "landscape",
"color_hex": "#918872", "blur_hash": "LPI#Px?aDikCGwW?M{kD-VR*s.fl",
"source": "Pexels", "license_type": "free",
"alt_description": "Older couple sits together on wooden bench in a park",
"attribution": { "plain": "Photo by Anastasia Shuraeva on Pexels", "html": "…" },
"urls": { "thumb": "…", "small": "…", "regular": "…", "large": "…" }
}
दूसरे स्वरूप के साथ कोई एजेंट कह सकता है “#3 पोर्ट्रेट है, यह आपका hero स्लॉट बिगाड़ देगा”, किसी डुप्लिकेट
फ़ोटोग्राफ़र को हटा सकता है, क्रेडिट लाइन दे सकता है, और आपके टेम्पलेट को ऐसा
width/height जोड़ा दे सकता है जो लेआउट शिफ़्ट रोकता है — बिना एक भी
इमेज फ़ेच किए। पहले वाले के साथ, इनमें से हर निर्णय अंदाज़ा या राउंड ट्रिप बन जाता है।
2. परिणामों को नंबर दें, ताकि कोई इंसान इशारा कर सके। परिणाम रैंक किए गए
#1, #2, #3… के साथ वापस आते हैं, जो बातचीत में किसी तस्वीर का ज़िक्र करने का तरीक़ा है —
“more like #3” — बिना किसी identifier को हाथ से कॉपी किए। जिन क्लाइंट्स में MCP Apps सपोर्टेड हैं, वहाँ
thumbnails इनलाइन रेंडर होते हैं, और किसी एक को खोलने पर वह मेटाडेटा दिखता है जो टूल के परिणाम में पहले
से था, बिना किसी अतिरिक्त कॉल के।
3. रीड-ओनली रहें, और इसे स्पष्ट रखें। तीन टूल, कोई राइट स्कोप नहीं, कोई अकाउंट म्यूटेशन
नहीं। इनमें से एक का कहीं भी कोई कीवर्ड समकक्ष नहीं है:
search_photos_by_image एक संदर्भ इमेज लेता है — किसी क्लाइंट का मौजूदा hero, चैट में
पेस्ट किया गया स्क्रीनशॉट — साथ ही उसे मोड़ने के लिए एक वैकल्पिक वाक्य
(“like this, but at night”)। किसी टैग-मिलान API में ऐसा कोई फ़ील्ड नहीं है जहाँ यह रिक्वेस्ट
टाइप भी की जा सके। और जो एजेंट कुछ भी बदल नहीं सकता, उसका सबसे बुरा नतीजा एक ख़ाली परिणाम-सेट होता है,
कोई सपोर्ट टिकट नहीं।
दो सतहें, और आपको कौन सी चाहिए
अंदर आने के ठीक दो रास्ते हैं, और चुनाव क्षमता के बारे में नहीं, बल्कि इस बारे में है कि लूप में कौन है — टूल्स और कैटलॉग दोनों पर एक जैसे हैं।
कनेक्टर, जब कोई इंसान लूप में हो। एक URL,
https://mcp.pexafy.com/mcp, जिसे किसी असिस्टेंट की कनेक्टर सेटिंग्स में एक बार जोड़
दिया जाता है; साइन-इन ब्राउज़र विंडो में होता है और क्लाइंट को अपनी ख़ुद की क्रेडेंशियल मिलती हैं, इसलिए
कोई key config फ़ाइल में पेस्ट करने या बाद में रोटेट करने की ज़रूरत नहीं। जो क्लाइंट OAuth लागू नहीं
करते, वे उसी endpoint के ख़िलाफ़ Pexafy API key को bearer token के रूप में भेजते हैं — यही वह चीज़ है
जो कनेक्टर को बिल्ड सर्वर के किसी cron job से इस्तेमाल करने लायक़ बनाती है, जहाँ “Allow” क्लिक करने के
लिए कोई मौजूद नहीं होता। Claude, ChatGPT और एक fleet config फ़ाइल के लिए चरण-दर-चरण वायरिंग
पाइपलाइन लेख में
है; यह नहीं बदला है।
HTTP API, जब कोई लूप में न हो। 800 टॉपिक क्लस्टर के लिए एक pool भरने वाले batch job
को चैट क्लाइंट होने का नाटक नहीं करना चाहिए: वही अकाउंट, वही key, सादा HTTP, प्रति कॉल 100 परिणाम।
इसके साथ चलने वाले पेसिंग नियम — rate-limit हेडर, क्यों per-minute
429 दोबारा प्रयास करने लायक़ है और monthly-quota 429 नहीं, वॉल्यूम पर
किसी वर्कर की लागत क्या होती है — ये
बड़े पैमाने पर इलस्ट्रेट
करने वाले लेख में हैं, जहाँ वह वर्कर पूरी तरह लिखा गया है।
यहाँ याद रखने लायक़ बात संकरी है, और यही वह है जिस पर बाज़ार अध्ययन टिका है: दोनों सतहें उसी दिन किसी प्रोग्राम के लिए पहुँच योग्य हैं जिस दिन वह लिखा जाता है, बिना किसी क्यू और बिना किसी कॉन्ट्रैक्ट के।
यह क्या हल नहीं करता
एक ईमानदार सूची, क्योंकि इनमें से हर एक ने किसी न किसी को rollback की क़ीमत चुकाई है।
- लाइसेंस अब भी तस्वीर को नियंत्रित करता है। Pexafy API की शर्तों के अनुसार अट्रीब्यूशन अनिवार्य नहीं है और हर परिणाम के साथ रेंडर करने के लिए तैयार एक attribution स्ट्रिंग आती है — लेकिन मूल लाइब्रेरी द्वारा जोड़ा गया लाइसेंस उस फ़ोटो के आपके इस्तेमाल पर लागू होता है। क्रेडिट को स्वचालित रूप से रेंडर करें; यह बाद में ऑडिट करने से सस्ता है।
- फ़्री-लाइसेंस कैटलॉग एडिटोरियल आर्काइव नहीं हैं। कोई न्यूज़ नहीं, कोई खेल नहीं, माँग पर कोई पहचाने जाने वाले ब्रांड या सार्वजनिक व्यक्ति नहीं। अगर आपके पेज को किसी ख़ास घटना या व्यक्ति की तस्वीर चाहिए, तो इसके लिए लाइसेंस्ड incumbents हैं, और उनके कनेक्टर अब मौजूद हैं।
- यह रिट्रीवल है, और सिर्फ़ रिट्रीवल। डायग्राम, चार्ट और स्क्रीनशॉट कोड से रेंडर किए जाते हैं, खोजे नहीं जाते; आपके पेजों में डुप्लिकेशन आपके डेटाबेस का एक कॉलम है, endpoint का कोई पैरामीटर नहीं; और कोई भी फ़ोटोग्राफ़ किसी पतले पेज को रैंक नहीं कराती — Google की स्पैम नीतियाँ scaled content abuse को एक जैसा मानती हैं, चाहे पेज इलस्ट्रेटेड हों या न हों।6 ये तीनों पाइपलाइन की समस्याएँ हैं जिनके पाइपलाइन जवाब हैं, जो पाइपलाइन लेख और वॉल्यूम वाले लेख में निकाले गए हैं।
कहाँ से शुरू करें
- बेंचमार्क फिर से चलाएँ। बीस लाइनें, कोई key नहीं। आज आप जो भी इमेज API इस्तेमाल करते हैं, उसे अपने एजेंट के तीन असली ब्रीफ़ हूबहू भेजें और ख़ाली परिणाम-सेट गिनें।
- जिस असिस्टेंट का आप पहले से इस्तेमाल करते हैं उसमें एक कनेक्टर जोड़ें और उससे, एक वाक्य में, इस हफ़्ते सचमुच ज़रूरत वाली एक तस्वीर माँगें। यही पूरा मूल्यांकन है।
- ब्रीफ़ को एजेंट में ले जाएँ — हर स्लॉट के लिए एक दृश्य, ड्राफ़्ट से लिखा गया, शीर्षक से कभी नहीं।
- वॉल्यूम पर कुछ भी प्रकाशित करने से पहले
photo_idकॉलम जोड़ें। - इसे फ़्री टियर पर चलाएँ — 5,000 सर्च प्रति माह, 20 प्रति मिनट पर, जब तक कोई बिल नहीं बल्कि कोई बिल्ड विंडो आपको ऊपर जाने पर मजबूर न करे।
संदर्भ एवं फ़ुटनोट
1 28 जुलाई 2026 का Model Context Protocol विनिर्देश: stateless request/response कोर, RFC 9207 के अनुसार issuer validation, Dynamic Client Registration की जगह लेने वाले Client ID Metadata Documents, और गेटवे रूटिंग के लिए HTTP हेडरों में ले जाए जाने वाले method/tool नाम।
2 Getty Images न्यूज़रूम, 12 अगस्त 2026 — “Getty Images Launches MCP Server to Connect Creative and Editorial Content to AI Workflows and Products”। एक्सेस पेज बताता है कि उपयोग के लिए एक सक्रिय Getty Images अग्रीमेंट चाहिए, जैसे Premium Access, और Web Service शर्तों की स्वीकृति चाहिए।
3 Shutterstock का कैटलॉग एक MCP सर्वर के ज़रिए उपलब्ध है जो 24 टूल (सर्च, कलेक्शन, लाइसेंसिंग) देता है, जो इस लेख के लिखे जाने के समय Shutterstock के अपने डेवलपर पोर्टल पर घोषित होने की बजाय एक थर्ड-पार्टी MCP प्लेटफ़ॉर्म के ज़रिए वितरित होता है; लाइसेंसिंग और डाउनलोड के लिए सक्रिय सब्सक्रिप्शन वाला अकाउंट चाहिए।
4 Getty Images Holdings, पूर्ण-वर्ष 2025 परिणाम (16 मार्च 2026 को रिपोर्ट किए गए): $981.3 मिलियन राजस्व, साल-दर-साल 4.5% की वृद्धि।
5 Mordor Intelligence, स्टॉक फ़ोटोग्राफ़ी बाज़ार: 2026 में USD 5.44 बिलियन, 6.86% CAGR की दर से बढ़ते हुए। बाज़ार-आकार के अनुमान पद्धति के अनुसार भिन्न होते हैं; इसे यहाँ केवल परिमाण का क्रम बताने के लिए उद्धृत किया गया है।
6 Google Search स्पैम नीतियाँ — scaled content abuse: रैंकिंग में हेरफेर करने के मुख्य उद्देश्य से बहुत सारे पेज बनाना और उपयोगकर्ताओं को बहुत कम मूल्य देना, चाहे यह ऑटोमेशन, मानवीय प्रयास या दोनों के मेल से बनाया गया हो।
प्राथमिक स्रोत, 18 अगस्त 2026 को जाँचे गए: MCP रजिस्ट्री API · MCP विनिर्देश · Getty Images MCP घोषणा · Unsplash API डॉक्स · Pexels API डॉक्स · Pixabay API डॉक्स · Openverse API · Google स्पैम नीतियाँ · Pexafy API व MCP डॉक्स। Openverse की गिनतियाँ, Pexafy के परिणाम-गिनतियाँ और इस लेख की हर लेटेंसी उसी दिन कैप्चर किए गए लाइव मान हैं; प्लान की सीमाएँ रेंडर के समय लाइव प्राइसिंग कैटलॉग से पढ़ी जाती हैं।
अक्सर पूछे जाने वाले प्रश्न
जब एआई एजेंट स्टॉक फोटो APIs पर सर्च करते हैं तो उन्हें कुछ क्यों नहीं मिलता?
elderly couple) तक छोटा करने पर, वही कैटलॉग सैकड़ों परिणाम देता है। Pixabay अपनी क्वेरी को 100 वर्णों तक सीमित करता है, जिसे अधिकतर एजेंट ब्रीफ अपने आप ही पार कर जाते हैं। एक सिमैंटिक इंजन पूरे वाक्य को एम्बेड करता है, इसलिए “tired” या “at night” जैसे उपवाक्य मैच को तोड़ने के बजाय रैंकिंग को बदल देते हैं।क्या Unsplash, Pexels या Pixabay के लिए कोई आधिकारिक MCP सर्वर है?
Getty Images MCP सर्वर की लागत क्या है, और क्या कोई भी इसका उपयोग कर सकता है?
एक इमेज सर्च API को एआई एजेंट के लिए उपयोगी बनने हेतु किन चीज़ों की ज़रूरत है?
क्या एक एआई असिस्टेंट फ़ोटो सर्च करके उन्हें बातचीत के अंदर ही दिखा सकता है?
mcp.pexafy.com/mcp पर तीन रीड-ओनली टूल्स प्रस्तुत करता है — search_photos (एक वाक्य), search_photos_by_image (एक संदर्भ इमेज, जिसे शब्दों में वैकल्पिक रूप से समायोजित किया जा सकता है) और get_similar_photos — और MCP Apps सपोर्ट करने वाले क्लाइंट्स में इनलाइन थंबनेल के साथ नंबर वाले परिणाम लौटाता है। परिणाम #1, #2, #3… के क्रम में रैंक किए जाते हैं, इसलिए “#3 जैसा और दिखाओ” बिना आइडेंटिफ़ायर कॉपी किए काम करता है। साइन-इन ब्राउज़र विंडो में OAuth 2.1 से होता है; OAuth न रखने वाले क्लाइंट API कुंजी को बियरर टोकन के रूप में भेज सकते हैं।