कभी एक्सपायर न होने वाली API कुंजियों की समस्या
कई साल पहले जारी की गई कुंजी, जिसे कभी रोटेट नहीं किया गया और जो आज भी मान्य है, कोई सुविधा नहीं है। यह एक जोखिम है जिसे सालों से किसी ने वास्तव में देखा तक नहीं।
लाइसेंस किए गए डेटा का आकर्षण साफ़ है: एक ही वेंडर उसे नियंत्रित करता है, उसे क्यूरेट करता है, और उसकी गुणवत्ता के लिए उसे कॉन्ट्रैक्ट के तहत जवाबदेह ठहराया जा सकता है। इसके साथ एक संरचनात्मक जोखिम भी आता है जिसे सौदे पर पहली बार हस्ताक्षर करते समय कम आँकना आसान है: लाइसेंस एक पक्ष के साथ रिश्ता है, और वह पक्ष भविष्य के नवीनीकरण में शर्तें बदल सकता है, क़ीमत बढ़ा सकता है, या पहुँच सीमित कर सकता है, ऐसे तरीक़ों से जिनसे मूल समझौते ने कभी पूरी सुरक्षा नहीं दी। आपका प्रोडक्ट जिस डेटासेट पर निर्भर है, वह ऐसी वजहों से महँगा या कम उपलब्ध हो सकता है जिनका डेटा से कोई लेना-देना नहीं और जो पूरी तरह एक ऐसी बातचीत से जुड़ी हैं जिसका आप हिस्सा नहीं थे।
खुला, समुदाय द्वारा रखरखाव किया जाने वाला संदर्भ डेटा जोखिम ख़त्म नहीं करता, लेकिन उसका रूप इस तरह बदल देता है जो हमारे विचार से उस पर बने प्रोडक्ट के लिए आम तौर पर ज़्यादा स्वस्थ है। IANA समय क्षेत्र डेटाबेस इसका साफ़ उदाहरण है: इसका रखरखाव खुले तौर पर होता है, इसकी सटीकता में सीधी रुचि रखने वाले योगदानकर्ता इस पर नज़र रखते हैं, और यह उस पर कुछ भी बनाने वाले हर व्यक्ति के लिए उपलब्ध है, डेटा और प्रोडक्ट के बीच किसी लाइसेंसिंग बातचीत के बिना। ISO 3166-1 के तहत देश कोड और ISO 3166-2 के तहत उप-विभाग कोड भी इसी तरह काम करते हैं, व्यापक रूप से अपनाए गए संदर्भ मानकों के रूप में, न कि ऐसी चीज़ के रूप में जिस तक पहुँच कोई एक कंपनी नियंत्रित करती हो।
जहाँ खुले संदर्भ मानक मौजूद हैं वहाँ उन पर निर्माण करना, और मालिकाना मेहनत को प्रोडक्ट के उन हिस्सों के लिए बचाकर रखना जिन्हें वास्तव में इसकी ज़रूरत है, जैसे ख़ुद जियोकोडिंग के पीछे का मिलान लॉजिक और कवरेज का काम, हमें उस फिर से मोलभाव वाले जोखिम से बचाता है जो समय क्षेत्र नियमों या देश कोड जैसी चीज़ें किसी एक विशेष वेंडर से लेने पर आता है। कोई भी IANA डेटाबेस तक हमारी पहुँच रद्द नहीं कर सकता या अगले कॉन्ट्रैक्ट नवीनीकरण पर उसकी क़ीमत दोगुनी नहीं कर सकता, क्योंकि उसके और उसका उपयोग करने वाले किसी के बीच कोई विशेष कॉन्ट्रैक्ट है ही नहीं।
इसका मतलब यह नहीं कि खुला डेटा अपने आप लाइसेंस किए गए डेटा से ज़्यादा गुणवत्ता वाला है, या कि लाइसेंसिंग हमेशा ग़लत विकल्प है। कुछ डेटा को वास्तव में उस तरह की निरंतर, वित्तपोषित, केंद्रीकृत मेहनत चाहिए जो वास्तविक रूप से केवल कोई व्यावसायिक वेंडर दे सकता है, और जब तुलनीय गुणवत्ता का कोई खुला विकल्प न हो, तो उसके लिए भुगतान करना एक वाजिब सौदा है। बात इससे सीमित है: जहाँ एक ठोस, सक्रिय रूप से रखरखाव किया जाने वाला खुला मानक पहले से मौजूद है, वहाँ उन्हीं मूल तथ्यों पर एक मालिकाना, लाइसेंस वाला विकल्प बनाना ज़्यादातर बस वह वेंडर जोखिम दोबारा पैदा करता है जिसे पहले ही होने की ज़रूरत नहीं थी।
हमें लगता है कि यह ऐसा मामला है जहाँ पर्दे के पीछे डेटा स्रोत से जुड़े फ़ैसले वास्तव में ग्राहक के लिए मायने रखते हैं, भले ही वह उन्हें कभी सीधे न देखे। जहाँ उपलब्ध हो वहाँ खुले संदर्भ डेटा पर बना प्रोडक्ट किसी एक वेंडर के भविष्य के फ़ैसलों के प्रति कम असुरक्षित होता है, जिसका मतलब है कि ख़ुद प्रोडक्ट के ग्राहक के नीचे से ऐसी वजहों से बदलने की संभावना कम होती है जिनका ग्राहक के किए किसी काम से कोई संबंध नहीं।