तुम्ही कमिट पुश केली कारण मॉनिटरिंग डॅशबोर्ड व्यवस्थित दिसत होता. HTTP 200. हिरवे टिक मार्क. तुम्ही दुपारच्या जेवणासाठी गेलात.
जेव्हा तुम्ही परत आलात, तेव्हा वापरकर्त्यांना रिकामे टेबल्स आणि जुनी आकडेवारी दिसत होती. तुम्ही स्वतः एंडपॉइंटला cURL केले. स्टेटस 200. पण बॉडी (body)? त्यात एक नम्र JSON ऑब्जेक्ट होता जो सांगत होता की सर्व्हिस डाऊन आहे, किंवा त्याने शून्य रेकॉर्ड्ससह एक रिकामे पाकीट (skeletal envelope) परत केले, किंवा रातोरात स्कीमा (schema) बदलला होता आणि तुमचा पार्सर (parser) 'null' व्हॅल्यूजमुळे अडकत होता. हीच ती '200 trap' आहे. सर्व्हरने HTTP विनंती यशस्वीरित्या पूर्ण केली; पण त्यातील डेटा जिवंत (सद्यस्थितीत उपलब्ध) असेल, असे त्याने कधीही आश्वासन दिलेले नव्हते.
सरकारी APIs हे इंटरनेटवरील सर्वात समृद्ध आणि अधिकृत डेटा स्ट्रीम्सपैकी एक आहेत. त्याहूनही उत्तम म्हणजे, आश्चर्यकारक संख्येने यासाठी कोणत्याही नोंदणीची, API कीची किंवा OAuth हँडशेकची गरज नसते. प्रवेशद्वार खुले आहे. पण अडचण अशी आहे की, ते पारदर्शकतेसाठी काम करणाऱ्या सनदी अधिकाऱ्यांनी (civil servants) तयार केले आहेत, तुमच्या 'uptime monitor' साठी नाही. ते प्रामाणिक आहेत, कधीकधी विचित्र असू शकतात आणि ते तुमच्याकडून प्रत्यक्ष 'payload' वाचण्याची अपेक्षा करतात.
येथे दहा स्रोत आहेत ज्यांचा तुम्ही आत्ताच वापर करू शकता, आणि त्यामध्ये तुम्हाला काय मिळेल याची माहिती खालीलप्रमाणे आहे.
दहा एंडपॉइंट्स
USAspending
ट्रेझरी विभाग फेडरल पैसा कुठे खर्च होतो याचा अधिकृत लेजर (ledger) चालवतो. कंत्राटे, अनुदान, कर्ज आणि थेट देयके. जर तुम्हाला एखाद्या विशिष्ट एजन्सीचा खर्च एखाद्या विशिष्ट झिप कोडमधील विक्रेत्यापर्यंत शोधायचा असेल, तर हा तुमचा सुरुवातीचा बिंदू आहे. हा डेटा सार्वजनिक क्षेत्रातील (public domain) असून तो प्रत्येक व्यवहारापर्यंत तपशीलवार (granular) आहे.
Treasury FiscalData
मागील कामकाजाच्या दिवसाच्या शेवटी नेमके राष्ट्रीय कर्ज हवे आहे का? किंवा ऐतिहासिक महसूल संकलन? FiscalData हे ट्रेझरीचे ओपन डेटा स्टोअर आहे. यामध्ये पैशांच्या अचूक आकड्यांसह (debt-to-the-penny), सरकारी सिक्युरिटीजवरील व्याजदर आणि नियमित चक्रावर अपडेट होणारे फेडरल आर्थिक सारांश उपलब्ध आहेत.
Federal Register
हे युनायटेड स्टेट्स सरकारचे दैनंदिन जर्नल आहे. प्रत्येक प्रस्तावित नियम, अंतिम नियम, सूचना आणि अध्यक्षीय दस्तऐवज येथे उपलब्ध होतात. जर तुम्ही अनुपालन (compliance) साधने तयार करत असाल किंवा नियामक बदल (regulatory change) ट्रॅक करत असाल, तर एजन्सी प्रत्यक्षात काय अंमलात आणत आहेत, याचे हे 'ground truth' आहे.
openFDA
FDA औषधांचे दुष्परिणाम, औषधांच्या लेबल्स, अन्न अंमलबजावणी अहवाल आणि उपकरणांचे रिकॉल (recalls) कव्हर करणारे क्युरेटेड डेटासेट प्रकाशित करते. हे क्लिनिकल सल्ल्याचा पर्याय नाही, परंतु औषध सुरक्षिततेच्या संवादांमधील हा एक महत्त्वाचा प्राथमिक स्रोत आहे. डेव्हलपर्स याचा वापर लक्षणे क्रॉस-रेफरन्स करण्यासाठी, रिकॉलचे भौगोलिक क्षेत्र ट्रॅक करण्यासाठी किंवा लेबलमधील बदल मॉनिटर करण्यासाठी करतात.
PubMed
नॅशनल सेंटर फॉर बायोटेक्नॉलॉजी इन्फॉर्मेशन (NCBI) त्यांच्या E-utilities द्वारे बायोमेडिकल साहित्याचा हा डेटाबेस राखते. औषधशास्त्र, नर्सिंग, दंतवैद्यकशास्त्र आणि पशुवैद्यकीय विज्ञान या क्षेत्रांतील करोडो संदर्भांसह (citations), हे साहित्य पुनरावलोकन (literature reviews) आणि सायटेशन नेटवर्कला बळ देते. याला पीअर-रिव्ह्यू केलेल्या शोधाचा कणा (backbone) समजावे.
ClinicalTrials.gov
नॅशनल इन्स्टिट्यूट्स ऑफ हेल्थद्वारे व्यवस्थापित, ही नोंदणी सार्वजनिक आणि खाजगीरित्या समर्थित अभ्यासांसाठी प्रोटोकॉल आणि निकालांची माहिती ठेवते. तुम्ही नोंदणी स्थिती (enrollment status), ठिकाण, निकालांचे मोजमाप आणि निकाल प्रत्यक्षात पोस्ट केले गेले आहेत की नाही, हे ट्रॅक करू शकता. वैद्यकीय संशोधन पारदर्शकतेवर आधारित साधने तयार करणाऱ्या प्रत्येकाला याची गरज आहे.
CDC Public Health Data
सेंटर्स फॉर डिसीज कंट्रोल अँड प्रिव्हेंशन (CDC) मृत्यूदर, जन्मदर, रोगांचे प्रमाण आणि वर्तणुकीशी संबंधित जोखीम घटक यांसारख्या देखरेख (surveillance) डेटाचे प्रकाशन करते. डेटासेटनुसार तपशील बदलू शकतात, परंतु हा स्रोत अमेरिकन सार्वजनिक आरोग्याचा अधिकृत सांख्यिकीय आधार आहे.
GBIF
ग्लोबल बायोडायव्हर्सिटी इन्फॉर्मेशन फॅसिलिटी जगभरातील संग्रहालये, नागरिक शास्त्रज्ञ आणि संशोधन संस्थांकडून प्रजातींच्या उपस्थितीचे रेकॉर्ड एकत्रित करते. तुम्हाला भू...
