सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

4
आर में एक नेल्स मॉडल के लिए सही शुरुआती मूल्य प्राप्त करना
मैं एक साधारण पावर लॉ मॉडल को एक डेटा सेट में फिट करने की कोशिश कर रहा हूं जो इस प्रकार है: mydf: rev weeks 17906.4 1 5303.72 2 2700.58 3 1696.77 4 947.53 5 362.03 6 लक्ष्य के माध्यम से बिजली लाइन को पारित करने और revभविष्य के हफ्तों …

2
रिज रिग्रेशन LASSO की तुलना में बेहतर व्याख्यात्मकता क्यों नहीं प्रदान कर सकता है?
मेरे पास पहले से ही रिज रिग्रेशन और LASSO के पेशेवरों और विपक्षों के बारे में एक विचार है। LASSO के लिए, L1 पेनल्टी शब्द एक विरल गुणांक वेक्टर निकलेगा, जिसे फीचर चयन विधि के रूप में देखा जा सकता है। हालाँकि, LASSO के लिए कुछ सीमाएँ हैं। यदि सुविधाओं …

4
पंक्ति सामान्यीकरण का उद्देश्य क्या है
मैं कॉलम के सामान्यीकरण के पीछे के तर्क को समझता हूं, क्योंकि यह सुविधाओं को समान रूप से भारित करने का कारण बनता है, भले ही उन्हें समान पैमाने पर मापा न जाए - हालांकि, अक्सर निकटतम पड़ोसी साहित्य में, दोनों कॉलम और पंक्तियों को सामान्यीकृत किया जाता है। पंक्तियों …


4
मुझे लॉजिस्टिक रिग्रेशन विश्लेषण में निरंतर स्वतंत्र चर के लिए लॉजिट को रैखिकता की धारणा की जांच कैसे करनी चाहिए?
मैं लॉजिस्टिक रिग्रेशन एनालिसिस में निरंतर प्रेडिक्टर वेरिएबल्स के लिए लॉजिट के लिए रैखिकता की धारणा से भ्रमित हूं। क्या हमें अविभाज्य लॉजिस्टिक रिग्रेशन विश्लेषण का उपयोग करते हुए संभावित भविष्यवक्ताओं की स्क्रीनिंग के दौरान रैखिक संबंध की जांच करने की आवश्यकता है? मेरे मामले में, मैं प्रतिभागियों के बीच …

1
गाऊसी प्रक्रिया प्रतिगमन में हाइपरपरमीटर ट्यूनिंग
मैं गाऊसी प्रक्रिया प्रतिगमन एल्गोरिथ्म के हाइपरपरमेटर्स को ट्यून करने की कोशिश कर रहा हूं जो मैंने लागू किया है। मैं बस फॉर्मूला द्वारा दिए गए लॉग सीमांत संभावना को अधिकतम करना चाहता हूं जहां K सहसंयोजक मैट्रिक्स है तत्व K_ {ij} = k (x_i, x_j) = b ^ {- …

2
पक्षपाती बूटस्ट्रैप: क्या यह देखा गया है कि सीआई को देखे गए आँकड़ों के आसपास केन्द्रित करना ठीक है?
यह बूटस्ट्रैप के समान है : अनुमान विश्वास अंतराल के बाहर है मेरे पास कुछ डेटा है जो एक आबादी में जीनोटाइप के मायने रखता है। मैं शैनन के सूचकांक का उपयोग करके आनुवंशिक विविधता का अनुमान लगाना चाहता हूं और बूटस्ट्रैपिंग का उपयोग करके एक आत्मविश्वास अंतराल भी उत्पन्न …

1
सियामी तंत्रिका नेटवर्क में बैक-प्रचार कैसे काम करता है?
मैं हस्ताक्षर की मान्यता के लिए 1994 में यान लेकुन और उनके सहयोगियों द्वारा पेश किए गए सियामी तंत्रिका नेटवर्क की वास्तुकला का अध्ययन कर रहा हूं ( "साइनस समय देरी तंत्रिका नेटवर्क का उपयोग करके हस्ताक्षर सत्यापन"। पीडीएफ , एनआईपीएस 1994) मैं इस वास्तुकला के सामान्य विचार को समझ …

2
सिकुड़न क्या है?
शब्द सिकुड़न कुछ हलकों में बहुत कुछ फेंक दिया जाता है। लेकिन संकोचन क्या है, इसकी स्पष्ट परिभाषा नहीं है। अगर मेरे पास टाइम सीरीज़ (या किसी प्रक्रिया के अवलोकन का कोई संग्रह) है, तो विभिन्न तरीके क्या हैं जो मैं श्रृंखला पर कुछ प्रकार के अनुभवजन्य संकोचन को माप …

1
कर्नेल पीसीए के लिए कर्नेल कैसे चुनें?
कर्नेल पीसीए (प्रमुख घटक विश्लेषण) द्वारा अंतिम डेटा आउटपुट में अच्छे डेटा पृथक्करण के परिणामस्वरूप कर्नेल चुनने के तरीके क्या हैं, और कर्नेल के मापदंडों को अनुकूलित करने के तरीके क्या हैं? यदि संभव हो तो आम आदमी के शब्दों को बहुत सराहा जाएगा, और ऐसे तरीकों की व्याख्या करने …

3
बर्नौली परीक्षण में "सफलता" की संभावना का अनुमान लगाने के लिए आवश्यक नमूना आकार
मान लीजिए कि एक खेल एक घटना प्रदान करता है जो पूरा होने पर, या तो एक इनाम देता है, या कुछ भी नहीं देता है। यह निर्धारित करने के लिए सटीक तंत्र कि क्या इनाम दिया गया है अज्ञात है, लेकिन मुझे लगता है कि एक यादृच्छिक संख्या जनरेटर …

1
के बीच कनेक्शन (घ-प्राइम) और एयूसी (आरओसी वक्र के तहत क्षेत्र); निहित पूर्वधारणायें
मशीन लर्निंग में हम आरओसी वक्र (अक्सर संक्षिप्त AUC , या AUROC) के तहत क्षेत्र का उपयोग करके यह बता सकते हैं कि सिस्टम दो श्रेणियों के बीच कितना भेदभाव कर सकता है। सिग्नल डिटेक्शन सिद्धांत में अक्सर (संवेदनशीलता सूचकांक) का उपयोग एक समान उद्देश्य के लिए किया जाता है। …

6
अचानक परिवर्तन को कैसे चिह्नित करें?
यह प्रश्न बहुत बुनियादी हो सकता है। एक डेटा के अस्थायी रुझान के लिए, मैं उस बिंदु का पता लगाना चाहूंगा जहां "अचानक" परिवर्तन होता है। उदाहरण के लिए, नीचे दिखाए गए पहले आंकड़े में, मैं कुछ आंकड़े पद्धति का उपयोग करके परिवर्तन बिंदु का पता लगाना चाहूंगा। और मैं …

2
पायथन, गामा, या ट्वीडेई वितरण का उपयोग करके त्रुटि वितरण के लिए परिवार के रूप में पाइथन / स्किकिट-जीएल में जीएलएम का मूल्यांकन करना संभव है?
कुछ पायथन और स्केलेर को सीखने की कोशिश कर रहा हूं, लेकिन मेरे काम के लिए मुझे ऐसे प्रतिगमन चलाने की आवश्यकता है जो पॉइसन, गामा और विशेष रूप से ट्वीडे परिवारों से त्रुटि वितरण का उपयोग करते हैं। मुझे उनके बारे में प्रलेखन में कुछ भी नहीं दिखता है, …

1
रैखिक मिश्रित प्रभाव मॉडल के परिणामों को चित्रित करने के लिए भूखंड
मैं आर में रैखिक मिश्रित प्रभाव मॉडलिंग का उपयोग करके कुछ डेटा का विश्लेषण कर रहा हूं। मैं परिणामों के साथ एक पोस्टर बनाने की योजना बना रहा हूं और मैं सोच रहा था कि क्या मिश्रित प्रभाव वाले मॉडल के साथ अनुभवी कोई भी सुझाव दे सकता है कि …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.