सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
प्रतिबंधित बोल्ट्जमैन मशीनों (आरबीएम) के आधुनिक उपयोग के मामले?
पृष्ठभूमि: विगत ४ वर्षों में बहुत से आधुनिक शोध (पोस्ट एलेक्सनेट ) कला वर्गीकरण परिणामों की स्थिति को प्राप्त करने के लिए तंत्रिका नेटवर्क के लिए सामान्य ढोंग का उपयोग करने से दूर चले गए हैं। उदाहरण के लिए, यहाँ mnist के लिए शीर्ष परिणामों में शीर्ष 50 के केवल …

2
अवशिष्ट और त्रुटि के बीच अवशिष्ट मानक त्रुटि अंतर
मैं के साथ पुन: पेश करने की कोशिश optimएक सरल रेखीय प्रतीपगमन के साथ लगे से परिणाम glmया यहाँ तक कि nlsआर कार्य करता है। पैरामीटर अनुमान समान हैं, लेकिन अवशिष्ट विचरण अनुमान और अन्य मापदंडों के मानक त्रुटियां विशेष रूप से समान नहीं हैं जब नमूना आकार कम होता …

1
रिज रिग्रेशन को उलट देना: रिस्पांस मैट्रिक्स और रिग्रेशन गुणांक को देखते हुए, उपयुक्त भविष्यवक्ता खोजें
एक मानक OLS प्रतिगमन समस्या पर विचार करें : मेरे पास _ और और मैं को कम करने के लिए ढूंढना चाहता हूं समाधान \ hat \ B = \ argmin_ \ B \ {L \} = (\ X ^ \ top \ X) ^ + \ X ^ \ …

2
सामान्यता की धारणा के लिए एफ-परीक्षण इतना संवेदनशील क्यों है?
सामान्य वितरण की धारणा के प्रति F -est सबसे भिन्न क्यों है , यहां तक ​​कि बड़े लिए भी संवेदनशील नहीं है ?NNN मैंने वेब पर खोज करने का प्रयास किया और लाइब्रेरी का दौरा किया, लेकिन इसमें से किसी ने भी कोई अच्छा जवाब नहीं दिया। यह कहता है …

3
खतरा दर के पीछे अंतर्ज्ञान
मैं उस समीकरण के बारे में उलझन में हूं जो खतरनाक दर की परिभाषा के रूप में कार्य करता है। मुझे इस बात का अंदाजा है कि खतरे की दर क्या है, लेकिन मैं यह नहीं देखता कि समीकरण उस अंतर्ज्ञान को कैसे व्यक्त करता है। यदि xxx एक यादृच्छिक …

3
CLT लिए काम क्यों नहीं करता है ?
तो हम जानते हैं कि पैरामीटर साथ poissons की राशि स्वयं साथ एक poisson है । इसलिए काल्पनिक रूप से, कोई भी और कह सकता है कि यह वास्तव में जहाँ प्रत्येक है: x , और काम करने के लिए CLT प्राप्त करने के लिए एक बड़ा n लें।λ n …

2
केंद्रीय सीमा प्रमेय का एक गतिशील सिस्टम दृश्य?
(मूल रूप से MSE पर पोस्ट किया गया।) मैंने शास्त्रीय केंद्रीय सीमा प्रमेय के सामान्य वितरण (या स्थिर वितरणों में से किसी एक) को "संभावना" के रूप में संभाव्यता घनत्व के स्थान में "आकर्षित करने वाले" के कई अनुमानों पर चर्चा करते देखा है। उदाहरण के लिए, विकिपीडिया के उपचार …

5
एक 6-प्रतिक्रिया विकल्प ("मुझे नहीं पता") को 5-पॉइंट लिकर्ट स्केल में जोड़ा गया था। क्या डेटा खो गया है?
मुझे प्रश्नावली से डेटा को बचाने में थोड़ी मदद की जरूरत है। मेरे एक सहकर्मी ने एक प्रश्नावली लागू की, लेकिन अनजाने में, मूल 5-पॉइंट लिकर्ट स्केल (दृढ़ता से सहमत होने के लिए दृढ़ता से असहमत) का उपयोग करने के बजाय, उन्होंने स्केल में 6 वां उत्तर डाला। और, मामले …

1
क्या एगॉन पियर्सन के अलावा किसी ने भी गोसेट के 1904 पेपर को एक्सेस किया है?
क्या एगॉन पियर्सन के अलावा किसी ने भी विलियम सीली गोसेट की 1904 की रिपोर्ट "द लॉरी ऑफ एरर ऑफ द ब्रेवरी" के आवेदन को एक्सेस किया है? मुझे लगता है कि यह गिनीज संपत्ति है, लेकिन इसके ऐतिहासिक महत्व को देखते हुए, यह एक बहुत ही दिलचस्प पढ़ा होगा, …

2
'69 में डेटा से सामान्य रूप से सीखने की कला
मैं 1969 से प्रसिद्ध Minsky और Papert पुस्तक "Perceptrons" के संदर्भ को समझने की कोशिश कर रहा हूं, ताकि तंत्रिका नेटवर्क के लिए महत्वपूर्ण हो। जहां तक ​​मुझे पता है, परसेप्ट्रॉन को छोड़कर अभी तक कोई अन्य सामान्य पर्यवेक्षित शिक्षण एल्गोरिदम नहीं थे: निर्णय पेड़ वास्तव में केवल 70 के …

2
"ये सभी डेटा पॉइंट एक ही वितरण से आते हैं।" टेस्ट कैसे करें?
मुझे ऐसा लगता है कि मैंने इस विषय पर यहां पहले चर्चा की है, लेकिन मैं कुछ खास नहीं खोज पाया। फिर, मैं वास्तव में निश्चित नहीं हूं कि मुझे क्या खोजना है। मेरे पास ऑर्डर किए गए डेटा का एक आयामी सेट है। मैं परिकल्पना करता हूं कि सेट …

1
कैरेट - बार-बार दोहराया जाने वाला के-गुना क्रॉस-सत्यापन बनाम नेस्टेड के-गुना क्रॉस सत्यापन, दोहराया गया
कैरट पैकेज कई मशीन सीखने वाले मॉडल के लिए एक शानदार आर पुस्तकालय है, और मॉडल निर्माण और मूल्यांकन के लिए कई कार्य है। पैरामीटर ट्यूनिंग और मॉडल प्रशिक्षण के लिए, कैरेट पैकेज तरीकों में से एक के रूप में 'दोहराया' को प्रस्तुत करता है। एक अच्छा अभ्यास के रूप …

1
भविष्यवाणियों के मॉडल का आकलन करने के लिए क्या बार-बार क्रॉस-वेलिडेशन का इस्तेमाल किया जाना चाहिए?
मुझे यह 2012 के लेख में आया था जिसमें गीते वनविनकेलेन और हेंड्रिक ब्लॉकिल ने दोहराया क्रॉस-वैलिडेशन की उपयोगिता पर सवाल उठाया था, जो क्रॉस-वैलिडेशन के विचरण को कम करने के लिए एक लोकप्रिय तकनीक बन गई है। लेखकों ने प्रदर्शित किया कि बार-बार क्रॉस-वैरिफिकेशन से मॉडल की भविष्यवाणियों के …

2
इसे "मानक" विचलन क्यों कहा जाता है?
मेरे पास एक सरल है - और संभवतः स्पष्ट रूप से तुच्छ - प्रश्न: मानक विचलन को सिर्फ " मानक " क्यों कहा जाता है ? क्या इसलिए कि यह डेटा सेट की तुलना और उनके फैलाव के संबंध में परिणामों का मानकीकरण करता है? स्टैक एक्सचेंज पर एक खोज …

1
कई रैखिक प्रतिगमन में, अनुमानित बिंदुओं का एक भूखंड एक सीधी रेखा में क्यों नहीं होता है?
मैं Y और X1, X2 के बीच संबंधों का वर्णन करने के लिए कई रैखिक प्रतिगमन का उपयोग कर रहा हूं। सिद्धांत से मैंने समझा कि एकाधिक प्रतिगमन Y और X (Y और X1, Y और X2) के बीच रैखिक संबंधों को मानता है। मैं एक्स के किसी भी परिवर्तन …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.