सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
एनोवा: प्रति समूह कुछ नमूनों के साथ कई समूहों के लिए सामान्यता की धारणा का परीक्षण
निम्नलिखित स्थिति मान लें: हमारे पास एक बड़ी संख्या है (उदाहरण के लिए 20) छोटे समूह के आकार (जैसे n = 3) के साथ। मैंने देखा कि अगर मैं समान वितरण से मान उत्पन्न करता हूं, तो अवशिष्ट लगभग सामान्य दिखाई देंगे, भले ही त्रुटि वितरण समान हो। निम्नलिखित आर …

2
पंक्ति वृद्धि का उपयोग करके रिज ने GLM को दंडित किया?
मैंने पढ़ा है कि रिज प्रतिगमन को मूल डेटा मैट्रिक्स में डेटा की पंक्तियों को जोड़कर प्राप्त किया जा सकता है, जहां प्रत्येक चर का निर्माण निर्भर चर के लिए 0 और स्वतंत्र चर के लिए कkk या शून्य के वर्गमूल का उपयोग करके किया जाता है । एक अतिरिक्त …

2
MCMC कब उपयोगी है?
मुझे यह समझने में परेशानी हो रही है कि एमसीएमसी दृष्टिकोण वास्तव में किस स्थिति में उपयोगी है। मैं क्रुश्के की पुस्तक "डूइंग बायेसियन डेटा एनालिसिस: ए ट्यूटोरियल विद आर एंड बीयूजीएस" से एक खिलौना उदाहरण के माध्यम से जा रहा हूं। अब तक जो मुझे समझ में आया है …
12 mcmc 

3
शास्त्रीय आंकड़ों में इस्तेमाल होने वाला होल्डआउट तरीका (प्रशिक्षण और परीक्षण में डेटा को विभाजित करना) क्यों नहीं है?
डेटा माइनिंग के लिए मेरी कक्षा के एक्सपोज़र में, मॉडल प्रदर्शन का आकलन करने के तरीके के रूप में होल्डआउट विधि पेश की गई थी। हालांकि, जब मैंने रैखिक मॉडल पर अपनी पहली कक्षा ली, तो इसे मॉडल सत्यापन या मूल्यांकन के साधन के रूप में पेश नहीं किया गया …


1
क्या जैकिनिफिंग के कोई समकालीन उपयोग हैं?
प्रश्न: बूटस्ट्रैपिंग जैकनाइफिंग से बेहतर है; हालाँकि, मैं सोच रहा हूँ कि क्या ऐसे उदाहरण हैं जहाँ jackknifing पैरामीटर अनुमानों के लिए अनिश्चितता को चिह्नित करने के लिए एकमात्र या कम से कम व्यवहार्य विकल्प है। इसके अलावा, व्यावहारिक स्थितियों में बूटस्ट्रेपिंग के सापेक्ष पक्षपाती / गलत तरीके से जैकनाइफिंग …

1
पुरुष और महिला शतरंज खिलाड़ी - वितरण की पूंछ में अपेक्षित विसंगतियां
मुझे 2009 से इस पेपर के निष्कर्षों में दिलचस्पी है: (सबसे अच्छी) महिलाएं शतरंज में इतनी अच्छी क्यों हैं? बौद्धिक डोमेन में भागीदारी दर और लिंग अंतर यह पत्र यह समझाने का प्रयास करता है कि बहुत अच्छे पुरुष शतरंज खिलाड़ी बहुत अच्छे महिला खिलाड़ियों की तुलना में बहुत बेहतर …

3
निरंतर चर की सशर्त संभावना
मान लीजिए कि यादृच्छिक चर यूUU मानकों 0 और 10 के साथ एक सतत वर्दी वितरण इस प्रकार (यानी यू~ यू ( 0 , 10 )U∼U(0,10)U \sim \rm{U}(0,10) ) अब आइए A को उस घटना को निरूपित करते हैं, जो यूUU = 5 और B की घटना है, जो यूUU …

1
k-साधन || उर्फ स्केलेबल के-मीन्स ++
बहमन बहमनी एट अल। k- साधन का परिचय दिया, जो k- साधन ++ का एक तेज़ संस्करण है। यह एल्गोरिथम उनके पेपर , बहमनी, बी।, मोसले, बी।, वातानी, ए।, कुमार, आर।, और वासिल्वित्सकी, एस। (2012) के पेज 4 से लिया गया है । स्केलेबल k- साधन ++। VLDB बंदोबस्ती की …

1
डिफ़ॉल्ट lme4 अनुकूलक को उच्च-आयामी डेटा के लिए बहुत सारे पुनरावृत्तियों की आवश्यकता होती है
टी एल; डॉ: lme4अनुकूलन डिफ़ॉल्ट रूप से मॉडल पैरामीटर की संख्या में रेखीय प्रतीत होता है, और है जिस तरह से एक बराबर की तुलना में धीमी glmसमूहों के लिए डमी चर के साथ मॉडल। वहाँ कुछ भी है मैं इसे गति कर सकता हूँ? मैं एक काफी बड़े पदानुक्रमित …

1
ओवरसिपोर्टेशन और ऑफ़सेट के साथ पॉसन यादृच्छिक प्रभाव वाले मॉडल में मॉडलिंग विकल्प
मैंने कई व्यावहारिक प्रश्नों में भाग लिया है जब मॉडलिंग प्रायोगिक अनुसंधान के डेटा को एक विषय-विषय के प्रयोग से गिनता है। मैं संक्षेप में प्रयोग, डेटा, और मैंने अब तक क्या किया है, मेरे सवालों का वर्णन करता हूं। चार अलग-अलग फिल्मों को अनुक्रम में उत्तरदाताओं का एक नमूना …

1
'परिकल्पना परीक्षण' और 'मॉडल चयन' में क्या अंतर है?
साहित्य में, दोनों शब्दों को अक्सर पर्यायवाची या अन्योन्याश्रित रूप से प्रयोग किया जाता है। मैं अब दोनों शब्दों के बीच एक स्पष्ट अंतर खोजने की कोशिश कर रहा हूं। मेरे दृष्टिकोण से, एक परिकल्पना आमतौर पर एक मॉडल के माध्यम से व्यक्त की जाती है। इसलिए भले ही हम …

3
आत्मविश्वास स्तर कैसे चुनें?
मैं अक्सर 90% आत्मविश्वास स्तर का उपयोग करता हूं, यह स्वीकार करते हुए कि यह 95% या 99% से अधिक अनिश्चितता की डिग्री है। लेकिन क्या सही आत्मविश्वास स्तर चुनने के लिए कोई दिशानिर्देश हैं? या विभिन्न क्षेत्रों में उपयोग किए जाने वाले आत्मविश्वास के स्तर के लिए दिशानिर्देश? इसके …

2
जब एक प्रायिकता घनत्व फ़ंक्शन होता है, तो कैसे ढूंढें ?
इसे कैसे हल किया जा सकता है? मुझे मध्यवर्ती समीकरणों की आवश्यकता है। शायद इसका जवाब ।- टी च( x )−tf(x)-tf(x) घघटी[ ∫∞टीx च( x )घx ]ddt[∫t∞xf(x)dx] \frac{d}{dt} \left [\int_t^\infty xf(x)\,dx \right ] च( x )f(x)f(x) प्रायिकता घनत्व फ़ंक्शन है। यह कहना है, और \ lim \ limit_ {x \ …

1
रैंडमाइज्ड लॉजिस्टिक रिग्रेशन और प्लेन-वेनिला लॉजिस्टिक रिग्रेशन के बीच अंतर
मैं रैंडमाइज्ड लॉजिस्टिक रिग्रेशन (RLR) और प्लेन लॉजिस्टिक रिग्रेशन (LR) के बीच के अंतरों को जानना चाहूंगा , इसलिए, मैं Meinshausen, et al द्वारा एक पेपर "स्थिरता चयन" पढ़ रहा हूं । ; हालाँकि मुझे समझ नहीं आ रहा है कि आरएलआर क्या है और आरएलआर और एलआर के बीच …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.