सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
फिट टेस्ट की अच्छाई: एंडरसन के बारे में सवाल-डार्लिंग टेस्ट और क्रैमेर-वॉन मेंस कसौटी
मैं फिट परीक्षणों की भलाई के लिए वेब पेज पढ़ रहा हूं, जब मैं एंडरसन-डार्लिंग परीक्षण और क्रामर-वॉन मिज़ कसौटी पर आया था । अब तक मुझे वह बात मिल गई थी; ऐसा लगता है कि एंडरसन-डार्लिंग परीक्षण और Cramér-von Mises मानदंड समान हैं, बस एक अलग वज़निंग फ़ंक्शन पर …

1
सांख्यिकीविद आपसी जानकारी का उपयोग संघ के उपाय के रूप में क्यों नहीं करते हैं?
मैंने गैर-सांख्यिकीविदों द्वारा कुछ बातचीत की है, जहाँ वे प्रतिगमन (या समतुल्य / निकट-संबंधी सांख्यिकीय परीक्षणों) के बजाय पारस्परिक जानकारी का उपयोग करके सहसंबंध के उपायों को सुदृढ़ करने के लिए लगते हैं। मुझे लगता है कि यह एक अच्छा कारण है कि सांख्यिकीविद् इस दृष्टिकोण को नहीं लेते हैं। …

3
लोचदार जाल से संबंधित भ्रम
मैं लोचदार नेट से संबंधित इस लेख को पढ़ रहा था। वे कहते हैं कि वे लोचदार नेट का उपयोग करते हैं क्योंकि अगर हम सिर्फ लास्सो का उपयोग करते हैं तो यह भविष्यवाणियों के बीच केवल एक भविष्यवक्ता का चयन करता है जो अत्यधिक सहसंबद्ध हैं। लेकिन यह वह …

4
क्या इस मामले में x पर y का प्रतिगमन स्पष्ट रूप से x पर y की तुलना में बेहतर है?
किसी व्यक्ति के रक्त में ग्लूकोज के स्तर को मापने के लिए इस्तेमाल किया जाने वाला एक उपकरण 10 लोगों के यादृच्छिक नमूने पर नजर रखता है। स्तरों को बहुत सटीक प्रयोगशाला प्रक्रिया का उपयोग करके भी मापा जाता है। इंस्ट्रूमेंट माप को x द्वारा निरूपित किया जाता है। प्रयोगशाला …

3
BUGS, JAGS में भारित सामान्यीकृत प्रतिगमन
में Rहम कर सकते हैं "पहले वजन" एक glmके माध्यम से प्रतिगमन वजन पैरामीटर। उदाहरण के लिए: glm.D93 <- glm(counts ~ outcome + treatment, family = poisson(), weights=w) यह एक JAGSया BUGSमॉडल में कैसे पूरा किया जा सकता है ? मुझे इस पर चर्चा करते हुए कुछ कागज मिले, लेकिन …

2
मिश्रित मॉडलों से भविष्यवाणियां करते समय यादृच्छिक प्रभावों में अनिश्चितता को शामिल करना क्यों मुश्किल है?
पर कई सूत्र हैं आर sig-एमई विश्वास के अंतराल का उपयोग कर भविष्यवाणियों के लिए प्राप्त करने के बारे lme4और nlmeउदाहरण के लिए आर में यहां और यहां 2010 में, Dougals बेट्स, दोनों संकुल के लेखकों में से एक ने कुछ टिप्पणी भी शामिल है। मैं उन्हें शब्दशः उद्धृत करने …

4
तंत्रिका नेटवर्क वजन का अभिसरण
मैं ऐसी स्थिति में आया, जहां मेरे तंत्रिका नेटवर्क का वजन 500 पुनरावृत्तियों के बाद भी परिवर्तित नहीं हो रहा है। मेरे तंत्रिका नेटवर्क में 1 इनपुट परत, 1 छिपी परत और 1 आउटपुट परत है। वे इनपुट परत में लगभग 230 नोड्स, हिडन लेयर में 9 नोड्स और आउटपुट …

3
क्या सुविधा चयन केवल प्रशिक्षण डेटा (या सभी डेटा) पर किया जाना चाहिए?
क्या सुविधा चयन केवल प्रशिक्षण डेटा (या सभी डेटा) पर किया जाना चाहिए? मैं गुयोन (2003) और सिंघी और लियू (2006) जैसे कुछ चर्चाओं और पत्रों के माध्यम से चला गया , लेकिन अभी भी सही उत्तर के बारे में निश्चित नहीं है। मेरा प्रयोग सेटअप इस प्रकार है: डेटासेट: …

2
यादृच्छिक प्रभाव जोड़ना गुणांक अनुमानों को प्रभावित करता है
मुझे हमेशा सिखाया गया है कि यादृच्छिक प्रभाव केवल विचरण (त्रुटि) को प्रभावित करते हैं, और यह निश्चित प्रभाव केवल माध्य को प्रभावित करते हैं। लेकिन मुझे एक उदाहरण मिला है जहाँ यादृच्छिक प्रभाव का मतलब भी होता है - गुणांक का अनुमान: require(nlme) set.seed(128) n <- 100 k <- …

3
क्या आयाम में कमी हमेशा कुछ जानकारी खो देती है?
जैसे शीर्षक कहता है, क्या आयाम में कमी हमेशा कुछ जानकारी खो देती है? उदाहरण के लिए पीसीए पर विचार करें। यदि मेरे पास मौजूद डेटा बहुत विरल है, तो मुझे लगता है कि "बेहतर एन्कोडिंग" पाया जा सकता है (क्या यह किसी भी तरह डेटा की रैंक से संबंधित …

2
कई चर के लिए एक स्कैटर-प्लॉट मैट्रिक्स की खोज
मैं कई मापदंडों (जैसे, 50-200) के साथ एक डेटासेट का विश्लेषण कर रहा हूं और मैं चर (2-चर तितर बितर भूखंड या 2 डी हिस्टोग्राम के संदर्भ में) के बीच संबंधों को देखने में दिलचस्पी रखता हूं। हालांकि, मापदंडों की इस संख्या के लिए 200x200 सरणी के भूखंडों को खींचना …

1
स्थानीय मोरन I सांख्यिकी (एलआईएसए) के लिए पी-मूल्य समायोजन
मैं कुछ खोजपूर्ण स्थानिक विश्लेषण के साथ काम कर रहा हूं R में spdep पैकेज का उपयोग कर रहा हूं। मुझे फंक्शन का उपयोग करके गणना किए गए स्थानिक संघ (LISA) के स्थानीय संकेतकों के पी- अंतराल को समायोजित करने के लिए एक विकल्प मिला localmoran। डॉक्स के अनुसार इसका …

1
सामान्यीकरण प्रदर्शन के वितरण की तुलना करना
यह कहें कि मेरे पास एक वर्गीकरण समस्या, और लिए दो सीखने के तरीके हैं , और मैं उनके सामान्यीकरण प्रदर्शन का अनुमान लगाता हूं जैसे कि बार-बार क्रॉस सत्यापन या बूटस्ट्रैपिंग। इस प्रक्रिया से मैं एक मिल स्कोर के वितरण और (जैसे एक मॉडल के लिए आरओसी एयूसी मानों …

1
हॉफिंग की असमानता एक महत्वपूर्ण सांख्यिकीय अवधारणा क्या है?
अपने ब्लॉग पर, लैरी वासरमैन के पास एक पोस्ट है जो उन्होंने अपने पाठ्यक्रम में अंतिम गिरावट में कवर करने की योजना बनाई थी। वह नोट करता है कि वह अधिक आधुनिक मुद्दों के पक्ष में कुछ शास्त्रीय विषयों को छोड़ रहा था। एक विषय जिसका वह उल्लेख करता है …

3
बीएमआई सूचकांक को भार / ऊंचाई रूप में परिभाषित करने के पीछे सांख्यिकीय कारण क्या हैं ?
हो सकता है कि इस प्रश्न का उत्तर दवा में हो, लेकिन क्या कोई सांख्यिकीय कारण हैं कि बीएमआई इंडेक्स की गणना ? उदाहरण के लिए सिर्फ क्यों नहीं ? मेरा पहला विचार यह है कि इसका द्विघात प्रतिगमन के साथ कुछ करना है। वजन / ऊंचाईवजन / ऊंचाई2weight/height2\text{weight}/\text{height}^2वजन / …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.