सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
लेज़ो की तरह जीरो रिग्रेसेशन कुछ गुणांक को शून्य में क्यों नहीं सिकोड़ता?
LASSO प्रतिगमन की व्याख्या करते समय, एक हीरे और वृत्त का आरेख अक्सर उपयोग किया जाता है। ऐसा कहा जाता है कि क्योंकि LASSO में कसना का आकार एक हीरा है, इसलिए प्राप्त न्यूनतम वर्ग समाधान हीरे के कोने को छू सकता है जैसे कि यह कुछ चर के संकोचन …

5
आप नवीनतम अनुसंधान के साथ कैसे अद्यतित रहते हैं?
इस सवाल को पढ़ने के बाद arXiv के बारे में और GitXiv का लिंक खोजने के लिए, जिसके बारे में मैं पहले अनजान था, मुझे आश्चर्य हुआ, लोग अपने क्षेत्र में नवीनतम शोधों को अद्यतन रखने के लिए किन वेबसाइटों / संसाधनों का उपयोग करते हैं?
16 academia 

3
दो चरण मॉडल: हेक्मैन मॉडल (नमूना चयन से निपटने के लिए) और वाद्य चर (अंतर्जात से निपटने के लिए) के बीच अंतर
मैं नमूना चयन और एंडोजेनिटी के बीच अंतर के बारे में अपना सिर पाने की कोशिश कर रहा हूं और बदले में हेक्मैन मॉडल (नमूना चयन से निपटने के लिए) वाद्य चर प्रतिगमन (एंडोजेनिटी से निपटने के लिए) से अलग हैं। क्या यह कहना सही है कि नमूना चयन एंडोजेनिटी …

1
लॉजिस्टिक्स रिग्रेशन में पियर्सन वीएस डेविएंस अवशिष्ट
मुझे पता है कि पारंपरिक पियर्सन अवशिष्ट को पारंपरिक संभाव्य तरीके से प्राप्त किया जाता है: ri=yi−πiπi(1−πi)−−−−−−−−√ri=yi−πiπi(1−πi) r_i = \frac{y_i-\pi_i}{\sqrt{\pi_i(1-\pi_i)}} और डीवाइस रेसिड्यूल्स एक अधिक सांख्यिकीय तरीके (प्रत्येक बिंदु की संभावना के योगदान के माध्यम से) प्राप्त किए जाते हैं: di=si−2[yilogπi^+(1−yi)log(1−πi)]−−−−−−−−−−−−−−−−−−−−−−−−−−√di=si−2[yilog⁡πi^+(1−yi)log⁡(1−πi)] d_i = s_i \sqrt{-2[y_i \log \hat{\pi_i} + (1 - …

2
मुख्य घटक विश्लेषण करने से पहले डेटा को लॉग-ट्रांसफ़ॉर्म क्यों करें?
यहाँ एक ट्यूटोरियल के बाद Im: http://www.r-bloggers.com/computing-and-visualizing-pca-in-r/ पीसीए की बेहतर समझ हासिल करने के लिए। ट्यूटोरियल आईरिस डेटासेट का उपयोग करता है और पीसीए से पहले एक लॉग ट्रांसफॉर्मेशन लागू करता है: सूचना निम्न कोड में हम के रूप में [1] और सेट द्वारा सुझाए गए सतत चर के लिए …

2
आर में आउटलेर का पता लगाने के साथ पूर्वानुमान कैसे करें? - समय श्रृंखला विश्लेषण प्रक्रिया और विधि
मेरे पास मासिक समय श्रृंखला डेटा है, और आउटलेर्स का पता लगाने के साथ पूर्वानुमान करना चाहते हैं। यह मेरे डेटा सेट का नमूना है: Jan Feb Mar Apr May Jun Jul Aug Sep Oct Nov Dec 2006 7.55 7.63 7.62 7.50 7.47 7.53 7.55 7.47 7.65 7.72 7.78 7.81 …

2
यदि संयुक्त वितरण बहुभिन्नरूपी सामान्य है तो पियर्सन की ρ केवल संघ की एक विस्तृत माप क्यों है?
इस सवाल के शीर्ष प्रतिक्रिया में यह दावा किया गया था । मुझे लगता है कि 'क्यों' प्रश्न पर्याप्त रूप से अलग है कि यह एक नया धागा वारंट करता है। Googling "एसोसिएशन का संपूर्ण माप" किसी भी हिट का उत्पादन नहीं करता था, और मुझे यकीन नहीं है कि …

3
हमें बूटस्ट्रैपिंग की आवश्यकता क्यों है?
मैं वर्तमान में लैरी वासरमैन के "ऑल स्टैटिस्टिक्स" पढ़ रहा हूं और उन्होंने अध्याय में कुछ लिखा है, जो उन्होंने गैर-पैरामीट्रिक मॉडल के सांख्यिकीय कार्यों के आकलन के बारे में लिखा है। उसने लिखा "कभी-कभी हम कुछ गणनाएँ करके सांख्यिकीय फ़ंक्शन की अनुमानित मानक त्रुटि पा सकते हैं। हालांकि अन्य …

1
मेट्रोपोलिस-हेस्टिंग्स एकीकरण - मेरी रणनीति काम क्यों नहीं कर रही है?
मान लें कि मेरे पास एक फ़ंक्शन g(x)g(x)g(x) जिसे मैं को एकीकृत करना चाहता हूं निश्चित रूप से समापन बिंदु पर शून्य पर जाता है, कोई ब्लोअप, अच्छा कार्य नहीं करता है। एक तरीका जिससे मैं नमूनों की सूची को वितरण आनुपातिक से उत्पन्न करने के लिए मेट्रोपोलिस-हेस्टिंग्स एल्गोरिथ्म का …

3
तंत्रिका जाल में tanh बनाम सिग्मॉइड
मैं इस तथ्य के लिए पहले से माफी मांगता हूं कि मैं अभी भी इस पर गति करने के लिए आ रहा हूं। मैं अपने न्यूरॉन सक्रियण फ़ंक्शन के लिए टैन्ह (मानचित्र -1 से 1) बनाम सिग्मॉइड (मानचित्र 0 से 1) का उपयोग करने के पेशेवरों और विपक्षों को समझने …

3
ईटीएस () फ़ंक्शन, ऐतिहासिक डेटा के अनुरूप पूर्वानुमान से बचने के लिए कैसे?
मैं एक मासिक पूर्वानुमान गणना को स्वचालित करने के लिए R में एक alogorithm पर काम कर रहा हूं। मैं पूर्वानुमान की गणना करने के लिए पूर्वानुमान पैकेज से दूसरों के बीच, ईटीएस () फ़ंक्शन का उपयोग कर रहा हूं। यह बहुत अच्छा काम कर रहा है। दुर्भाग्य से, कुछ …

1
क्या मल्टीराएट गॉसियन डेटा के पीसीए घटक सांख्यिकीय रूप से स्वतंत्र हैं?
क्या पीसीए घटक (प्रमुख घटक विश्लेषण में) सांख्यिकीय रूप से स्वतंत्र हैं यदि हमारा डेटा बहुभिन्नरूपी सामान्य रूप से वितरित किया जाता है? यदि हां, तो इसे कैसे प्रदर्शित / सिद्ध किया जा सकता है? मैं पूछता हूं क्योंकि मैंने इस पोस्ट को देखा , जहां शीर्ष उत्तर बताता है: …
16 pca  independence  svd 

2
आंशिक रूप से वर्गों में "आंशिक" क्या है?
आंशिक कम से कम वर्गों के प्रतिगमन (PLSR) या आंशिक रूप से कम से कम वर्गों के संरचनात्मक समीकरण मॉडलिंग (PLS-SEM) में, "आंशिक" शब्द किसको संदर्भित करता है?

1
दृढ़ तंत्रिका नेटवर्क में सुविधा मानचित्रों की संख्या
जब कंफर्टेबल न्यूरल नेटवर्क सीखते हैं, तो मेरे पास निम्न आकृति के बारे में प्रश्न होते हैं। 1) परत 1 में C1 में 6 फीचर मैप हैं, क्या इसका मतलब है कि छह संलयन कर्नेल हैं? इनपुट के आधार पर फीचर मैप तैयार करने के लिए प्रत्येक कन्वेन्शनल कर्नेल का …

2
कोई 'यादृच्छिक' आत्मविश्वास या विश्वसनीय अंतराल का उपयोग क्यों करेगा?
मैं हाल ही में एक पेपर पढ़ रहा था जिसमें उसके आत्मविश्वास और विश्वसनीय अंतराल में यादृच्छिकता शामिल थी, और मैं सोच रहा था कि क्या यह मानक है (और, यदि हां, तो ऐसा क्यों करना उचित है)। अंकन सेट करने के लिए, मान लें कि हमारा डेटा और हम …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.