सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
अनुदैर्ध्य गणना डेटा का विश्लेषण कैसे करें: जीएलएमएम में अस्थायी स्वसंबंध के लिए लेखांकन?
हैलो सांख्यिकीय गुरु और आर प्रोग्रामिंग जादूगर, मैं पर्यावरण की स्थिति और वर्ष के दिन के एक समारोह के रूप में पशु कब्जा मॉडलिंग में दिलचस्पी रखता हूं। एक अन्य अध्ययन के भाग के रूप में, मेरे पास तीन वर्षों में ~ 160 दिनों की कैप्टेंसी है। इन दिनों में …

4
बिजली कानून वितरण के पीछे अंतर्ज्ञान
मुझे पता है कि एक पावर लॉ डिस्ट्रीब्यूशन का pdfp ( x ) = α - 1एक्समिनट( x)एक्समिनट)- αपी(एक्स)=α-1एक्समिनट(एक्सएक्समिनट)-α p(x) = \frac{\alpha-1}{x_{\text{min}}} \left(\frac{x}{x_{\text{min}}} \right)^{-\alpha} लेकिन इसका सहज रूप से क्या मतलब है, उदाहरण के लिए, शेयर की कीमतें एक बिजली कानून वितरण का पालन करती हैं? क्या इसका मतलब यह …

8
अनपेक्षित टी-परीक्षण के लिए न्यूनतम नमूना आकार
क्या टी-टेस्ट के लिए वैध होने के लिए आवश्यक न्यूनतम नमूना आकार निर्धारित करने के लिए "नियम" है? उदाहरण के लिए, तुलना को 2 आबादी के साधनों के बीच किया जाना चाहिए। एक जनसंख्या से 7 डेटा पॉइंट हैं और दूसरे से केवल 2 डेटा पॉइंट हैं। दुर्भाग्य से, प्रयोग …

6
एक बड़े पाठ कॉर्पस को कहां खोजें? [बन्द है]
बन्द है। यह सवाल ऑफ टॉपिक है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि यह क्रॉस मान्य के लिए विषय पर हो । 6 साल पहले बंद हुआ । मैं डाउनलोड करने के लिए बड़े (> …
16 dataset 

2
प्रक्षेप का सांख्यिकीय औचित्य क्या है?
मान लीजिए कि हमारे पास दो बिंदु हैं (निम्नलिखित आंकड़ा: काले घेरे) और हम उनके (पार) के बीच एक तीसरे बिंदु के लिए एक मूल्य खोजना चाहते हैं। दरअसल हम अपने प्रायोगिक परिणामों, काले बिंदुओं के आधार पर इसका अनुमान लगाने जा रहे हैं। सबसे सरल मामला एक रेखा खींचना …

2
दो-पूंछ वाले परीक्षणों की व्याख्या करना
मैं अपने छात्रों को समझाने के विभिन्न तरीकों की तलाश कर रहा हूं (प्राथमिक सांख्यिकी पाठ्यक्रम में) दो पूंछ वाला परीक्षण क्या है, और इसके पी मान की गणना कैसे की जाती है। आप अपने छात्रों को दो-बनाम एक-पूंछ परीक्षा के बारे में कैसे समझाते हैं?

5
स्व-अध्ययन के लिए संभाव्यता सिद्धांत पुस्तकें
क्या कोई अच्छी किताबें हैं जो संभाव्यता सिद्धांत की महत्वपूर्ण अवधारणाओं की व्याख्या करती हैं जैसे कि संभावना वितरण फ़ंक्शन और संचयी वितरण फ़ंक्शन? कृपया, जॉन राइस द्वारा "गणितीय सांख्यिकी और डेटा विश्लेषण" जैसी पुस्तकों को संदर्भित करने से बचें, जो सरल क्रमपरिवर्तन अवधारणाओं के साथ शुरू होती हैं और …

4
क्लस्टरिंग 1D डेटा
मेरे पास एक डेटासेट है, मैं केवल एक चर के आधार पर उस डेटा पर क्लस्टर बनाना चाहता हूं (कोई लापता मान नहीं हैं)। मैं उस एक चर के आधार पर 3 क्लस्टर बनाना चाहता हूं। कौन सा क्लस्टरिंग एल्गोरिदम का उपयोग करने के लिए, k- साधन, EM, DBSCAN आदि? …
16 clustering 

3
बड़ा, स्मार्ट (एर) दांव लगाना
मैं 1X2 (भारित) खेलों में दांव का सुझाव देने के लिए एक एल्गोरिथ्म कोड करने की कोशिश कर रहा हूं। मूल रूप से, प्रत्येक खेल में मैचों का एक सेट होता है (घर से दूर की टीमें): 1: घर जीतता है X: ड्रा 2: जीत दूर प्रत्येक मैच और प्रतीक …

11
आर के साथ शुरू करने और सीखने का तरीका?
मैंने कई बार "अपने दम पर जाने" की कोशिश की है - लेकिन सीमित सफलता के साथ। मैं एक आकस्मिक एसपीएसएस उपयोगकर्ता हूं और कुछ एसएएस का अनुभव है। एक पॉइंटर की सराहना करते हैं या दो में से एक है जिसकी पृष्ठभूमि समान है और अब आर का उपयोग …
16 r  references 

1
क्या मैं दो अनुभवजन्य वितरणों की तुलना करने के लिए कोलमोगोरोव-स्मिरनोव का उपयोग कर सकता हूं?
क्या दो अनुभवजन्य वितरणों की तुलना करने के लिए कोल्मोगोरोव-स्मिरनोव अच्छाई-से-फिट परीक्षण का उपयोग करना ठीक है यह निर्धारित करने के लिए कि क्या वे समान अंतर्निहित वितरण से आए हैं, बजाय एक अनुभवजन्य वितरण की पूर्व-निर्दिष्ट संदर्भ वितरण से तुलना करने के लिए? मुझे यह एक और तरीका पूछने …

2
हम क्लस्टरिंग के साथ आयामी कमी को कब जोड़ते हैं?
मैं दस्तावेज़-स्तरीय क्लस्टरिंग करने की कोशिश कर रहा हूं। मैंने टर्म-डॉक्यूमेंट फ़्रीक्वेंसी मैट्रिक्स का निर्माण किया है और मैं k- साधनों का उपयोग करके इन उच्च आयामी वैक्टरों को क्लस्टर करने का प्रयास कर रहा हूं। सीधे क्लस्ट करने के बजाय, मैंने जो भी किया, वह पहले यू, एस, वीटी …

1
कस्टम वितरण से यादृच्छिक नमूने उत्पन्न करना
मैं R. My pdf का उपयोग कर एक कस्टम पीडीएफ से यादृच्छिक नमूने उत्पन्न करने की कोशिश कर रहा हूं: fX(x)=32(1−x2),0≤x≤1fX(x)=32(1−x2),0≤x≤1f_{X}(x) = \frac{3}{2} (1-x^2), 0 \le x \le 1 मैंने समान नमूने तैयार किए और फिर इसे अपने कस्टम वितरण में बदलने की कोशिश की। मैंने अपने वितरण ( FX(x)FX(x)F_{X}(x) …
16 r  sampling  uniform 

2
वास्तव में 'पूल डेटा' का क्या अर्थ है?
मैंने सोचा था कि 'पूलिंग डेटा' का मतलब केवल उन डेटा को संयोजित करना था जो पहले श्रेणियों में विभाजित थे ... अनिवार्य रूप से, श्रेणियों की अनदेखी और डेटा को डेटा का एक विशाल 'पूल' बना देता है। मुझे लगता है कि यह आंकड़ों के आवेदन की तुलना में …


हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.