सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
2D में बहुआयामी डेटा (LSI) की कल्पना करना
मैं दस्तावेजों के बीच समानताएं खोजने के लिए अव्यक्त अर्थ इंडेक्सिंग का उपयोग कर रहा हूं ( धन्यवाद, जेएमएस! ) आयाम में कमी के बाद, मैंने दस्तावेजों को समूह में क्लस्टर करने के लिए k-mean clustering की कोशिश की है, जो बहुत अच्छी तरह से काम करता है। लेकिन मैं …

7
देशों के प्रकारों की पहचान करने के लिए डेटा घटाने की तकनीक
मैं एक परिचयात्मक आर्थिक भूगोल पाठ्यक्रम पढ़ाता हूं। मेरे छात्रों को समकालीन विश्व अर्थव्यवस्था में पाए जाने वाले देशों के प्रकारों की बेहतर समझ और डेटा कटौती तकनीकों की सराहना करने में मदद करने के लिए, मैं एक ऐसे असाइनमेंट का निर्माण करना चाहता हूं, जो विभिन्न प्रकार के देशों …

2
प्रतिगमन एफ परीक्षण की शक्ति क्या है?
बहुस्तर प्रतिगमन में चर के सबसेट के लिए शास्त्रीय एफ-परीक्षण में जहां 'कम' मॉडल के तहत चुकता त्रुटियों का योग है, जो 'बिग' मॉडल अंदर घोंसला हैं , और स्वतंत्रता की डिग्री हैं दो मॉडल। अशक्त परिकल्पना के तहत कि 'बड़े' मॉडल में अतिरिक्त चर में कोई रेखीय व्याख्यात्मक शक्ति …

3
क्या स्पार्ट भविष्यवाणियों और प्रतिक्रियाओं का उपयोग करते हुए CART जैसी विधियों के लिए कोई लाइब्रेरी उपलब्ध है?
मैं आर में gbm पैकेज का उपयोग करते हुए कुछ बड़े डेटा सेट के साथ काम कर रहा हूं। मेरे पूर्वसूचक मैट्रिक्स और मेरी प्रतिक्रिया वेक्टर दोनों बहुत विरल हैं (अर्थात अधिकांश प्रविष्टियां शून्य हैं)। मैं एक एल्गोरिथ्म का उपयोग करके निर्णय पेड़ों का निर्माण करने की उम्मीद कर रहा …

1
आर में रैखिक बैलिस्टिक संचायक (एलबीए) सिमुलेशन को संशोधित करना
"लीनियर बैलिस्टिक एक्यूमुलेटर" मॉडल (एलबीए) गतिमान सरल निर्णय कार्यों में मानव व्यवहार के लिए एक सफल मॉडल है। डोनकिन एट अल (2009, पीडीएफ ) कोड प्रदान करते हैं जो मानव व्यवहार डेटा को दिए गए मॉडल के मापदंडों का अनुमान लगाने की अनुमति देता है, और मैंने इस कोड को …

2
एक छिपे हुए मार्कोव मॉडल में प्रारंभिक संक्रमण संभाव्यता का महत्व
एक छिपे हुए मार्कोव मॉडल में संक्रमण की संभावनाओं को कुछ प्रारंभिक मूल्य देने के क्या लाभ हैं? आखिरकार सिस्टम उन्हें सीखेगा, इसलिए यादृच्छिक लोगों के अलावा अन्य मूल्यों को देने का क्या मतलब है? क्या अंतर्निहित एल्गोरिथ्म बॉम-वेल्च जैसे अंतर बनाता है? यदि मुझे शुरुआत में संक्रमण की संभावनाएँ …

1
अनियंत्रित श्रेणीबद्ध भविष्यवक्ता चर के स्तरों की संख्या कम करना
मैं एक क्लासिफायरियर को प्रशिक्षित करना चाहता हूं, एसवीएम या यादृच्छिक वन, या किसी अन्य क्लासिफायरियर को कहना चाहता हूं। डेटासेट में एक विशेषता 1000 स्तरों वाला एक श्रेणीगत चर है। इस चर में स्तरों की संख्या को कम करने का सबसे अच्छा तरीका क्या है। R combine.levels()में Hmisc पैकेज …

1
यह निर्धारित करना कि समय श्रृंखला में परिवर्तन सांख्यिकीय रूप से महत्वपूर्ण है
मेरे पास प्रत्येक सप्ताह प्राप्त होने वाली कुल कॉल हैं और उन्हें लगभग 3 वर्ष पीछे जाते हुए एक चार्ट पर प्लॉट किया है। आँख से ऐसा लगता है कि क्रिसमस पर भारी गिरावट आई थी, ऐसा लगता है कि बरामद नहीं हुआ है, ऐसा लगता है कि अनुरोधों में …

1
यह "अधिकतम सहसंबंध गुणांक" क्या है?
एक विशिष्ट इमेज प्रोसेसिंग स्टेटिस्टिक हैरालिक टेक्सचर फीचर्स का उपयोग , जो 14 हैं। मैं इन सुविधाओं में से 14 वीं के बारे में सोच रहा हूँ: एक निकटता मानचित्र को देखते हुए (जो हम केवल दो पूर्णांकों का एक अनुभवजन्य वितरण देख सकते हैं , यह के रूप में …

2
क्या रेफरी wiki StatProb.com पर प्रकाशित करना सार्थक है? [बन्द है]
बंद हो गया । यह सवाल राय आधारित है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि इस पोस्ट को संपादित करके तथ्यों और उद्धरणों के साथ उत्तर दिया जा सके । 7 महीने पहले बंद हुआ …

4
कैसे बेतरतीब सहसंबंध मैट्रिक्स उत्पन्न करने के लिए जो लगभग सामान्य रूप से दिए गए मानक विचलन के साथ ऑफ-विकर्ण प्रविष्टियों को वितरित करता है?
मैं एक यादृच्छिक सहसंबंध मैट्रिक्स उत्पन्न करना चाहूंगा, ताकि इसके ऑफ-विकर्ण तत्वों का वितरण लगभग सामान्य जैसा दिखाई दे । मैं यह कैसे कर सकता हूं? प्रेरणा यह है। समय श्रृंखला डेटा के एक सेट के लिए , सहसंबंध वितरण अक्सर सामान्य के काफी करीब दिखता है। मैं सामान्य स्थिति …

2
आत्मविश्वास अंतराल के साथ बातचीत की साजिश कैसे बनाएं?
मेरे प्रयास: मैं विश्वास अंतराल प्राप्त नहीं कर सका interaction.plot() और दूसरी ओर plotmeans()पैकेज 'gplot' से दो ग्राफ़ प्रदर्शित नहीं होंगे। इसके अलावा, मैं दो plotmeans()ग्राफ़ को एक के ऊपर एक नहीं लगा सकता क्योंकि डिफ़ॉल्ट रूप से अक्ष भिन्न होते हैं। मुझे plotCI()पैकेज 'gplot' के प्रयोग से कुछ सफलता …

2
क्या एक यादृच्छिक वन मॉडल से एक भविष्यवाणी की व्याख्या करने का एक तरीका है?
मान लें कि मुझे एक यादृच्छिक वन (आर में यादृच्छिकफोरस्ट पैकेज का उपयोग करके) के आधार पर एक भविष्य कहनेवाला वर्गीकरण मॉडल मिला है। मैं इसे सेट करना चाहता हूं ताकि एंड-यूज़र्स के लिए एक भविष्यवाणी उत्पन्न करने के लिए एक आइटम निर्दिष्ट कर सकें, और यह एक वर्गीकरण संभावना …

4
एक अध्ययन के लिए अति-संचालित होने का क्या मतलब है?
एक अध्ययन के लिए अति-संचालित होने का क्या मतलब है? मेरी धारणा यह है कि इसका मतलब है कि आपके नमूने के आकार इतने बड़े हैं कि आपके पास ऋणात्मक प्रभाव आकारों का पता लगाने की शक्ति है। ये प्रभाव आकार शायद इतने छोटे होते हैं कि वे चर के …

3
गैर-रैखिक निर्भरता को मापना
दो यादृच्छिक चर के बीच सहसंयोजी एक माप को परिभाषित करता है कि वे एक दूसरे से रैखिक रूप से कितने निकट से संबंधित हैं। लेकिन क्या होगा अगर संयुक्त वितरण परिपत्र है? निश्चित रूप से वितरण में संरचना है। इस संरचना को कैसे निकाला जाता है?

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.