सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

5
सहसंबंध निर्धारित करने के लिए 2 गैर-स्थिर समय श्रृंखला की तुलना कैसे करें?
मेरे पास दो डेटा सीरीज़ हैं जो समय के साथ मृत्यु की औसत आयु को दर्शाती हैं। दोनों श्रृंखला समय के साथ मृत्यु की बढ़ती उम्र को प्रदर्शित करती हैं, लेकिन एक दूसरे की तुलना में बहुत कम है। मैं यह निर्धारित करना चाहता हूं कि क्या निचले नमूने की …

4
समय श्रृंखला में स्पष्टीकरण के लिए क्या करना है?
अभी तक क्रॉस सेक्शनल डेटा के साथ ज्यादातर काम किया है और बहुत हाल ही में ब्राउज़ कर रहा है, परिचयात्मक समय श्रृंखला साहित्य का एक गुच्छा के माध्यम से ठोकरें स्कैन कर रहा है मुझे आश्चर्य है कि समय श्रृंखला विश्लेषण में कौन से भूमिका व्याख्यात्मक चर खेल रहे …

6
मैं किसी श्रृंखला में डेटा बिंदुओं की संख्या को कैसे कम करूं?
मैंने 10 साल से अधिक समय तक आँकड़ों का अध्ययन नहीं किया है (और फिर एक बुनियादी पाठ्यक्रम), इसलिए शायद मेरा सवाल समझना थोड़ा कठिन है। वैसे भी, मैं जो करना चाहता हूं वह एक श्रृंखला में डेटा बिंदुओं की संख्या को कम करना है। एक्स-एक्सिस माप की शुरुआत से …

1
U-Matrix को स्वचालित रूप से कैसे क्लस्टर करें?
स्व-आयोजन मानचित्र को प्रशिक्षित करने के बाद, कोई भी यू-मैट्रिक्स की गणना कर सकता है । हैं कुछ उपकरण मैन्युअल रूप से इसे कल्पना और समूहों की पहचान करने के लिए, लेकिन अगर वहाँ एक स्वचालित तरीके से इस प्रक्रिया करने के लिए (यानी एक मानव समूहों की पहचान करने …

4
जब त्रुटियों को सामान्य रूप से वितरित नहीं किया जाता है, तो प्रतिगमन के लेस्टर-वर्ग और अधिकतम-संभावना तरीके समतुल्य क्यों नहीं हैं?
शीर्षक यह सब कहता है। मैं समझता हूं कि यदि मॉडल की त्रुटियों को सामान्य रूप से वितरित किया जाता है, तो लेस्टर-स्क्वेयर और अधिकतम-संभावनाएं प्रतिगमन गुणांक के लिए समान परिणाम देगी। लेकिन, क्या होता है यदि त्रुटियों को सामान्य रूप से वितरित नहीं किया जाता है? दो विधियाँ अब …

1
पीडीएफ के समारोह की मानकता और मानक सामान्य रैंडम वेरिएबल की सीडीएफ
साक्ष्य प्रदान करें कि Q(x)=x2+xϕ(x)Φ(x)Q(x)=x2+xϕ(x)Φ(x)Q\left(x\right)=x^{2}+x\frac{\phi\left(x\right)}{\Phi\left(x\right)} उत्तल है∀x>0∀x>0\forall x>0 । इधर,ϕϕ\phiऔरΦΦ\mathbf{\Phi}मानक सामान्य पीडीएफ और CDF क्रमश: कर रहे हैं। स्टीप्स की कोशिश की 1) कैलकुलस विधि मैं पथरी विधि की कोशिश की है और दूसरा व्युत्पन्न के लिए एक सूत्र है, लेकिन पता चलता है कि यह सकारात्मक है नहीं पा …

5
समय श्रृंखला डेटा पूर्वानुमान के लिए एक बार आउटलेर्स को सही करने के लिए कैसे?
मैं समय श्रृंखला डेटा में उन्हें ढूंढने / उनका पता लगाने के लिए आउटलेर्स को सही करने का एक तरीका खोजने की कोशिश कर रहा हूं। R में nnetar जैसे कुछ तरीके, बड़े / बड़े आउटलेर्स के साथ टाइम सीरीज़ के लिए कुछ त्रुटियां देते हैं। मैं पहले से ही …

1
आर पूर्वानुमान पैकेज से टीबीएटीएस का उपयोग करके समय श्रृंखला अपघटन की व्याख्या करना
मैं निम्नलिखित समय सीरीज़ डेटा को मौसमी, प्रवृत्ति और अवशिष्ट पोटीनीनेट में विघटित करना चाहूंगा। डेटा एक व्यावसायिक भवन से प्रति घंटा कूलिंग एनर्जी प्रोफ़ाइल है: TotalCoolingForDecompose.ts <- ts(TotalCoolingForDecompose, start=c(2012,3,18), freq=8765.81) plot(TotalCoolingForDecompose.ts) इसलिए स्पष्ट दैनिक और साप्ताहिक मौसमी प्रभाव हैं, इसलिए से सलाह के आधार पर: कई मौसमी घटकों के …

1
घातांक और गामा के बीच वितरण के लिए नाम?
घनत्व जहां एक पैरामीटर है, घातांक ( ) के बीच रहता है और ( ) वितरण। बस उत्सुक अगर यह वितरण के एक अधिक सामान्य परिवार का एक उदाहरण होता है? मैं इसे ऐसे नहीं पहचानता।च( s ) ∝ एसs + αइ- एस,s > 0च(रों)αरोंरों+αइ-रों,रों>0f(s)\propto \frac{s}{s+\alpha}e^{-s},\quad s > 0α ≥ …

1
बार-बार किए गए उपाय aova: lm vs lmer
मैं दोनों के बीच lmऔर lmerदोहराया उपायों (2x2x2) के बीच कई इंटरैक्शन टेस्ट को पुन: पेश करने की कोशिश कर रहा हूं । मैं दोनों तरीकों की तुलना करना चाहता हूं, क्योंकि दोहराए गए उपायों के लिए SPSS की GLM lmयहां प्रस्तुत दृष्टिकोण के समान सटीक परिणाम देती है, इसलिए …

1
की MLE है
मान लीजिए ( एक्स), वाई)(X,Y)(X,Y) में पीडीएफ है चθ( एक्स , वाई) = ई- ( एक्स / θ + θ y)1x > 0 , y> 0,θ > ०fθ(x,y)=e−(x/θ+θy)1x>0,y>0,θ>0f_{\theta}(x,y)=e^{-(x/\theta+\theta y)}\mathbf1_{x>0,y>0}\quad,\,\theta>0 नमूना का घनत्व ( एक्स , वाई ) = ( एक्स )मैं, वाईमैं)1 ≤ i ≤ n(X,Y)=(Xi,Yi)1≤i≤n(\mathbf X,\mathbf Y)=(X_i,Y_i)_{1\le i\le n} …

2
जर्मन टैंक समस्या का समाधान
क्या एक औपचारिक गणितीय प्रमाण है कि जर्मन टैंक समस्या का समाधान केवल मापदंडों k (मनाया नमूनों की संख्या) और मीटर (मनाया नमूनों में अधिकतम मूल्य) का एक कार्य है? दूसरे शब्दों में, क्या कोई यह साबित कर सकता है कि समाधान अधिकतम मूल्य के अलावा अन्य नमूना मूल्यों से …

2
विदेशी मुद्रा की कीमतों का अनुकरण करने के लिए ARMA-GARCH मॉडल का उपयोग करना
मैंने एक ARIMA (1,1,1) -GARCH (1,1) मॉडल को AUD / USD विनिमय दर की समय श्रृंखला के लिए मॉडल किया है, जो कई वर्षों के दौरान एक-एक मिनट के अंतराल पर सैंपल की गई कीमतों को दो से अधिक प्रदान करता है। जिस पर मॉडल का अनुमान लगाने के लिए …

5
बिनिंग को हर कीमत पर क्यों टाला जाना चाहिए?
इसलिए मैंने कुछ पोस्ट पढ़ी हैं कि क्यों बिनिंग से हमेशा बचा जाना चाहिए। इस दावे के लिए एक लोकप्रिय संदर्भ यह लिंक है । मुख्य पलायन यह है कि बिनिंग पॉइंट्स (या कटपॉइंट्स) बल्कि मनमाने ढंग से और साथ ही सूचना के नुकसान के कारण होते हैं, और यह …

2
क्या कभी फजी लॉजिक हुआ?
फजी लॉजिक मशीन लर्निंग और डेटा माइनिंग में अनुसंधान के एक सक्रिय क्षेत्र की तरह लग रहा था जब मैं ग्रेड स्कूल (2000 के दशक के प्रारंभ) में था। फ़ज़ी इंफ़ेक्शन सिस्टम, फ़ज़ी सी-साधन, विभिन्न न्यूरल नेटवर्क के फ़ज़ी वर्जन और सदिश मशीन आर्किटेक्चर सभी को ग्रेड पाठ्यक्रमों में पढ़ाया …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.