सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
गतिशील कारक विश्लेषण बनाम राज्य अंतरिक्ष मॉडल
R में MARSS पैकेज गतिशील कारक विश्लेषण के लिए कार्य करता है। इस पैकेज में, डायनेमिक फैक्टर मॉडल को स्टेट स्पेस मॉडल के एक विशेष रूप के रूप में लिखा गया है और वे मानते हैं कि सामान्य रुझान एआर (1) प्रक्रिया का पालन करते हैं। जैसा कि मैं उन …

1
-tests बनाम-tests?
मैं यह पता लगाने की कोशिश कर रहा हूं कि अंतर क्या है टीएस और वेस्ट के बीच ।टीटीtzzz जहाँ तक मैं बता सकता हूँ, परीक्षण के दोनों वर्गों के लिए एक ही परीक्षण सांख्यिकीय का उपयोग करता है, कुछ का रूप ख^- सीसेˆ( बी^)ख^-सीसे^(ख^)\frac{\hat{b} - C}{\widehat{\operatorname{se}}(\hat{b})} जहाँ कुछ नमूना …

1
लॉजिस्टिक रिग्रेशन मॉडल हेरफेर
मैं समझना चाहूंगा कि निम्नलिखित कोड क्या कर रहा है। जिस व्यक्ति ने कोड लिखा था वह अब यहां काम नहीं करता है और यह लगभग पूरी तरह से अनिर्दिष्ट है। मुझे किसी ऐसे व्यक्ति द्वारा इसकी जांच करने के लिए कहा गया था जो सोचता है कि " यह …

3
गणितीय रूप से तंत्रिका नेटवर्क को चित्रमय मॉडल के रूप में मॉडलिंग करना
मैं एक तंत्रिका नेटवर्क और एक ग्राफिकल मॉडल के बीच गणितीय संबंध बनाने के लिए संघर्ष कर रहा हूं। ग्राफिकल मॉडल में यह विचार सरल है: संभाव्यता वितरण ग्राफ में क्लोन के अनुसार फैक्टर करता है, जिसमें संभावित रूप से घातीय परिवार होते हैं। क्या तंत्रिका नेटवर्क के लिए एक …

2
QQ कथानक व्याख्या
निम्नलिखित कोड और आउटपुट पर विचार करें: par(mfrow=c(3,2)) # generate random data from weibull distribution x = rweibull(20, 8, 2) # Quantile-Quantile Plot for different distributions qqPlot(x, "log-normal") qqPlot(x, "normal") qqPlot(x, "exponential", DB = TRUE) qqPlot(x, "cauchy") qqPlot(x, "weibull") qqPlot(x, "logistic") ऐसा लगता है कि लॉग-नॉर्मल के लिए क्यूक्यू प्लॉट …

2
कैसे बताएं कि अवशिष्ट एक ग्राफिक से स्वतःसंबंधित हैं या नहीं
जब आप एक OLS प्रतिगमन करते हैं और परिणामी अवशिष्टों को प्लॉट करते हैं, तो आप कैसे बता सकते हैं कि अवशिष्ट स्वतःसंबंधित हैं? मुझे पता है कि इस के लिए परीक्षण (डर्बिन, ब्यूश-गॉडफ्रे) हैं, लेकिन मैं सोच रहा था कि क्या आप बस एक साजिश को देख सकते हैं …

1
वितरण मुक्त आँकड़ों / विधियों और गैर-पैरामीट्रिक आँकड़ों के बीच क्या अंतर है?
से विकिपीडिया गैर-पैरामीट्रिक कवर तकनीक का पहला अर्थ जो किसी विशेष वितरण से संबंधित डेटा पर निर्भर नहीं करता है। इनमें अन्य शामिल हैं: वितरण मुक्त विधियां, जो मान्यताओं पर भरोसा नहीं करती हैं कि डेटा किसी दिए गए प्रायिकता वितरण से लिया गया है। जैसे कि यह पैरामीट्रिक आँकड़ों …

4
इस मामले में लीनियर रिग्रेशन पर पोइसन रिग्रेशन के क्या फायदे हैं?
मुझे एक डेटा सेट दिया गया है जिसमें एक हाई स्कूल में छात्रों द्वारा अर्जित पुरस्कारों की संख्या है जहाँ अर्जित किए गए पुरस्कारों की संख्या के भविष्यवाणियों में उस प्रकार का कार्यक्रम शामिल है जिसमें छात्र को दाखिला दिया गया था और मैथ्स में उनकी अंतिम परीक्षा का स्कोर …

1
पॉसों प्रतिगमन मॉडल को मान्य करने के लिए लागत समारोह
गणना डेटा के लिए जो मैंने एकत्र किया है, मैं मॉडल बनाने के लिए पॉइसन रिग्रेशन का उपयोग करता हूं। मैं glmआर में फ़ंक्शन का उपयोग कर रहा हूं, जहां मैं उपयोग करता हूं family = "poisson"। संभावित मॉडलों का मूल्यांकन करने के लिए (मेरे पास कई भविष्यवक्ता हैं) मैं …

2
R में क्लस्टरिंग के k- साधनों के परिणाम की व्याख्या करना
मैं kmeansएंडरसन के आईरिस डाटासेट पर k- साधन एल्गोरिथ्म प्रदर्शन के लिए R के निर्देश का उपयोग कर रहा था । मेरे पास कुछ मापदंडों के बारे में एक प्रश्न है जो मुझे मिला। परिणाम हैं: Cluster means: Sepal.Length Sepal.Width Petal.Length Petal.Width 1 5.006000 3.428000 1.462000 0.246000 इस मामले में, …

1
कम से कम वर्गों बनाम सामान्यीकृत रैखिक मॉडल बनाम नॉनलाइनियर कम से कम वर्गों का उपयोग करके एक घातीय फ़ंक्शन को फिटिंग करना
मेरे पास एक डेटा सेट है जो घातीय क्षय का प्रतिनिधित्व करता है। मैं एक घातीय समारोह फिट करने के लिए चाहते हैं इस डेटा के लिए। मैंने प्रतिक्रिया चर को बदलने के लिए लॉग की कोशिश की है और फिर एक पंक्ति में फिट होने के लिए कम से …

1
कैसे पता लगा सकते हैं कि क्या एक गाऊसी प्रक्रिया ओवर-फिटिंग है?
मैं क्रॉस-वैलिडेशन के बजाय डेटा के सीमांत लिलिहुड को अधिकतम करके कई एआरडी कर्नेल के साथ गॉसियन प्रक्रिया का प्रशिक्षण दे रहा हूं। मुझे संदेह है कि यह अति-फिटिंग है। मैं इस संदेह को बायेसियन संदर्भ में कैसे परख सकता हूं?

2
लॉजिस्टिक रिग्रेशन और रैंडम फॉरेस्ट के परिणामों को कैसे मिलाएं?
मैं मशीन लर्निंग के लिए नया हूं। मैंने एक ही डेटासेट पर लॉजिस्टिक रिग्रेशन और रैंडम फ़ॉरेस्ट लागू किया। इसलिए मुझे परिवर्तनीय महत्व मिलता है (लॉजिस्टिक रिग्रेशन के लिए पूर्ण गुणांक और यादृच्छिक वन के लिए चर महत्व)। मैं अंतिम परिवर्तनीय महत्व प्राप्त करने के लिए दोनों को मिलाने के …

2
दो रैखिक प्रतिगमन मॉडल की तुलना करना
मैं दो रैखिक प्रतिगमन मॉडल की तुलना करना चाहता हूं जो दो अलग-अलग परिस्थितियों में समय के साथ एक mRNA की गिरावट दर का प्रतिनिधित्व करते हैं। प्रत्येक मॉडल का डेटा स्वतंत्र रूप से एकत्र किया गया। यहाँ डेटासेट है। समय (घंटे) लॉग (उपचार ए) लॉग (उपचार बी) 0 2.02 …

1
Kernelised k निकटतम पड़ोसी
मैं कर्नेल के लिए नया हूं और कर्नेल kNN की कोशिश करते हुए एक रोड़ा मारा है। प्रारंभिक मैं एक बहुपद कर्नेल का उपयोग कर रहा हूं: K(x,y)=(1+⟨x,y⟩)dK(x,y)=(1+⟨x,y⟩)dK(\mathbf{x},\mathbf{y}) = (1 + \langle \mathbf{x},\mathbf{y} \rangle)^d आपका विशिष्ट यूक्लिडियन kNN निम्नलिखित दूरी मीट्रिक का उपयोग करता है: d(x,y)=||x−y||d(x,y)=||x−y||d(\mathbf{x}, \mathbf{y}) = \vert\vert \mathbf{x} …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.