सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

4
आंकड़ों के इतिहास को प्रदान करने वाले अच्छे संसाधन क्या हैं?
ऑनलाइन या ऑफलाइन संसाधन क्या हैं जो आंकड़ों के इतिहास और अब तक के आंकड़ों में मुख्य सफलता का अवलोकन करते हैं? मैंने विकिपीडिया पर सांख्यिकी के इतिहास के पृष्ठ को पढ़ा है ।

2
कारक से संख्यात्मक चर में परिवर्तित करने में समस्या [बंद]
बन्द है। यह सवाल ऑफ टॉपिक है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि यह क्रॉस मान्य के लिए विषय पर हो । 7 साल पहले बंद हुआ । मैं एक कारक चर को एक सांख्यिक …

2
सहसंबंध गुणांक की तुलना करना
मेरे पास डेटा के दो सेट हैं जहां मेरे पास 78 और 35 नमूनों के लिए ~ 250.000 मूल्य हैं। कुछ नमूने एक परिवार के सदस्य हैं और यह डेटा का प्रभाव हो सकता है। मैंने युग्मक सहसंबंध की गणना की है और यह 0.7 और 0.95 के बीच भिन्न …

1
जब विश्वास अंतराल और विश्वसनीय अंतराल के उदाहरण मिलते हैं
विश्वसनीय अंतराल पर विकिपीडिया लेख में , यह कहता है: किसी एकल पैरामीटर और डेटा के मामले में, जिसे एक ही पर्याप्त आँकड़ा में संक्षेपित किया जा सकता है, यह दिखाया जा सकता है कि विश्वसनीय अंतराल और विश्वास अंतराल मेल खाएगा यदि अज्ञात पैरामीटर एक स्थान पैरामीटर है (अर्थात …

1
यदि मेरा डेटा असतत या निरंतर है तो परीक्षण कैसे करें?
यह मुझे लगता है कि सही सांख्यिकीय उपकरण चुनने के लिए, मुझे सबसे पहले यह पहचानना होगा कि मेरे डेटासेट असतत हैं या निरंतर। क्या आप मुझे यह सिखाने के लिए मन बना सकते हैं कि मैं कैसे परीक्षण कर सकता हूं कि डेटा असतत है या आर के साथ …

1
GLM के लिए किस तरह के अवशिष्ट और कुक की दूरी का उपयोग किया जाता है?
क्या किसी को पता है कि कुक की दूरी का सूत्र क्या है? मूल कुक की दूरी के सूत्र छात्र के अवशेषों का उपयोग करते हैं, लेकिन आरडी का उपयोग क्यों किया जाता है। एक GLM के लिए कुक की दूरी की साजिश की गणना करते समय पियर्सन अवशिष्ट। मुझे …

2
R [बंद] में इसके नाम से कॉलम इंडेक्स खोजना
बन्द है। यह सवाल ऑफ टॉपिक है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि यह क्रॉस मान्य के लिए विषय पर हो । 6 साल पहले बंद हुआ । एक डेटा फ्रेम में, मैं नाम से …
11 r 

1
अनिश्चितताओं को कैसे एकत्रित किया जाए, यह देखने के लिए कौन से चित्रमय तरीके उपयोगी हैं?
मेरे पास सिस्टम का एक सेट है जहां अनिश्चितताएं जमा होती हैं। ये हमेशा विशुद्ध रूप से additive नहीं होते हैं - कभी-कभी वे होते हैं, कभी-कभी वे नहीं होते हैं। मुझे प्रशंसक-चार्ट, आत्मविश्वास-अंतराल के साथ बार चार्ट और एकल आइटम संवाद के लिए बॉक्स प्लॉट का उपयोग करने में …

1
जब आप किसी सूत्र को नीचे खींचते हैं तो रेंज को बदलने से एक्सेल को कैसे रोकें? [बन्द है]
बन्द है। यह सवाल ऑफ टॉपिक है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि यह क्रॉस मान्य के लिए विषय पर हो । 7 साल पहले बंद हुआ । मैं एक्सेल स्प्रेडशीट में डेटा के कॉलम …
11 excel 

1
ARIMA (1,1,0) श्रृंखला का अनुकरण
मैंने ARIMA मॉडल को मूल समय श्रृंखला में फिट किया है, और सबसे अच्छा मॉडल ARIMA (1,1,0) है। अब मैं उस मॉडल से श्रृंखला का अनुकरण करना चाहता हूं। मैंने सरल एआर (1) मॉडल लिखा था, लेकिन मैं यह नहीं समझ सका कि मॉडल एआरआई (1,1,0) के भीतर अंतर को …
11 r  time-series  arima 

2
दो भारित यादृच्छिक चर की भिन्नता
करते हैं: यादृच्छिक चर का मानक विचलन A=σ1=5A=σ1=5A =\sigma_{1}=5 यादृच्छिक चर का मानक विचलन B=σ2=4B=σ2=4B=\sigma_{2}=4 फिर A + B का विचरण है: Var(w1A+w2B)=w21σ21+w22σ22+2w1w2p1,2σ1σ2Var(w1A+w2B)=w12σ12+w22σ22+2w1w2p1,2σ1σ2Var(w_{1}A+w_{2}B)= w_{1}^{2}\sigma_{1}^{2}+w_{2}^{2}\sigma_{2}^{2} +2w_{1}w_{2}p_{1,2}\sigma_{1}\sigma_{2} कहाँ पे: दो यादृच्छिक चर के बीच संबंध है।p1,2p1,2p_{1,2} यादृच्छिक चर ए का वजन हैw1w1w_{1} यादृच्छिक चर B का वजन हैw2w2w_{2} w1+w2=1w1+w2=1w_{1}+w_{2}=1 नीचे दिए गए …

4
आप k- साधनों के कार्यान्वयन का परीक्षण कैसे करते हैं?
डिस्क्लेमर: मैंने इस सवाल को स्टैकओवरफ़्लो पर पोस्ट किया है, लेकिन मुझे लगा कि शायद यह इस प्लेटफॉर्म के लिए बेहतर है। आप बहुआयामी डेटा सेट के लिए अपने स्वयं के k- साधन कार्यान्वयन का परीक्षण कैसे करते हैं? मैं डेटा पर पहले से ही लागू कार्यान्वयन (यानी, मैटलैब) को …

4
विशाल नमूनों के साथ टी-टेस्ट कैसे करें?
मेरे पास दो आबादी है, एक एन = 38,704 (टिप्पणियों की संख्या) और अन्य एन = 1,313,662 के साथ। इन डेटा सेट में ~ 25 चर हैं, सभी निरंतर। मैंने प्रत्येक डेटा सेट में प्रत्येक का मतलब निकाला और सूत्र का उपयोग करके परीक्षण आँकड़ा की गणना की t = …
11 t-test 

1
नमूना मात्रा के बजाय कॉर्निश-फिशर विस्तार का उपयोग क्यों करें?
कोर्निश-फिशर विस्तार एक वितरण क्षणों के आधार पर की quantiles अनुमान लगाने के लिए एक तरह से प्रदान करता है। (इस अर्थ में, मैं इसे एज्यूवर्थ एक्सपेंशन के पूरक के रूप में देखता हूं , जो क्षणों के आधार पर संचयी वितरण का अनुमान देता है।) मैं जानना चाहता हूं …

2
जटिल मौसमी के लिए मौसमी सूचकांक की गणना
मैं घातीय चौरसाई का उपयोग करके खुदरा वस्तुओं (सप्ताह तक) का पूर्वानुमान लगाना चाहता हूं। मैं अभी से अटक रहा हूं कि सेसोनॉलिटी इंडेक्स की गणना, स्टोर और कैसे लागू करें। समस्या यह है कि सभी उदाहरण मुझे एक प्रकार की साधारण सीज़न से मिलते हैं। मेरे मामले में मुझे …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.