सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
नकारात्मक द्विपद वितरण के लिए अधिकतम संभावना अनुमानक
प्रश्न निम्नलिखित है: एन मान का एक यादृच्छिक नमूना पैरामीटर k = 3 के साथ एक नकारात्मक द्विपद वितरण से एकत्र किया जाता है। पैरामीटर की अधिकतम संभावना अनुमानक का पता लगाएं hood। इस अनुमानक की मानक त्रुटि के लिए एक असममित सूत्र का पता लगाएं। बताएं कि यदि पैरामीटर …

2
अंतर विधि में अंतर: उपचार और नियंत्रण समूह के बीच सामान्य प्रवृत्ति की धारणा के लिए परीक्षण कैसे करें?
पिछले धागे से एक टिप्पणी के बाद , मैं जानना चाहता हूं कि अंतर पद्धति में उपचार और नियंत्रण समूह के बीच सामान्य प्रवृत्ति की धारणा के लिए कोई कैसे परीक्षण कर सकता है? क्या मैं दो समय बिंदुओं (उदाहरण के लिए, 2002 में आधारभूत सर्वेक्षण, 2002 से 2006 तक …

4
आयामीता का अभिशाप: केएनएन क्लासिफायरियर
मैं केविन मर्फी की किताब पढ़ रहा हूं: मशीन लर्निंग-ए प्रायिकेशनल पर्सपेक्टिव। पहले अध्याय में लेखक आयामीता के अभिशाप की व्याख्या कर रहा है और एक हिस्सा है जो मुझे समझ में नहीं आता है। एक उदाहरण के रूप में, लेखक बताता है: विचार करें कि डी-आयामी इकाई क्यूब के …

3
एक उदाहरण जहां k-medoid एल्गोरिदम का आउटपुट k-mean एल्गोरिथ्म के आउटपुट से अलग है
मैं के मेडोइड और के साधनों के बीच अंतर को समझता हूं। लेकिन क्या आप मुझे एक छोटे से डेटा सेट के साथ एक उदाहरण दे सकते हैं जहां k मेडॉइड आउटपुट k का मतलब आउटपुट से अलग है।

2
वृद्धिशील गाऊसी प्रक्रिया प्रतिगमन
मैं एक वृद्धिशील गाऊसी प्रक्रिया प्रतिगमन को एक बिंदु के माध्यम से एक-एक करके डेटा बिंदुओं पर स्लाइडिंग विंडो का उपयोग करके लागू करना चाहता हूं। चलो इनपुट अंतरिक्ष के आयामी स्वरूप को दर्शाते हैं। तो, हर डेटा बिंदु में तत्वों की संख्या ।घddएक्समैंxix_iघdd चलो स्लाइडिंग विंडो का आकार हो।nnn …

2
माध्य बनाम माध्य अंतर में अंतर
दो स्वतंत्र नमूनों का अध्ययन करते समय, हमें बताया जाता है कि हम "दो साधनों के अंतर" को देख रहे हैं। इसका मतलब है कि हम जनसंख्या 1 से मतलब लेते हैं (y¯1y¯1\bar y_1) और जनसंख्या 2 से इसका मतलब घटाएँ (y¯2y¯2\bar y_2)। तो, हमारे "दो साधनों का अंतर" है …

1
भिन्नात्मक-भिन्न-भिन्न सूत्र को समझना
मेरे पास टाइम सीरीज़ है yटीyty_tऔर मैं इसे एआरएफआईएमए (उर्फ फारिमा) प्रक्रिया के रूप में मॉडल करना चाहूंगा। अगरyटीyty_t (भिन्नात्मक) क्रम से एकीकृत है घdd, मैं इसे स्थिर बनाने के लिए भिन्न-भिन्न करना चाहूंगा। प्रश्न : भिन्नात्मक-विभेदन को परिभाषित करने वाला निम्नलिखित सूत्र सही है? Δघyटी:=yटी-डीyटी - 1+घ(d)- ( 1 …

1
कारक विश्लेषण में वेरिमैक्स और विस्मरण घुमाव के बीच अंतर
कारक विश्लेषण में वेरिमैक्स घुमाव और तिरछे घुमाव के बीच अंतर क्या है? इसके अलावा, मैं सिद्धांत और SPSS दोनों में प्रमुख घटक विश्लेषण, वेरिमैक्स रोटेशन और खोजपूर्ण कारक विश्लेषण के बीच के संबंध के बारे में उलझन में हूं। वे कैसे संबंधित हैं?

5
डर्बिन वॉटसन ने आँकड़ा परीक्षण किया
मैंने अपने प्रतिगमन मॉडल में DW परीक्षण को R में लागू किया और मुझे 1.78 का DW परीक्षण आँकड़ा और 2.2e-16 = 0 का p-मान मिला। क्या इसका मतलब यह है कि अवशिष्टों के बीच कोई स्वसंबंध नहीं है क्योंकि प्रतिमा एक छोटे पी-मान के साथ 2 के करीब है …

1
क्या प्रतिगमन गुणांक के अनुमान असंबंधित हैं?
एक साधारण प्रतिगमन पर विचार करें (सामान्यता ग्रहण नहीं की गई): जहां मीन और मानक विचलन । की कम से कम स्क्वायर अनुमान कर रहे हैं और असहसंबद्ध?Yमैं= ए + बीएक्समैं+इमैं,Yi=a+bXi+ei,Y_i = a + b X_i + e_i,इमैंeie_i000σσ\sigmaएaaखbb

2
पीसीए प्रक्षेपण के कुल विचरण को अधिकतम क्यों करता है?
क्रिस्टोफर बिशप ने अपनी पुस्तक पैटर्न रिकॉग्निशन एंड मशीन लर्निंग इन ए प्रूफ में लिखा है , कि डेटा को पहले से चुने गए घटकों को ऑर्थोगोनल स्पेस में पेश किए जाने के बाद प्रत्येक लगातार प्रमुख घटक प्रक्षेपण के विचरण को अधिकतम करता है। दूसरे भी ऐसे ही प्रमाण …

2
क्या एफ-माप सटीकता का पर्याय है?
मैं समझता हूं कि एफ-माप (सटीक और याद के आधार पर) एक अनुमान है कि एक क्लासिफायरियर कितना सटीक है। जब हम असंतुलित डेटासेट होते हैं, तब भी एफ-माप सटीकता का पक्षधर है । मेरे पास एक सरल प्रश्न है (जो तकनीक के बारे में सही शब्दावली का उपयोग करने …

2
प्रतिशत डेटा के लिए वितरण
मेरे पास अपने डेटा के साथ मॉडल बनाने के लिए उपयोग करने के लिए सही वितरण के बारे में एक प्रश्न है। मैंने 50 भूखंडों के साथ एक वन इन्वेंट्री का आयोजन किया, प्रत्येक भूखंड का माप 20 मीटर × 50 मीटर है। प्रत्येक भूखंड के लिए, मैंने अनुमान लगाया …

3
मुझे 1 से अधिक एन्ट्रापी की जानकारी क्यों मिल रही है?
एन्ट्रापी की गणना करने के लिए मैंने निम्नलिखित फ़ंक्शन लागू किया: from math import log def calc_entropy(probs): my_sum = 0 for p in probs: if p > 0: my_sum += p * log(p, 2) return - my_sum परिणाम: >>> calc_entropy([1/7.0, 1/7.0, 5/7.0]) 1.1488348542809168 >>> from scipy.stats import entropy # using …

1
Noncentrality Parameter - यह क्या है, यह क्या करता है, एक सुझाया गया मूल्य क्या होगा?
मैं अपने आँकड़ों के ज्ञान पर ब्रश करने की कोशिश कर रहा हूँ, विशेष रूप से नमूना आकार निर्धारण और सांख्यिकीय विद्युत विश्लेषण के संबंध में। लेकिन ऐसा लगता है कि जितना मुझे पढ़ने की ज़रूरत है उतना ही मैं इसे पढ़ूंगा। वैसे भी मुझे G * पावर नाम का …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.