सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
क्या लॉजिस्टिक रिग्रेशन की ट्रेनिंग में "आंशिक क्रेडिट" (निरंतर परिणाम) देना कभी एक अच्छा विचार है?
मैं भविष्यवाणी करने के लिए एक लॉजिस्टिक रिग्रेशन का प्रशिक्षण ले रहा हूं कि कौन से धावक एक भीषण धीरज दौड़ को पूरा करने की संभावना रखते हैं। बहुत कम धावक इस दौड़ को पूरा करते हैं, इसलिए मेरे पास गंभीर वर्ग असंतुलन और सफलताओं का एक छोटा सा नमूना …

2
राव-ब्लैकवेल प्रमेय को क्यों है?
राव-ब्लैकवेल प्रमेय कहता है चलो का एक आकलनकर्ता हो साथ के लिए सभी । मान लीजिये कि लिए पर्याप्त है , और let उसके बाद सभी , असमानता सख्त है जब तक कि का एक कार्य नहीं है θई( θ 2)&lt;∞θटीθθ*=ई( θ |टी)θई(θ*-θ)2≤ई( θ -θ)2 θ टीθ^θ^\hat{\theta}θθ\thetaE(θ^2)&lt;∞E(θ^2)&lt;∞\Bbb E (\hat{\theta}^2) < …

3
लॉजिस्टिक रिग्रेशन में रैंकिंग सुविधाएँ
मैंने लॉजिस्टिक रिग्रेशन का इस्तेमाल किया। मेरे पास छह विशेषताएं हैं, मैं इस क्लासिफायर में महत्वपूर्ण विशेषताओं को जानना चाहता हूं जो अन्य विशेषताओं की तुलना में परिणाम को प्रभावित करते हैं। मैंने जानकारी प्राप्त की, लेकिन ऐसा लगता है कि यह प्रयुक्त क्लासिफ़ायर पर निर्भर नहीं करता है। क्या …

5
मीनिंग, मेडियन की व्याख्या करते हुए, लैमन की शर्तों में मोड
आप माध्य, माध्यिका और संख्याओं की सूची की अवधारणा की व्याख्या कैसे करेंगे और वे केवल मूल अंकगणितीय कौशल वाले किसी व्यक्ति के लिए महत्वपूर्ण क्यों हैं? आइए तिरछापन, सीएलटी, केंद्रीय प्रवृत्ति, उनके सांख्यिकीय गुणों आदि का उल्लेख न करें। मैंने किसी को समझाया है कि संख्याओं की सूची को …

3
क्या डिराक के डेल्टा समारोह को गौसियन वितरण का एक उपवर्ग माना जाना चाहिए?
विकिडता में, ऑन्कोलॉजी में संभावना वितरण (सब कुछ की तरह) को जोड़ना संभव है, उदाहरण के लिए, कि टी-वितरण गैर-टी-वितरण का एक उपवर्ग है, देखें, जैसे, https://angryloki.github.io/wikidata-graph-builder/?property=P279&amp;item=Q209675&amp;iterations=3&amp;limit=3 विभिन्न सीमित मामले हैं, उदाहरण के लिए, जब टी-वितरण में स्वतंत्रता की डिग्री अनंत तक जाती है या जब विचरण सामान्य वितरण (गौसियन …

2
इस प्रकार की साजिश को साइड-बाय-साइड केंद्रित क्षैतिज घनत्व सलाखों के साथ कहा जाता है?
आप इस प्रकार के प्लॉट को क्या कहेंगे, और क्या उन्हें R में बनाना संभव है? संपादित करें: बहुत धन्यवाद सभी - बहुत उपयोगी। अब तक का सर्वश्रेष्ठ शीर्षक: मात्रात्मक वायलिन प्लॉट!

3
रैखिक प्रतिगमन करते समय ढलान के लिए एक असंक्रामक पूर्व क्या होना चाहिए?
बायेसियन रैखिक प्रतिगमन करते समय, किसी को ढलान और इंटरसेप्ट लिए पूर्व असाइन करने की आवश्यकता होती है । चूंकि एक स्थान पैरामीटर है, जो पहले एक समान असाइन करने के लिए समझ में आता है; हालाँकि, यह मुझे लगता है कि स्केल पैरामीटर के समान है और इसके पहले …

1
क्या "बेसबॉल के पायथागॉरियन प्रमेय" के पीछे कोई वास्तविक आँकड़े हैं?
मैं sabermetrics के बारे में एक किताब पढ़ रहा हूं, विशेष रूप से वेन विंस्टन द्वारा मैथलेटिक्स, और पहले अध्याय में वह एक मात्रा का परिचय देता है जिसका उपयोग टीमों की जीत दर का अनुमान लगाने के लिए किया जा सकता है: और वह है, यह जीत दर की …

1
एकल परत NeuralNetwork ReLU सक्रियण SVM के बराबर है?
मान लीजिए कि मेरे पास एक सरल सिंगल लेयर न्यूरल नेटवर्क है, जिसमें एन इनपुट और एक एकल आउटपुट (बाइनरी वर्गीकरण कार्य) है। यदि मैंने आउटपुट नोड में सक्रियण फ़ंक्शन को सिग्मॉइड फ़ंक्शन के रूप में सेट किया है - तो परिणाम एक लॉजिस्टिक प्रतिगमन क्लासिफायरियर है। इसी परिदृश्य में, …

1
दो सैंपल ची स्क्वेर टेस्ट
यह सवाल वैन डेर वार्ट की पुस्तक एसिम्प्टोटिक स्टेटिस्टिक्स, पीजी से है। 253. # 3: मान लीजिए कि और पैरामीटर और साथ स्वतंत्र बहुराष्ट्रीय वैक्टर हैं । शून्य परिकल्पना के तहत कि दर्शाता हैXmXm\mathbf{X}_mYnYn\mathbf{Y}_n(m,a1,…,ak)(m,a1,…,ak)(m,a_1,\ldots,a_k)(n,b1,…,bk)(n,b1,…,bk)(n,b_1,\ldots,b_k)ai=biai=bia_i=b_i ∑i=1k(Xm,i−mc^i)2mc^i+∑i=1k(Yn,i−nc^i)2nc^i∑i=1k(Xm,i−mc^i)2mc^i+∑i=1k(Yn,i−nc^i)2nc^i\sum_{i=1}^k \dfrac{(X_{m,i} - m\hat{c}_i)^2}{m\hat{c}_i} + \sum_{i=1}^k \dfrac{(Y_{n,i} - n\hat{c}_i)^2}{n\hat{c}_i} में वितरण है। जहाँ ।χ2k−1χk−12\chi^2_{k-1}c^i=(Xm,i+Yn,i)/(m+n)c^i=(Xm,i+Yn,i)/(m+n)\hat{c}_i = (X_{m,i} …

2
ऊपरी सीमा के साथ निरंतर वर्दी आर.वी. का वितरण एक और निरंतर वर्दी आरवी है
यदि और , तो क्या मैं कह सकता हूं किवाई ~ यू ( एक , एक्स ) वाई ~ यू ( एक , ख ) ?एक्स∼ यू( ए , बी )एक्स~यू(ए,ख)X \sim U(a, b)Y∼ यू( ए , एक्स)Y~यू(ए,एक्स)Y \sim U(a, X)Y∼ यू( ए , बी ) ?Y~यू(ए,ख)?Y \sim U(a, b)? …

2
सॉफ्टेमैक्स का उपयोग संभाव्यता वितरण का प्रतिनिधित्व करने के लिए क्यों किया जाता है?
मशीन लर्निंग साहित्य में, प्रायिकता वितरण का प्रतिनिधित्व करने के लिए, सॉफ्टमैक्स फ़ंक्शन का अक्सर उपयोग किया जाता है। क्या इसका कोई कारण है? एक अन्य फ़ंक्शन का उपयोग क्यों नहीं किया जाता है?

1
एक MIMIC कारक और संकेतक (SEM) के साथ एक संयुक्त के बीच क्या अंतर है?
अव्यक्त चर (SEM) के साथ संरचनात्मक समीकरण मॉडलिंग में, एक सामान्य मॉडल सूत्रीकरण "एकाधिक संकेतक, एकाधिक कारण" (MIMIC) है जहां एक अव्यक्त चर कुछ चर के कारण होता है और दूसरों द्वारा परिलक्षित होता है। यहाँ एक सरल उदाहरण दिया गया है: अनिवार्य रूप से, f1के लिए एक प्रतिगमन परिणाम …

2
बहुराष्ट्रीय वितरण के गुणांकों का योग
\newcommand{\P}{\mathbb{P}} मैं एक निष्पक्ष मर रहा हूँ। जब भी मुझे 1, 2, या 3 मिलता है, मैं एक '1' लिखता हूं; जब भी मुझे कोई 4 मिलता है तो मैं एक '2' लिखता हूं; जब भी मुझे कोई 5 या 6 मिलता है, तो मैं '3.' लिखता हूं। आज्ञा देना …

3
दो समान समय श्रृंखला के विचलन शुरू होने पर सत्यापित करने के लिए सांख्यिकीय परीक्षण
जैसा कि शीर्षक से मैं जानना चाहूंगा कि क्या एक सांख्यिकीय परीक्षण मौजूद है जो मुझे दो समान समय श्रृंखला के बीच एक महत्वपूर्ण विचलन की पहचान करने में मदद कर सकता है। विशेष रूप से, नीचे दिए गए आंकड़े को देखते हुए, मैं यह पता लगाना चाहूंगा कि श्रृंखला …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.