सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
पल उत्पन्न समारोह पर बाध्य
यह सवाल उठता है से एक से पूछा यहाँ एक पल के सृजन कार्य (MGFs) पर बाध्य के बारे में। मान लीजिए XXX एक घिरा शून्य मतलब यादृच्छिक चर में मूल्यों पर ले जा रहा है [−σ,σ][−σ,σ][-\sigma, \sigma] और जाने G(t)=E[etX]G(t)=E[etX]G(t) = E[e^{tX}] अपने एमजीएफ हो। से एक बाध्य Hoeffding …

2
मशीन सीखने के लिए संख्याओं के लिए श्रेणीगत विशेषताओं को एन्कोड करना
कई मशीन लर्निंग एल्गोरिदम, उदाहरण के लिए तंत्रिका नेटवर्क, संख्याओं से निपटने की उम्मीद करते हैं। इसलिए, जब आपके पास एक श्रेणीबद्ध डेटा होता है, तो आपको इसे परिवर्तित करने की आवश्यकता होती है। उदाहरण के लिए, मेरा मतलब है: कार ब्रांड: ऑडी, बीएमडब्ल्यू, शेवरले ... यूजर आईडी: 1, 25, …

1
हमें विभिन्न अनुमानों में विभिन्न अनुमानकों के अभिसरण व्यवहार पर चर्चा क्यों करनी चाहिए?
पुस्तक के पहले अध्याय में बीजगणितीय ज्यामिति और सांख्यिकीय शिक्षण सिद्धांत जो विभिन्न कार्यात्मक स्थान में अनुमानों के अभिसरण के बारे में बात करता है, इसमें उल्लेख किया गया है कि बायेसियन अनुमान श्वार्ट्ज वितरण टोपोलॉजी से मेल खाता है, जबकि अधिकतम गति का अनुमान सुपर-मानक टोपोलॉजी से मेल खाता …

3
क्या कोई कृपया समय श्रृंखला समानता का निर्धारण करने के लिए गतिशील समय की व्याख्या कर सकता है?
मैं समय श्रृंखला की एक साथ तुलना करने के लिए गतिशील समय को मापने के उपाय को समझने की कोशिश कर रहा हूं। मेरे पास तीन टाइम सीरीज़ डेटासेट हैं: T1 <- structure(c(0.000213652387565, 0.000535045478866, 0, 0, 0.000219346347883, 0.000359669104424, 0.000269469145783, 0.00016051364366, 0.000181950509461, 0.000385579332948, 0.00078170803205, 0.000747244535774, 0, 0.000622858922454, 0.000689084895259, 0.000487983408564, 0.000224744353298, 0.000416449765747, …

5
शून्य डेटा वाले इनपुट डेटा में वीबुल वितरण कैसे फिट करें?
मैं एक मौजूदा भविष्यवाणी एल्गोरिथ्म को पुन: पेश करने की कोशिश कर रहा हूं, जो एक सेवानिवृत्त शोधकर्ता द्वारा दिया गया है। पहला कदम एक वीबुल वितरण के लिए कुछ अवलोकन किए गए डेटा को फिट करना है, एक आकार और पैमाने प्राप्त करना है जो भविष्य के मूल्यों की …

1
समानता और असमानता बाधाओं के लिए विवश अनुकूलन पुस्तकालय
मेरे अनुकूलन समारोह के लिए उपयुक्त विवश अनुकूलन पुस्तकालय के चयन के लिए कोई सिफारिशें? मैं रैखिक समानता और असमानता बाधाओं के साथ एआई) गैर-रेखीय फ़ंक्शन को कम कर रहा हूं, और ii) समारोह के ग्रेडिएंट और हेसियन उपलब्ध हैं। यदि यह मदद करता है, तो मैं जिस फ़ंक्शन को …

4
"मॉडरेशन" बनाम "इंटरैक्शन"?
मैं इन दो शब्दों को लेकर आया हूं जो कई संदर्भों में परस्पर उपयोग किए जाते हैं। मूल रूप से, एक मध्यस्थ (एम) एक कारक है जो एक्स और वाई के बीच संबंधों पर प्रभाव डालता है। मॉडरेशन विश्लेषण आमतौर पर एक प्रतिगमन मॉडल का उपयोग करके किया जाता है। …

2
ARMA / ARIMA मिश्रित प्रभाव मॉडलिंग से कैसे संबंधित है?
पैनल डेटा विश्लेषण में, मैंने ऑटो-सहसंबंध के मुद्दों से निपटने के लिए यादृच्छिक / मिश्रित प्रभावों के साथ बहु-स्तरीय मॉडल का उपयोग किया है (यानी, समय के साथ व्यक्तियों के भीतर टिप्पणियों का क्लस्टर किया जाता है) समय के कुछ विनिर्देश और ब्याज के झटके को समायोजित करने के लिए …

3
काटे गए वितरण का क्या अर्थ है?
एक डायनेमिक सिस्टम के एक साधारण अंतर समीकरण मॉडल के संवेदनशीलता विश्लेषण के बारे में एक शोध लेख में, लेखक ने सामान्य वितरण के रूप में एक मॉडल पैरामीटर का वितरण प्रदान किया (मतलब = 1e-4, std = 3e-5) रेंज में विभाजित [0.5e] -4 १.५e-४]। फिर वह मॉडल के सिमुलेशन …

1
जब असंतुलित वर्गों से अधिक / अंडर-सैंपलिंग की जाती है, तो सटीकता को अधिकतम करने से गर्भपात की लागत कम से कम होती है?
सबसे पहले, मैं कुछ सामान्य लेआउट का वर्णन करना चाहूंगा, जो डेटा माइनिंग की किताबें बताती हैं कि असंतुलित डेटासेट से कैसे निपटना है । आमतौर पर मुख्य खंड को असंतुलित डेटासेट नाम दिया गया है और वे इन दो उपखंडों को कवर करते हैं: लागत-संवेदनशील वर्गीकरण और नमूनाकरण तकनीक। …

8
मशीन सीखने के लिए "हॉट एल्गोरिदम" क्या हैं?
यह मशीन सीखने की शुरुआत करने वाले किसी व्यक्ति से एक भोला सवाल है। मैं इन दिनों मार्सलैंड की पुस्तक "मशीन लर्निंग: एन अल्गोरिथमिक परिप्रेक्ष्य" पढ़ रहा हूं। मुझे यह एक परिचयात्मक पुस्तक के रूप में उपयोगी लगता है, लेकिन अब मैं उन्नत एल्गोरिदम में जाना चाहूंगा, जो वर्तमान में …

4
सांख्यिकीय संदर्भ को कैसे पचाएं?
सबसे पहले, मुझे लगता है कि नहीं यह दिलचस्प साइट के सभी सक्रिय सदस्य के रूप में अपना काम सांख्यिकीविदों हैं। अन्यथा इस प्रकार पूछे जाने वाले प्रश्न का कोई मतलब नहीं है! मैं निश्चित रूप से उनका सम्मान करता हूं, लेकिन मुझे एक स्पष्टीकरण की आवश्यकता है जो वैचारिक …


1
एसवीएम में हाइपरप्लेन से दूरी की व्याख्या करना
मुझे SVM ​​को सहज रूप से समझने में कुछ संदेह है। मान लें कि हमने SVMLight या LibSVM जैसे कुछ मानक टूल का उपयोग करके वर्गीकरण के लिए एक SVM मॉडल का प्रशिक्षण लिया है। जब हम परीक्षण मॉडल पर भविष्यवाणी के लिए इस मॉडल का उपयोग करते हैं, तो …

2
क्या ईएएस में बायेसियन और अक्सरवादी दृष्टिकोण में अंतर हैं?
बहुत सीधे शब्दों में कहें: खोज डेटा विश्लेषण के लिए बायेसियन और फ़्रीक्वेंटिस्ट दृष्टिकोण में कोई अंतर हैं? मैं ईडीए के तरीकों में निहित निहित गैसों के बारे में नहीं जानता क्योंकि हिस्टोग्राम एक हिस्टोग्राम है, स्कैटरप्लॉट एक स्कैप्लेटोट है, आदि, और न ही मैंने ईएआरए को सिखाया या प्रस्तुत …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.