सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
क्या रैंक के आंकड़ों (स्पीयरमैन सहसंबंध) के लिए एक प्रतिगमन लाइन की साजिश करना "ठीक है"?
मेरे पास डेटा है जिसके लिए मैंने स्पीयरमैन सहसंबंध की गणना की और इसे प्रकाशन के लिए कल्पना करना चाहता हूं। निर्भर चर को रैंक किया गया है, स्वतंत्र चर नहीं है। जो मैं कल्पना करना चाहता हूं वह वास्तविक ढलान की तुलना में सामान्य प्रवृत्ति है, इसलिए मैंने स्वतंत्र …

3
इकाई गेंद से एन नमूनों की उत्पत्ति के लिए निकटतम निकटतम बिंदु के लिए सूत्र की व्याख्या
में सांख्यिकीय लर्निंग के तत्वों , एक समस्या उच्च आयामी रिक्त स्थान का k- nn साथ प्रकाश डाला मुद्दों के लिए शुरू की है। कर रहे हैं डेटा बिंदुओं कि समान रूप से एक में वितरित कर रहे आयामी इकाई गेंद।पीNNNppp मूल से निकटतम डेटा बिंदु की औसत दूरी अभिव्यक्ति …

4
सुदृढीकरण सीखने पर पाठ्यपुस्तक
मैं सुदृढीकरण सीखने में एक पाठ्यपुस्तक / व्याख्यान नोट्स की तलाश कर रहा हूं। मैं "सांख्यिकीय शिक्षा का परिचय" का शौकीन हूं , लेकिन दुर्भाग्य से वे इस विषय को कवर नहीं करते हैं। मुझे पता है कि सटन और बार्टो की एक पुस्तक एक मानक संदर्भ है, और शायद …

2
पैनल डेटा के लिए मशीन लर्निंग एल्गोरिदम
इस सवाल में - क्या निर्णय पेड़ों के निर्माण के लिए एक विधि है जो संरचित / पदानुक्रमित / बहुस्तरीय भविष्यवक्ताओं का ध्यान रखती है? - वे पेड़ों के लिए एक पैनल डेटा विधि का उल्लेख करते हैं। क्या वेक्टर मशीनों और तंत्रिका नेटवर्क के समर्थन के लिए विशिष्ट पैनल …

2
कई रैखिक प्रतिगमन में पी-मूल्य की समझ
कई रैखिक प्रतिगमन विश्लेषण के पी-मूल्य के बारे में, मिनिटैब की वेबसाइट से परिचय नीचे दिखाया गया है। प्रत्येक पद के लिए p- मान शून्य परिकल्पना का परीक्षण करता है कि गुणांक शून्य के बराबर है (कोई प्रभाव नहीं)। एक कम पी-मूल्य (<0.05) इंगित करता है कि आप अशक्त परिकल्पना …

2
एक शोर साइन लहर के लिए संभावना वितरण
मैं कुछ माप त्रुटि होने पर एक दोलन समारोह से नमूना बिंदुओं की संभावना वितरण की विश्लेषणात्मक रूप से गणना करने के लिए देख रहा हूं। मैंने पहले ही "शोर के बिना" भाग के लिए संभाव्यता वितरण की गणना कर ली है (मैं इसे अंत में डालूंगा), लेकिन मैं यह …

2
दो रैंकिंग एल्गोरिदम की तुलना कैसे करें?
मैं दो रैंकिंग एल्गोरिदम की तुलना करना चाहता हूं। इन एल्गोरिदम में, ग्राहक अपनी खोज में कुछ शर्तों को निर्दिष्ट करता है। क्लाइंट की आवश्यकताओं के अनुसार, इन एल्गोरिथ्म को डेटा बेस में प्रत्येक आइटम के लिए एक अंक प्रदान करना चाहिए और उच्चतम स्कोर के साथ आइटम पुनर्प्राप्त करना …

5
रिज और LASSO मानदंड
यह पोस्ट इस प्रकार है: विकर्ण में स्थिरांक जोड़कर रिज अनुमान ओएलएस से बेहतर क्यों हो जाता है? यहाँ मेरा सवाल है: जहाँ तक मुझे पता है, रिज नियमितीकरण एक -norm (euclidean दूरी) का उपयोग करता है । लेकिन हम इस आदर्श के वर्ग का उपयोग क्यों करते हैं? ( …

2
कई-स्तरीय कारक वाले मॉडल को फिट करने के लिए आर को एक लंबा समय क्यों लगता है?
मैं एक मॉडल को कई स्तरों के साथ फिट करता हूं और उस मॉडल को फिट करने के लिए आर को वास्तव में लंबा समय लगता है। ऐसा क्यों है? उदाहरण के लिए, यदि मैं खिलाड़ियों के वेतन की भविष्यवाणी करने के लिए एक प्रतिगमन फिट बैठता हूं, और सभी …

1
क्या प्रत्येक अर्ध-सकारात्मक निश्चित मैट्रिक्स एक सहसंयोजक मैट्रिक्स के अनुरूप है?
यह सर्वविदित है कि एक सहसंयोजक मैट्रिक्स को अर्ध-सकारात्मक निश्चित होना चाहिए, हालांकि, क्या यह सच है? यही है, क्या प्रत्येक अर्ध-सकारात्मक निश्चित मैट्रिक्स एक सहसंयोजक मैट्रिक्स के अनुरूप है?

4
"वक्रता" का क्या अर्थ है?
जहां तक ​​मैं बता सकता हूं, वक्रता को अस्पष्ट रूप से परिभाषित किया गया है , लेकिन इसका अर्थ है नॉनलाइनियर । क्या वो सही है? या क्या वक्रता की एक अलग परिभाषा है?

1
दो पारेटो वितरण को जोड़ने में क्या वितरण होता है
मैं सोच रहा हूं कि फॉर्म दो (या अधिक) प्रकार-एक परेतो वितरण को जोड़ने में क्या वितरण परिणाम है । प्रायोगिक तौर पर, यह दो-मोड पावर-लॉ की तरह दिखता है, अल्फ़ाज़ के अंतर के लिए विषम।एक्स- αएक्स-αx^{-\alpha}

1
बहाव के साथ श्रृंखला और प्रवृत्ति के साथ श्रृंखला के बीच अंतर
बहाव के साथ एक श्रृंखला को रूप में तैयार किया जा सकता है, जहां बहाव (स्थिर) और । yt=c+ϕyt−1+εtyt=c+ϕyt−1+εty_t = c + \phi y_{t-1} + \varepsilon_tcccϕ=1ϕ=1\phi=1 ट्रेंड के साथ एक श्रृंखला को रूप में तैयार किया जा सकता है, जहां बहाव (स्थिर) है, नियतात्मक समय की प्रवृत्ति है और ।yt=c+δt+ϕyt−1+εtyt=c+δt+ϕyt−1+εty_t …

1
संभावना अनुपात परीक्षण के लिए नियमितता की स्थिति क्या है
क्या कोई मुझे बता सकता है कि लिक्लिऐलिटी रेशियो टेस्ट के स्पर्शोन्मुख वितरण के लिए नियमितता की स्थिति क्या है? हर जगह मैं देखता हूं, यह 'नियमित परिस्थितियों के तहत' या 'संभाव्य नियमितताओं के तहत' लिखा जाता है। क्या स्थितियाँ ठीक हैं? यह कि पहले और दूसरे लॉग-अप की संभावनाएं …

2
एक सामान्य और एक सतत यादृच्छिक चर के बीच सहयोग की गैर-पैरामीट्रिक माप
मैं समस्या को यहाँ फेंक रहा हूँ जैसा कि मैंने प्राप्त किया। मेरे पास दो यादृच्छिक चर हैं। जिनमें से एक निरंतर (Y) है और दूसरा वह जो असतत है और उसे ordinal (X) के रूप में जाना जाएगा । मैंने क्वेरी के साथ प्राप्त किए गए प्लॉट के नीचे …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.