सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
रैखिक प्रतिगमन जब आप केवल
मान लीजिए कि ।Xβ=YXβ=YX\beta =Y हम वास्तव में नहीं जानते हैं, प्रत्येक भविष्यवक्ता के साथ केवल इसका संबंध, ।YYYXtYXtYX^\mathrm{t}Y साधारण न्यूनतम-वर्ग (OLS) समाधान और इसमें कोई समस्या नहीं है।β=(XtX)−1XtYβ=(XtX)−1XtY\beta=(X^\mathrm{t} X)^{-1} X^\mathrm{t}Y लेकिन मान लें कि एकवचन (बहुकोशिकीयता) के पास है, और आपको इष्टतम रिज पैरामीटर का अनुमान लगाने की आवश्यकता …

6
यादृच्छिक वन: परीक्षण सेट में नए कारक स्तरों को कैसे संभालना है?
मैं आर में एक यादृच्छिक वन मॉडल का उपयोग करके भविष्यवाणियां करने की कोशिश कर रहा हूं। हालाँकि, मुझे त्रुटि मिलती है क्योंकि प्रशिक्षण सेट की तुलना में कुछ कारकों का परीक्षण सेट में भिन्न मूल्य है। उदाहरण के लिए, एक कारक Cat_2में मान हैं 34, 68, 76, आदि, परीक्षण …

3
जड़ माध्य चुकता त्रुटि और माध्य बायस विचलन की अवधारणात्मक समझ
मैं रूट मीन स्क्वार्ड एरर (RMSE) और मीन बायस डेविएशन (MBD) की एक वैचारिक समझ हासिल करना चाहूंगा। डेटा की अपनी तुलना के लिए इन उपायों की गणना करने के बाद, मुझे अक्सर यह पता चलता है कि आरएमएसई उच्च है (उदाहरण के लिए, 100 किग्रा), जबकि एमबीडी कम है …

2
प्रश्नावली से क्रमिक डेटा को उचित अंतराल डेटा में कैसे बदलना है?
क्या ऑर्डिनल लेवल डेटा को इंटरवल लेवल में बदलने का कोई सीधा- साधा तरीका है (जैसे कि इसे दूसरे तरीके से करने के लिए हैं)? और एक्सेल या एसपीएसएस में प्रदर्शन कर सकते हैं? डेटा होने के बाद, कहिए: 10 सवाल पैरामीट्रिक परीक्षण उद्देश्यों (सामान्य वितरण, प्रश्न से बाहर गैर …

2
चंक टेस्ट क्या हैं?
मल्टीकोलिनरिटी की उपस्थिति में मॉडल चयन पर एक सवाल के जवाब में , फ्रैंक हार्ले ने सुझाव दिया : सभी चर को मॉडल में रखें, लेकिन प्रतिस्पर्धी चर के प्रभावों के लिए समायोजित एक चर के प्रभाव के लिए परीक्षण न करें ... प्रतिस्पर्धी चर के चंक परीक्षण शक्तिशाली होते …

3
दो आयामी कोलमोगोरोव-स्मिरनोव
मैं यह निर्धारित करने के लिए कुछ दो आयामी Kolmogorov-Smironov परीक्षण चलाना चाहूंगा कि क्या एक दो आयामी वितरण एक संदर्भ के साथ फिट बैठता है। क्या कोई ऐसा पैकेज या एप्लिकेशन है जिसे मैं अपेक्षाकृत सरल फैशन में उपयोग कर सकता हूं? या वहाँ एक अलग एल्गोरिथ्म है जो …

4
EM एल्गोरिथ्म के लिए तेजी से विकल्प
अव्यक्त चर (विशेष रूप से pLSA) के साथ मॉडल सीखने के लिए EM एल्गोरिथ्म के लिए कोई त्वरित विकल्प हैं? मैं गति के पक्ष में सटीक बलिदान के साथ ठीक हूं।

2
महत्व नमूनाकरण द्वारा निर्मित मोंटे कार्लो के अनुमानों पर परिणाम
मैं पिछले एक साल से काफी बारीकी से महत्व के नमूने पर काम कर रहा हूं और कुछ खुले हुए सवाल हैं जिनके साथ मुझे कुछ मदद मिलने की उम्मीद थी। महत्व के नमूने योजनाओं के साथ मेरा व्यावहारिक अनुभव यह रहा है कि वे कभी-कभी शानदार कम-भिन्नता और कम-पूर्वाग्रह …

3
रूबी एक सांख्यिकी कार्यक्षेत्र के रूप में
यह एक प्रश्न भी है जो एक कार्यस्थल के रूप में पायथन से बहुत अधिक संबंधित है और एक सांख्यिकी कार्यक्षेत्र के रूप में उत्कृष्टता प्राप्त करता है । मुझे पता है कि रूबी बनाम पायथन के बारे में बहुत बड़ी चर्चा है लेकिन इस सवाल पर बात नहीं बनती। …
13 r  python  software  ruby 

3
एक-पूंछ और दो-पूंछ परीक्षण के बीच अंतर?
अपने सांख्यिकी पाठ्यक्रम के लिए अध्ययन करते समय, मैं एक-पूंछ और दो-पूंछ वाले परिकल्पना परीक्षणों के बीच अंतर को समझने की कोशिश कर रहा था। विशेष रूप से, एक-पूंछ वाला परीक्षण शून्य को अस्वीकार क्यों करता है जबकि दो-पूंछ वाला एक नहीं करता है? एक उदाहरण:

3
वहाँ एक सूत्र या यादृच्छिक यादृच्छिक के लिए सही sampSize का निर्धारण करने के लिए नियम है?
मैं एक randomForest के साथ खेल रहा हूँ और पाया है कि आम तौर पर sampSize बढ़ने से बेहतर प्रदर्शन होता है। क्या कोई नियम / सूत्र / आदि है जो बताता है कि इष्टतम sampSize क्या होना चाहिए या क्या यह परीक्षण और त्रुटि है? मुझे लगता है कि …
13 r  random-forest 

2
अनुपात का विश्लेषण करें
मेरे पास कई अनुपात वाले डेटासेट हैं जो 1. तक जोड़ते हैं। मुझे इन अनुपातों के परिवर्तन में एक ढाल के साथ दिलचस्पी है (उदाहरण डेटा के लिए नीचे देखें)। gradient <- 1:99 A1 <- gradient * 0.005 A2 <- gradient * 0.004 A3 <- 1 - (A1 + A2) …
13 r  multinomial 



6
मल्टीकोलिनरिटी जब व्यक्तिगत प्रतिगमन महत्वपूर्ण होते हैं, लेकिन वीआईएफ कम होते हैं
मेरे पास 6 चर ( ) हैं जिनका उपयोग मैं भविष्यवाणी करने के लिए कर रहा हूं । अपना डेटा विश्लेषण करते समय, मैंने पहली बार कई रैखिक प्रतिगमन की कोशिश की। इसमें से केवल दो चर महत्वपूर्ण थे। हालाँकि, जब मैंने प्रत्येक चर की व्यक्तिगत रूप से से तुलना …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.