सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
कौन सा कर्नेल विधि सर्वोत्तम संभावना आउटपुट देता है?
हाल ही में मैंने डिफ़ॉल्ट घटनाओं की संभावनाओं का अनुमान लगाने के लिए एसवीएम-आउटपुट के प्लैट की स्केलिंग का उपयोग किया है। अधिक प्रत्यक्ष विकल्प "कर्नेल लॉजिस्टिक रिग्रेशन" (KLR) और संबंधित "आयात वेक्टर मशीन" प्रतीत होते हैं। क्या कोई बता सकता है कि संभाव्यता-आउटपुट देने वाली कौन सी कर्नेल विधि …

4
मैं आर में शून्य-फुलाया पैरामीटर के घनत्व का अनुमान कैसे लगा सकता हूं?
मेरे पास बहुत सारे शून्य के साथ एक डेटा सेट है जो इस तरह दिखता है: set.seed(1) x <- c(rlnorm(100),rep(0,50)) hist(x,probability=TRUE,breaks = 25) मैं इसके घनत्व के लिए एक रेखा खींचना चाहूंगा, लेकिन density()फ़ंक्शन एक चलती हुई खिड़की का उपयोग करता है जो एक्स के नकारात्मक मूल्यों की गणना करता …
10 r  probability  kde 

5
अनुभवजन्य डेटा से यादृच्छिक बहुभिन्नरूपी मान उत्पन्न करें
मैं आंशिक रूप से सहसंबद्ध रिटर्न के साथ कई संपत्तियों के मूल्यांकन के लिए मोंटे कार्लो फ़ंक्शन पर काम कर रहा हूं। वर्तमान में, मैं सिर्फ rmvnorm()आर में फ़ंक्शन के लिए एक सहसंयोजक मैट्रिक्स उत्पन्न करता हूं और उत्पन्न करता हूं (यादृच्छिक मूल्यों को सहसंबद्ध बनाता है ।) हालांकि, किसी …
10 mcmc  monte-carlo  pdf 

3
घातीय मॉडल का अनुमान
एक घातीय मॉडल समीकरण का अनुसरण करके वर्णित मॉडल है: yमैं^= β0⋅ ईβ1एक्स1 मैं+ … + Βकएक्सk iyमैं^=β0⋅इβ1एक्स1मैं+...+βकएक्सकमैं\hat{y_{i}}=\beta_{0}\cdot e^{\beta_{1}x_{1i}+\ldots+\beta_{k}x_{ki}} इस तरह के मॉडल का अनुमान लगाने के लिए उपयोग किया जाने वाला सबसे आम दृष्टिकोण रैखिककरण है, जिसे दोनों पक्षों के लघुगणकों की गणना करके आसानी से किया जा सकता …

3
डेटामाइनिंग के लिए कारक स्तरों के संयोजन के लिए आर पैकेज?
आश्चर्य है कि अगर किसी ने आर में एक पैकेज / फ़ंक्शन को चलाया है जो एक कारक के स्तर को मिलाएगा जिसका कारक के सभी स्तरों का अनुपात कुछ सीमा से कम है? विशेष रूप से, डेटा तैयार करने के पहले चरणों में से एक, मैं आचरण करता हूं …

2
पीएलएस में प्रतिगमन गुणांक पर विश्वास अंतराल की गणना कैसे करें?
की अंतर्निहित मॉडल PLS है कि किसी दिए गए मैट्रिक्स एक्स और एन वेक्टर y से संबंधित हैं एक्स = टी पी ' + ई , y = टी क्यू ' + च , जहां टी एक अव्यक्त है n × कश्मीर मैट्रिक्स, और ई , f शोर की शर्तें …

1
आर में, "ग्लमैनेट" एक अवरोधन के लायक है?
मैं R का उपयोग करके एक रैखिक मॉडल फिटिंग कर रहा हूं glmnet। मूल (गैर-नियमित) मॉडल का उपयोग करके फिट lmकिया गया था और इसमें निरंतर शब्द नहीं था (यानी यह फॉर्म में था lm(y~0+x1+x2,data))। glmnetभविष्यवक्ताओं की एक मैट्रिक्स और प्रतिक्रियाओं का एक वेक्टर लेता है। मैं glmnetप्रलेखन पढ़ रहा …
10 r  regression  lasso 

3
चंचल समय श्रृंखला प्रतिगमन के बारे में सीखने के लिए संसाधन
"स्पुरियस रिग्रेशन" (समय श्रृंखला के संदर्भ में) और यूनिट रूट टेस्ट जैसे संबद्ध शब्द कुछ ऐसे हैं, जिनके बारे में मैंने बहुत कुछ सुना है, लेकिन कभी समझ में नहीं आया। क्यों / कब, सहज रूप से, ऐसा होता है? (मेरा मानना ​​है कि जब आपकी दो समय की श्रृंखला …

1
जीएलएस और एसयूआर के बीच अंतर
मैं कुछ सामान्यीकृत वर्गों (जीएलएस) के बारे में पढ़ रहा हूं और इसे मेरी बुनियादी अर्थमितीय पृष्ठभूमि में वापस लाने की कोशिश कर रहा हूं। मुझे धीरे-धीरे असंबंधित प्रतिगमन (एसयूआर) का उपयोग करके ग्रेड स्कूल में याद आता है जो जीएलएस के समान लगता है। एक कागज जिस पर मैंने …

4
सांख्यिकीय मॉडलिंग के साथ आरंभ करने के लिए टिप्स और ट्रिक्स?
मैं डेटा माइनिंग के क्षेत्र में काम करता हूं और आंकड़ों में बहुत कम औपचारिक स्कूली शिक्षा मिली है। हाल ही में मैंने बहुत से काम पढ़े हैं जो सीखने और खनन के लिए बायेसियन प्रतिमानों पर केंद्रित हैं, जो मुझे बहुत दिलचस्प लगते हैं। मेरा सवाल है (कई हिस्सों …

2
वितरणों की समानता के लिए ची-स्क्वायर परीक्षण: इसे कितने शून्य सहन करते हैं?
मैं म्यूटेंट के दो समूहों की तुलना कर रहा हूं, जिनमें से प्रत्येक में 21 विभिन्न फेनोटाइप में से केवल एक हो सकता है। मैं यह देखना चाहूंगा कि क्या इन परिणामों का वितरण दो समूहों के बीच समान है। मैंने एक ऑनलाइन परीक्षण पाया जो "वितरणों की समानता के …

1
R से C ++ (अंततः Rcpp के साथ) का अनुवाद करें [बंद]
बन्द है। यह सवाल ऑफ टॉपिक है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि यह क्रॉस मान्य के लिए विषय पर हो । 2 साल पहले बंद हुआ । मैं Rcpp का उपयोग करना सीखना चाहूंगा …
10 r  c++ 

1
क्लस्टर विश्लेषण के बाद भेदभाव विश्लेषण
K- साधनों जैसे क्लस्टरिंग एल्गोरिदम के परिणामों पर डिस्क्रिमिनेटल एनालिसिस (DA) का उपयोग करने के लिए औचित्य, यदि कोई हो, जैसा कि मैं समय-समय पर साहित्य में देखता हूं (मूल रूप से मानसिक विकारों के नैदानिक ​​उपप्रकार पर)? यह आम तौर पर क्लस्टर निर्माण के दौरान उपयोग किए जाने वाले …

3
लॉजिस्टिक रिग्रेशन (SPSS) में गैर-बाइनरी श्रेणीबद्ध चर से कैसे निपटें
मुझे बहुत सारे स्वतंत्र चर के साथ बाइनरी लॉजिस्टिक रिग्रेशन करना है। उनमें से ज्यादातर बाइनरी हैं, लेकिन कुछ वैरिएबल चर में दो से अधिक स्तर हैं। ऐसे चरों से निपटने का सबसे अच्छा तरीका क्या है? उदाहरण के लिए, तीन संभावित मूल्यों के साथ एक चर के लिए, मुझे …

2
दो वितरणों के अनुदैर्ध्य तुलना
मेरे पास छह महीने के अंतराल पर चार बार 2500 लोगों को दिए गए रक्त परीक्षण के परीक्षा परिणाम हैं। परिणाम मुख्य रूप से प्रतिरक्षा प्रतिक्रिया के दो उपायों से मिलकर बनता है - एक निश्चित तपेदिक एंटीजन की उपस्थिति में, एक अनुपस्थिति में। वर्तमान में, प्रत्येक परीक्षण एंटीजन प्रतिक्रिया …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.