सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
Naive Bayes निरंतर चर के साथ कैसे काम करता है?
मेरी (बहुत बुनियादी) समझ के लिए, Naive Bayes ने प्रशिक्षण डेटा में प्रत्येक सुविधा के वर्ग आवृत्तियों के आधार पर संभावनाओं का अनुमान लगाया है। लेकिन यह निरंतर चर की आवृत्ति की गणना कैसे करता है? और भविष्यवाणी करते समय, यह एक नए अवलोकन को कैसे वर्गीकृत करता है जो …

1
क्या 1% जैसी कम घटना दर वाले डेटा के लिए ग्रेडिंग बूस्ट उचित है?
मैं एंटरप्राइज़ माइनर का उपयोग करके लगभग 1% की दर से एक डेटासेट पर ग्रेडिंग बढ़ाने की कोशिश कर रहा हूं, लेकिन यह किसी भी आउटपुट का उत्पादन करने में विफल हो रहा है। मेरा प्रश्न यह है कि चूंकि यह एक निर्णय आधारित पेड़ है, इसलिए क्या इस तरह …

2
सीएनएन जेवियर वजन आरंभीकरण
कुछ ट्यूटोरियल्स में मैंने पाया कि "जेवियर" वेट इनिशियलाइज़ेशन (पेपर: डीप फीडफोरवर्ड न्यूरल नेटवर्क के प्रशिक्षण की कठिनाई को समझना ) न्यूरल नेटवर्क के वज़न को कम करने का एक कारगर तरीका है। पूरी तरह से जुड़ी हुई परतों के लिए उन ट्यूटोरियल में अंगूठे का एक नियम था: वीa …

3
एयूसी की संभावित व्याख्या कैसे प्राप्त करें?
आरओसी वक्र के तहत क्षेत्र की संभावना क्यों है कि एक क्लासिफायर बेतरतीब ढंग से चुनी गई "सकारात्मक" एक (मूल सकारात्मक वर्ग से) की तुलना में एक यादृच्छिक रूप से चुने गए "सकारात्मक" उदाहरण (पुनर्प्राप्त भविष्यवाणियों से) को रैंक करेगा? वास्तविक सकारात्मक और नकारात्मक श्रेणी के वितरण के CDF और …
14 probability  roc  auc 

3
जब
मुझे पता है कि निरंतर चर P[X=x]=0P[X=x]=0P[X=x]=0 । लेकिन मैं कल्पना नहीं कर सकता कि यदि , तो संभावित x की अनंत संख्या है । और यह भी कि उनकी संभावनाएँ असीम रूप से छोटी क्यों हैं?P[X=x]=0P[X=x]=0P[X=x]=0xxx

2
वितरण के माध्यम के बारे में क्षणों के लिए अंतर्ज्ञान?
क्या कोई इस बात पर अंतर्ज्ञान दे सकता है कि प्रायिकता वितरण के उच्चतर क्षण , तीसरे और चौथे क्षण की तरह, और अनुरूप हैं? विशेष रूप से, तीसरी या चौथी शक्ति के लिए उठाए गए माध्य के बारे में विचलन तिरछापन और कुर्तोसिस के माप में तब्दील क्यों होता …

2
जेन्सेन शैनन डायवर्जेंस बनाम कुल्बैक-लीब्लर डाइवर्जेंस?
मुझे पता है कि केएल डाइवर्जेंस सममित नहीं है और इसे कड़ाई से मीट्रिक नहीं माना जा सकता है। यदि ऐसा है, तो जेएस डाइवर्जेंस द्वारा मीट्रिक के लिए आवश्यक गुणों को संतुष्ट करने के लिए इसका उपयोग क्यों किया जाता है? क्या ऐसे परिदृश्य हैं जहां केएल विचलन का …

3
Naive Bayes में लॉग-सम-एक्सप ट्रिक कैसे काम करती है, इसका उदाहरण
मैंने कई स्थानों पर लॉग-सम-एक्सप-ट्रिक के बारे में पढ़ा है (जैसे यहाँ , और यहाँ ) लेकिन कभी भी इसका उदाहरण नहीं देखा है कि इसे विशेष रूप से नैवे बेस क्लासिफायर में कैसे लागू किया जाता है (जैसे असतत सुविधाओं और दो वर्गों के साथ) इस चाल का उपयोग …

2
एक वर्ग एसवीएम क्या है और यह कैसे काम करता है?
मैं अपने शोध कार्य के लिए, एक वर्ग एसवीएम का उपयोग कर रहा था , जिसे स्किट-लर्न में लागू किया गया था । लेकिन मुझे इसकी कोई अच्छी समझ नहीं है। क्या कोई कृपया एक वर्ग SVM का सरल, अच्छा विवरण दे सकता है ?

6
MLE बनाम MAP का आकलन, कब किसका उपयोग करना है?
MLE = अधिकतम संभावना अनुमान एमएपी = अधिकतम एक बादरी MLE सहज / भोली है जिसमें यह केवल पैरामीटर (यानी संभावना फ़ंक्शन) दिए गए अवलोकन की संभावना के साथ शुरू होता है और अवलोकन के साथ पैरामीटर को सर्वश्रेष्ठ उच्चारण खोजने की कोशिश करता है । लेकिन यह पूर्व ज्ञान …

2
लॉजिस्टिक रिग्रेशन में अतिवृद्धि
मैं लॉजिस्टिक रिग्रेशन में अतिविशिष्टता की अवधारणा पर एक हैंडल पाने की कोशिश कर रहा हूं। मैंने पढ़ा है कि जब एक प्रतिक्रिया चर का विचरण द्विपद वितरण से अपेक्षित होता है, तो ओवरडायर्स विचलन होता है। लेकिन अगर एक द्विपद चर केवल दो मान (1/0) हो सकता है, तो …

2
क्रॉस सत्यापन और पैरामीटर अनुकूलन
जब मैं 10-गुना क्रॉस सत्यापन का उपयोग करता हूं तो मेरे पास पैरामीटर अनुकूलन के बारे में एक प्रश्न है। मैं पूछना चाहता हूं कि क्या मापदंडों को हर गुना मॉडल प्रशिक्षण के दौरान ठीक करना चाहिए या नहीं, अर्थात (1) प्रत्येक गुना औसत सटीकता के लिए अनुकूलित मापदंडों में …

1
Bca पद्धति का उपयोग करते हुए विश्वास अंतराल की गणना करते समय आर बूट पैकेज से उत्पन्न "अनुमानित समायोजन 'a' NA" क्यों है?
मेरे पास उन संख्याओं का एक वेक्टर है जो मैंने यहां अपलोड किया है ... (/ कोड / MyData.Rdata) dput का उपयोग करके। मैं bca ci प्राप्त करना चाहूँगा इसलिए मैंने यह कोड लिखा है: my.mean <- function(dat, idx){ return (mean(dat[idx], na.rm = TRUE)) } boot.out<-boot(data=my.data, statistic = my.mean, R=1000) …
14 r  bootstrap 

3
बहुभिन्नरूपी मोड का कम्प्यूटेशनल रूप से कुशल अनुमान
लघु संस्करण: एक बहुआयामी डेटा सेट के मोड का आकलन करने का सबसे कम्प्यूटेशनल तरीका क्या है, जो निरंतर वितरण से नमूना है? लंबा संस्करण: मुझे एक डेटा सेट मिला है, जिसके लिए मुझे मोड का अनुमान लगाना होगा। मोड माध्य या माध्यिका के साथ मेल नहीं खाता। एक नमूना …

2
आर में जीवित रहने की संभावना का अनुमान लगाना
का एक नमूना के आधार पर अस्तित्व बार, मैं समय जीवित रहने की संभावना का अनुमान लगाने के लिए करना चाहते हैं कुछ विशेष के लिए, टी , कापलान-मायर आकलनकर्ता के प्रयोग से। क्या इसमें ऐसा करना संभव है ? कृपया ध्यान दें, टी जरूरी नहीं कि घटना का समय …
14 r  kaplan-meier 

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.