सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
मशीन सीखने में बेयस त्रुटि क्या है?
http://www.deeplearningbook.org/contents/ml.html पृष्ठ ११६ में नीचे दिए गए त्रुटि के बारे में बताया गया है आदर्श मॉडल एक ऐसा अणु है जो केवल डेटा को उत्पन्न करने वाले वास्तविक संभाव्यता वितरण को जानता है। यहां तक ​​कि ऐसा मॉडल अभी भी कई समस्याओं पर कुछ त्रुटि पैदा करेगा, क्योंकि वितरण में …

3
मशीन लर्निंग में लापता डेटा की समस्या के आसपास काम करने के तरीके
वस्तुतः किसी भी डेटाबेस को हम मशीन लर्निंग एल्गोरिदम का उपयोग करके भविष्यवाणियां करना चाहते हैं, कुछ विशेषताओं के लिए लापता मान पाएंगे। इस समस्या को संबोधित करने के लिए कई दृष्टिकोण हैं, जो उन विशेषताओं को छोड़ देते हैं जब तक कि वे गायब नहीं होते हैं जब तक …

2
सहसंबंधित बर्नौली परीक्षण, बहुभिन्नरूपी बर्नौली वितरण?
मैं एक शोध प्रश्न को सरल कर रहा हूं जो मेरे पास काम पर है। कल्पना कीजिए कि मेरे पास 5 सिक्के हैं और चलो सिर को एक सफलता कहते हैं। ये बहुत सफल होने की संभावना के साथ पक्षपाती सिक्के हैं p = 0.1। अब, यदि सिक्के स्वतंत्र थे, …

1
अंतर एंट्रोपी की व्याख्या कैसे करें?
मैंने हाल ही में एक असतत संभावना वितरण के एन्ट्रापी पर इस लेख को पढ़ा । यह अपेक्षित संख्या बिट्स के रूप में एन्ट्रॉपी के बारे में सोचने का एक अच्छा तरीका बताता है (कम से कम जब आपके एन्ट्रापी परिभाषा में का उपयोग करते हुए ) एक संदेश को …

2
सटीक रिकॉल वक्र में "बेसलाइन" क्या है
मैं सटीक रीकॉल कर्व को समझने की कोशिश कर रहा हूं, मुझे समझ में आ रहा है कि क्या प्रिसिजन और रिकॉल हैं, लेकिन जो चीज मुझे समझ नहीं आ रही है, वह "बेसलाइन" वैल्यू है। मैं इस लिंक को पढ़ रहा था https://classeval.wordpress.com/introduction/introduction-to-the-prepy-recall-plot/ और मुझे आधार रेखा के हिस्से …

3
हमेशा कम से कम एक नीति क्यों होती है जो अन्य सभी नीतियों से बेहतर या समान होती है?
सुदृढीकरण सीखना: एक परिचय। दूसरा संस्करण, प्रगति में , रिचर्ड एस। सटन और एंड्रयू जी। बार्टो (सी) 2012, पीपी 67-68। एक सुदृढीकरण सीखने के कार्य को हल करने का मतलब है, मोटे तौर पर, एक ऐसी नीति खोजना जो लंबे समय से अधिक इनाम प्राप्त करता है। परिमित एमडीपी के …

3
फ्रिस-वॉ प्रमेय की उपयोगिता
मुझे अर्थमिति में फ्रिश वॉ प्रमेय पढ़ाना है, जिसका मैंने अध्ययन नहीं किया है। मैंने इसके पीछे के गणित को समझ लिया है और मुझे आशा है कि यह विचार "एक गुणांक जो आपको एक विशेष गुणांक के लिए कई रैखिक मॉडल से मिलता है, साधारण प्रतिगमन मॉडल के गुणांक …

5
क्या प्रशिक्षण डेटासेट पर केवल खोजपूर्ण डेटा विश्लेषण करना बेहतर है?
मैं डेटासेट पर खोजपूर्ण डेटा विश्लेषण (EDA) कर रहा हूं। फिर मैं एक आश्रित चर की भविष्यवाणी करने के लिए कुछ सुविधाओं का चयन करूंगा। सवाल यह है कि क्या मुझे अपने प्रशिक्षण डेटासेट पर EDA करना चाहिए? या क्या मुझे प्रशिक्षण और परीक्षण डेटासेट में शामिल होना चाहिए, फिर …

2
प्रायिकता अनुमानों के साथ बार-बार 10-गुना क्रॉस सत्यापन के लिए औसत आरओसी
मैं मशीन लर्निंग एल्गोरिदम का उपयोग करके लगभग 10,000 मामलों पर 10 गुना क्रॉस क्रॉस सत्यापन दोहराया (10 बार) का उपयोग करने की योजना बना रहा हूं। हर बार पुनरावृत्ति अलग यादृच्छिक बीज के साथ की जाएगी। इस प्रक्रिया में मैं प्रत्येक मामले के लिए संभाव्यता अनुमान के 10 उदाहरण …
15 roc 

1
आकस्मिक पैरामीटर समस्या
मैं हमेशा आकस्मिक पैरामीटर समस्या का सही सार पाने के लिए संघर्ष करता हूं। मैंने कई अवसरों में पढ़ा कि नॉनलाइनर पैनल डेटा मॉडल के निश्चित प्रभाव अनुमानक "अच्छी तरह से ज्ञात" आकस्मिक पैरामीटर समस्या के कारण गंभीर रूप से पक्षपाती हो सकते हैं। जब मैं इस समस्या का स्पष्ट …

2
तंत्रिका नेटवर्क में बैच सीखने की विधि में वजन कैसे अपडेट किया जाता है?
क्या कोई मुझे बता सकता है कि मुझे बैच विधि का उपयोग करके एक तंत्रिका नेटवर्क कैसे बनाया जाना चाहिए? मैंने पढ़ा है कि, बैच मोड में, प्रशिक्षण सेट में सभी नमूनों के लिए, हम नेटवर्क में प्रत्येक न्यूरॉन के लिए त्रुटि, डेल्टा और इस तरह से वजन की गणना …

1
जिसमें रैंडम फॉरेस्ट में इंटरेक्शन टर्म्स शामिल हैं
मान लीजिए कि हमारे पास एक प्रतिक्रिया वाई और भविष्यवाणियां X1, ...., Xn हैं। अगर हम X1, ...., Xn के रैखिक मॉडल के माध्यम से Y को फिट करने की कोशिश करते थे, और यह सिर्फ इतना हुआ कि Y और X1 के बीच का वास्तविक संबंध, ..., Xn रैखिक …

1
"लक्षित अधिकतम संभावना उम्मीद" क्या है?
मैं मार्क वैन डेर लान के कुछ पत्रों को समझने की कोशिश कर रहा हूं। वह बर्कले में एक सैद्धांतिक सांख्यिकीविद् है जो मशीन सीखने के साथ समस्याओं पर काम करता है। मेरे लिए एक समस्या (गहरी गणित के अलावा) यह है कि वह अक्सर पूरी तरह से अलग शब्दावली …

2
टॉप-एन सटीकता की परिभाषा क्या है?
मैं इमेज वर्गीकरण पर साइंटिफिक पेपर पढ़ रहा हूं। प्रयोगात्मक परिणामों में वे शीर्ष -1 और शीर्ष -5 सटीकता की बात करते हैं, लेकिन मैंने कभी इस शब्द के बारे में नहीं सुना, और न ही इसे Google का उपयोग करके पा सकते हैं। क्या कोई मुझे परिभाषा दे सकता …

4
कौन से चर समझाते हैं कि कौन से पीसीए घटक, और इसके विपरीत?
इस डेटा का उपयोग करना: head(USArrests) nrow(USArrests) मैं पीसीए इस प्रकार कर सकता हूं: plot(USArrests) otherPCA <- princomp(USArrests) मैं नए घटकों को प्राप्त कर सकता हूं otherPCA$scores और विचरण के अनुपात को घटकों द्वारा समझाया गया summary(otherPCA) लेकिन क्या होगा अगर मैं जानना चाहता हूं कि कौन से चर ज्यादातर …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.