सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

3
रैखिक प्रतिगमन निष्पादित करें, लेकिन कुछ विशेष डेटा बिंदुओं के माध्यम से जाने के लिए समाधान को मजबूर करें
मुझे पता है कि बिंदुओं के एक सेट पर एक रेखीय प्रतिगमन कैसे करें। यही है, मुझे पता है कि मेरी पसंद के बहुपद को किसी दिए गए डेटा सेट (एलएसई अर्थ में) में कैसे फिट किया जाए। हालांकि, जो मुझे नहीं पता है, वह यह है कि अपने समाधान …

2
दो आश्रित बहुभिन्नरूपी सामान्य यादृच्छिक चर का रैखिक संयोजन
मान लें कि हमारे पास यादृच्छिक चर के दो वैक्टर हैं, दोनों सामान्य हैं, अर्थात, और । हम उनके रैखिक संयोजन के वितरण में रुचि रखते हैं , जहां और मैट्रीस हैं, एक वेक्टर है। यदि और स्वतंत्र हैं, तो । प्रश्न आश्रित मामले में है, यह मानते हुए कि …

2
घटना-दर अनुपात की व्याख्या
इसलिए, मैं एक यादृच्छिक प्रभाव नकारात्मक-द्विपद मॉडल फिट करना चाहता हूं। इस तरह के एक मॉडल के लिए STATA घातांक गुणांक का उत्पादन कर सकता है। सहायता फ़ाइल के अनुसार ऐसे गुणांक को घटना-दर अनुपात के रूप में व्याख्या किया जा सकता है। दुर्भाग्य से मैं एक देशी अंग्रेजी बोलने …

3
रैंडम फ़ॉरेस्ट क्लासिफ़ायर के लिए इष्टतम पैरामीटर क्या होना चाहिए?
वर्तमान में मैं एक द्विआधारी वर्गीकरण समस्या के लिए MATLAB पर आरएफ टूलबॉक्स का उपयोग कर रहा हूं डेटा सेट: 50000 नमूने और 250 से अधिक विशेषताएं तो पेड़ों को उगाने के लिए प्रत्येक विभाजन पर पेड़ों की संख्या और बेतरतीब ढंग से चुनी गई विशेषता क्या होनी चाहिए? क्या …

5
क्लस्टरिंग (k- साधन, या अन्यथा) न्यूनतम क्लस्टर आकार की बाधा के साथ
मुझे क्लस्टर (WSS) के समूह-योग को कम करने के लिए क्लस्टर्स में इकाइयों को क्लस्टर करने की आवश्यकता है , लेकिन मुझे यह सुनिश्चित करने की आवश्यकता है कि प्रत्येक क्लस्टर में कम से कम इकाइयां हों। किसी भी विचार अगर आर के क्लस्टरिंग कार्यों में से कोई एक न्यूनतम …
14 r  clustering 

2
R में कॉक्सफ के "कॉफ" और "एक्सप" (कॉफ) के आउटपुट में क्या अंतर है?
मैं यह समझने की कोशिश कर रहा हूं कि वास्तव में "कॉफ" और "(एक्सप) कॉफ" का उत्पादन कॉक्सफ संकेत क्या करता है। ऐसा लगता है कि "(एक्सप) कॉफ" कमांड में दिए गए समूह के अनुसार मॉडल में पहले चर की तुलना है। "कॉफ" और "एक्‍स (एक्सप) कॉफ" के मूल्यों पर …

3
OLS BLUE है। लेकिन क्या होगा अगर मुझे निष्पक्षता और रैखिकता की परवाह नहीं है?
गॉस-मार्कोव प्रमेय हमें बताता है कि ओएलएस अनुमानक रैखिक पुनरुत्पादक मॉडल के लिए सबसे अच्छा रैखिक निष्पक्ष अनुमानक है। लेकिन मान लीजिए कि मैं रैखिकता और निष्पक्षता की परवाह नहीं करता। फिर क्या रेखीय प्रतिगमन मॉडल के लिए कुछ अन्य (संभव nonlinear / पक्षपाती) अनुमानक है जो गॉस-मार्कोव मान्यताओं या …

6
रैखिक प्रतिगमन जब वाई बंधे और असतत है
सवाल सीधा है: क्या वाई बाउंडेड और असतत होने पर रैखिक प्रतिगमन का उपयोग करना उचित है (उदाहरण के लिए टेस्ट स्कोर 1 ~ 100, कुछ पूर्व-निर्धारित रैंकिंग 1 ~ 17)? इस मामले में, क्या रैखिक प्रतिगमन का उपयोग करना "अच्छा नहीं" है, या इसका उपयोग करना पूरी तरह से …

5
हमें वैकल्पिक परिकल्पना की आवश्यकता क्यों है?
जब हम परीक्षण करते हैं तो हम दो परिणामों के साथ समाप्त होते हैं। 1) हम अशक्त परिकल्पना को अस्वीकार करते हैं 2) हम अशक्त परिकल्पना को अस्वीकार करने में विफल हैं। हम वैकल्पिक परिकल्पना को स्वीकार करने के बारे में बात नहीं करते हैं। यदि हम वैकल्पिक परिकल्पना को …

2
गामा वितरण के लघुगणक का अपेक्षित मूल्य क्या है?
यदि का अपेक्षित मान , तो का अपेक्षित मान क्या है ? क्या इसकी गणना विश्लेषणात्मक रूप से की जा सकती है?Gamma(α,β)Gamma(α,β)\mathsf{Gamma}(\alpha, \beta)αβαβ\frac{\alpha}{\beta}log(Gamma(α,β))log⁡(Gamma(α,β))\log(\mathsf{Gamma}(\alpha, \beta)) मेरे द्वारा उपयोग किया जा रहा परिमाप आकार-दर है।

3
तंत्रिका नेटवर्क को सुविधा चयन / इंजीनियरिंग की आवश्यकता क्यों है?
विशेष रूप से कागल प्रतियोगिताओं के संदर्भ में मैंने देखा है कि मॉडल का प्रदर्शन फीचर चयन / इंजीनियरिंग के बारे में है। जबकि मैं पूरी तरह से समझ सकता हूं कि अधिक परंपरागत / पुराने-स्कूल एमएल एल्गोरिदम से निपटने के दौरान ऐसा क्यों होता है, मैं यह नहीं देखता …

2
बीटा रिग्रेशन में लॉगिट लिंक का उपयोग क्यों करें?
हाल ही में, मैं एक परिणाम के लिए एक बीटा प्रतिगमन मॉडल को लागू करने में रुचि रखता हूं, जो एक अनुपात है। ध्यान दें कि यह परिणाम एक द्विपद संदर्भ में फिट नहीं होगा, क्योंकि इस संदर्भ में असतत "सफलता" की कोई सार्थक अवधारणा नहीं है। वास्तव में, परिणाम …

1
गहन क्यू लर्निंग में एपिसोड और एपोक के बीच अंतर क्या है?
मैं प्रसिद्ध पेपर "प्ले अटारी विथ डीप रिनफोर्स लर्निंग" ( पीडीएफ ) को समझने की कोशिश कर रहा हूं । मैं एक युग और प्रकरण के बीच के अंतर के बारे में स्पष्ट नहीं हूं । एल्गोरिथ्म , बाहरी लूप एपिसोड से अधिक है , जबकि आकृति में एक्स-एक्सिस को …

2
प्रशिक्षण / सत्यापन / परीक्षण सेट के संदर्भ में के-गुना क्रॉस सत्यापन कैसे फिट होता है?
मेरा मुख्य प्रश्न यह समझने की कोशिश करना है कि प्रशिक्षण / सत्यापन / परीक्षण सेट (यदि यह इस तरह के संदर्भ में बिल्कुल फिट बैठता है) के संदर्भ में k- गुना क्रॉस-वैलिडेशन कैसे फिट बैठता है। आमतौर पर, लोग डेटा को एक प्रशिक्षण, सत्यापन और परीक्षण सेट में विभाजित …

5
क्या प्रतिगमन लागत संदर्भ के संदर्भ में समझ में आता है?
क्या प्रति-प्रवेश लागत प्रतिगमन के संदर्भ में समझ में आता है (वर्गीकरण के विपरीत)? यदि हां, तो आप TensorFlow के माध्यम से एक खिलौना उदाहरण दे सकते हैं? यदि नहीं, तो क्यों नहीं? मैं माइकल नील्सन द्वारा न्यूरल नेटवर्क्स और डीप लर्निंग में क्रॉस-एंट्रोपी के बारे में पढ़ रहा था …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.