सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
मुलायम-थ्रेसिंग बनाम लासो दंड
मैं संक्षेप में प्रस्तुत करने के लिए क्या मैं अब तक उच्च आयामी डेटा सेट के साथ दंडित मल्टीवेरिएट विश्लेषण में समझा कोशिश कर रहा हूँ, और मैं अभी भी का एक उचित परिभाषा हो रही के माध्यम से संघर्ष नरम थ्रेशोल्डिंग बनाम कमंद (या ) दण्डनीय ठहराए।एल1L1L_1 अधिक सटीक …

5
दो विश्लेषणात्मक तरीकों को दिखाने के लिए कौन से तरीके समान हैं?
मेरे पास दो अलग-अलग विश्लेषणात्मक तरीके हैं जो एक मैट्रिक्स में किसी विशेष अणु की एकाग्रता को माप सकते हैं (उदाहरण के लिए पानी में नमक की मात्रा को मापते हैं) दो विधियाँ अलग-अलग हैं, और प्रत्येक में इसकी अपनी त्रुटि है। दो तरीकों को दिखाने के लिए क्या तरीके …

1
क्यूबिक स्प्लिन और दंडित स्प्लीन कितने अलग हैं?
मैं विभिन्न प्रतिगमन समस्याओं में splines का उपयोग करने के बारे में बहुत कुछ पढ़ रहा हूं। कुछ किताबें (उदाहरण के लिए हॉजेस रिचली पैरामैट्रिअज़ लिनियर मॉडल्स ) दंडित विभाजन की सलाह देती हैं। अन्य (उदाहरण के लिए, हार्इल रिग्रेशन मॉडलिंग रणनीतियाँ ) प्रतिबंधित क्यूबिक स्प्लीन के लिए चुनते हैं। …

1
शब्द "विरल पूर्व" (FBProphet Paper) का क्या अर्थ है?
"स्केल पर पूर्वानुमान" (FBProphet पूर्वानुमान उपकरण ) पेपर को पढ़ते हुए, देखें https://peerj.com/preprints/3190.pdf ) मैं "विरल पूर्व" शब्द के पार आया था। लेखक स्पष्ट करते हैं कि वे कुछ स्केलर रेट से एक विचलन वेक्टर के मॉडलिंग में इस तरह के "विरल पूर्व" का उपयोग कर रहे थे , जो …

4
हम सिर्फ हाइपर मापदंडों को क्यों नहीं सीखते हैं?
मैं एक बहुत ही लोकप्रिय पेपर " एक्सप्लेनिंग और हार्नेसिंग एडिशनल एग्जामिनेशन " लागू कर रहा था और पेपर में, यह एक प्रतिकूल उद्देश्य फ़ंक्शन को प्रशिक्षित करता है J '' (') = αJ (+) + (1 - α) J' (θ)। यह α को एक हाइपरपरमीटर के रूप में मानता …

2
एक प्रशिक्षण परत में कई फिल्टर प्रशिक्षण के दौरान एक ही पैरामीटर नहीं सीखेंगे?
मैंने जो भी सीखा है, उसके आधार पर, हम अलग-अलग फ़ीचर डिटेक्टरों को सीखने के लिए CNN के कन्वीनर लेयर में कई फिल्टरों का उपयोग करते हैं। लेकिन चूंकि ये फ़िल्टर समान रूप से लागू होते हैं (यानी इनपुट के क्षेत्रों में स्लेज और गुणा), तो क्या वे प्रशिक्षण के …

2
द्वितीय क्रम विभेदन के पीछे अंतर्ज्ञान क्या है?
कभी-कभी एक समय सीरी को स्थिर बनाने के लिए अलग करने की आवश्यकता हो सकती है। हालाँकि मुझे समझ में नहीं आता है कि कैसे दूसरे क्रम के विभेदक इसे स्थिर बनाने में मदद कर सकते हैं जब प्रथम-क्रम विभेदक पर्याप्त नहीं है। क्या आप दूसरे क्रम विभेदक और उन …

1
आर में प्रत्येक भविष्यवाणी के लिए प्रतिगमन (यादृच्छिक जंगलों / XGBoost के साथ) में आत्मविश्वास स्कोर की गणना कैसे करें?
क्या एक अनुमानित स्कोर प्राप्त करने का एक तरीका है (हम रैंडम फ़ॉरेस्ट या चरम ग्रेड बूस्टिंग (XGBoost) जैसे एल्गोरिदम का उपयोग करते समय प्रत्येक अनुमानित मूल्य के लिए इसे आत्मविश्वास मूल्य या संभावना भी कह सकते हैं)। मान लें कि यह आत्मविश्वास स्कोर 0 से 1 तक होगा और …

3
एक-गर्म एन्कोडिंग बनाम डमी एन्कोडिंग के साथ समस्याएं
मैं इस तथ्य से अवगत हूं कि कश्मीर स्तरों के साथ श्रेणीबद्ध चर को डमी एन्कोडिंग में k-1 चर के साथ एन्कोड किया जाना चाहिए (इसी तरह बहु-मूल्यवान श्रेणीबद्ध चर के लिए)। मैं सोच रहा था कि अलग-अलग रिग्रेशन के तरीकों के लिए डमी एन्कोडिंग के ऊपर एक हॉट-इनकोडिंग (यानी …

2
लैस्सो / रिज रिग्रेशन के लिए मानकीकरण बनाम सामान्यीकरण
मुझे पता है कि रिज और लास्सो रिग्रेशन के लिए सुविधाओं का मानकीकरण करना आम बात है, हालांकि, क्या इन रिग्रेशन विधियों के लिए जेड-स्कोर मानकीकरण के विकल्प के रूप में (0,1) पैमाने पर सुविधाओं को सामान्य करने के लिए यह अधिक व्यावहारिक होगा?

2
बूटस्ट्रैपिंग के पेशेवरों और विपक्ष
मैंने बस बूटस्ट्रैपिंग की अवधारणा के बारे में सीखा है, और एक भोली सवाल मन में आया: यदि हम हमेशा अपने डेटा के कई बूटस्ट्रैप नमूने उत्पन्न कर सकते हैं, तो अधिक "वास्तविक" डेटा प्राप्त करने के लिए परेशान क्यों हैं? मुझे लगता है कि मेरे पास एक स्पष्टीकरण है, …

3
CIFAR-10 60% से अधिक नहीं मिल सकता है सटीकता, टेन्सरफ़्लो बैकएंड के साथ केरस [बंद]
बन्द है। यह सवाल ऑफ टॉपिक है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि यह क्रॉस मान्य के लिए विषय पर हो । पिछले साल बंद हुआ । CIFAR-10 डेटासेट पर 15 युगों के बाद प्रशिक्षण …

2
क्या हम अशक्तता परीक्षण में अशक्तता को स्वीकार कर सकते हैं?
साधनों की एक सामान्य टी-टेस्ट में, सामान्य परिकल्पना परीक्षण विधियों का उपयोग करके, हम या तो नल को अस्वीकार करते हैं या अशक्त को अस्वीकार करने में असफल होते हैं लेकिन हम कभी भी शून्य को स्वीकार नहीं करते हैं। इसका एक कारण यह है कि यदि हमें अधिक साक्ष्य …

1
क्या मुझे रैंडम फॉरेस्ट रेजिस्टर या क्लासिफायर चुनना चाहिए?
मैं यादृच्छिक जंगल द्वारा एक बाइनरी लक्ष्य वर्ग के साथ एक डेटासेट फिट करता हूं। अजगर में, मैं इसे या तो randomforestclassifier या randomforestregressor द्वारा कर सकता हूं। मैं सीधे randomforestclassifier से वर्गीकरण प्राप्त कर सकता हूं या पहले randomforestregressor चला सकता हूं और अनुमानित स्कोर (निरंतर मूल्य) का एक …

3
ओआरएस का अनुमानक एआर (1) गुणांक पक्षपाती क्यों है?
मैं यह समझने की कोशिश कर रहा हूं कि ओएलएस एक एआर (1) प्रक्रिया का एक पक्षपाती अनुमानक क्यों देता है। विचारणीय इस मॉडल में, सख्त अतिशयोक्ति का उल्लंघन किया जाता है, यानी और सहसंबद्ध होते हैं, लेकिन और असंबद्ध होते हैं। लेकिन अगर यह सच है, तो निम्न सरल …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.