सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
logloss बनाम गिन्नी / औक
मैंने दो मॉडल (h2o AutoML का उपयोग करके बाइनरी क्लासीफायर) को प्रशिक्षित किया है और मैं उपयोग करने के लिए एक का चयन करना चाहता हूं। मेरे पास निम्नलिखित परिणाम हैं: model_id auc logloss logloss_train logloss_valid gini_train gini_valid DL_grid_1 0.542694 0.287469 0.092717 0.211956 0.872932 0.312975 DL_grid_2 0.543685 0.251431 0.082616 0.186196 …

4
मशीन लर्निंग पाइप लाइन में फ़ीचर सेलेक्शन और हाइपरपैरिमेट ऑप्टिमाइज़ेशन का आदेश कैसे दिया जाना चाहिए?
मेरा उद्देश्य सेंसर संकेतों को वर्गीकृत करना है। मेरे समाधान की अब तक की अवधारणा है: i) कच्चे सिग्नल से इंजीनियरिंग सुविधाएँ ii) राहत के साथ प्रासंगिक सुविधाओं का चयन और क्लस्टरिंग दृष्टिकोण iii) एनएन, रैंडम फ़ॉरेस्ट और एसवीएम लागू करें हालांकि मैं एक दुविधा में फंसा हुआ हूं। Ii) …

1
तंत्रिका नेटवर्क में एक अड़चन परत का क्या मतलब है?
मैं फेसनेट पेपर पढ़ रहा था और परिचय के तीसरे पैराग्राफ में यह कहता है: गहरे नेटवर्क पर आधारित पिछला चेहरा पहचान दृष्टिकोण एक ज्ञात पहचान के सेट पर प्रशिक्षित वर्गीकरण परत का उपयोग करते हैं और फिर प्रशिक्षण में प्रयुक्त पहचान के सेट से परे मान्यता को सामान्य बनाने …

2
क्या हम विभेदक विश्लेषण में स्पष्ट स्वतंत्र चर का उपयोग कर सकते हैं?
विवेचक विश्लेषण में, आश्रित चर श्रेणीगत है, लेकिन क्या मैं रेखीय विभेदक विश्लेषण में स्वतंत्र चर के रूप में कुछ अन्य निरंतर चर के साथ एक श्रेणीगत चर (जैसे आवासीय स्थिति: ग्रामीण, शहरी) का उपयोग कर सकता हूं?

2
स्किटिट-लर्न बूटस्ट्रैप फ़ंक्शन टेस्ट सेट को फिर से क्यों करता है?
मॉडल मूल्यांकन के लिए बूटस्ट्रैपिंग का उपयोग करते समय, मैंने हमेशा सोचा कि आउट-ऑफ-बैग नमूने सीधे परीक्षण सेट के रूप में उपयोग किए जाते थे। हालाँकि, ऐसा प्रतीत नहीं होता है कि हटाए गए डरावने-सीखने केBootstrap दृष्टिकोण के लिए मामला है , जो आउट-ऑफ-द-बैग डेटा सब्मिट से ड्राइंग से परीक्षण …

1
मानकीकृत बेटों को मूल चर में वापस लाना
मुझे पता है कि यह शायद एक बहुत ही सरल प्रश्न है, लेकिन खोज के बाद मुझे वह उत्तर नहीं मिल रहा है जिसकी मुझे तलाश है। मुझे एक समस्या है जहां मुझे बेटों के रिज अनुमानों की गणना करने के लिए चर (रिज रिग्रेशन) चलाने की आवश्यकता है। फिर …

4
यादृच्छिक श्रेणीबद्ध डेटा कैसे उत्पन्न करें?
मान लीजिए कि मेरे पास एक श्रेणीगत चर है जो मान ए, बी, सी और डी ले सकता है मैं 10000 यादृच्छिक डेटा अंक कैसे उत्पन्न कर सकता हूं और प्रत्येक की आवृत्ति के लिए नियंत्रण कर सकता हूं? उदाहरण के लिए: A = 10% B = 20% C = …

2
प्रभाव कार्यों और OLS
मैं यह समझने की कोशिश कर रहा हूं कि कार्य कैसे प्रभावित करते हैं। क्या कोई साधारण OLS प्रतिगमन के संदर्भ में व्याख्या कर सकता है yi=α+β⋅xi+εiyi=α+β⋅xi+εi\begin{equation} y_i = \alpha + \beta \cdot x_i + \varepsilon_i \end{equation} जहाँ मैं लिए प्रभाव कार्य करना चाहता हूँ ।ββ\beta

1
मशीन लर्निंग मॉडल की "क्षमता" क्या है?
मैं कार्ल Doersch द्वारा वैरिएंट ऑटोएन्कोडर्स पर इस ट्यूटोरियल का अध्ययन कर रहा हूं । दूसरे पृष्ठ में यह कहा गया है: इस तरह के सबसे लोकप्रिय फ्रेमवर्क में से एक है वैरिएंट ऑटोकेनोडर [1, 3], इस ट्यूटोरियल का विषय है। इस मॉडल की धारणाएं कमजोर हैं, और बैकप्रोपैजेशन के …

2
अधिकतम औसत विसंगति (दूरी वितरण)
मेरे पास दो डेटा सेट (स्रोत और लक्ष्य डेटा) हैं जो विभिन्न वितरण का पालन करते हैं। मैं MMD का उपयोग कर रहा हूं - जो कि स्रोत और लक्ष्य डेटा के बीच सीमांत वितरण की गणना करने के लिए एक गैर-पैरामीट्रिक दूरी वितरण है। स्रोत डेटा, Xs लक्ष्य डेटा, …

2
कैसे एक प्रतिशत के लिए एक विश्वास अंतराल प्राप्त करने के लिए?
मेरे पास कच्चे डेटा मानों का एक समूह है जो डॉलर की राशि है और मैं उस डेटा के एक प्रतिशत के लिए एक आत्मविश्वास अंतराल खोजना चाहता हूं। क्या इस तरह के विश्वास अंतराल के लिए एक सूत्र है?

2
क्या एक इंस्ट्रूमेंट वेरिएबल इक्वेशन को एक निर्देशित एसाइक्लिक ग्राफ (DAG) के रूप में लिखा जा सकता है?
निर्देशित चक्रीय ग्राफ (DAG) सांख्यिकीय मॉडल में गुणात्मक कारण धारणाओं के कुशल दृश्य प्रतिनिधित्व हैं, लेकिन क्या उनका उपयोग नियमित साधन चर समीकरण (या अन्य समीकरण) प्रस्तुत करने के लिए किया जा सकता है? यदि हां, तो कैसे? यदि नहीं, तो क्यों?

1
L-BFGS कैसे काम करता है?
कागज का उद्देश्य नियमित रूप से लॉग-लाइबिलिटी को अधिकतम करके कुछ मापदंडों का अनुकूलन करना था। फिर वे आंशिक व्युत्पत्ति की गणना करते हैं। और फिर लेखकों का उल्लेख है कि वे एल-बीएफजीएस का उपयोग करके समीकरण का अनुकूलन करते हैं, कई चर (अधिक विवरण नहीं) के चिकनी कार्यों को …

4
मुफ्त सार्वजनिक हित डेटा होस्टिंग? [बन्द है]
बन्द है। यह सवाल ऑफ टॉपिक है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि यह क्रॉस मान्य के लिए विषय पर हो । 4 साल पहले बंद हुआ । मेरे पास http://data.barrycarter.info/ पर कई स्टेशनों के …
14 dataset 

1
वे यहाँ एक गामा वितरण क्यों चुनेंगे?
मेरे पाठ्यक्रम के लिए एक अभ्यास में, हम एक कागले चिकित्सा डेटासेट का उपयोग कर रहे हैं । व्यायाम कहता है: हम अलग-अलग शुल्कों के वितरण को मॉडल करना चाहते हैं और हम वास्तव में उस वितरण के बारे में अपनी अनिश्चितता को पकड़ने में सक्षम होना चाहते हैं ताकि …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.