सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए


2
R में सूत्र y ~ x + 0 क्या वास्तव में गणना करता है?
आर के बजाय formulaसेट के साथ आर में एक रैखिक प्रतिगमन करने के बीच सांख्यिकीय अंतर क्या है ? मैं उन दो अलग-अलग परिणामों की व्याख्या कैसे करूं?y ~ x + 0y ~ x

1
बूटस्ट्रैप पद्धति। क्यों यादृच्छिक प्रतिस्थापन के बजाय "प्रतिस्थापन के साथ" फिर से तैयार करें?
बूटस्ट्रैप विधि ने पिछले वर्षों में एक महान प्रसार देखा है, मैं इसका उपयोग भी बहुत करता हूं, विशेष रूप से क्योंकि पीछे तर्क काफी सहज है। लेकिन यह एक बात है जो मुझे समझ नहीं आ रही है। Efron ने एकल टिप्पणियों को छोड़कर या बेतरतीब ढंग से हटाने …

1
पहचान लिंक के साथ ओएलएस बनाम पॉइसन जीएलएम
मेरे सवाल से सामान्य रूप से पॉइसन रिग्रेशन और जीएलएम की मेरी खराब समझ का पता चलता है। यहाँ मेरा प्रश्न बताने के लिए कुछ नकली डेटा दिए गए हैं: ### some fake data x=c(1:14) y=c(0, 1, 2, 3, 1, 4, 9, 18, 23, 31, 20, 25, 37, 45) कुछ …

2
तंत्रिका नेटवर्क में क्रॉस-एन्ट्रापी लागत फ़ंक्शन
मैं इस ट्यूटोरियल में पाया गया क्रॉस-एन्ट्रापी कॉस्ट फंक्शन देख रहा हूँ : C=−1n∑x[ylna+(1−y)ln(1−a)]C=−1n∑x[yln⁡a+(1−y)ln⁡(1−a)]C = -\frac{1}{n} \sum_x [y \ln a+(1−y)\ln(1−a)] हम वास्तव में क्या समेट रहे हैं? यह निश्चित रूप से, है, से अधिक , लेकिन और साथ परिवर्तन नहीं करते । सब के सब के एक में आदानों हैं …

2
Backpropagation के माध्यम से एक SVM को कैसे प्रशिक्षित करें?
मैं सोच रहा था कि क्या बैकप्रॉपैगैशन का उपयोग करके एक एसवीएम (एक रैखिक कहो, चीजों को आसान बनाने के लिए) को प्रशिक्षित करना संभव था? वर्तमान में, मैं एक रोड ब्लॉक में हूं, क्योंकि मैं केवल क्लासिफायर के आउटपुट को लिखने के बारे में सोच सकता हूं f(x;θ,b)=sgn(θ⋅x−(b+1))=sgn(g(x;θ,b))f(x;θ,b)=sgn(θ⋅x−(b+1))=sgn(g(x;θ,b)) f(\mathbf{x};\theta,b) …

2
सेंसर किए गए डेटा का अनुकरण कैसे करें
मैं सोच रहा हूं कि मैं किस तरह से वेबुल वितरण जीवनकाल के एक नमूने का अनुकरण कर सकता हूं, जिसमें टाइप I दाएं-सेंसर किए गए अवलोकन शामिल हैं। उदाहरण के लिए, n = 3, आकार = 3, स्केल = 1 और सेंसरिंग दर = .15, और सेंसरिंग समय = …

1
स्किकिट बिनोमियल डिविज़न लॉस फंक्शन
यह स्कैडिट ग्रैडिएंटबॉस्टिंग का द्विपद अवमूल्यन हानि कार्य है, def __call__(self, y, pred, sample_weight=None): """Compute the deviance (= 2 * negative log-likelihood). """ # logaddexp(0, v) == log(1.0 + exp(v)) pred = pred.ravel() if sample_weight is None: return -2.0 * np.mean((y * pred) - np.logaddexp(0.0, pred)) else: return (-2.0 / …

3
क्या एक तंत्रिका नेटवर्क एक कार्यात्मक और इसके कार्यात्मक व्युत्पन्न सीख सकता है?
मैं समझता हूं कि तंत्रिका नेटवर्क (एनएन) को कुछ अनुमानों (नेटवर्क और फ़ंक्शन दोनों पर अनुमानित) के तहत दोनों कार्यों और उनके डेरिवेटिव के लिए सार्वभौमिक सन्निकटन माना जा सकता है। वास्तव में, मैंने सरल, अभी तक गैर-तुच्छ कार्यों (जैसे, बहुपद) पर कई परीक्षण किए हैं, और ऐसा लगता है …

1
क्या सपोर्ट वेक्टर मशीन विशेषताओं के बीच सहसंबंध के प्रति संवेदनशील है?
मैं 20 विशेषताओं के आधार पर मामलों (TRUE / FALSE) को वर्गीकृत करने के लिए एक SVM को प्रशिक्षित करना चाहूंगा। मुझे पता है कि उनमें से कुछ विशेषताएँ अत्यधिक सहसंबद्ध हैं। इसलिए मेरा सवाल है: सुविधाओं के बीच एसवीएम सहसंबंध या अतिरेक के प्रति संवेदनशील है? कोई संदर्भ?

1
नोट किए गए बॉक्स भूखंडों की व्याख्या कैसे करें
कुछ EDA करते समय मैंने एक कारक के दो स्तरों के बीच के अंतर को दर्शाने के लिए एक बॉक्स प्लॉट का उपयोग करने का निर्णय लिया। जिस तरह से ggplot ने बॉक्स प्लॉट को प्रस्तुत किया वह संतोषजनक था, लेकिन थोड़ा सरल (नीचे पहला प्लॉट)। जबकि बॉक्स भूखंडों की …

3
मार्कोव श्रृंखला बनाम एचएमएम
मार्कोव श्रृंखला मेरे लिए समझ में आता है, मैं उन्हें वास्तविक जीवन की समस्याओं में संभावित परिवर्तन को मॉडल करने के लिए उपयोग कर सकता हूं। उसके बाद एचएमएम आता है। HMMs को MC की तुलना में कई समस्याओं के मॉडल के लिए अधिक उपयुक्त माना जाता है। हालाँकि, जिन …

2
यादृच्छिक डेटा के साथ महत्वपूर्ण मौसमी भिन्नता देते हुए stl फ़ंक्शन क्यों होता है
मैं stl के साथ निम्नलिखित कोड के साथ साजिश रची (Loess द्वारा समय श्रृंखला के मौसमी अपघटन) समारोह: plot(stl(ts(rnorm(144), frequency=12), s.window="periodic")) यह ऊपर कोड (rnorm फ़ंक्शन) में यादृच्छिक डेटा के साथ साइनफ़िसेंट मौसमी भिन्नता दिखाता है। हर बार इसे चलाने के दौरान साइनफ़िक रूप से भिन्नता देखी जाती है, हालांकि …

1
क्या मैं एक्टिवेशन फंक्शन के रूप में ऑटोएनकोडर में ReLU का उपयोग कर सकता हूं?
तंत्रिका नेटवर्क के साथ एक ऑटोएन्कोडर को लागू करते समय, अधिकांश लोग सिग्माइड को सक्रियण फ़ंक्शन के रूप में उपयोग करेंगे। क्या हम इसके बजाय ReLU का उपयोग कर सकते हैं? (चूँकि ReLU की ऊपरी सीमा की कोई सीमा नहीं है, मूल रूप से इसका मतलब है कि इनपुट छवि …

2
कर सकते हैं वृद्धि जब
अगर β∗=argminβ∥y−Xβ∥22+λ∥β∥1β∗=argminβ‖y−Xβ‖22+λ‖β‖1\beta^*=\mathrm{arg\,min}_{\beta} \|y-X\beta\|^2_2+\lambda\|\beta\|_1 , कर सकते हैं ∥β∗∥2‖β∗‖2\|\beta^*\|_2 वृद्धि λλ\lambda बढ़ता है? मुझे लगता है कि यह संभव है। हालांकि ∥β∗∥1‖β∗‖1\|\beta^*\|_1 बढ़ जाता है जब λλ\lambda (मेरा प्रमाण ) बढ़ता है , तो ∥β∗∥2‖β∗‖2\|\beta^*\|_2 बढ़ सकता है। नीचे दिया गया आंकड़ा एक संभावना दर्शाता है। जब λλ\lambda बढ़ता है, यदि …
11 lasso 

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.