सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

4
प्रतिगमन मापदंडों के लिए आत्मविश्वास अंतराल: बेयसियन बनाम शास्त्रीय
दो सरणियों x और y को देखते हुए, दोनों की लंबाई n, मैं एक मॉडल y = a + b * x फिट करता हूं और ढलान के लिए 95% विश्वास अंतराल की गणना करना चाहता हूं। यह (b - डेल्टा, b + डेल्टा) है जहाँ b सामान्य तरीके से …

1
रिज रिग्रेशन के संदर्भ में लैग्रैन्जियम छूट
"द एलीमेंट ऑफ स्टैटिस्टिकल लर्निंग" (2 थ एड), पी 63 में, लेखक रिज रिग्रेशन के निम्नलिखित दो सूत्र देते हैं: β^ridge=argminβ{∑i=1N(yi−β0−∑j=1pxijβj)2+λ∑j=1pβ2j}β^ridge=argminβ{∑i=1N(yi−β0−∑j=1pxijβj)2+λ∑j=1pβj2} \hat{\beta}^{ridge} = \underset{\beta}{\operatorname{argmin}} \left\{ \sum_{i=1}^N(y_i-\beta_0-\sum_{j=1}^p x_{ij} \beta_j)^2 + \lambda \sum_{j=1}^p \beta_j^2 \right\} तथा β^ridge=argminβ∑i=1N(yi−β0−∑j=1pxijβj)2, subject to ∑j=1pβ2j≤t.β^ridge=argminβ∑i=1N(yi−β0−∑j=1pxijβj)2, subject to ∑j=1pβj2≤t. \hat{\beta}^{ridge} = \underset{\beta}{\operatorname{argmin}} \sum_{i=1}^N(y_i-\beta_0-\sum_{j=1}^p x_{ij} \beta_j)^2 \text{, subject to …

5
मॉडल की कीमतें कैसे?
मैंने मटमैथिक्स स्टैकएक्सचेंज साइट पर यह सवाल पूछा था और यहां पूछने की सिफारिश की गई थी। मैं एक शौक परियोजना पर काम कर रहा हूँ और निम्नलिखित समस्या के साथ कुछ मदद की आवश्यकता होगी। थोड़ा सा संदर्भ मान लीजिए कि सुविधाओं और कीमत के विवरण के साथ वस्तुओं …

2
VIF, हालत सूचकांक और eigenvalues
मैं वर्तमान में अपने डेटासेट में बहुस्तरीयता का आकलन कर रहा हूं। VIF और हालत सूचकांक के दहलीज मूल्य नीचे / ऊपर एक समस्या का सुझाव देते हैं? वीआईएफ: मैंने सुना है कि वीआईएफ एक समस्या है।≥ १०≥10\geq 10 दो समस्या चर हटाने के बाद, वीआईएफ है प्रत्येक चर के …

2
रैंडम नंबर और मल्टीकोर पैकेज
आर में प्रोग्रामिंग करते समय, मैंने कुछ बार मल्टीकोर पैकेज का उपयोग किया है । हालाँकि, मैंने कभी इस बारे में एक बयान नहीं देखा कि यह कैसे यादृच्छिक संख्याओं को संभालता है। जब मैं सी के साथ ओपनएमपी का उपयोग करता हूं, तो मैं एक उचित समानांतर आरएनजी का …

2
गिब्स नमूने में पूर्ण सशर्त कहाँ से आते हैं?
मेट्रोपोलिस-हेस्टिंग्स और गिब्स नमूना जैसे एमसीएमसी एल्गोरिदम संयुक्त पश्च वितरण से नमूने लेने के तरीके हैं। मुझे लगता है कि मैं समझता हूं और महानगर-जल्दबाजी को बहुत आसानी से लागू कर सकता है - आप बस शुरुआती बिंदुओं को किसी भी तरह से चुनते हैं, और 'पैरामीटर को अंतरिक्ष में …
15 bayesian  mcmc  gibbs 

2
Boxplot में औसत के बजाय औसत दिखाएं [बंद]
बन्द है। यह सवाल ऑफ टॉपिक है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि यह क्रॉस मान्य के लिए विषय पर हो । 5 महीने पहले बंद हुआ । जब अजगर मैटप्लाब्लिब के साथ एक बॉक्सप्लॉट …

3
यह निर्धारित करना कि दैनिक विज़िट का उपयोग करके कोई वेबसाइट सक्रिय है या नहीं
प्रसंग: मेरे पास वेबसाइटों का एक समूह है जहां मैं दैनिक आधार पर विज़िट की संख्या रिकॉर्ड करता हूं: W0 = { 30, 34, 28, 30, 16, 13, 8, 4, 0, 5, 2, 2, 1, 2, .. } W1 = { 1, 3, 21, 12, 10, 20, 15, 43, 22, …

4
स्वतंत्रता की समान संख्या के साथ मिश्रित प्रभाव वाले मॉडल की तुलना करना
मेरा एक प्रयोग है जिसे मैं यहाँ सार करने की कोशिश करूँगा। कल्पना कीजिए कि मैं आपके सामने तीन सफेद पत्थरों को उछालता हूं और आपको उनकी स्थिति के बारे में निर्णय लेने के लिए कहता हूं। मैं पत्थरों के गुणों और आपकी प्रतिक्रिया को रिकॉर्ड करता हूं। मैं कई …

4
समय श्रृंखला की सांख्यिकीय समानता
मान लें कि किसी के पास एक समय श्रृंखला है जिसमें से कोई भी कई माप ले सकता है जैसे कि अवधि, अधिकतम, न्यूनतम, औसत आदि और फिर इनका उपयोग करके एक ही गुण के साथ एक मॉडल साइन वेव बना सकते हैं, क्या कोई सांख्यिकीय दृष्टिकोण है जो उपयोग …

3
क्या आप में से कुछ लोग अपने सांख्यिकीय कार्य को दूसरों के साथ संचालित करने और साझा करने के लिए Google डॉक्स स्प्रेडशीट का उपयोग करते हैं?
मुझे पता है कि आपमें से ज्यादातर को लगता है कि Google डॉक्स अभी भी एक आदिम उपकरण है। यह कोई मटलब या आर नहीं है और एक्सेल भी नहीं है। फिर भी, मैं इस वेब आधारित सॉफ्टवेयर की शक्ति पर चकित हूं जो केवल एक ब्राउज़र की ऑपरेटिंग क्षमता …

10
डेटा-माइनिंग सॉफ्टवेयर टूल का एक सर्वेक्षण
यद्यपि मुझे एक इंजीनियर के रूप में प्रशिक्षित किया गया था, लेकिन मुझे लगता है कि मैं डेटा खनन में अधिक दिलचस्पी ले रहा हूं। अभी मैं आगे क्षेत्र की जांच करने की कोशिश कर रहा हूं। विशेष रूप से, मैं सॉफ्टवेयर टूल्स की विभिन्न श्रेणियों को समझना चाहूंगा जो …

5
एक बहुत अच्छा डेटा रेखांकन दिखाने के लिए
मैं एक ऐसी परियोजना पर काम कर रहा हूं जिसमें आवास डेटा के लिए 14 चर और 345,000 अवलोकन शामिल हैं (वर्ष निर्मित, वर्ग फुटेज, मूल्य बेचे, काउंटी का निवास, आदि)। मैं अच्छी ग्राफिकल तकनीकों और आर लाइब्रेरीज़ को खोजने की कोशिश कर रहा हूँ, जिनमें अच्छी प्लॉटिंग तकनीकें हैं। …

4
मेटा-विश्लेषण के अच्छे परिचयात्मक उपचार की तलाश है
एक (गैर-सांख्यिकीविद) सहकर्मी ने मेडिकल पत्रिकाओं के लिए समीक्षा किए गए पत्रों में मेटा-विश्लेषणों का सामना कर रहा है और एक अच्छे परिचयात्मक स्तर के उपचार की तलाश कर रहा है ताकि वह खुद को शिक्षित कर सके। कोई सिफारिशें? पसंदीदा? किताबें, मोनोग्राफ, गैर-तकनीकी सर्वेक्षण लेख सभी ठीक होंगे। (हां, …

5
छोटे नमूना नैदानिक ​​अध्ययन में मशीन सीखने की तकनीक का अनुप्रयोग
जब आप एक वर्गीकरण संदर्भ में दिलचस्प भविष्यवक्ताओं को अलग करना चाहते हैं, तो छोटे नमूना नैदानिक ​​अध्ययनों में रैंडम फ़ॉरेस्ट या दंडित प्रतिगमन (एल 1 या एल 2 दंड के साथ, या एक संयोजन) जैसी मशीन सीखने की तकनीक को लागू करने के बारे में आप क्या सोचते हैं? …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.