सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
आर में दो बहुपद प्रतिगमन के बीच अंतर के सांख्यिकीय महत्व की तुलना करें
इसलिए सबसे पहले मैंने इस मंच पर कुछ शोध किया, और मुझे पता है कि इसी तरह के प्रश्न पूछे गए हैं, लेकिन वे आमतौर पर ठीक से उत्तर नहीं दिए गए हैं या कभी-कभी उत्तर केवल मेरे लिए समझने के लिए पर्याप्त विस्तृत नहीं हैं। तो इस बार मेरा …

1
आर में ARIMA टाइम सीरीज़ में अनुमानित प्लॉटिंग प्लॉटिंग
इस प्रश्न में एक से अधिक गंभीर गलतफहमी होने की संभावना है, लेकिन इसका मतलब गणनाओं को सही रूप में प्राप्त करना नहीं है, बल्कि समय श्रृंखला के सीखने को ध्यान में रखकर प्रेरित करना है। समय श्रृंखला के आवेदन को समझने की कोशिश में, ऐसा लगता है जैसे कि …

1
कैसे पीसीए eigenvectors नहीं हैं कि वैक्टर के "eigenvalues" (समझाया विचरण का प्रतिशत) पाने के लिए?
मैं समझना चाहता हूं कि कैसे मैं डेटा सेट के विचरण का प्रतिशत प्राप्त कर सकता हूं, पीसीए द्वारा प्रदान किए गए समन्वय स्थान में नहीं, बल्कि (घुमाए हुए) वैक्टरों के थोड़ा अलग सेट के खिलाफ। set.seed(1234) xx <- rnorm(1000) yy <- xx * 0.5 + rnorm(1000, sd = 0.6) …

1
आवधिक डेटा फिट करने के लिए आवधिक विभाजन
इस सवाल के लिए एक टिप्पणी में , उपयोगकर्ता @whuber ने आवधिक डेटा को फिट करने के लिए आवृत्तियों के आवधिक संस्करण का उपयोग करने की संभावना का हवाला दिया। मैं इस पद्धति के बारे में अधिक जानना चाहूंगा, विशेष रूप से समीकरणों को परिभाषित करने वाले समीकरण, और उन्हें …

2
एक ही कक्षा में एक ही नाम दिए जाने से पाँच बच्चों की संभावना
बच्चे के नामकरण मंचों पर, भावी माता-पिता हर समय जेनिफर के अपने डर के कुछ संस्करण दोहराते हैं: "मैं नहीं चाहता कि मेरा बच्चा अपने नाम के साथ कक्षा में 5 में से एक हो।" बात यह है कि कोई भी नाम किसी भी तरह की लोकप्रियता के करीब नहीं …

3
टेस्ट त्रुटि का सीवी का अनुमान वास्तविक परीक्षण त्रुटि को कम क्यों करता है?
यह मेरी समझ है कि परीक्षण त्रुटि का k- गुना क्रॉस-सत्यापन अनुमान आमतौर पर वास्तविक परीक्षण त्रुटि को कम करता है। मैं उलझन में हूं कि ऐसा क्यों है। मैं देखता हूं कि प्रशिक्षण त्रुटि आमतौर पर परीक्षण त्रुटि से कम क्यों होती है - क्योंकि आप मॉडल को उसी …

2
की उम्मीद
चलो , , , और स्वतंत्र हो। की अपेक्षा क्या है ?X1X1X_1X2X2X_2⋯⋯\cdotsXd∼N(0,1)Xd∼N(0,1)X_d \sim \mathcal{N}(0, 1)X41(X21+⋯+X2d)2X14(X12+⋯+Xd2)2\frac{X_1^4}{(X_1^2 + \cdots + X_d^2)^2} यह पता लगाने के लिए आसान है समरूपता द्वारा। लेकिन मुझे नहीं पता कि मैं कैसे । क्या आप कुछ संकेत प्रदान कर सकते हैं?E(X21X21+⋯+X2d)=1dE(X12X12+⋯+Xd2)=1d\mathbb{E}\left(\frac{X_1^2}{X_1^2 + \cdots + X_d^2}\right) = \frac{1}{d}X41(X21+⋯+X2d)2X14(X12+⋯+Xd2)2\frac{X_1^4}{(X_1^2 …

1
N iid सामान्य चर के अधिकतम अनुपात का अपेक्षित मूल्य
मान लीजिए X1,...,XnX1,...,XnX_1,...,X_n से आईआईडी रहे N(μ,σ2)N(μ,σ2)N(\mu,\sigma^2) और जाने X(i)X(i)X_{(i)} निरूपित iii 'से वां सबसे छोटा तत्व X1,...,XnX1,...,XnX_1,...,X_n । में लगातार दो तत्वों के बीच अनुपात की अपेक्षित अधिकतम सीमा को ऊपरी करने में सक्षम व्यक्ति कैसे होगा X(i)X(i)X_{(i)}? अर्थात्, आप एक ऊपरी आधार की गणना कैसे कर सकते हैं: …

5
क्यों एफ बीटा स्कोर बीटा को उसी तरह परिभाषित करता है?
यह F बीटा स्कोर है: Fβ=(1+β2)⋅precision⋅recall(β2⋅precision)+recallFβ=(1+β2)⋅precision⋅recall(β2⋅precision)+reसीएएलएलF_\beta = (1 + \beta^2) \cdot \frac{\mathrm{precision} \cdot \mathrm{recall}}{(\beta^2 \cdot \mathrm{precision}) + \mathrm{recall}} विकिपीडिया लेख में कहा गया है कि ।एफβएफβF_\beta "measures the effectiveness of retrieval with respect to a user who attaches β times as much importance to recall as precision" मुझे विचार नहीं …

2
कण फिल्टर को समझने के लिए गणितीय और सांख्यिकीय पूर्वापेक्षाएँ?
मैं वर्तमान में वित्त में कण फिल्टर और उनके संभावित उपयोगों को समझने की कोशिश कर रहा हूं और मैं काफी संघर्ष कर रहा हूं। (I) क्वांटिटेटिव फाइनेंस में एक बैकग्राउंड (क्वांटिटेटिव फाइनेंस में बैकग्राउंड से आने वाली) गणितीय और सांख्यिकीय पूर्वापेक्षाएँ हैं, ताकि (i) कण फिल्टर की मूल बातें …

1
दिखाएँ अनुमान आदेश आँकड़ों के माध्यम से प्रतिशत में परिवर्तित होता है
चलो आईआईडी यादृच्छिक एक से नमूना चर का एक अनुक्रम हो अल्फा स्थिर वितरण , मानकों के साथ । α = 1.5 ,X1,X2,…,X3nX1,X2,…,X3nX_1, X_2, \ldots, X_{3n}α=1.5,β=0,c=1.0,μ=1.0α=1.5,β=0,c=1.0,μ=1.0\alpha = 1.5, \; \beta = 0, \; c = 1.0, \; \mu = 1.0 अब अनुक्रम , जहां , ।Y1,Y2,…,YnY1,Y2,…,YnY_1, Y_2, \ldots, Y_{n}Yj+1=X3j+1X3j+2X3j+3−1Yj+1=X3j+1X3j+2X3j+3−1Y_{j+1} = …

3
क्या एक निश्चित शैली में चित्र बनाने के लिए तंत्रिका नेटवर्क को प्रशिक्षित करना संभव है?
क्या निश्चित शैली में चित्र बनाने के लिए तंत्रिका नेटवर्क को प्रशिक्षित करना संभव है? (इसलिए यह एक छवि लेता है और इसे एक शैली में बदल देता है जिसे इसके लिए प्रशिक्षित किया गया था।) क्या इस तरह की चीज़ के लिए कोई स्वीकृत तकनीक है? मुझे डीपआर्ट एल्गोरिथ्म …

2
केवल सुविधा चयन के लिए LASSO का उपयोग करना
मेरी मशीन सीखने वर्ग में, हम, कैसे LASSO प्रतिगमन सुविधा चयन प्रदर्शन पर बहुत अच्छा है के बारे में सीखा है, क्योंकि यह का उपयोग करता है है नियमितीकरण।एल1एल1l_1 मेरा प्रश्न: क्या लोग आमतौर पर LASSO मॉडल का उपयोग सिर्फ फीचर चयन के लिए करते हैं (और फिर उन विशेषताओं …

1
एनोव मॉडल में कोवरिएट्स के क्रम को बदलते समय पी-वैल्यू महत्व में क्यों बदलते हैं?
मेरे पास 482 अवलोकनों का डेटा सेट है। data=Populationfull Im 3 एसएनपी के लिए एक जीनोटाइप एसोसिएशन विश्लेषण करने जा रहा है। Im मेरे विश्लेषण के लिए एक मॉडल बनाने की कोशिश कर रहा हूँ और aov (y ~ x, data = ...) का उपयोग कर Im। एक विशेषता के …
10 r  anova 

6
हम कभी भी जनसंख्या परिवर्तन को कैसे जान सकते हैं?
परिकल्पना परीक्षण में, एक आम सवाल यह है कि जनसंख्या का विचरण क्या है? मेरा सवाल यह है कि हम कभी भी जनसंख्या परिवर्तन को कैसे जान सकते हैं? यदि हम संपूर्ण वितरण को जानते हैं, तो हम पूरी आबादी का मतलब भी जान सकते हैं । फिर परिकल्पना परीक्षण …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.