सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
एक अनुमानक को एक यादृच्छिक चर क्यों माना जाता है?
एक अनुमानक और एक अनुमान क्या है की मेरी समझ है: अनुमानक: एक अनुमान की गणना करने के लिए एक नियम अनुमान: अनुमान के आधार पर डेटा के एक सेट से गणना की गई मूल्य इन दो शब्दों के बीच, यदि मुझे यादृच्छिक चर को इंगित करने के लिए कहा …

1
बेयर एट अल से सापेक्ष विपरीत प्रमेय है। पेपर: "हाई डायमेंशनल स्पेस में डिस्टेंस मेट्रिक्स के हैरान करने वाले व्यवहार पर" भ्रामक?
यह बहुत बार उद्धृत किया जाता है जब आयामीता के अभिशाप का उल्लेख और जाता है (दाएं सूत्र को इसके विपरीत कहा जाता है) लिमघ→ ∞var ( | | X)घ| |कइ[ | | एक्सघ| |क]) =0,फिर: डीअधिकतमकघ- डीमिनटकघडीमिनटकघ→ 0लिमघ→∞वर(||एक्सघ||कइ[||एक्सघ||क])=0,फिर:डीअधिकतमघक-डीमिनटघकडीमिनटघक→0 \lim_{d\rightarrow \infty} \text{var} \left(\frac{||X_d||_k}{E[||X_d||_k]} \right) = 0, \text{then}: \frac{D_{\max^{k}_{d}} - D_{\min^{k}_{d}}}{D_{\min^{k}_{d}}} …

1
पिटमैन-कोपमैन-डार्मोइस प्रमेय के स्नातक स्तर के प्रमाण
पिटमैन-कोपमैन-डॉर्मोइस प्रमेय का कहना है कि यदि संभाव्यता वितरण के एक पैराडाइरिज्ड परिवार से एक ईद नमूना पर्याप्त सांख्यिकीय मानता है, जिसके स्केलर घटकों की संख्या नमूना आकार के साथ नहीं बढ़ती है, तो यह एक घातीय परिवार है। क्या कोई पाठ्यपुस्तक या प्रारंभिक एक्सपोजर पेपर सबूत देते हैं? इसका …

2
क्या सिम्पसन का विरोधाभास एक छिपे हुए चर से उलट के सभी उदाहरणों को कवर करता है?
निम्नलिखित सिम्पसन के विरोधाभास के अस्तित्व के 'चित्र द्वारा सबूत' के रूप में पेश किए गए कई विज़ुअलाइज़ेशन के बारे में एक सवाल है, और संभवतः शब्दावली के बारे में एक सवाल है। सिम्पसन के विरोधाभास का वर्णन करने के लिए और इसके (और क्यों गहरी और दिलचस्प हो सकता …

3
जब मैं इसके माध्यम से एक यादृच्छिक चर को प्रतिस्थापित नहीं कर सकता?
मॉडलिंग और सिमुलेशन में लगातार सरलीकरण एक यादृच्छिक चर को उसके औसत मूल्य से बदलना है। इस सरलीकरण से गलत निष्कर्ष कब निकलेगा?

1
एक seq2seq RNN मॉडल को स्कोर करने के लिए मुझे किस हानि कार्य का उपयोग करना चाहिए?
मैं चो 2014 पेपर के माध्यम से काम कर रहा हूं जिसने seq2seq मॉडलिंग के लिए एनकोडर-डिकोडर आर्किटेक्चर पेश किया। कागज में, वे दिए गए आउटपुट इनपुट की संभावना (या यह नकारात्मक-लॉग-संभावना) का उपयोग करते हैं, लंबाई इनपुट और लंबाई आउटपुट के लिए नुकसान फ़ंक्शन के रूप में :एम वाई …

1
जोड़ीदार सीमांत वितरण से संयुक्त वितरण प्राप्त करें
मान लें कि हमारे पास 3 यादृच्छिक चर , और हम सीमांत वितरण जानते हैं, लेकिन हमें कुछ और पता नहीं है (जैसे कि सशर्त स्वतंत्रता के रूप में)। क्या हमें संयुक्त वितरण ?एक्स1, एक्स2, एक्स3एक्स1,एक्स2,एक्स3X_1,X_2,X_3पी( एक्स)1, एक्स2) , पी( एक्स)2, एक्स3) , पी( एक्स)3, एक्स1)पी(एक्स1,एक्स2),पी(एक्स2,एक्स3),पी(एक्स3,एक्स1)P(X_1,X_2), P(X_2,X_3), P(X_3,X_1)पी( एक्स)1, एक्स2, …

6
वैज्ञानिक साहित्य में "वन-हॉट" एन्कोडिंग को क्या कहा जाता है?
ऑपरेटर का नाम क्या है जो एक श्रेणीगत वेक्टर लेता है और इसे एक-गर्म एन्कोडिंग का उपयोग करके द्विआधारी प्रतिनिधित्व में बदल देता है? मैं सोच रहा हूं कि मैं एक वैज्ञानिक पत्र लिख रहा हूं और उसके लिए एक उचित नाम की आवश्यकता है।

2
का आसान प्रमाण ?
चलो स्वतंत्र मानक सामान्य यादृच्छिक चर हो। वहाँ कई (लंबा) सबूत हैं, जो दिखा रहे हैंजेड1, ⋯ , जेडnजेड1,⋯,जेडnZ_1,\cdots,Z_n ∑i=1n(Zi−1n∑j=1nZj)2∼χ2n−1∑i=1n(Zi−1n∑j=1nZj)2∼χn−12 \sum_{i=1}^n \left(Z_i - \frac{1}{n}\sum_{j=1}^n Z_j \right)^2 \sim \chi^2_{n-1} कई सबूत काफी लंबे होते हैं और उनमें से कुछ प्रेरण का उपयोग करते हैं (जैसे कि कैसला सांख्यिकीय इंजेक्शन)। मैं सोच …

2
नियमितीकरण के तरीकों पर सबसे महत्वपूर्ण "शुरुआती कागजात" क्या हैं?
कई उत्तरों में मैंने देखा है कि CrossValidated उपयोगकर्ता ओपी को लस्सो, रिज और इलास्टिक नेट पर शुरुआती कागजात खोजने का सुझाव देते हैं। पश्चात के लिए, लास्सो, रिज और इलास्टिक नेट पर सेमिनल क्या हैं?

1
डिज़ाइन मैट्रिक्स के आकार के साथ लास्सो कैसे होता है?
अगर मेरे पास एक डिज़ाइन मैट्रिक्स , जहां आयाम की टिप्पणियों की संख्या है , तो लिए हल करने की जटिलता क्या है LASSO, wrt और ? मुझे लगता है कि उत्तर को संदर्भित करना चाहिए कि इन मापदंडों के साथ एक LASSO पुनरावृत्ति तराजू कैसे, इसके बजाय पुनरावृत्तियों की …

3
डेटा वैज्ञानिक साक्षात्कार प्रश्न: रैखिक प्रतिगमन कम
मुझे एक नौकरी के लिए एक साक्षात्कार प्रश्न का सामना करना पड़ा जहां साक्षात्कारकर्ता ने मुझे मान लिया कि आपका एक मूल्य लोच मॉडल के लिए बहुत कम (5 से 10% के बीच) है। आप इस प्रश्न को कैसे हल करेंगे?आर2R2R^2 मैं इस तथ्य के अलावा और कुछ नहीं सोच …

2
ओएलएस का उपयोग करते हुए अवशेषों पर त्रुटियों को फिर से दर्ज करते समय ढलान हमेशा ठीक 1 क्यों होता है?
मैं R में कुछ सरल सिमुलेशन का उपयोग करते हुए त्रुटियों और अवशिष्टों के बीच संबंधों के साथ प्रयोग कर रहा था। एक बात जो मुझे मिली है, वह यह है कि नमूना आकार या त्रुटि भिन्नता की परवाह किए बिना, मैं हमेशा ढलान के लिए ठीक प्राप्त करता हूं …


1
मुझे मैनुअल बहुपद विस्तार और R `पॉली 'फ़ंक्शन का उपयोग करने के लिए अलग-अलग भविष्यवाणियां क्यों मिल रही हैं?
मुझे मैनुअल बहुपद विस्तार और आर polyफ़ंक्शन का उपयोग करने के लिए अलग-अलग भविष्यवाणियां क्यों मिल रही हैं ? set.seed(0) x <- rnorm(10) y <- runif(10) plot(x,y,ylim=c(-0.5,1.5)) grid() # xp is a grid variable for ploting xp <- seq(-3,3,by=0.01) x_exp <- data.frame(f1=x,f2=x^2) fit <- lm(y~.-1,data=x_exp) xp_exp <- data.frame(f1=xp,f2=xp^2) yp <- …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.