सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

3
एक निश्चित प्रभाव वास्तव में कब तय होता है?
इस प्रकार के एक रेखीय अप्रतिबंधित प्रभावों के मॉडल पर विचार करें: जहां एक गैर- लेकिन समय-अपरिवर्तनीय विशेषता है और एक त्रुटि है, और इंडेक्स व्यक्तिगत टिप्पणियों और समय, क्रमशः। एक निश्चित प्रभाव (FE) प्रतिगमन में विशिष्ट दृष्टिकोण को व्यक्तिगत डमी (एलएसडीवी) / डी-अर्थ के माध्यम से या पहले अलग-अलग …

2
2 डी में कर्नेल घनत्व आकलनकर्ता को एकीकृत करना
मैं इस सवाल से आ रहा हूँ अगर कोई भी निशान का पालन करना चाहता है। मूल रूप से मेरे पास एक डेटा सेट है जो ऑब्जेक्ट्स से बना है, जहां प्रत्येक ऑब्जेक्ट में इसके साथ संलग्न मानों की संख्या दी गई है (दो इस मामले में):ΩΩ\OmegaNNN Ω=o1[x1,y1],o2[x2,y2],...,oN[xN,yN]Ω=o1[x1,y1],o2[x2,y2],...,oN[xN,yN]\Omega = o_1[x_1, …

1
समय-श्रृंखला डेटा के वास्तविक समय सामान्यीकरण के लिए एल्गोरिदम?
मैं एक एल्गोरिथ्म पर काम कर रहा हूं जो कई हालिया डेटा बिंदुओं के वेक्टर में कई सेंसर धाराओं से लेता है और यूक्लिडियन दूरी की तुलना पिछले वैक्टर से करता है। समस्या यह है कि अलग-अलग डेटा स्ट्रीम पूरी तरह से अलग-अलग सेंसर से हैं, इसलिए एक साधारण यूक्लिडियन …

2
क्या पीयर्सन के सहसंबंध परीक्षण के लिए पी-मूल्यों को केवल सहसंबंध गुणांक और नमूना आकार से गणना की जा सकती है?
पृष्ठभूमि: मैंने एक लेख पढ़ा जहां लेखक पियरसन सहसंबंध 0.754 को नमूना आकार 878 से रिपोर्ट करते हैं। सहसंबंध परीक्षण के लिए परिणामी पी-मान "दो सितारा" महत्वपूर्ण है (यानी p <0.01)। हालाँकि, मुझे लगता है कि इतने बड़े सैंपल साइज़ के साथ, संबंधित पी-वैल्यू 0.001 (यानी तीन स्टार महत्वपूर्ण) से …

4
अपेक्षित संख्या मैं तब तक आरेखण कार्ड के बाद रहूंगा जब तक कि मुझे एक इक्का, 2, 3 और आगे नहीं मिलता
मुझे निम्नलिखित को हल करने में कुछ परेशानी हो रही है। आप एक मानक 52-कार्ड डेक से प्रतिस्थापन के बिना कार्ड खींचते हैं जब तक आपको एक इक्का नहीं मिलता। आप तब तक ड्रॉ करते हैं, जब तक आप एक 2. प्राप्त नहीं कर लेते हैं। आप 3 पर जारी …

1
मशीन लर्निंग का उपयोग करके वित्तीय समय की भविष्यवाणी करने के लिए पहला कदम सीखना
मैं भविष्य में वित्तीय समय 1 या अधिक चरणों की भविष्यवाणी करने के लिए मशीन सीखने का उपयोग करने के बारे में समझ पाने की कोशिश कर रहा हूं। मेरे पास कुछ वर्णनात्मक डेटा के साथ एक वित्तीय समय है और मैं एक मॉडल बनाना चाहूंगा और फिर मॉडल का …

2
वर्णनात्मक आँकड़े क्या प्रभाव आकार नहीं हैं?
विकिपीडिया कहता है प्रभाव का आकार किसी घटना की ताकत या उस मात्रा के नमूने-आधारित अनुमान का एक माप है। डेटा से परिकलित एक प्रभाव आकार एक वर्णनात्मक आँकड़ा है जो किसी भी संबंध के अनुमानित परिमाण को व्यक्त करता है बिना किसी बयान के कि क्या डेटा में स्पष्ट …


2
जब डेटा में एक गाऊसी वितरण होता है, तो कितने नमूने इसकी विशेषता होगी?
गॉसियन डेटा को एक ही आयाम में वितरित करने के लिए इसे (माध्य, विचरण) को चिह्नित करने के लिए दो मापदंडों की आवश्यकता होती है, और अफवाह यह है कि लगभग 30 यादृच्छिक रूप से चयनित नमूने आमतौर पर इन मापदंडों का अनुमान लगाने के लिए पर्याप्त रूप से उच्च …

2
पोस्मोन GLMM में लार () के साथ आर में अतिप्रवाह के लिए परीक्षण कैसे करें?
मेरे पास निम्न मॉडल है: > model1<-lmer(aph.remain~sMFS1+sAG1+sSHDI1+sbare+season+crop +(1|landscape),family=poisson) ... और यह सारांश आउटपुट है। > summary(model1) Generalized linear mixed model fit by the Laplace approximation Formula: aph.remain ~ sMFS1 + sAG1 + sSHDI1 + sbare + season + crop + (1 | landscape) AIC BIC logLik deviance 4057 4088 -2019 …

2
गेलमैन द्वारा रिपोर्ट किए गए "विरोधाभास" का नाम
एंड्रयू जेलमैन की पुस्तक "रेड स्टेट, ब्लू स्टेट" में वह इस तथ्य का विश्लेषण करते हैं कि विशेष राज्यों में अमीर लोग गरीब लोगों की तुलना में अधिक रिपब्लिकन वोट देते हैं, लेकिन धनी राज्य गरीब राज्यों की तुलना में अधिक डेमोक्रेटिक वोट करते हैं। क्या इस विरोधाभास का कोई …
12 paradox 

2
सामान्य के योग का अनुपात सामान्य के क्यूब्स का योग
कृपया मदद मुझे सीमित वितरण को खोजने के लिए (के रूप में n→∞n→∞n \rightarrow \infty निम्न में से): जहां iid ।Un=X1+X2+…+XnX31+X32+…X3n,Un=X1+X2+…+XnX13+X23+…Xn3, U_n = \frac{X_1 + X_2 + \ldots + X_n}{X_1^3 + X_2^3 + \ldots X_n^3},XiXiX_iN(0,1)N(0,1)N(0,1)

2
सामान्यीकृत रैखिक मॉडल में अवशिष्टों का अपेक्षित वितरण क्या है?
मैं एक सामान्यीकृत रैखिक मॉडल का प्रदर्शन कर रहा हूं, जहां मुझे सामान्य से अलग एक परिवार को निर्दिष्ट करना होगा। अवशिष्टों का अपेक्षित वितरण क्या है? उदाहरण के लिए, क्या अवशेषों को सामान्य रूप से वितरित किया जाना चाहिए?

3
Naive Bayes में प्रायिकताएँ हैं: क्या मुझे शब्दों की गिनती दोगुनी करनी चाहिए?
मैं अपने स्वयं के Naive Bayes bag o 'शब्द मॉडल का प्रोटोटाइप बना रहा हूं, और मेरे पास फीचर संभावनाओं की गणना करने के बारे में एक प्रश्न था। मान लीजिए कि मुझे दो कक्षाएं मिली हैं, मैं केवल स्पैम और स्पैम का उपयोग नहीं करूंगा क्योंकि यह सभी का …

5
आर में फ़ीचर चयन पैकेज, जो प्रतिगमन और वर्गीकरण दोनों करते हैं
ताला लगा हुआ । यह सवाल और इसके जवाब बंद हैं क्योंकि यह सवाल ऑफ-टॉपिक है लेकिन इसका ऐतिहासिक महत्व है। यह वर्तमान में नए उत्तरों या इंटरैक्शन को स्वीकार नहीं कर रहा है। मैं आर के लिए बहुत नया हूं। मैं अभी मशीन लर्निंग सीख रहा हूं। बहुत खेद …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.