सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

5
एक अच्छा संसाधन क्या है जिसमें विभिन्न वर्गीकरणों के पेशेवरों और विपक्षों की तुलना शामिल है?
सबसे अच्छा आउट-ऑफ-द-बॉक्स 2-क्लास क्लासिफायरियर क्या है? हां, मुझे लगता है कि यह मिलियन डॉलर का सवाल है, और हां, मैं नो लंच प्रमेय से अवगत हूं , और मैंने पिछले प्रश्नों को भी पढ़ा है: आपके आवेदन के लिए सबसे अच्छा आउट-ऑफ-द-बॉक्स बॉक्स-क्लास क्लासीफायर क्या है? और सबसे खराब …

1
कैसे ggplot के साथ एक सीढ़ी चरणों समारोह की साजिश करने के लिए?
ताला लगा हुआ । यह सवाल और इसके जवाब बंद हैं क्योंकि यह सवाल ऑफ-टॉपिक है लेकिन इसका ऐतिहासिक महत्व है। यह वर्तमान में नए उत्तरों या इंटरैक्शन को स्वीकार नहीं कर रहा है। मेरा ग्राफ इस तरह है: इसे बनाने के लिए आर कोड है: DF <- data.frame(date = …

3
मैं किसी एक जनसंख्या से यादृच्छिक सदस्य की तुलना में "बेहतर" होने की यादृच्छिक सदस्य की संभावना का अनुमान कैसे लगा सकता हूं?
मान लीजिए कि मेरे पास दो अलग-अलग आबादी से नमूने हैं। यदि मैं मापता हूं कि प्रत्येक सदस्य को एक कार्य करने में कितना समय लगता है, तो मैं आसानी से प्रत्येक जनसंख्या के माध्य और विचरण का अनुमान लगा सकता हूं। यदि मैं अब प्रत्येक व्यक्ति से एक व्यक्ति …

1
एक समय श्रृंखला के एक आसन्न मैट्रिक्स के Eigenfunctions?
एक साधारण समय श्रृंखला पर विचार करें: > tp <- seq_len(10) > tp [1] 1 2 3 4 5 6 7 8 9 10 हम इस समय श्रृंखला के लिए एक आसन्न मैट्रिक्स की गणना कर सकते हैं जो नमूनों के बीच अस्थायी लिंक का प्रतिनिधित्व करते हैं। इस मैट्रिक्स …

4
यादृच्छिक ऑटो सहसंबद्ध बाइनरी टाइम श्रृंखला डेटा कैसे उत्पन्न करें?
मैं बाइनरी टाइम श्रृंखला कैसे उत्पन्न कर सकता हूं: 1 अवलोकन करने की औसत संभावना निर्दिष्ट है (5% कहो); समय में 1 अवलोकन की सशर्त संभावना पर मान दिया टी - 1 (कहते हैं कि 30% है, तो टी - 1 मान 1 था)?tttt−1t−1t-1t−1t−1t-1

2
'मैसेज पासिंग मेथड ’क्या है?
मेरे पास एक अस्पष्ट अर्थ है कि संदेश पारित करने की विधि क्या है: एक एल्गोरिथ्म जो वितरण के लिए एक सन्निकटन का निर्माण करता है, जो सभी अन्य कारकों के सभी सन्निकटन पर वितरण सशर्त के कारकों में से प्रत्येक के पुनरावृत्तियों का निर्माण करता है। मेरा मानना ​​है …

1
R में कार पैकेज के साथ ANOVA विरोधाभासों की स्थापना और व्याख्या कैसे करें?
मान लीजिए कि मेरे पास एक सरल 2x2 फैक्टरियल प्रयोग है जिसे मैं एनोवा पर करना चाहता हूं। इस तरह, उदाहरण के लिए: d <- data.frame(a=factor(sample(c('a1','a2'), 100, rep=T)), b=factor(sample(c('b1','b2'), 100, rep=T))); d$y <- as.numeric(d$a)*rnorm(100, mean=.75, sd=1) + as.numeric(d$b)*rnorm(100, mean=1.2, sd=1) + as.numeric(d$a)*as.numeric(d$b)*rnorm(100, mean=.5, sd=1) + rnorm(100); एक महत्वपूर्ण अंतःक्रिया के …
15 r  anova  contrasts 

2
आर में कर्नेल घनत्व आकलन में "पीडीएफ" के तहत क्षेत्र
मैं कर्नेल घनत्व अनुमान करने के लिए R में ' घनत्व ' फ़ंक्शन का उपयोग करने का प्रयास कर रहा हूं । मैं के रूप में ऐसा लगता है वक्र के तहत क्षेत्र जरूरी 1. किसी भी के लिए नहीं है कुछ परेशानी परिणाम की व्याख्या और विभिन्न डेटासेट की …

4
मैं मतदान पर प्रतिष्ठा के प्रभावों के अपने विश्लेषण को कैसे सुधार सकता हूं?
हाल ही में मैंने upvotes ( ब्लॉग-पोस्ट देखें ) पर प्रतिष्ठा के प्रभावों का कुछ विश्लेषण किया था , और बाद में संभवतः अधिक ज्ञानवर्धक (या अधिक उपयुक्त) विश्लेषण और ग्राफिक्स के बारे में मेरे कुछ प्रश्न थे। तो कुछ सवाल (और विशेष रूप से किसी का जवाब देने और …

1
गणितीय रूप से (वितरण) एल्गोरिथम बनाम गणितीय रूप से सीखने के पक्ष और विपक्ष क्या हैं?
गणितीय रूप से बनाम (कंप्यूटर सिमुलेशन के माध्यम से) वितरण के गुणों के बारे में सीखने के पक्ष और विपक्ष क्या हैं? ऐसा लगता है कि कंप्यूटर सिमुलेशन एक वैकल्पिक शिक्षण पद्धति हो सकती है, खासकर उन नए छात्रों के लिए जो पथरी में मजबूत महसूस नहीं करते हैं। यह …

1
क्वांटाइल सामान्यीकरण कैसे काम करता है?
जीन अभिव्यक्ति में माइक्रोएरे का उपयोग करते हुए अध्ययन किया जाता है, तीव्रता डेटा को सामान्य किया जाना चाहिए ताकि तीव्रता को व्यक्तियों के बीच, जीन के बीच तुलना की जा सके। वैचारिक रूप से और एल्गोरिथ्म में, "क्वांटाइल सामान्यीकरण" कैसे काम करता है, और आप इसे एक गैर-सांख्यिकीविद् को …

5
डेटा पर वर्गमूल परिवर्तन का उपयोग करने का कारण क्या हो सकता है?
क्या डेटा को वर्गमूल के साथ बदलने के लिए मैं क्या सोच सकता हूं, इसका कोई कारण है? मेरा मतलब है कि मैं हमेशा निरीक्षण करता हूं कि आर ^ 2 बढ़ता है। लेकिन यह शायद डेटा को केंद्रित करने के कारण है! किसी भी विचार की सराहना की है!

2
कुल्बैक-लीबलर दो गामा वितरण के बीच विचलन
गामा वितरण parameterize करने के लिए चुनना Γ(b,c)Γ(b,c)\Gamma(b,c) पीडीएफ द्वारा g(x;b,c)=1Γ(c)xc−1bce−x/bg(x;b,c)=1Γ(c)xc−1bce−x/bg(x;b,c) = \frac{1}{\Gamma(c)}\frac{x^{c-1}}{b^c}e^{-x/b} के बीच Kullback-Leibler विचलनΓ(bq,cq)Γ(bq,cq)\Gamma(b_q,c_q)औरΓ(bp,cp)Γ(bp,cp)\Gamma(b_p,c_p)द्वारा [1] के रूप में दिया जाता है KLGa(bq,cq;bp,cp)=(cq−1)Ψ(cq)−logbq−cq−logΓ(cq)+logΓ(cp)+cplogbp−(cp−1)(Ψ(cq)+logbq)+bqcqbpKLGa(bq,cq;bp,cp)=(cq−1)Ψ(cq)−log⁡bq−cq−log⁡Γ(cq)+log⁡Γ(cp)+cplog⁡bp−(cp−1)(Ψ(cq)+log⁡bq)+bqcqbp\begin{align} KL_{Ga}(b_q,c_q;b_p,c_p) &= (c_q-1)\Psi(c_q) - \log b_q - c_q - \log\Gamma(c_q) + \log\Gamma(c_p)\\ &\qquad+ c_p\log b_p - (c_p-1)(\Psi(c_q) + \log b_q) + \frac{b_qc_q}{b_p} \end{align} मेरा अनुमान …

8
आँकड़ों का उपयोग कैसे न करें
यह एक खुले हुए सवाल की तरह है लेकिन मैं स्पष्ट होना चाहता हूं। पर्याप्त जनसंख्या को देखते हुए आप कुछ सीखने में सक्षम हो सकते हैं (यह खुला हिस्सा है) लेकिन आप अपनी आबादी के बारे में जो कुछ भी सीखते हैं, वह कभी भी जनसंख्या के सदस्य पर …

1
क्या जीएसवीडी सभी रैखिक बहुभिन्नरूपी तकनीकों को लागू करता है?
मैं सामान्यीकृत SVD के बारे में Hervé Abdi के लेख पर आया था । लेखक ने उल्लेख किया: सामान्यीकृत एसवीडी (जीएसवीडी) एक आयताकार मैट्रिक्स को विघटित करता है और पंक्तियों और मैट्रिक्स के स्तंभों पर लगाए गए अवरोधों को ध्यान में रखता है। GSVD एक निचली श्रेणी के मैट्रिक्स द्वारा …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.