सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
वैकल्पिक फ़नल प्लॉट, मानक त्रुटि (एसई) का उपयोग किए बिना
अपने मेटा-विश्लेषण को प्रस्तुत करने से पहले मैं विषमता और प्रकाशन पूर्वाग्रह के परीक्षण के लिए एक फ़नल प्लॉट बनाना चाहता हूं। मेरे पास प्रत्येक अध्ययन से प्रभावित आकार और प्रभाव आकार हैं, जो मान -1 से +1 तक लेते हैं। मेरे पास मरीजों के लिए नमूना आकार n1, n2 …

1
अंतराल और अलग-अलग समय आधार के साथ दो समय श्रृंखला को कैसे सहसंबंधित करें?
मैंने StackOverflow पर यह सवाल पूछा , और इसे यहाँ पूछने की सिफारिश की गई। मेरे पास 3 डी एक्सेलेरोमीटर डेटा की दो समय श्रृंखला है जिसमें अलग-अलग समय के आधार हैं (नमूने अलग-अलग समय पर शुरू हुए, नमूने के समय कुछ बहुत मामूली रेंगने के साथ), साथ ही साथ …

4
सांख्यिकीय सॉफ्टवेयर का परीक्षण
सांख्यिकीय सॉफ्टवेयर के परीक्षण में कौन सी तकनीक / दृष्टिकोण उपयोगी हैं? मुझे उन कार्यक्रमों में विशेष रूप से दिलचस्पी है जो अधिकतम संभावना का उपयोग करके पैरामीट्रिक अनुमान लगाते हैं। अन्य कार्यक्रमों या प्रकाशित स्रोतों से उन लोगों के परिणामों की तुलना करना हमेशा संभव नहीं होता है, क्योंकि …

2
RNG, R, mclapply और कंप्यूटर के क्लस्टर
मैं R और कंप्यूटर के एक क्लस्टर पर एक सिमुलेशन चला रहा हूं और निम्नलिखित समस्या है। प्रत्येक X कंप्यूटर पर मैं चलता हूं: fxT2 <- function(i) runif(10) nessay <- 100 c(mclapply(1:nessay, fxT2), recursive=TRUE) 32 कंप्यूटर हैं, जिनमें से प्रत्येक में 16 कोर हैं। हालाँकि, लगभग 2% यादृच्छिक संख्याएँ समान …

4
ईमेल पते से एक अर्ध-यादृच्छिक संख्या [बंद]
बन्द है। यह सवाल ऑफ टॉपिक है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि यह क्रॉस मान्य के लिए विषय पर हो । 2 साल पहले बंद हुआ । मेरा लक्ष्य: मुझे एक फंक्शन चाहिए जो …

1
अर्थमितीय विधियों के सफल वास्तविक दुनिया अनुप्रयोगों के प्रलेखित / प्रतिलिपि प्रस्तुत करने योग्य उदाहरण?
यह सवाल बहुत व्यापक लग सकता है, लेकिन यहां वह है जिसकी मुझे तलाश है। मुझे पता है कि अर्थमितीय विधियों के बारे में कई उत्कृष्ट किताबें हैं, और अर्थमितीय तकनीकों के बारे में कई उत्कृष्ट लेख हैं। इस क्रॉसविलेस्ड प्रश्न में वर्णित अर्थमिति के उत्कृष्ट प्रतिलिपि प्रस्तुत करने योग्य …

1
सुविधाओं की अतिरेक की मात्रा कैसे निर्धारित करें?
मेरे पास तीन विशेषताएं हैं जो मैं वर्गीकरण समस्या को हल करने के लिए उपयोग करता हूं। मूल रूप से, इन विशेषताओं ने बूलियन मूल्यों का उत्पादन किया, इसलिए मैं सकारात्मक और नकारात्मक वर्गीकरणों के ओवरलैप को देखते हुए उनके अतिरेक का मूल्यांकन कर सकता था। अब मैंने इसके बजाय …

4
अंतर्निहित आँकड़ों की अवधारणाओं पर एक संसाधन, लागू आँकड़ों में प्रयुक्त तकनीकों का नहीं
आंकड़ों में मौलिक अवधारणाओं का सबसे गहन उपचार कौन सी पुस्तक है? मैं गणना और प्रक्रियाओं के तरीकों के विवरण के बारे में एक पुस्तक के लिए नहीं पूछ रहा हूं, मैं मुख्य रूप से एक पुस्तक में दिलचस्पी लेता हूं जो नींव संबंधी अवधारणाओं को अच्छी तरह से समझाता …
10 references 

1
आर संकुलन के लिए सांख्यिकी संकुल का उपयोग आर में
मुझे क्लस्टर पैकेज के एक या दो पहलुओं को समझने में कठिनाई हो रही है। मैं क्विक-आर से बारीकी से उदाहरण का अनुसरण कर रहा हूं , लेकिन विश्लेषण के एक या दो पहलुओं को नहीं समझता। मैंने उस कोड को शामिल किया है जिसका मैं इस विशेष उदाहरण के …
10 r  clustering 

2
JAGS में सेंसरिंग / ट्रंकेशन
मैं एक सवाल है कि JAGS में सेंसरिंग समस्या को कैसे ठीक किया जाए। मैं सामान्य रूप से एक बीवरिएट मिश्रण का निरीक्षण करता हूं जहां एक्स मान माप त्रुटि है। मैं सेंसर किए गए मूल्यों के वास्तविक अंतर्निहित 'साधनों' को मॉडल करना चाहूंगा। ⌈ xटी आर यू ई+ Ε …

4
MATLAB और R के निर्माण में रॉस क्विनलान का C5.0 का योगदान है
मैं करने के लिए MATLAB और आर इंटरफ़ेस का निर्माण पर विचार कर रहा हूँ रॉस Quinlan के C5.0 (यह से परिचित नहीं उन लोगों के लिए, C5.0 एक निर्णय पेड़ एल्गोरिथ्म और सॉफ्टवेयर पैकेज है, का एक विस्तार C4.5 ), और मैं कोशिश कर रहा हूँ उन घटकों की …

2
रिज और एसएएस में रिज रिग्रेशन कार्यान्वयन के बीच अंतर
मैं एप्लाइड रैखिक सांख्यिकीय मॉडल , 5 वें एड अध्याय 11 में रिज रिग्रेशन का वर्णन पढ़ रहा हूं । रिज रिग्रेशन यहां उपलब्ध शरीर के वसा डेटा पर किया जाता है । पाठ्यपुस्तक एसएएस में आउटपुट से मेल खाती है, जहां पीछे के रूपांतरित गुणांक फिट किए गए मॉडल …

1
एक टुकड़ा रंजकता रेखा प्लॉटिंग
वहाँ एक टुकड़ा मॉडल के प्रतिगमन लाइन की साजिश रचने का एक तरीका है जैसे, linesप्रत्येक खंड को अलग से उपयोग करने के लिए, या उपयोग करने के अलावा geom_smooth(aes(group=Ind), method="lm", fill=FALSE)? m.sqft <- mean(sqft) model <- lm(price~sqft+I((sqft-m.sqft)*Ind)) # sqft, price: continuous variables, Ind: if sqft>mean(sqft) then 1 else 0 …

3
जिपफ के लिए मापदंडों का अनुमान कैसे लगाया जाए एक डेटा सैंपल से वितरण को काट दिया?
मुझे जिप्फ़ के लिए अनुमान पैरामीटर के साथ एक समस्या है। मेरी स्थिति निम्नलिखित है: मेरे पास एक नमूना सेट है (एक प्रयोग से मापा जाता है जो कॉल उत्पन्न करता है जिसे एक ज़िप वितरण का पालन करना चाहिए)। मुझे प्रदर्शित करना है कि यह जनरेटर वास्तव में ज़िप …

2
पुनर्लेखन के लिए अच्छा पाठ?
क्या समूह लागू रेज़म्पलिंग तकनीकों के लिए एक अच्छा परिचय पाठ / संसाधन सुझा सकता है? विशेष रूप से, मैं समूहों की तुलना करने के लिए शास्त्रीय पैरामीट्रिक परीक्षणों (जैसे टी परीक्षण, एनोवा, एएनसीओवीए) के विकल्पों में दिलचस्पी रखता हूं, जब सामान्यता जैसी धारणाओं का स्पष्ट रूप से उल्लंघन होता …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.