सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
एक मिश्रित प्रभाव मॉडल में निश्चित प्रभाव पर इंजेक्शन
मेरे पास सहसंबद्ध डेटा है और ब्याज के भविष्यवक्ता के लिए व्यक्तिगत स्तर (सशर्त) प्रभाव का अनुमान लगाने के लिए एक लॉजिस्टिक रिग्रेशन मिश्रित प्रभाव मॉडल का उपयोग कर रहा हूं। मुझे पता है कि मानक सीमांत मॉडल के लिए, वाल्ड परीक्षण का उपयोग करने वाले मॉडल मापदंडों पर निष्कर्ष …

1
सख्त वॉन न्यूमैन असमानता का उदाहरण
चलो एक आकलनकर्ता के Bayes जोखिम निरूपित एक पूर्व के संबंध में , चलो पैरामीटर अंतरिक्ष पर सभी महंतों के सेट को निरूपित , और के सेट को निरूपित सभी (संभवतः यादृच्छिक) निर्णय नियम।r(π,δ)r(π,δ)r(\pi, \delta)δδ\deltaππ\piΠΠ\PiΘΘ\ThetaΔΔ\Delta जॉन वॉन न्यूमैन की न्यूनतम असमानता की सांख्यिकीय व्याख्या बताती है कि supπ∈Πinfδ∈Δr(π,δ)≤infδ∈Δsupπ∈Πr(π,δ),supπ∈Πinfδ∈Δr(π,δ)≤infδ∈Δsupπ∈Πr(π,δ), \sup_{\pi\in\Pi} \inf_{\delta\in\Delta} …

2
गैर-नेस्टेड मॉडल के लिए संभावना अनुपात परीक्षण का उपयोग क्यों नहीं किया जा सकता है?
अधिक विशेष रूप से, क्यों संभावना अनुपात परीक्षण asymptotically a वितरण है यदि मॉडल नेस्टेड हैं, लेकिन यह नहीं-नेस्टेड मॉडल के लिए अब ऐसा नहीं है? मैं समझता हूं कि यह विल्क्स प्रमेय से निकला है, लेकिन दुर्भाग्य से, मैं इसके प्रमाण को नहीं समझता ।χ2χ2\chi^2

1
Lmer और p-values ​​पर भ्रम: MCMC वालों की तुलना में मेमिस पैकेज से p-मान कैसे करते हैं?
मैं इस धारणा के तहत था कि पैकेज lmer()में फ़ंक्शन lme4पी-वैल्यू (देखें lmer, पी-वैल्यू और सब कुछ ) का उत्पादन नहीं करता है । : मैं बजाय के रूप में इस सवाल का प्रति एमसीएमसी उत्पन्न पी मानों का उपयोग किया गया है में महत्वपूर्ण प्रभाव lme4मिश्रित मॉडल और इस …

2
यदि कोई भी पैरामीट्रिक परीक्षण शून्य को अस्वीकार नहीं करता है, तो क्या इसका गैर-वैकल्पिक विकल्प भी ऐसा करता है?
यदि गैर-पैरामीट्रिक परीक्षणों को उनके पैरामीट्रिक विकल्पों की तुलना में कम शक्ति माना जाता है, तो क्या इसका मतलब यह है कि यदि कोई पैरामीट्रिक परीक्षण शून्य को अस्वीकार नहीं करता है, तो इसका गैर-पैरामीट्रिक विकल्प शून्य को भी अस्वीकार नहीं करता है? यदि पैरामीट्रिक परीक्षण की मान्यताओं को पूरा …

1
समझ माप एकाग्रता असमानताओं
इस प्रश्न की भावना में होफेडिंग असमानता में प्रयुक्त एक लेम्मा के सबूत को समझना , मैं उन चरणों को समझने की कोशिश कर रहा हूं जो हॉफिंग की असमानता की ओर ले जाते हैं। प्रमाण में मेरे लिए जो सबसे अधिक रहस्य रखता है वह वह हिस्सा है जहां …

1
कैसे एक lm () से उत्पादन का अनुवाद करने के लिए एक प्रतिगमन समीकरण में एक क्यूबलाइन के साथ फिट
मेरे पास कुछ कोड और आउटपुट हैं, और मैं एक मॉडल का निर्माण करना चाहूंगा। मैं इस आउटपुट का उपयोग करके मॉडल का निर्माण करना नहीं जानता: require("splines") x <- c(0.2, 0.23, 0.26, 0.29, 0.33, 0.46, 0.53 ) y <- c(0.211, 0.2026, 0.2034, 0.2167, 0.2177, 0.19225, 0.182) fit <- lm(y …
12 r  splines 

2
मल्टी-लेबल वर्गीकरण समस्याओं पर तंत्रिका नेटवर्क कैसे लागू करें?
विवरण: बता दें कि प्रॉब्लम डोमेन डॉक्यूमेंट क्लासिफिकेशन है, जहां 1 या अधिक कक्षाओं से संबंधित प्रत्येक फीचर वैक्टर का एक सेट मौजूद है। उदाहरण के लिए, एक दस्तावेज़ और श्रेणियों doc_1से संबंधित हो सकता है ।SportsEnglish सवाल: वर्गीकरण के लिए तंत्रिका नेटवर्क का उपयोग करना, एक फीचर वेक्टर के …

4
आर [बंद] में सांख्यिकीय विश्लेषण के लिए बस डेटा स्टोर करने का सबसे अच्छा तरीका
बन्द है। यह सवाल ऑफ टॉपिक है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि यह क्रॉस मान्य के लिए विषय पर हो । 6 साल पहले बंद हुआ । मैं कुछ समय से बिना किसी समस्या …
12 r  dataset 

2
लॉगरिदमिक ऑफसेट के साथ बाइनरी मॉडल (प्रोबिट और लॉगिट)
क्या किसी को इस बात की व्युत्पत्ति है कि प्रोब और लॉजिट जैसे बाइनरी मॉडल में ऑफसेट कैसे काम करता है? मेरी समस्या में, अनुवर्ती विंडो लंबाई में भिन्न हो सकती है। मान लीजिए कि रोगियों को उपचार के रूप में रोगनिरोधी गोली मिलती है। शॉट अलग-अलग समय पर होता …

1
हिडन मार्कोव मॉडल में "सर्वश्रेष्ठ" मॉडल का चयन करने के लिए मानदंड
मेरे पास एक समय श्रृंखला डेटा सेट है, जिसमें मैं डेटा में अव्यक्त राज्यों की संख्या का अनुमान लगाने के लिए एक छिपे हुए मार्कोव मॉडल (एचएमएम) को फिट करने की कोशिश कर रहा हूं। ऐसा करने के लिए मेरा छद्म कोड निम्नलिखित है: for( i in 2 : max_number_of_states …

2
मिश्रित मॉडल प्रति स्तर 1 अवलोकन के साथ
मैं glmerकुछ व्यावसायिक डेटा के साथ एक यादृच्छिक प्रभाव मॉडल फिट कर रहा हूं । उद्देश्य वितरक द्वारा बिक्री के प्रदर्शन का विश्लेषण करना है, क्षेत्रीय विविधता को ध्यान में रखते हुए। मेरे पास निम्नलिखित चर हैं: distcode: वितरक आईडी, लगभग 800 स्तरों के साथ region: शीर्ष-स्तरीय भौगोलिक आईडी (उत्तर, …

2
मैं लॉग स्पेस में असतत (श्रेणीबद्ध) वितरण से कैसे नमूना ले सकता हूं?
मान लीजिए कि मेरे पास एक असतत वितरण वेक्टर द्वारा परिभाषित है जैसे कि श्रेणी को प्रायिकता और इसी तरह तैयार किया जाएगा । मुझे पता चलता है कि वितरण में कुछ मूल्य इतने कम हैं कि वे मेरे कंप्यूटर के फ्लोटिंग पॉइंट नंबर प्रतिनिधित्व को कम करते हैं, इसलिए …

2
समय श्रृंखला और प्रतिगमन के बीच संबंध और अंतर?
समय श्रृंखला और प्रतिगमन के बीच क्या संबंध और अंतर हैं? के लिए मॉडल और मान्यताओं , यह सही है कि प्रतिगमन मॉडल इनपुट चर के विभिन्न मानों के लिए उत्पादन चर के बीच स्वतंत्रता मान है, जबकि समय श्रृंखला मॉडल नहीं है? कुछ अन्य अंतर क्या हैं? के लिए …

1
कुछ विरोधाभासों का परीक्षण: क्या यह काफी कठिन समस्या है, या नहीं?
मैंने इसे Mathoverflow में पोस्ट किया और किसी का जवाब नहीं: सांख्यिकीय रूप से महत्वपूर्ण विरोधाभासों की पहचान के लिए शेफ़ी की विधि व्यापक रूप से ज्ञात है। साधन के बीच एक विपरीत , आबादी का एक रैखिक संयोजन है जिसमें , और इसके विपरीत एक स्केलर मल्टीपल अनिवार्य रूप …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.