सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
एनोवा में सामान्य धारणा से प्रस्थान: कुर्तोसिस या तिरछापन अधिक महत्वपूर्ण है?
कुटनेर एट अल द्वारा लागू रैखिक सांख्यिकीय मॉडल। एनोवा मॉडल की सामान्यता धारणा से निम्नलिखित प्रस्थान के बारे में बताता है: त्रुटि वितरण का कुर्तोसिस (या तो सामान्य वितरण की तुलना में कम या ज्यादा), इनफ़ेक्शंस पर प्रभाव के संदर्भ में वितरण की विषमता से अधिक महत्वपूर्ण है । मैं …

3
एक प्रयोग डिजाइन में एक संभावित उलझन
प्रश्न का अवलोकन चेतावनी: इस प्रश्न के लिए सेट अप की बहुत आवश्यकता है। कृपया मेरा साथ दें। मेरा और मेरा एक सहयोगी एक प्रयोग डिजाइन पर काम कर रहे हैं। डिज़ाइन को बड़ी संख्या में बाधाओं के आसपास काम करना चाहिए, जिसे मैं नीचे सूचीबद्ध करूंगा। मैंने एक ऐसी …

2
Wishart-Wishart के पैरामीटर क्या हैं?
N D- डायमेंशनल वैक्टर \ mathbf {x_1}, .., \ mathbf {x_N} \ start {align} \ mathbf {x_i} और \ sim उत्पन्न करने के लिए उपयोग किए जाने वाले एक सामान्य वितरण के सटीक मैट्रिक्स ΛΛ\boldsymbol{\Lambda} को खोजते समय \ mathcal {N} (\ boldsymbol {\ mu, \ Lambda ^ {- 1}}) …

1
डन के परीक्षण के परिणाम कैसे पढ़ें?
मैं डन के परीक्षण से परिणाम कैसे पढ़ूं ? विशेष रूप से, नीचे दी गई तालिका के मूल्य मुझे क्या बताते हैं? मेरे पास 4 समूहों में गैर-पैरामीट्रिक डेटा है, और मैंने पहले पुष्टि करने के लिए क्रुस्कल-वालिस परीक्षण किया था कि समूहों के वितरण एक दूसरे से और समग्र …

1
क्या दूर की देखरेख, स्व-प्रशिक्षण, स्व-पर्यवेक्षण सीखने और कमजोर पर्यवेक्षण के बीच कोई अंतर है?
मैंने जो पढ़ा है: दूर की निगरानी : A Distant supervision algorithm usually has the following steps: 1] It may have some labeled training data 2] It "has" access to a pool of unlabeled data 3] It has an operator that allows it to sample from this unlabeled data and …

3
संयुक्त वितरण के अधिकतम संभावना आकलनकर्ता ने केवल मामूली गणना दी
चलो दो स्पष्ट चर का एक संयुक्त वितरण हो , के साथ । कहते हैं कि वितरण इस वितरण से लिया गया था, लेकिन हमें केवल सी : के लिए मामूली गणना दी गई है। एक्स , वाई x , y ∈ { 1 , ... , कश्मीर } n …

3
4-आयामी डेटा को देखने के लिए कुछ लोकप्रिय विकल्प क्या हैं?
कहें कि मेरे पास निम्नलिखित चार आयामी डेटा हैं, जहां पहले तीन को निर्देशांक माना जा सकता है, और अंतिम को मूल्यों के रूप में माना जा सकता है। c1, c2, c3, value 1, 2, 6, 0.456 34, 34, 12 0.27 12, 1, 66 0.95 अंतिम मूल्य पर पहले तीन …

1
लॉजिस्टिक रिग्रेशन विथ रिग्रेशन स्प्लिन्स आर
मैं ब्रिटेन में सिर की चोट के एक राष्ट्रीय आघात डेटाबेस से पूर्वव्यापी डेटा के आधार पर एक लॉजिस्टिक रिग्रेशन मॉडल विकसित कर रहा हूं। मुख्य परिणाम 30 दिन की मृत्यु है ("जीवित" उपाय के रूप में चिह्नित)। पिछले अध्ययनों में परिणाम पर महत्वपूर्ण प्रभाव के प्रकाशित सबूत के साथ …

1
MCMC में ऑटोकार्ट्रेशन प्लॉट की व्याख्या कैसे करें
जॉन के क्रूसके द्वारा "पिल्ला किताब" के रूप में भी जानी जाने वाली पुस्तक डूइंग बेयसियन डेटा एनालिसिस पढ़कर मैं बायेसियन आंकड़ों से परिचित हो रहा हूं । अध्याय 9 में, पदानुक्रमित मॉडल को इस सरल उदाहरण के साथ पेश किया जाता है: और बर्नोली अवलोकन 3 सिक्के, प्रत्येक 10 …

1
GBM प्रिडिक्शन इंटरवल कैसे खोजें
मैं कैरेट पैकेज का उपयोग करके GBM मॉडल के साथ काम कर रहा हूं और अपने अनुमानित डेटा के लिए पूर्वानुमान अंतराल को हल करने के लिए एक विधि ढूंढ रहा हूं। मैंने बड़े पैमाने पर खोज की है लेकिन केवल रैंडम फ़ॉरेस्ट के लिए पूर्वानुमान अंतराल खोजने के लिए …

3
रेखीय प्रतिगमन में इस्तेमाल किए जाने वाले गॉसियन बेसिस फ़ंक्शन मापदंडों को समझना
मैं एक रेखीय प्रतिगमन कार्यान्वयन में गाऊसी आधार फ़ंक्शन को लागू करना चाहता हूं। दुर्भाग्य से मुझे आधार फ़ंक्शन में कुछ मापदंडों को समझने में मुश्किल समय आ रहा है। विशेष रूप से और ।μμ\muσσ\sigma मेरा डेटासेट एक 10,000 x 31 मैट्रिक्स है। 10,000 नमूने और 31 सुविधाएँ। मैंने पढ़ा …


3
मैं ट्रिमिंग प्रतिशत बनाम छंटनी के माध्यम की साजिश की व्याख्या कैसे कर सकता हूं?
एक होमवर्क प्रश्न के भाग के लिए, मुझे सबसे छोटे और सबसे बड़े अवलोकन को हटाकर और परिणाम की व्याख्या करने के लिए एक डेटासेट के लिए छंटनी के माध्यम की गणना करने के लिए कहा गया था। छंटनी का मतलब अप्रभावित माध्य से कम था। मेरी व्याख्या यह थी …

4
आउटलायर्स को हटाने के लिए अच्छा फॉर्म?
मैं सॉफ्टवेयर बिल्ड के लिए आंकड़ों पर काम कर रहा हूं। मेरे पास पास / असफल और बीते हुए समय पर प्रत्येक निर्माण के लिए डेटा है और हम इन / सप्ताह के ~ 200 उत्पन्न करते हैं। सफलता की दर कुल मिलाकर आसान है, मैं कह सकता हूं कि …

2
SAS PROC GLIMMIX मुझे एक द्विपद शुक्राणु के लिए ग्लमर (lme4) की तुलना में बहुत अलग यादृच्छिक ढलान क्यों देता है
मैं आर के साथ अधिक परिचित हूं, और चार निवास स्थानों के लिए 5 वर्षों में लगभग 35 व्यक्तियों के लिए यादृच्छिक ढलान (चयन गुणांक) का अनुमान लगाने की कोशिश कर रहा हूं। प्रतिक्रिया चर है कि क्या कोई स्थान "उपयोग किया गया था" (1) या "उपलब्ध" (0) निवास स्थान …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.