सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

5
क्या मैं तिरछा सामान्य डेटा के लिए परिकल्पना परीक्षण कर सकता हूं?
मेरे पास डेटा का एक संग्रह है, जिसे मैंने मूल रूप से सोचा था कि सामान्य रूप से वितरित किया गया था। तब मैंने वास्तव में इसे देखा, और महसूस किया कि यह नहीं था, ज्यादातर इसलिए क्योंकि डेटा तिरछा है, और मैंने एक शॉपीरो-विकक्स टेस्ट भी किया। मैं अभी …

2
वर्गीकरण के लिए एसवीएम के साथ Adaboost का उपयोग करना
मुझे पता है कि Adaboost कमजोर क्लासीफायर के सेट के रैखिक संयोजन का उपयोग करके एक मजबूत क्लासिफायरियर बनाने की कोशिश करता है। हालाँकि, मैंने कुछ शर्तों और मामलों में Adaboost और SVM के सामंजस्य (भले ही SVM एक मजबूत क्लासिफायरिफायर है) में काम करने वाले सुझाव देने वाले कुछ …

2
आश्चर्य है कि यह बीन प्लॉट विश्लेषण चार्ट का क्या मतलब है
कोई बीन प्लॉट चार्ट की व्याख्या और निर्माण कैसे करता है। यहाँ एक उदाहरण वॉकस एट अल से लिया गया है । 2010 । यह किस तरह का डेटा है? (स्रोत: biomedcentral.com )

2
क्या मेला मरना ऐसी कोई बात है?
क्या मेला मरना ऐसी कोई बात है? पासा पर जहां नंबर एक स्कूप आउट डॉट द्वारा दर्शाया जाता है, निश्चित रूप से इससे फर्क पड़ता है? क्या किसी ने कोई शोध किया है? वास्तव में इसके बारे में सोचकर, एक सिक्का फ्लिप क्यों उचित होगा? हर तरफ का भौतिकी पूरी …
11 dice 

2
क्या पॉइसन वितरण स्थिर है और एमजीएफ के लिए व्युत्क्रम सूत्र हैं?
सबसे पहले, मेरे पास एक सवाल है कि पॉइसन वितरण "स्थिर" है या नहीं। बहुत भोलेपन से (और "स्थिर" वितरण के बारे में मुझे भी यकीन नहीं है), मैंने एमजीएफ के उत्पाद का उपयोग करके आरवी के वितरित पॉसों के रैखिक संयोजन का काम किया। ऐसा लगता है कि मुझे …

3
मैं सामान्य वितरण से नमूना मानक विचलन का मानक विचलन कैसे पा सकता हूं?
मुझे माफ कर दो अगर मैंने कुछ स्पष्ट याद किया है। मैं एक भौतिक विज्ञानी हूं जो अनिवार्य रूप से एक (हिस्टोग्राम) वितरण एक औसत मूल्य के बारे में केंद्रित है जो एक सामान्य वितरण के लिए अनुमानित है। मेरे लिए महत्वपूर्ण मूल्य इस गाऊसी यादृच्छिक चर का मानक विचलन …

2
महत्वपूर्ण भविष्यवक्ता एकाधिक लॉजिस्टिक प्रतिगमन में गैर-महत्वपूर्ण हो जाते हैं
जब मैं दो अलग-अलग (अविभाज्य) लॉजिस्टिक रिग्रेशन मॉडल में अपने चर का विश्लेषण करता हूं, तो मुझे निम्नलिखित मिलते हैं: Predictor 1: B= 1.049, SE=.352, Exp(B)=2.85, 95% CI=(1.43, 5.69), p=.003 Constant: B=-0.434, SE=.217, Exp(B)=0.65, p=.046 Predictor 2: B= 1.379, SE=.386, Exp(B)=3.97, 95% CI=(1.86, 8.47), p<.001 Constant: B=-0.447, SE=.205, Exp(B)=0.64, p=.029 …

1
एबीसी मॉडल चयन
यह दिखाया गया है कि सारांश आंकड़ों के उपयोग से आने वाली त्रुटि की उपस्थिति के कारण बेयस कारकों का उपयोग करने वाले एबीसी मॉडल विकल्प की सिफारिश नहीं की जानी है। इस पत्र में निष्कर्ष बेयस कारक (एल्गोरिथम 2) के अनुमान के लिए एक लोकप्रिय विधि के व्यवहार के …

2
भविष्यवाणी और सहिष्णुता अंतराल
मेरे पास भविष्यवाणी और सहिष्णुता के अंतराल के लिए कुछ प्रश्न हैं। आइए पहले सहिष्णुता अंतराल की परिभाषा पर सहमत हों: हमें एक विश्वास स्तर दिया जाता है, 90% कहते हैं, जनसंख्या का प्रतिशत कैप्चर करने के लिए, 99% और एक नमूना आकार कहते हैं, 20 कहते हैं। संभाव्यता वितरण …

1
क्या फिशर z में r का रूपांतरण मेटा-एनालिसिस को लाभ देता है?
आमतौर पर को दो मानों के बीच अंतर का परीक्षण करने के लिए फिशर में बदल दिया जाता है । लेकिन, जब एक मेटा-विश्लेषण किया जाना है, तो हमें ऐसा कदम क्यों उठाना चाहिए? क्या यह माप त्रुटि या गैर-नमूना त्रुटि के लिए सही है और हमें यह क्यों मानना …

3
डेटासेट में परिवर्तनशील नाम
अच्छे चर नाम हैं: a) टाइप करने के लिए छोटा / आसान, बी) याद रखने में आसान, c) समझने योग्य / संप्रेषणीय। क्या मैं कुछ भूल रहा हूँ? संगति कुछ देखने के लिए है। जिस तरह से मैं इसे रखूंगा वह यह है कि लगातार नामकरण परंपराएं उपरोक्त गुणों में …

2
"इकाई सूचना पूर्व" क्या है?
मैं Wagenmakers (2007) पढ़ रहा हूँ p मानों की व्यापक समस्या का एक व्यावहारिक समाधान । मैं बीआईसी के मूल्यों को बेयस कारकों और संभावनाओं में परिवर्तित कर रहा हूं। हालाँकि, अब तक मुझे इस बात की अच्छी जानकारी नहीं है कि यूनिट की पूर्व सूचना क्या है। मैं चित्रों …

1
आर में एक पॉइसन जीएलएम फिटिंग - दर बनाम मायने रखता है
मैं वर्तमान में एक प्रोजेक्ट पर काम कर रहा हूं जिसमें समय के साथ कुछ गणना डेटा के GLM (और अंततः GAM) शामिल हैं। आम तौर पर मैं इसे एसएएस में करूंगा, लेकिन मैं आर के लिए जाने की कोशिश कर रहा हूं, और ... मुद्दे। जब मैं निम्नलिखित का …

3
सट्टेबाज अपनी शुरुआती बाधाओं का चयन कैसे करते हैं?
मुझे पता है कि सट्टेबाजों ने प्रत्येक परिणाम में रखे गए धन की मात्रा की संभावनाओं की भविष्यवाणी करते हुए, लाभ को अधिकतम करने के लिए अपनी बाधाओं को समायोजित किया। सट्टेबाज अपनी शुरुआती बाधाओं का चयन कैसे करते हैं?

4
लॉटरी में लोगों द्वारा किस संख्या को चुने जाने की संभावना है?
मेगा मिलियन आज $ 500 मिलियन से अधिक है। मुझे याद है कि कुछ संख्याओं के बारे में एक JSTOR पेपर पढ़ना, जिन्हें चुने जाने की सबसे अधिक संभावना नहीं है। उदाहरण के लिए बहुत से लोग 7 चुनते हैं क्योंकि यह उनकी भाग्यशाली संख्या है, और मैं इसके विपरीत …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.