सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
रेखीय मिश्रित प्रभाव मॉडल के परिणामों की रिपोर्टिंग
रेखीय मिश्रित प्रभाव वाले मॉडल आमतौर पर जीव विज्ञान के मेरे कोने में उपयोग नहीं किए जाते हैं, और मुझे उन सांख्यिकीय परीक्षण की रिपोर्ट करने की आवश्यकता है जो मैंने एक पेपर में उपयोग किया था जिसे मैं लिखने की कोशिश कर रहा हूं। मुझे पता है कि बहुस्तरीय …

2
वेरिएंस-कोवरियन मैट्रिक्स व्याख्या
मान लें कि हमारे पास एक रैखिक मॉडल है Model1और vcov(Model1)निम्नलिखित मैट्रिक्स देता है: (Intercept) latitude sea.distance altitude (Intercept) 28.898100 -23.6439000 -34.1523000 0.50790600 latitude -23.643900 19.7032500 28.4602500 -0.42471450 sea.distance -34.152300 28.4602500 42.4714500 -0.62612550 altitude 0.507906 -0.4247145 -0.6261255 0.00928242 इस उदाहरण के लिए, यह मैट्रिक्स वास्तव में क्या प्रदर्शित करता है? …

2
यह वितरण एक समान क्यों है?
हम बायेसियन सांख्यिकीय परीक्षण की जांच कर रहे हैं, और एक विषम (मेरे लिए कम से कम) घटना पर आते हैं। निम्नलिखित मामले पर विचार करें: हम यह मापने में रुचि रखते हैं कि कौन सी जनसंख्या, ए या बी, की उच्च रूपांतरण दर है। एक जांच के लिए, हम …

1
दो नमूनों के साधनों की तुलना करने के लिए बूटस्ट्रैप टेस्ट कैसे करें?
मेरे पास दो भारी तिरछे नमूने हैं और मैं टी-स्टेटिस्टिक का उपयोग करके अपने साधनों की तुलना करने के लिए बूटस्ट्रैपिंग का उपयोग करने की कोशिश कर रहा हूं। इसे करने की सही प्रक्रिया क्या है? मैं जिस प्रक्रिया का उपयोग कर रहा हूं मैं अंतिम चरण में मूल / …

2
इंटेलिजेंस स्क्वायर्ड स्कोरिंग और विनर निर्धारण
एक एनपीआर पॉडकास्ट है जिसे इंटेलिजेंस स्क्वॉयर कहा जाता है। प्रत्येक एपिसोड कुछ विवादास्पद बयान पर लाइव डिबेट का प्रसारण है जैसे कि "दूसरा संशोधन अब प्रासंगिक नहीं है" या "कॉलेज परिसरों पर सकारात्मक कार्रवाई अच्छे से अधिक नुकसान करती है"। चार प्रतिनिधियों ने बहस की- दो प्रस्ताव के लिए …
12 bayesian  rating 

3
क्या सिद्धांत, फिट या कुछ और के आधार पर वितरण का चयन करना बेहतर है?
यह एक दार्शनिक प्रश्न पर आधारित है, लेकिन मुझे इस बात में दिलचस्पी है कि वितरण अनुभव के बारे में अधिक अनुभव वाले अन्य लोग कैसे सोचते हैं। कुछ मामलों में यह स्पष्ट लगता है कि सिद्धांत सबसे अच्छा काम कर सकता है (चूहों की पूंछ की लंबाई संभवतः सामान्य …

1
मैं एचएमएम को वर्गीकरण के लिए कैसे प्रशिक्षित करूं?
इसलिए मैं समझता हूं कि जब आप एचएमएम को प्रशिक्षित करते हैं तो मानक दृष्टिकोण का वर्गीकरण होता है: प्रत्येक वर्ग के लिए अपने डेटा सेट को डेटा सेट में अलग करें प्रति वर्ग एक एचएमएम को प्रशिक्षित करें परीक्षण सेट पर प्रत्येक विंडो को वर्गीकृत करने के लिए प्रत्येक …

1
यदि परीक्षण सांख्यिकीय का वितरण द्विविध है, तो क्या पी-वैल्यू का कोई मतलब है?
पी-मूल्य को कम से कम चरम पर एक परीक्षण-सांख्यिकीय प्राप्त करने की संभावना के रूप में परिभाषित किया गया है जो कि मनाया जाता है, शून्य-परिकल्पना को सच मानते हैं। दूसरे शब्दों में, लेकिन क्या होगा अगर परीक्षण आंकड़ा वितरण में bimodal है? इस संदर्भ में पी-वैल्यू का क्या मतलब …

3
बॉक्सप्लॉट से कम विचरण
मैं सोच रहा था कि एक बॉक्सप्लॉट का उपयोग करके एक चर के प्रसरण को कैसे कम किया जाए। क्या कम से कम यह घटाना संभव है कि क्या दो चर एक समान रूप से अपने बॉक्सप्लॉट को देख रहे हों?
12 variance  boxplot 

2
सामान्यीकृत रैखिक मॉडल में सामान्यता के लिए अवशिष्ट की जाँच करना
यह पेपर डेटा का विश्लेषण करने के लिए सामान्यीकृत रैखिक मॉडल (द्विपद और नकारात्मक द्विपद त्रुटि वितरण) का उपयोग करता है। लेकिन फिर विधियों के सांख्यिकीय विश्लेषण अनुभाग में, यह कथन है: ... और लॉजिस्टिक रिग्रेशन मॉडल का उपयोग करके उपस्थिति डेटा मॉडलिंग करके, और सामान्यीकृत रैखिक मॉडल (जीएलएम) का …


1
गैर गणितज्ञों के लिए क्लॉपर-पीयरसन
मैं सोच रहा था कि क्या कोई मुझे अनुपात के लिए क्लॉपर-पियर्सन सीआई से परे अंतर्ज्ञान समझा सकता है। जहाँ तक मुझे पता है, हर CI में एक विचरण शामिल होता है। हालांकि, अनुपात के लिए, भले ही मेरा अनुपात 0 या 1 (0% या 100%) हो, क्लॉपर-पीयरसन सीआई की …

4
अनिश्चितताओं को शामिल करते हुए कर्नेल घनत्व का अनुमान
जब एक-आयामी डेटा की कल्पना करते हैं, तो यह गलत तरीके से चुने गए बिन चौड़ाई के लिए खाता करने के लिए कर्नेल घनत्व अनुमान तकनीक का उपयोग करना आम है। जब मेरे एक आयामी डेटासेट में माप अनिश्चितता होती है, तो क्या इस जानकारी को शामिल करने का कोई …

2
एक प्रश्नावली से बेकार सवालों की पहचान
मैं एक प्रश्नावली विकसित कर रहा हूं। इसकी विश्वसनीयता और वैधता में सुधार के लिए मैं सांख्यिकीय विधियों का उपयोग करना चाहता हूं। मैं उन सवालों को खत्म करना चाहता हूं जिनके जवाब हमेशा एक जैसे होते हैं। इसका मतलब है कि लगभग सभी प्रतिभागियों ने उन सवालों पर एक …

4
क्या आप क्रॉस-वेलिडेशन द्वारा कोई जमीनी सच्चाई वाले डेटासेट पर विभिन्न क्लस्टरिंग विधियों की तुलना कर सकते हैं?
वर्तमान में, मैं एक टेक्स्ट डॉक्यूमेंट डेटासेट का विश्लेषण करने की कोशिश कर रहा हूँ जिसमें कोई जमीनी सच्चाई नहीं है। मुझे बताया गया था कि आप अलग-अलग क्लस्टरिंग विधियों की तुलना करने के लिए k-fold क्रॉस सत्यापन का उपयोग कर सकते हैं। हालाँकि, मैंने पिछले दिनों जो उदाहरण देखे …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.