सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

4
Bayesian प्रायिकता के दृष्टिकोण से, 95% विश्वास अंतराल में 95% प्रायिकता के साथ सही पैरामीटर क्यों नहीं है?
विश्वास अंतराल पर विकिपीडिया पृष्ठ से : ... यदि आत्मविश्वास अंतरालों का निर्माण दोहराया (और संभवतः अलग) प्रयोगों के कई अलग-अलग डेटा विश्लेषणों में किया जाता है, तो ऐसे अंतरालों का अनुपात जिसमें पैरामीटर का सही मूल्य होता है, आत्मविश्वास स्तर से मेल खाते हैं ... और उसी पेज से: …

1
संभावना अनुपात परीक्षण - lmer R - गैर-नेस्टेड मॉडल
मैं वर्तमान में कुछ काम की समीक्षा कर रहा हूं और निम्नलिखित में आया हूं, जो मुझे गलत लगता है। दो मिश्रित मॉडल को (आर में) लमर का उपयोग करके फिट किया जाता है। मॉडल गैर-नेस्टेड हैं और इसकी तुलना संभावना-अनुपात परीक्षणों द्वारा की जाती है। संक्षेप में, यहाँ मेरे …

4
स्पीयरमैन सहसंबंध के लिए निम्नलिखित दो सूत्रों की समतुल्यता साबित करें
से विकिपीडिया , स्पीयरमैन की वरीयता श्रेणी सहसंबंध चर परिवर्तित करके की जाती है और स्थान पर रहीं चर में और , और फिर वें स्थान पर चर के बीच पियर्सन की सहसंबंध की गणना:Y i x i y iXiXiX_iYiYiY_ixixix_iyiyiy_i हालाँकि, लेख यह कि यदि चर और Y_i के बीच …

3
क्या मैं नमूना आकार, और न्यूनतम और अधिकतम मूल्यों से एक सामान्य वितरण का पुनर्निर्माण कर सकता हूं? मैं मध्य-बिंदु का उपयोग प्रॉक्सी का मतलब करने के लिए कर सकता हूं
मुझे पता है कि यह थोड़ा रोपे हो सकता है, सांख्यिकीय रूप से, लेकिन यह मेरी समस्या है। मेरे पास बहुत सी श्रेणी के डेटा हैं, जो एक चर का न्यूनतम, अधिकतम और नमूना आकार कहना है। इन आंकड़ों में से कुछ के लिए मेरे पास एक मतलब है, लेकिन …

2
असमान नमूना आकार: जब कॉल करने के लिए यह क्विट करता है
मैं एक अकादमिक पत्रिका के लेख की समीक्षा कर रहा हूं और लेखकों ने किसी हीन सांख्यिकी की सूचना न देने के औचित्य के रूप में निम्नलिखित लिखा है (मैंने दो समूहों की प्रकृति को स्पष्ट किया है): कुल में, 2,349 में से 25 (1.1%) उत्तरदाताओं ने एक्स की सूचना …

1
गैर-पैरामीट्रिक अनुमानित वितरण से यादृच्छिक नमूने कैसे आकर्षित करें?
मेरे पास 100 अंकों का एक नमूना है जो निरंतर और एक आयामी है। मैंने कर्नेल विधियों का उपयोग करके इसके गैर-पैरामीट्रिक घनत्व का अनुमान लगाया। मैं इस अनुमानित वितरण से यादृच्छिक नमूने कैसे खींच सकता हूं?

3
रैंडम फ़ॉरेस्ट मॉडल में अधिक हाल के डेटा को वेट करना
मैं 6 श्रेणियों के बीच भेदभाव करने के लिए रैंडम फ़ॉरेस्ट के साथ एक वर्गीकरण मॉडल का प्रशिक्षण दे रहा हूं। मेरे लेन-देन के डेटा में लगभग 60k + अवलोकन और 35 चर हैं। यहाँ एक उदाहरण है कि यह लगभग कैसा दिखता है। _________________________________________________ |user_id|acquisition_date|x_var_1|x_var_2| y_vay | |-------|----------------|-------|-------|--------| |111 …

4
क्या रैंडम फ़ॉरेस्ट मेथडोलॉजी को रैखिक प्रतिगमन पर लागू किया जा सकता है?
रैंडम फ़ॉरेस्ट निर्णय पेड़ों की एक टुकड़ी बनाकर काम करते हैं जहां प्रत्येक पेड़ मूल प्रशिक्षण डेटा (इनपुट चर और टिप्पणियों दोनों का नमूना) के बूटस्ट्रैप नमूने का उपयोग करके बनाया जाता है। क्या रेखीय प्रतिगमन के लिए एक समान प्रक्रिया लागू की जा सकती है? प्रत्येक k regressions के …

3
एक बहुपद प्रतिगमन से विश्वास बैंड को समझना
मैं नीचे दिए गए मेरे ग्राफ में दिखाई देने वाले परिणाम को समझने की कोशिश कर रहा हूं। आमतौर पर, मैं एक्सेल का उपयोग करता हूं और एक रेखीय-प्रतिगमन लाइन प्राप्त करता हूं, लेकिन नीचे के मामले में मैं आर का उपयोग कर रहा हूं और मुझे कमांड के साथ …

3
कॉक्स PH मॉडल से बचने के समय के संदर्भ में भविष्यवाणियां कैसे करें?
मैं उन प्रतिभागियों के डेटासेट में सर्व-मृत्यु दर के लिए एक भविष्यवाणी मॉडल (कॉक्स पीएच) विकसित करना चाहता हूं, जिनके (लगभग) सभी फॉलो-अप के अंत में मृत्यु हो गई है (जैसे 1-वर्ष)। एक निश्चित समय-बिंदु पर मरने के पूर्ण जोखिम की भविष्यवाणी करने के बजाय, मैं प्रत्येक व्यक्ति के लिए …

3
क्या p = 5.0% महत्वपूर्ण है?
आज मुझसे पूछा गया कि क्या 0.05 (बिल्कुल) का p- मान महत्वपूर्ण माना जाता है (अल्फा = 5%) या नहीं। मुझे उत्तर नहीं पता था और Google ने दोनों उत्तर दिए: (a) परिणाम महत्वपूर्ण है यदि p 5% से कम है और (b) यदि p 5% से कम है या …

3
प्रत्येक पत्ते में रैखिक प्रतिगमन मॉडल के साथ प्रतिगमन ट्री एल्गोरिदम
लघु संस्करण: मैं एक आर पैकेज की तलाश कर रहा हूं जो निर्णय पेड़ों का निर्माण कर सकता है जबकि निर्णय पेड़ में प्रत्येक पत्ती एक पूर्ण रैखिक प्रतिगमन मॉडल है। AFAIK, पुस्तकालय rpartनिर्णय वृक्ष बनाता है जहाँ प्रत्येक पत्ती में आश्रित चर स्थिर होता है। क्या एक और पुस्तकालय …
14 r  regression  rpart  cart 

1
क्रमिक और एक सतत चर के बीच सहसंबंध का सही आकलन कैसे करें?
मैं इसके बीच सहसंबंध का अनुमान लगाना चाहता हूं: एक क्रमिक चर: विषयों को 1-5 पैमाने पर 6 प्रकार के फलों के लिए उनकी पसंद को रेट करने के लिए कहा जाता है (बहुत घृणित से लेकर बहुत स्वादिष्ट तक) औसत विषयों में पैमाने के केवल 3 बिंदुओं का उपयोग …

2
छोटे
मुझे एक अध्ययन के लिए विश्लेषण करने के लिए चार अलग-अलग समय बिंदुओं पर लोहे के स्तर पर उपचार के प्रभाव को देखने के लिए डेटा दिया गया था (उपचार से पहले, दिन उपचार समाप्त हो गया, उपचार के 4 सप्ताह बाद और उपचार के 2-4 महीने बाद)। कोई नियंत्रण …

3
क्रोनबाक के अल्फा मूल्यों के लिए विवरण कहां से आते हैं (जैसे, गरीब, उत्कृष्ट)?
क्रोनबाक के अल्फा मानों का वर्णन करना काफी आम लगता है: α ≥ 0.9 उत्कृष्ट 0.7 ≤ α <0.9 अच्छा 0.6 ≤ α <0.7 स्वीकार्य 0.5 ≤ α <0.6 गरीब α <0.5 अस्वीकार्य ये मूल्य कहां से आते हैं? मुझे इनका वर्णन करने वाला एक मूल शोध लेख नहीं मिला। …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.