सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
IV के रूप में दिशात्मक डेटा के साथ लॉजिस्टिक प्रतिगमन
मैं प्रतिगमन में एक स्वतंत्र चर के रूप में दिशात्मक डेटा (डिग्री में दिशा का माप) का उपयोग करने पर अच्छे संदर्भों की तलाश कर रहा हूं; आदर्श रूप से, यह पदानुक्रमित गैरलाइन मॉडल (डेटा नेस्टेड हैं) के लिए भी उपयोगी होगा। मुझे दिशात्मक डेटा में भी दिलचस्पी है। मुझे …

3
क्या संभावना है कि अनंत विचरण के साथ एक सामान्य वितरण का इसके मतलब से अधिक मूल्य है?
मुझे आज साक्षात्कार में कुछ इसी तरह से पूछा गया। साक्षात्कारकर्ता यह जानना चाहता था कि क्या संभावना है कि जब एक अस्थिरता अनंतता में आ जाती है तो एक पैसे का विकल्प पैसा खत्म हो जाएगा। मैंने कहा 0% क्योंकि सामान्य वितरण जो कि ब्लैक-स्कोल्स मॉडल से गुजरते हैं …

4
दो यादृच्छिक चर के छोटे के लिए निष्पक्ष अनुमानक
मान लीजिए और वाई ~ एन ( μ y , σ 2 y )एक्स∼ एन( μएक्स, σ2एक्स)X∼N(μx,σx2)X \sim \mathcal{N}(\mu_x, \sigma^2_x)Y∼ एन( μy, σ2y)Y∼N(μy,σy2)Y \sim \mathcal{N}(\mu_y, \sigma^2_y) मुझे में दिलचस्पी है । क्या z के लिए एक निष्पक्ष अनुमानक है ?z= मिनट ( μएक्स, μy)z=min(μx,μy)z = \min(\mu_x, \mu_y)zzz सरल की आकलनकर्ता …

1
एक "सरल" माप त्रुटि मॉडल फिटिंग के लिए तरीके
मैं उन तरीकों की तलाश कर रहा हूं जिनका उपयोग "ओएलएस" माप त्रुटि मॉडल का अनुमान लगाने के लिए किया जा सकता है। x i = X i + e x , i Y i = α + β X iyमैं= यमैं+ ईy, मैंyi=Yi+ey,iy_{i}=Y_{i}+e_{y,i} एक्समैं= एक्समैं+ ईx , ixi=Xi+ex,ix_{i}=X_{i}+e_{x,i} Yमैं= …

4
शून्य-छिन्न नकारात्मक द्विपद GEE के लिए R / Stata पैकेज?
यह मेरा पहला पोस्ट है। मैं इस समुदाय के लिए वास्तव में आभारी हूं। मैं अनुदैर्ध्य गणना डेटा का विश्लेषण करने की कोशिश कर रहा हूं जो शून्य-ट्रेंकेटेड है (संभावना है कि प्रतिक्रिया चर = 0 0 है), और माध्य! = विचरण, इसलिए एक नकारात्मक द्विपद वितरण एक पॉइसन पर …

2
क्लस्टरिंग परिणामों की तुलना को समझना
मैं समूहों में डेटा वर्गीकृत करने के साथ प्रयोग कर रहा हूं। मैं इस विषय पर काफी नया हूं, और कुछ विश्लेषणों के उत्पादन को समझने की कोशिश कर रहा हूं। क्विक-आर के उदाहरणों का उपयोग करते हुए , कई Rपैकेज सुझाए गए हैं। मैंने इनमें से दो पैकेज ( …
13 r  clustering 

3
बहुभिन्नरूपी-बर्नौली वितरण के लिए संभाव्यता सूत्र
मैं एक एन-variate में एक घटना की संभावना के लिए एक सूत्र की जरूरत Bernoulli वितरण दिया साथ संभावनाओं एक भी तत्व के लिए और तत्वों के जोड़े के लिए । समान रूप से मैं माध्य और सहसंयोजक दे सकता था ।X∈{0,1}nX∈{0,1}nX\in\{0,1\}^nP(Xi=1)=piP(Xi=1)=piP(X_i=1)=p_iP(Xi=1∧Xj=1)=pijP(Xi=1∧Xj=1)=pijP(X_i=1 \wedge X_j=1)=p_{ij}XXX मुझे पहले से ही पता था …

3
LASSO समाधान की गणना के लिए GLMNET या LARS?
मैं LASSO समस्या के लिए गुणांक प्राप्त करना चाहूंगा ||Y−Xβ||+λ||β||1.||Y−Xβ||+λ||β||1.||Y-X\beta||+\lambda ||\beta||_1. समस्या यह है कि ग्लमैनेट और लार्स फ़ंक्शन अलग-अलग उत्तर देते हैं। Glmnet फ़ंक्शन के लिए मैं के गुणांक के लिए पूछता हूं / | | य | | सिर्फ λ के बजाय , लेकिन मुझे अभी भी अलग-अलग …

2
अनुपात-लौकिक पूर्वानुमान त्रुटियों का खोजपूर्ण विश्लेषण
डेटा: मैंने हाल ही में पवन ऊर्जा उत्पादन पूर्वानुमान त्रुटियों के अनुपात-लौकिक क्षेत्र के स्टोचैस्टिक गुणों का विश्लेषण करने पर काम किया है। औपचारिक रूप से, यह एक प्रक्रिया होने के लिए कहा जा सकता है समय में दो बार अनुक्रमित किया जाता है (tऔरh के साथ) और एक बार …

7
सांख्यिकी सिद्धांत और अनुप्रयोगों से समझ बनाना
मैंने हाल ही में मेडिकल और बायोलॉजिकल मॉडलिंग में अपनी स्नातकोत्तर डिग्री के साथ इंजीनियरिंग गणित के साथ एक पृष्ठभूमि के रूप में स्नातक किया है। भले ही मेरे शिक्षा कार्यक्रम में गणितीय आंकड़ों पर एक महत्वपूर्ण मात्रा में पाठ्यक्रम शामिल थे (एक सूची के लिए नीचे देखें), जिसे मैंने …

5
यह कैसे साबित करें कि एलो रेटिंग या पेज रैंकिंग मेरे सेट के लिए एक अर्थ है?
मेरे पास खिलाड़ियों का एक सेट है। वे एक दूसरे के खिलाफ (जोड़ीदार) खेलते हैं। खिलाड़ियों के जोड़े बेतरतीब ढंग से चुने जाते हैं। किसी भी खेल में, एक खिलाड़ी जीतता है और दूसरा हारता है। खिलाड़ी एक दूसरे के साथ सीमित संख्या में खेल खेलते हैं (कुछ खिलाड़ी अधिक …

1
क्या संभावना अनुपात और बायेसियन मॉडल तुलना शून्य-परिकल्पना परीक्षण के लिए बेहतर और पर्याप्त विकल्प प्रदान करती है?
सांख्यिकीविदों और शोधकर्ताओं के बढ़ते शरीर के जवाब में, जो एक संचयी प्रयास के रूप में विज्ञान के लिए अशक्त-परिकल्पना परीक्षण (NHT) की उपयोगिता की आलोचना करते हैं, अमेरिकी मनोवैज्ञानिक एसोसिएशन टास्क फोर्स ऑन स्टेटिक इन्वेंशन ने NHT पर एक समान प्रतिबंध लगाने से परहेज किया, लेकिन इसके बजाय शोधकर्ताओं …

5
स्टेपवाइज लॉजिस्टिक रिग्रेशन और सैंपलिंग
मैं SPSS में डेटा के एक सेट पर एक स्टेपवाइज लॉजिस्टिक रिग्रेशन फिट कर रहा हूं। इस प्रक्रिया में, मैं अपने मॉडल को एक यादृच्छिक सबसेट में फिट कर रहा हूं जो लगभग है। कुल नमूने का 60%, जो लगभग 330 मामले हैं। मुझे जो दिलचस्प लगता है वह यह …

1
लार्स बनाम लैस्सो के लिए वंश का समन्वय
लार्स का उपयोग करने के पेशेवरों और विपक्ष क्या हैं [1] बनाम एल -1-नियमित रैखिक प्रतिगमन फिटिंग के लिए समन्वित वंश का उपयोग करना? मुझे मुख्य रूप से प्रदर्शन के पहलुओं में दिलचस्पी है (मेरी समस्याएं Nसैकड़ों और हजारों की संख्या में हैं p। <20) हालांकि, किसी भी अन्य अंतर्दृष्टि …

1
आर में एक एलएम ऑब्जेक्ट के बिना नेवी-वेस्ट मानक त्रुटियों की गणना करें
मैंने यह सवाल कल StackOverflow पर पूछा , और एक उत्तर मिला, लेकिन हम सहमत हुए कि यह थोड़ा हैकिश लगता है और इसे देखने का एक बेहतर तरीका हो सकता है। प्रश्न: मैं वेक्टर के लिए Newey-West (HAC) मानक त्रुटियों की गणना करना चाहता हूं (इस मामले में स्टॉक …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.