सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

3
निरंतर वितरण से सैंपल किए गए डेटा के मोड की गणना करना
निरंतर वितरण से नमूना किए गए डेटा के 'मोड' की फिटिंग के लिए सबसे अच्छे तरीके क्या हैं? चूंकि निरंतर वितरण के लिए मोड तकनीकी रूप से अपरिभाषित है (दाएं?), मैं वास्तव में पूछ रहा हूं कि 'आप सबसे सामान्य मूल्य कैसे पाते हैं'? यदि आप मानते हैं कि माता-पिता …

3
बहुस्तरीय मॉडलिंग के लिए उदाहरणात्मक डेटासेट और विश्लेषण
मैंने हाल ही में मल्टीलेवल मॉडलिंग पर एक परिचयात्मक पाठ्यक्रम लिया। हमारे द्वारा उपयोग किए जाने वाले अधिकांश डेटासेट और उदाहरण सामाजिक विज्ञान के थे। मुझे अभी एक बायोस्टैटिस्टिक्स विभाग में 2 सप्ताह की इंटर्नशिप मिली है, जहाँ वे चाहते हैं कि मैं एक ऐसी आपातकालीन स्थिति के लिए रोगी …

1
एक यादृच्छिक वन वृक्ष के लिए एक बेहतर लागत फ़ंक्शन: गिन्नी इंडेक्स या एन्ट्रॉपी?
एक यादृच्छिक वन वृक्ष के लिए एक बेहतर लागत फ़ंक्शन: गिन्नी इंडेक्स या एन्ट्रॉपी? मैं क्लोजर में यादृच्छिक वन को लागू करने की कोशिश कर रहा हूं।

2
जब कुछ समय बिंदुओं में भारी प्रतिक्रियाएं होती हैं और कुछ दोहराया उपायों के अध्ययन में नहीं आता है तो क्या करें?
आमतौर पर, जब एक अनुदैर्ध्य डिजाइन में निरंतर लेकिन तिरछे परिणाम के उपायों का सामना होता है (जैसे, एक-विषय के प्रभाव के साथ) सामान्य दृष्टिकोण परिणाम को सामान्यता में बदलना है। यदि स्थिति चरम है, जैसे कि छंटनी की गई टिप्पणियों के साथ, किसी को फैंसी मिल सकता है और …

2
एक अनपेक्षित टी-टेस्ट के लिए कौन सी सामान्य धारणाएं आवश्यक हैं? और वे कब मिले?
यदि हम एक युग्मित टी-टेस्ट आयोजित करना चाहते हैं, तो आवश्यकता है (यदि मैं सही ढंग से समझता हूं) कि माप की मिलान इकाइयों के बीच औसत अंतर सामान्य रूप से वितरित किया जाएगा। युग्मित टी-टेस्ट में, यह मांग में व्यक्त किया गया है (AFAIK) कि माप की मिलान इकाइयों …

1
लॉजिस्टिक रिग्रेशन के लिए होस्मेर-लेमेशो बनाम एआईसी
यदि होस्मेर-लेमेशो फिट की कमी को इंगित करता है लेकिन एआईसी सभी मॉडलों में सबसे कम है .... तो क्या आपको अभी भी मॉडल का उपयोग करना चाहिए? यदि मैं एक चर को हटाता हूं, तो होस्मेर-लेमेशो स्टेटिस्टिक महत्वपूर्ण नहीं है (जिसका अर्थ है कि फिट की सकल कमी नहीं …

1
उच्च पक्ष के लिए एक तरफा चेबीशेव असमानता
क्या एक पक्षीय मामले में उच्च पल चेबीशेव की असमानताओं का एक एनालॉग है? Chebyshev-Cantelli असमानता केवल विचरण के लिए काम करती है, जबकि Chebyshevs असमानता आसानी से सभी घातांक के लिए उत्पादन किया जा सकता है। क्या किसी को उच्चतर क्षणों का उपयोग करके एकतरफा असमानता का पता चलता …

2
लार्स के लिए लस्सो संशोधन
मैं यह समझने की कोशिश कर रहा हूं कि लार्स उत्पन्न करने के लिए लार्स एल्गोरिथ्म को कैसे संशोधित किया जा सकता है। जबकि मैं LARS को समझता हूं, मैं तिब्शीरानी एट अल द्वारा पेपर से लास्सो संशोधन को देखने में सक्षम नहीं हूं। विशेष रूप से मैं यह नहीं …
12 lasso 

1
निर्णय पेड़ों में बाइनरी विभाजन के कार्यान्वयन में अंतर
मैं एक निर्णय वृक्ष में बाइनरी विभाजन के व्यावहारिक कार्यान्वयन के बारे में उत्सुक हूं - क्योंकि यह एक श्रेणीबद्ध भविष्यवक्ता स्तरों से संबंधित है ।एक्सजेXjX{j} विशेष रूप से, मैं अक्सर किसी फैसले के पेड़ का उपयोग करके भविष्य कहनेवाला मॉडल का निर्माण करते समय (जैसे बैगिंग, ओवरसैंपलिंग आदि) किसी …

9
मैं अपने आप अच्छे ग्राफ कैसे बना सकता हूं?
उदाहरण के लिए। इस पृष्ठ पर उन जैसे http://store.steampowered.com/hwsurvey क्या कोई तैयार सॉफ्टवेयर है जो ऐसा कर सकता है? वैकल्पिक रूप से, अन्य सॉफ़्टवेयर के लिए कोई सिफारिशें जो कुछ समान करती हैं? मुझे पता है कि यह वास्तव में एक सांख्यिकी प्रश्न नहीं है, लेकिन मुझे बहुत दृढ़ता से …

3
सार्वजनिक रूप से उपलब्ध डेटा के लिए होस्टिंग विकल्प
इसलिए आपने प्रजनन योग्य अनुसंधान के विचार का समर्थन करने का निर्णय लिया है और लोगों को देखने और उपयोग करने के लिए अपना डेटा ऑनलाइन उपलब्ध कराना चाहते हैं। सवाल यह है कि आप इसकी मेजबानी कहां करते हैं? मेरा पहला झुकाव निश्चित रूप से एक निजी वीप्लस है …

2
प्रशिक्षण डेटा में असमान समूह आकार के साथ एसवीएम
मैं प्रशिक्षण डेटा से एक एसवीएम बनाने की कोशिश कर रहा हूं जहां एक समूह को दूसरे से अधिक का प्रतिनिधित्व किया जाता है। हालांकि, समूहों को समान रूप से अंतिम परीक्षण डेटा में प्रतिनिधित्व किया जाएगा। इसलिए, मैं प्रशिक्षण डेटा में दो समूहों के प्रभाव को संतुलित करने के …

2
आर में मोंटे कार्लो सिमुलेशन का उपयोग करते हुए लगभग अभिन्न
एमसी सिमुलेशन का उपयोग करके मैं निम्नलिखित अभिन्न को कैसे अनुमानित करूं? ∫1- 1∫1- 1| x-y|डी एक्सd य∫−11∫−11|x−y|dxdy \int_{-1}^{1} \int_{-1}^{1} |x-y| \,\mathrm{d}x \,\mathrm{d}y धन्यवाद! संपादित करें (कुछ संदर्भ): मैं सीखने का प्रयास कर रहा हूं कि अनुकरण का उपयोग कैसे अभिन्न अंग से किया जाए, और जब मैं कुछ कठिनाइयों …

4
सांख्यिकीविदों से परामर्श के लिए संदर्भ अपने ग्राहकों की पेशकश करने के लिए
यह प्रश्न विकिपीडिया जैसे कमजोर विकसित संसाधनों के सामने एक व्यक्ति के आँकड़ों में महारत हासिल करने और अपने दम पर संभाव्यता की कठिनाई को दर्शाता है। यह मेरे लिए हुआ कि सांख्यिकीविदों से परामर्श करना, और यहाँ कुछ हैं, नियमित रूप से एक ग्राहक को कुछ अवधारणाओं और तरीकों …

2
गणना डेटा के विचरण का पैरामीट्रिक मॉडलिंग
मैं कुछ डेटा मॉडल करना चाह रहा हूं, लेकिन मुझे यकीन नहीं है कि मैं किस प्रकार के मॉडल का उपयोग कर सकता हूं। मेरे पास गणना डेटा है, और मुझे एक मॉडल चाहिए जो डेटा के माध्य और विचरण दोनों का पैरामीट्रिक अनुमान लगाएगा। यही है, मेरे पास विभिन्न …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.