सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
एक प्रतिगमन मॉडल में निर्भर चर के अंतराल को शामिल करना और कौन सा अंतराल आवश्यक है?
निर्भर चर के रूप में हम जिस डेटा का उपयोग करना चाहते हैं, वह इस प्रकार है (यह गणना डेटा है)। हमें डर है कि चूंकि इसमें चक्रीय घटक और प्रवृत्ति संरचना है इसलिए प्रतिगमन किसी भी तरह से पक्षपाती हो जाता है। यदि यह मदद करता है तो हम …

2
सीमा और मानक विचलन के बीच संबंध
एक लेख में मुझे एक नमूना आकार N के मानक विचलन का सूत्र मिलाNNN σ=R¯¯¯¯2.534σ=R¯2.534\sigma=\frac{\overline{R}}{2.534} जहां मुख्य नमूने से R¯¯¯¯R¯\overline{R}उपसमूह (आकार 666 ) की औसत श्रेणी है । संख्या 2.5342.5342.534की गणना कैसे की जाती है? यह सही संख्या है?

2
K- साधनों को ढाल वंश का उपयोग करके अनुकूलित क्यों नहीं किया जाता है?
मुझे पता है कि k- साधन आमतौर पर एक्सपेक्टेशन मैक्सिमाइजेशन का उपयोग करके अनुकूलित किया जाता है । हालाँकि हम इसके नुकसान फ़ंक्शन को उसी तरह से अनुकूलित कर सकते हैं जिस तरह से हम किसी अन्य को अनुकूलित करते हैं! मुझे कुछ कागजात मिले जो वास्तव में बड़े पैमाने …

1
Scipy में बीटा वितरण फिटिंग
विकिपीडिया के अनुसार बीटा संभावना वितरण में दो आकार पैरामीटर हैं: और ।αα\alphaββ\beta जब मैं scipy.stats.beta.fit(x)पायथन में कॉल करता हूं , जहांx रेंज में संख्याओं का एक गुच्छा होता है , 4 मान वापस आ जाते हैं। यह मुझे अजीब लगता है।[0,1][0,1][0,1] गुग्लिंग के बाद मैंने पाया कि वापसी मूल्यों …

2
मैं संख्यात्मक डेटा को स्वाभाविक रूप से "कोष्ठक" कैसे बना सकता हूं? (उदा आय)
निम्नलिखित वर्णन करता है कि मैं क्या हासिल करने की कोशिश कर रहा हूं, लेकिन यह संभव है कि एक वैकल्पिक समस्या बयान मेरे लक्ष्य का वर्णन कर सके: में चाहता हूं निम्नलिखित संख्याओं को उन समूहों में विभाजित करें, जहाँ प्रत्येक समूह के भीतर संख्याओं के प्रकार बहुत बड़े …

1
एक घातीय चौरसाई मॉडल में लापता डेटा से निपटना
मॉडल के घातीय चौरसाई परिवार के संदर्भ में लापता डेटा से निपटने के लिए एक मानक तरीका प्रतीत नहीं होता है। विशेष रूप से, पूर्वानुमान पैकेज में ets नामक R कार्यान्वयन केवल लापता डेटा के बिना सबसे लंबे समय तक ले जाने के लिए लगता है, और Hyndman एट अल …

1
आर में गैर-रैखिक मिश्रित प्रभाव प्रतिगमन
आश्चर्यजनक रूप से, मैं Google का उपयोग करते हुए निम्नलिखित प्रश्न का उत्तर नहीं पा रहा था: मेरे पास कई व्यक्तियों के कुछ जैविक डेटा हैं जो समय में एक मोटे तौर पर वृद्धि के व्यवहार को दर्शाते हैं। इस प्रकार, मैं एक मानक लॉजिस्टिक विकास का उपयोग करके इसे …

4
सार्वजनिक स्वास्थ्य नीति अनुसंधान में मामले के अध्ययन क्या हैं जहां अविश्वसनीय / भ्रमित / अमान्य अध्ययन या मॉडल का दुरुपयोग किया गया था?
मैं एक मौजूदा सार्वजनिक स्वास्थ्य मुद्दे पर एक साहित्य समीक्षा का मसौदा तैयार कर रहा हूं जहां डेटा को भ्रमित किया गया है: सार्वजनिक स्वास्थ्य / महामारी विज्ञान की शिक्षा में उपयोग किए जाने वाले सामान्य ऐतिहासिक केस-स्टडीज कहां हैं जहां अवैध या उलझे हुए संबंध या अंतर्विरोध जानबूझकर या …

1
क्या एक औसत-निष्पक्ष अनुमानक न्यूनतम निरपेक्षता को कम करता है?
यह एक अनुवर्ती है, लेकिन मेरे पिछले एक प्रश्न का भी एक अलग सवाल है । मैंने विकिपीडिया पर पढ़ा कि " एक औसत-निष्पक्ष अनुमानक पूर्ण-विचलन हानि के संबंध में जोखिम को कम करता है, जैसा कि लाप्लास द्वारा देखा गया है ।" हालाँकि, मेरे मोंटे कार्लो सिमुलेशन परिणाम इस …

4
MCMC के लिए एक व्यावहारिक उदाहरण
मैं MCMC से संबंधित कुछ व्याख्यानों से गुजर रहा था। हालाँकि, मुझे इसका अच्छा उदाहरण नहीं मिलता कि इसका उपयोग कैसे किया जाता है। क्या कोई मुझे एक ठोस उदाहरण दे सकता है। सभी मैं देख सकता हूं कि वे एक मार्कोव श्रृंखला चलाते हैं और कहते हैं कि इसका …

3
समान रूप से वितरित और सहसंबद्ध यादृच्छिक संख्या के जोड़े उत्पन्न करें
मैं कुछ सहसंबंध के साथ यादृच्छिक संख्याओं के जोड़े उत्पन्न करना चाहूंगा। हालांकि, दो सामान्य चर के एक रैखिक संयोजन का उपयोग करने का सामान्य दृष्टिकोण यहां मान्य नहीं है, क्योंकि वर्दी चर का एक रैखिक संयोजन कोई समान रूप से वितरित चर नहीं है। मुझे एकरूप होने के लिए …

2
अनुकूलन: आंकड़ों में सभी बुराई की जड़?
मैंने पहले अभिव्यक्ति को सुना है: "आँकड़ों में अनुकूलन सभी बुराई की जड़ है"। उदाहरण के लिए, इस धागे में शीर्ष उत्तर मॉडल चयन के दौरान बहुत अधिक आक्रामक तरीके से अनुकूलन के खतरे के संदर्भ में यह बयान देता है। मेरा पहला प्रश्न निम्नलिखित है: क्या यह उद्धरण विशेष …

4
संशयवादी (लेकिन गणित-विपरीत नहीं) पाठक के लिए इंजेक्शन
मैं सिर्फ सांख्यिकीय अनुमान ("अनुपात और साधनों की तुलना") पर एक व्याख्यान देखा, आँकड़ों का एक हिस्सा ऑनलाइन पाठ्यक्रम। मेरे लिए यह सामग्री हमेशा की तरह कम समझ में आती है (अब तक मैंने इस सामान को दर्जनों बार देखा होगा, पिछले तीन दशकों में फैल चुका है)। मैं "बेसिक …

1
यह R में lme4 के साथ मिश्रित प्रभाव मॉडल का विश्लेषण करने का एक स्वीकार्य तरीका है?
मेरे पास विश्लेषण करने के लिए असंतुलित दोहराए गए डेटा सेट हैं, और मैंने पढ़ा है कि जिस तरह से अधिकांश सांख्यिकीय पैकेज एनोवा (यानी III प्रकार के वर्ग) के साथ इसे संभालते हैं, वह गलत है। इसलिए, मैं इन आंकड़ों का विश्लेषण करने के लिए एक मिश्रित प्रभाव मॉडल …

2
मैकनेमर के परीक्षण और सशर्त लॉजिस्टिक प्रतिगमन के बीच संबंध
मैं युग्मित टिप्पणियों में द्विआधारी प्रतिक्रिया डेटा के मॉडलिंग में दिलचस्पी रखता हूं। हम एक समूह में पूर्व-पोस्ट हस्तक्षेप की प्रभावशीलता के बारे में अनुमान लगाने का लक्ष्य रखते हैं, संभवतः कई covariates के लिए समायोजन कर रहे हैं और यह निर्धारित करते हैं कि क्या एक समूह द्वारा प्रभाव …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.