सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

4
बूटस्ट्रैप, मोंटे कार्लो
मैंने होमवर्क के भाग के रूप में निम्नलिखित प्रश्न निर्धारित किए हैं: डेटा के एक अनिश्चित नमूने के माध्य पर 95% विश्वास अंतराल प्राप्त करने के लिए बूटस्ट्रैप के प्रदर्शन की जांच करने के लिए एक सिमुलेशन अध्ययन को डिजाइन और कार्यान्वित करें। आपका कार्यान्वयन आर या एसएएस में हो …

2
क्या रैंडम वन भविष्यवाणी पूर्वाग्रह प्रदर्शित करते हैं?
मुझे लगता है कि यह एक सीधा सवाल है, हालांकि इसके पीछे का तर्क क्यों या क्यों नहीं हो सकता है। मेरे द्वारा पूछे जाने का कारण यह है कि मैंने हाल ही में एक RF के अपने कार्यान्वयन को लिखा है और हालांकि यह अच्छा प्रदर्शन करता है, यह …

6
अजगर का उपयोग कर बॉम-वेल्च एल्गोरिथ्म के साथ छिपे हुए मार्कोव मॉडल
मैं एचएमएम और बॉम-वेल्च के कुछ अजगर कार्यान्वयन (शुद्ध अजगर में या मौजूदा सामान लपेटकर) की तलाश कर रहा हूं। कुछ विचार? मैंने अभी-अभी Google में खोजा है और मुझे अन्य मशीन लर्निंग तकनीकों के संबंध में वास्तव में खराब सामग्री मिली है। क्यों?

5
मशीन सीखने की समस्या से निपटने के लिए आप किस प्रोग्रामिंग लैंग्वेज की सलाह देते हैं?
वर्तमान में ऑक्टेव में काम कर रहे हैं, लेकिन खराब प्रलेखन के कारण प्रगति बहुत धीमी है। मशीन सीखने की समस्याओं को हल करने के लिए किस भाषा को सीखना और उपयोग करना आसान है, और अच्छी तरह से प्रलेखित है? मैं एक छोटे डेटासेट (हजारों उदाहरण) पर प्रोटोटाइप देख …

3
प्रॉबिट और लॉजिट मॉडल के सीमांत प्रभाव
क्या कोई यह बता सकता है कि आम आदमी की शर्तों में प्रोबिट और लॉजिट मॉडल के मामूली प्रभाव की गणना कैसे की जाए? मैं आंकड़ों के लिए नया हूं और इन दो मॉडलों के बारे में उलझन में हूं।

1
जब नमूने सामान्य रूप से वितरित किए जाते हैं तो क्या मैं एक युग्मित टी-टेस्ट का उपयोग कर सकता हूं लेकिन उनका अंतर नहीं है?
मेरे पास एक प्रयोग का डेटा है जहां मैंने समान परिस्थितियों में दो अलग-अलग उपचार लागू किए, परिणाम के रूप में प्रत्येक मामले में 0 और 500 के बीच पूर्णांक का निर्माण किया। मैं यह निर्धारित करने के लिए एक युग्मित टी-परीक्षण का उपयोग करना चाहता हूं कि क्या दो …

2
मैं JAGS में शून्य-फुलाया गया पोइसन कैसे सेट कर सकता हूं?
मैं R और JAGS में शून्य-फुलाया हुआ पॉइसन मॉडल स्थापित करने का प्रयास कर रहा हूं। मैं JAGS में नया हूं और मुझे यह करने के लिए कुछ मार्गदर्शन की आवश्यकता है। मैं निम्नलिखित के साथ कोशिश कर रहा हूं जहां y [i] मनाया चर है model { for (i …

1
सामान्यता के उल्लंघन की डिग्री का एक अच्छा सूचकांक क्या है और उस सूचकांक में कौन से वर्णनात्मक लेबल संलग्न किए जा सकते हैं?
प्रसंग: एक पिछले प्रश्न में, @ रोबी ने लगभग 600 मामलों के साथ एक अध्ययन में पूछा कि सामान्यता के परीक्षणों ने महत्वपूर्ण गैर-सामान्यता का सुझाव दिया फिर भी भूखंडों ने सामान्य वितरण का सुझाव दिया । कई लोगों ने यह मुद्दा बनाया कि सामान्यता का महत्व परीक्षण बहुत उपयोगी …

5
सामान्यता के लिए सभी परीक्षण शून्य परिकल्पना को क्यों अस्वीकार करेंगे?
कोलगोमोरोव-स्मिरनोव परीक्षण, शापिरो परीक्षण, आदि .... सभी इस परिकल्पना को खारिज करते हैं कि वितरण सामान्य है। फिर भी जब मैं सामान्य मात्रा और हिस्टोग्राम की साजिश करता हूं, तो डेटा स्पष्ट रूप से सामान्य होता है। शायद इसलिए कि परीक्षणों की शक्ति अधिक है? नमूना आकार लगभग 650 है। …

5
एक गाऊसी गिरी की गणना प्रभावी ढंग से सुन्न में कैसे करें [बंद]
बन्द है। यह सवाल ऑफ टॉपिक है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि यह क्रॉस मान्य के लिए विषय पर हो । 3 साल पहले बंद हुआ । मेरे पास एम कॉलम और एन पंक्तियों …

1
आर में मिश्रित डेटा के लिए मजबूत क्लस्टर विधि
मैं एक छोटा सा डेटा सेट (4 अंतराल अंतराल के 64 अवलोकनों और एक एकल तीन-कारक श्रेणीगत चर) देख रहा हूँ। अब, मैं क्लस्टर विश्लेषण के लिए काफी नया हूं, लेकिन मुझे पता है कि उन दिनों से काफी प्रगति हुई है जब पदानुक्रमित क्लस्टरिंग या के-साधन एकमात्र उपलब्ध विकल्प …

3
एक स्थानिक प्रक्रिया के लिए मापदंडों का अनुमान लगाना
मुझे सकारात्मक पूर्णांक मानों का एक ग्रिड दिया गया है । ये संख्या एक तीव्रता का प्रतिनिधित्व करती है जो उस ग्रिड स्थान पर कब्जा करने वाले व्यक्ति के विश्वास की ताकत के अनुरूप होना चाहिए (एक उच्च मूल्य जो एक उच्च विश्वास को दर्शाता है)। एक व्यक्ति की सामान्य …

5
कैसे एक अच्छा रंग तीव्रता पैमाने बनाने के लिए?
मैं आंकड़ों में अच्छा नहीं हूं, लेकिन मुझे लगता है कि मैं सही जगह पर आया हूं। मेरा प्रश्न सरल है: मेरी समस्या में एक छोटे देश में कई राज्यों की जनसंख्या की तुलना करना शामिल है, लेकिन कुछ राज्यों की जनसंख्या ३,०००,००० और कुछ की आबादी २००० है। मैं …

4
बहुत उच्च आयामीता के डेटा के लिए पीसीए कैसे करें?
प्रमुख घटक विश्लेषण (पीसीए) करने के लिए, आपको डेटा से प्रत्येक कॉलम के साधनों को घटाना होगा, सहसंबंध गुणांक मैट्रिक्स की गणना करना होगा और फिर eigenvectors और eigenvalues ​​को ढूंढना होगा। ठीक है, बल्कि, यह वही है जो मैंने पायथन में इसे लागू करने के लिए किया था, सिवाय …
12 pca  python 

5
क्या हार्मोनिक मतलब के लिए मानक विचलन की गणना की जा सकती है?
क्या हार्मोनिक के लिए मानक विचलन की गणना की जा सकती है? मैं समझता हूं कि मानक विचलन की गणना अंकगणितीय माध्य के लिए की जा सकती है, लेकिन यदि आपके पास हार्मोनिक मतलब है, तो आप मानक विचलन या सीवी की गणना कैसे करते हैं?

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.