सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
नकारात्मक ACF (ऑटोक्रेलेशन फ़ंक्शन) की व्याख्या कैसे करें?
इसलिए मैंने तेल रिटर्न के एसीएफ / पीएसीएफ की साजिश रची और कुछ सकारात्मक ऑटोक्रॉलेशन देखने की उम्मीद कर रहा था, लेकिन मेरे आश्चर्य के लिए मुझे केवल नकारात्मक महत्वपूर्ण ऑटोक्रॉलेशन प्राप्त होता है। मुझे उपरोक्त ग्राफ की व्याख्या कैसे करनी चाहिए? वे संकेत करते प्रतीत होते हैं कि तेल …

3
यदि बहुआयामी वितरण समान हैं तो परीक्षण करें
आइए बताते हैं कि मेरे पास एन-आयामी निरंतर-मूल्यवान वैक्टर के दो या अधिक नमूना आबादी हैं। अगर ये नमूने समान वितरण से हैं, तो क्या इसका परीक्षण करने का एक गैर-तरीका है? यदि हां, तो क्या इसके लिए आर या अजगर में एक फ़ंक्शन है?

2
रैखिक एसवीएम वर्गीकरण के लिए स्केलिंग क्यों महत्वपूर्ण है?
रैखिक एसवीएम वर्गीकरण का प्रदर्शन करते समय, अक्सर प्रशिक्षण डेटा को सामान्य करने में सहायक होता है, उदाहरण के लिए, औसत विचलन को विभाजित करके और मानक डेटा के माध्यम से परीक्षण डेटा को मापता है। यह प्रक्रिया नाटकीय रूप से वर्गीकरण प्रदर्शन को क्यों बदलती है?

3
रैंक सूचियों की तुलना
मान लीजिए कि दो समूहों, जिनमें और शामिल हैं, प्रत्येक श्रेणी में 25 वस्तुओं का एक सेट है जो कम से कम महत्वपूर्ण है। इन रैंकिंग की तुलना करने के सबसे अच्छे तरीके क्या हैं?एन 2n1n1n_1n2n2n_2 स्पष्ट रूप से, 25 मान-व्हिटनी यू परीक्षण करना संभव है, लेकिन इससे 25 परीक्षण …

4
केएनएन में संबंधों, वज़न और मतदान से निपटना
मैं एक kNN एल्गोरिथ्म प्रोग्रामिंग कर रहा हूं और निम्नलिखित जानना चाहूंगा: टाई-ब्रेक: बहुसंख्यक मतदान में स्पष्ट विजेता नहीं होने पर क्या होता है? जैसे सभी k निकटतम पड़ोसी विभिन्न वर्गों से हैं, या k = 4 के लिए वर्ग A से 2 पड़ोसी हैं और वर्ग B से 2 …

2
स्टेन में परिभाषित पुजारियों के बिना पैरामीटर
मैंने अभी स्टेन का उपयोग करना सीखना शुरू किया है और rstan। जब तक मैं हमेशा इस बारे में भ्रमित नहीं होता कि JAGS / BUGS ने कैसे काम किया है, तो मैंने सोचा कि आपको हमेशा मॉडल से तैयार किए जाने वाले प्रत्येक पैरामीटर के लिए किसी न किसी …

9
विभिन्न गुणों के साथ वितरण के संदर्भ
मैं अक्सर अपने आप को ऐसे प्रश्न पूछते हुए देखता हूं, "मुझे पता है कि यह चर में निहित है और अधिकांश द्रव्यमान झूठ और फिर 1. की ओर लगातार गिरावट आती है। मैं इसे मॉडल करने के लिए किस वितरण का उपयोग कर सकता हूं? "( 0 , 1 …

1
दूरी सहसंबंध बनाम आपसी जानकारी
मैंने कुछ समय के लिए आपसी जानकारी के साथ काम किया है। लेकिन मुझे "सहसंबंध की दुनिया" में एक बहुत हालिया माप मिला, जिसका उपयोग वितरण स्वतंत्रता को मापने के लिए भी किया जा सकता है, जिसे "दूरी सहसंबंध" (जिसे ब्राउनियन सहसंबंध भी कहा जाता है) कहा जाता है: http://en.wikipedia.org/wiki/Browarian_covariance …

2
जब मैनर्स बराबर होते हैं तो मैन-व्हिटनी यू टेस्ट महत्वपूर्ण क्यों है?
मुझे एक मान-व्हिटनी रैंक परीक्षा से परिणाम मिला है जो मुझे समझ में नहीं आता है। 2 आबादी का माध्य समान (6.9) है। प्रत्येक जनसंख्या के ऊपरवाले और निम्न मात्राएँ निम्न हैं: 6.64 और 7.2 6.60 और 7.1 इन आबादी की तुलना करने वाले परीक्षण से उत्पन्न पी-मान 0.007 है। …

4
R [बंद] में AUPR की गणना
बन्द है। यह सवाल ऑफ टॉपिक है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि यह क्रॉस मान्य के लिए विषय पर हो । 8 महीने पहले बंद हुआ । आरओसी के तहत एक पैकेज की गणना …

1
वितरित चर के लिए सबसे तेज ज्ञात पूंछ सीमाएं क्या हैं ?
चलो एक ची-चुकता वितरित साथ यादृच्छिक चर हो कश्मीर स्वतंत्रता की डिग्री। निम्नलिखित संभावनाओं के लिए सबसे तेज ज्ञात सीमाएं क्या हैंX∼χ2kX∼χk2X \sim \chi^2_kkkk P[X&gt;t]≤1−δ1(t,k)P[X&gt;t]≤1−δ1(t,k) \mathbb{P}[X > t] \leq 1 - \delta_1(t, k) तथा P[X&lt;z]≤1−δ2(z,k)P[X&lt;z]≤1−δ2(z,k) \mathbb{P}[X < z] \leq 1 - \delta_2(z, k) जहां और δ 2 कुछ कार्य हैं। …

1
बिंदु-प्रक्रियाओं के बीच क्रॉस सहसंबंध का विश्लेषण
मैं एक विश्लेषण विधि पर एक सलाह चाहूंगा जिसका उपयोग कर रहा हूं, यह जानने के लिए कि क्या यह सांख्यिकीय रूप से ध्वनि है। मैं दो बिंदु मापा जाता है प्रक्रियाओं और टी 2 = टी 2 1 , टी 2 2 , । । । , टी 2 …

1
ओरेकल असमानता: मूल शब्दों में
मैं एक कागज के माध्यम से जा रहा हूं जो कुछ साबित करने के लिए oracle असमानता का उपयोग करता है लेकिन मैं यह समझने में असमर्थ हूं कि यह क्या करने की कोशिश कर रहा है। जब मैंने 'ओरेकल असमानता' के बारे में ऑनलाइन खोज की, तो कुछ स्रोतों …

1
कनेक्शनवादी टेम्पोरल क्लासिफिकेशन (CTC) क्या है?
मैं एक ऑप्टिकल कैरेक्टर रिकग्निशन (OCR) प्रोजेक्ट करना चाह रहा हूं। कुछ शोध करने के बाद, मैं एक वास्तुकला में आया हूं जो दिलचस्प लगता है: सीएनएन + आरएनएन + सीटीसी। मैं जटिल तंत्रिका नेटवर्क (CNN), और आवर्तक तंत्रिका नेटवर्क (RNN) से परिचित हूं, लेकिन कनेक्शनवादी टेम्पोरल वर्गीकरण (CTC) क्या …

2
आपको KNN में डेटा स्केल करने की आवश्यकता क्यों है
क्या कोई कृपया मुझे समझा सकता है कि K के निकटतम पड़ोसियों का उपयोग करते समय आपको डेटा को सामान्य करने की आवश्यकता क्यों है। मैंने इसे देखने की कोशिश की है, लेकिन मैं अभी भी इसे समझ नहीं पा रहा हूं। मुझे निम्न लिंक मिला: https://discuss.analyticsvidhya.com/t/why-it-is-necessary-to-normalize-in-knn/2715 लेकिन इस स्पष्टीकरण …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.