सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

4
डीएनए अनुक्रमण के लिए नकारात्मक द्विपद वितरण को तैयार करना
ऋणात्मक द्विपद वितरण जैव सूचना विज्ञान में गणना डेटा के लिए एक लोकप्रिय मॉडल बन गया है (विशेषकर अनुक्रमण की अपेक्षित संख्या जीनोम के किसी दिए गए क्षेत्र के भीतर पढ़ती है)। स्पष्टीकरण भिन्न हैं: कुछ इसे कुछ के रूप में समझाते हैं जो पॉइसन वितरण की तरह काम करता …

3
गिस-पॉइसन के रूप में पिशोन का विस्तार क्या है?
एक पॉइज़न वितरण प्रति यूनिट समय घटनाओं को माप सकता है, और पैरामीटर । घातांक वितरण अगली घटना तक समय को मापता है, पैरामीटर । एक वितरण को दूसरे में परिवर्तित कर सकते हैं, यह इस बात पर निर्भर करता है कि क्या यह मॉडल घटनाओं या समयों के लिए …

1
गौसियन कोप्युला से अनुकरण कैसे करें?
मान लीजिए कि मेरे पास दो यूनिवर्सिएट सीमांत वितरण हैं, और कहते हैं , जिससे मैं अनुकरण कर सकता हूं। अब, एक गौसियन कोप्युला का उपयोग करके उनके संयुक्त वितरण का निर्माण करें, जो दर्शाता । सभी मापदंडों को जाना जाता है।FFFGGGC(F,G;Σ)C(F,G;Σ)C(F,G;\Sigma) क्या इस कोपला से अनुकरण के लिए एक …

3
मंझला का एक निष्पक्ष अनुमान
मान लीजिए कि हमारे पास एक यादृच्छिक चर X [ 0 , 1 ]XX पर समर्थित है जिससे हम नमूने खींच सकते हैं। हम एक्स के माध्य के एक निष्पक्ष अनुमान के साथ कैसे आ सकते हैं ?[0,1][0,1]XX हम, निश्चित रूप से, कुछ नमूने उत्पन्न कर सकते हैं और नमूना …
16 sampling 

1
Iteratively रिवाइस्टेड लिस्ट स्क्वायर की परिभाषा और अभिसरण
मैं निम्नलिखित फॉर्म के कार्यों को कम से कम करने के लिए पुनरावृत्त कम से कम वर्ग (IRLS) का उपयोग कर रहा हूं, J(m)=∑Ni=1ρ(|xi−m|)J(m)=∑i=1Nρ(|xi−m|)J(m) = \sum_{i=1}^{N} \rho \left(\left| x_i - m \right|\right) जहां NNN के उदाहरण की संख्या है xi∈Rxi∈Rx_i \in \mathbb{R} , m∈Rm∈Rm \in \mathbb{R} मजबूत अनुमान है कि …

3
अनुक्रम डेटा से मार्कोव संक्रमण संभावनाओं का अनुमान लगाना
मेरे पास 4 राज्यों A−DA−DA-D : उदा जैसे अनुक्रमों (432 अवलोकनों का सटीक होना) का पूरा सेट है Y=⎛⎝⎜⎜⎜⎜AB⋮BCA⋮CDA⋮ADC⋮DBA⋮AA−⋮BC−⋮A⎞⎠⎟⎟⎟⎟Y=(ACDDBACBAACA−−⋮⋮⋮⋮⋮⋮⋮BCADABA)Y=\left(\begin{array}{c c c c c c c} A& C& D&D & B & A &C\\ B& A& A&C & A&- &-\\ \vdots&\vdots&\vdots&\vdots&\vdots&\vdots&\vdots\\ B& C& A&D & A & B & A\\ \end{array}\right) …

1
मल्टी-साइट अध्ययन के लिए मिश्रित मॉडल बनाम पूलिंग मानक त्रुटियां - एक मिश्रित मॉडल इतना अधिक कुशल क्यों है?
मुझे एक डेटा सेट मिला है जिसमें कुछ मुट्ठी भर साइटों से "टूटी हुई छड़ी" मासिक मामला मायने रखता है। मैं दो अलग-अलग तकनीकों से एकल सारांश अनुमान लगाने की कोशिश कर रहा हूं: तकनीक 1: 0/1 सूचक चर के साथ एक पॉइसन GLM के साथ "टूटी हुई छड़ी" को …

3
थीटा का क्या अर्थ है?
मैं आँकड़ों के लिए एक नौसिखिया हूँ और यह पाया । आंकड़ों में, ta, निचला अक्षर ग्रीक 'थीटा', कुछ सामान्य संभाव्यता वितरण के सामान्य (सदिश) पैरामीटर (एस) का सामान्य नाम है। एक आम समस्या थीटा के मूल्य (ओं) को खोजना है। ध्यान दें कि इस तरह से एक पैरामीटर के …

1
Wishart मैट्रिक्स के लॉग-निर्धारक का अपेक्षित मूल्य
चलो , यानी एक के हिसाब से वितरित डी × डी आयामी विशार्ट मतलब के साथ वितरण ν Ψ और स्वतंत्रता की डिग्री ν । मैं के लिए एक अभिव्यक्ति चाहते हैं ई ( लॉग | Λ | ) जहां | Λ | निर्धारक है।Λ ~ डब्ल्यूडी( ν, Ψ )Λ~डब्ल्यूडी(ν,Ψ)\Lambda …

3
K- गुना क्रॉस सत्यापन पर ग्रिड खोज
मैंने 10-गुना क्रॉस सत्यापन सेटिंग में 120 नमूनों का डेटासेट किया है। वर्तमान में, मैं पहले होल्डआउट के प्रशिक्षण डेटा को चुनता हूं और ग्रिड खोज द्वारा गामा और सी के मूल्यों को लेने के लिए उस पर 5 गुना क्रॉस-सत्यापन करता हूं। मैं आरबीएफ कर्नेल के साथ एसवीएम का …

1
की मात्राओं के लिए बंद रूप अभिव्यक्ति
मैं दो यादृच्छिक चर, है जहां U ( 0 , 1 ) एक समान 0-1 वितरण है।αमैं∼ ईद U(0,1),i=1,2αi∼iid U(0,1),i=1,2\alpha_i\sim \text{iid }U(0,1),\;\;i=1,2यू(0,1)U(0,1)U(0,1) फिर, ये उपज एक प्रक्रिया है, कहते हैं: P(x)=α1sin(x)+α2cos(x),x∈(0,2π)P(x)=α1sin⁡(x)+α2cos⁡(x),x∈(0,2π)P(x)=\alpha_1\sin(x)+\alpha_2\cos(x), \;\;\;x\in (0,2\pi) अब, मैं सोच रहा था एक बंद फार्म के लिए अभिव्यक्ति है कि क्या वहाँ की सैद्धांतिक …

1
प्रायिकता सिम्प्लेक्स पर कुछ वितरण क्या हैं?
Let आयाम की प्रायिकता सिंप्लेक्स हो , यानी ऐसा है कि और \ sum_i x_i = 1 ।ΔKΔK\Delta_{K}K−1K−1K-1x∈ΔKx∈ΔKx \in \Delta_{K}xi≥0xi≥0x_i \ge 0∑ixi=1∑ixi=1\sum_i x_i = 1 जो वितरण अक्सर (या अच्छी तरह से जाना जाता है, या अतीत में परिभाषित) मौजूद हैं?ΔKΔK\Delta_{K} स्पष्ट रूप से, डिरिक्लेट और लॉगिट-नॉर्मल वितरण हैं। क्या …

2
क्या GBM वर्गीकरण असंतुलित वर्ग आकारों से ग्रस्त है?
मैं एक पर्यवेक्षित बाइनरी वर्गीकरण मुद्दे के साथ काम कर रहा हूं। मैं GBM पैकेज का उपयोग करना चाहता हूं ताकि वह बिना किसी संक्रमित / संक्रमित व्यक्ति को वर्गीकृत कर सके। मेरे पास संक्रमित व्यक्तियों की तुलना में 15 गुना अधिक असंक्रमित है। मैं सोच रहा था कि क्या …

2
अवशिष्टों की माप विषमता
यह विकिपीडिया लिंक ओएलएस अवशिष्टों की विषमलैंगिकता का पता लगाने के लिए कई तकनीकों को सूचीबद्ध करता है। मैं यह सीखना चाहूंगा कि विषमलैंगिकता से प्रभावित क्षेत्रों का पता लगाने में किस तकनीक का हाथ अधिक कुशल है। उदाहरण के लिए, यहां ओएलएस 'रेजिड्यूल्स बनाम फिटेड' प्लॉट के मध्य क्षेत्र …

2
एक चमक में आर-संरचना जी-संरचना क्या हैं?
मैं MCMCglmmहाल ही में पैकेज का उपयोग कर रहा हूं । मैं प्रलेखन में आर-संरचना और जी-संरचना के रूप में संदर्भित से भ्रमित हूं। ये यादृच्छिक प्रभावों से संबंधित प्रतीत होते हैं - विशेष रूप से उन पर पूर्व वितरण के लिए मापदंडों को निर्दिष्ट करते हुए, लेकिन प्रलेखन में …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.