सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
रैखिक प्रतिगमन में सामान्यता की धारणा
रैखिक प्रतिगमन की धारणा के रूप में, त्रुटि के वितरण की सामान्यता कभी-कभी गलत तरीके से "विस्तारित" होती है या इसे y या x की सामान्यता की आवश्यकता के रूप में व्याख्या की जाती है। क्या ऐसा परिदृश्य / डेटासेट बनाना संभव है, जहां X और Y गैर-सामान्य हों, लेकिन …

3
क्या रेखीय विभेदक विश्लेषण (LDA) में स्केलिंग मान का उपयोग रेखीय विभेदकों पर व्याख्यात्मक चर बनाने के लिए किया जा सकता है?
प्रमुख घटक विश्लेषण के माध्यम से प्राप्त मूल्यों के एक द्विप्लव का उपयोग करके, व्याख्यात्मक चर का पता लगाना संभव है जो प्रत्येक सिद्धांत घटक को बनाते हैं। क्या यह रैखिक विवेचक विश्लेषण के साथ भी संभव है? उपलब्ध कराए गए उदाहरण द डेटा "एडगर एंडरसन का आइरिस डेटा" ( …

2
कार्ड के दो डेक के बीच सहसंबंध?
मैंने एक ओवरहैंड कार्ड फेरबदल करने के लिए एक कार्यक्रम लिखा है । प्रत्येक कार्ड को क्रमांकित किया गया है, जिसमें से सूट जा रहा है CLUBS, DIAMONDS, HEARTS, SPADESऔर रैंक दो से दस तक जैक, क्वीन, किंग और ऐस। इस प्रकार दो क्लबों की संख्या 1 है, तीनों क्लबों …

3
फ्रीडमैन टेस्ट के बाद नेमेनी पोस्ट-हॉक टेस्ट को सही तरीके से कैसे लागू करें
मैं कई डेटा सेट पर कई एल्गोरिदम के प्रदर्शन की तुलना कर रहा हूं। चूंकि उन प्रदर्शन मापों को सामान्य रूप से वितरित करने की गारंटी नहीं है, इसलिए मैंने डेमेसर (2006) के आधार पर नेमेनी पोस्ट-हॉक टेस्ट के साथ फ्रीडमैन टेस्ट को चुना । फिर मुझे एक और पेपर …

1
बूटस्ट्रैप महत्व परीक्षण के दो तरीके
बूटस्ट्रैप का उपयोग करके मैं दो तरीकों का उपयोग करके महत्व परीक्षणों के पी मूल्यों की गणना करता हूं: अशक्त परिकल्पना के तहत पुनरुत्पादन करना और मूल डेटा से आने वाले परिणामों के रूप में कम से कम चरम की गणना करना वैकल्पिक परिकल्पना के तहत फिर से शुरू करना …

4
कार्य-कारण निष्कर्ष के लिए दर्शन के ऑनलाइन संसाधन
क्या आप किसी भी किताबें, लेख, निबंध, ऑनलाइन ट्यूटोरियल / पाठ्यक्रम आदि की सिफारिश कर सकते हैं, जो कि महामारी विज्ञान / जीव-विज्ञानी के लिए दिलचस्प और उपयोगी होगा, जो कार्य-कारण / कारण-संबंधी निष्कर्ष के दर्शन के बारे में जान सके? मैं एक एपि और बायोस्टैट्स फ्रेमवर्क से वास्तव में …

2
दैनिक समय श्रृंखला डेटा में प्रभावों को मॉडल करने के लिए महीने कैसे करें?
मेरे पास दैनिक डेटा की दो बार श्रृंखला है। एक है sign-upsऔर दूसरी terminationsसदस्यता है। मैं दोनों चरों में निहित जानकारी का उपयोग करके बाद की भविष्यवाणी करना चाहता हूँ। इन श्रृंखलाओं के ग्राफ को देखते हुए यह स्पष्ट है कि महीनों पहले साइन-अप के गुणकों के साथ समाप्ति का …

3
खतरे की दर, संभाव्यता घनत्व, उत्तरजीविता कार्य के बीच संबंध का प्रमाण
मैं उत्तरजीविता के विश्लेषणों पर थोड़ा पढ़ रहा हूं और अधिकांश पाठ्यपुस्तकें बताती हैं कि h(t)=limΔt→0P(t&lt;T≤t+Δt|T≥t)Δt=f(t)1−F(t)(1)h(t)=limΔt→0P(t&lt;T≤t+Δt|T≥t)Δt=f(t)1−F(t)(1)h(t)= \lim_{ \Delta t \rightarrow 0} \frac{P(t < T \leq t+\Delta t |T \geq t )}{ \Delta t} =\frac{f(t)}{1-F(t)} (1) जहां h(t)h(t)h(t) खतरा दर है, f(t)=limΔt→0P(t&lt;T≤t+Δt)Δt(2)f(t)=limΔt→0P(t&lt;T≤t+Δt)Δt(2)f(t)=\lim_{\Delta t \rightarrow 0} \frac{P(t < T \leq t+\Delta t)}{ …
11 survival 

1
कर्नेल रिज प्रतिगमन दक्षता
रिज प्रतिगमन के रूप में व्यक्त किया जा सकता है y^=(X′X+aId)−1Xxy^=(X′X+aId)−1Xx\hat{y} = (\mathbf{X'X} + a\mathbf{I}_d)^{-1}\mathbf{X}x कहाँ पे y^y^\hat{y} अनुमानित लेबल है, IdId\mathbf{I}_d d×dd×dd \times d मैट्रिक्स की पहचान करें, xx\mathbf{x} वह वस्तु जिसके लिए हम एक लेबल खोजने की कोशिश कर रहे हैं, और XX\mathbf{X} n×dn×dn \times d का मैट्रिक्स …

3
पीसीए, आईसीए और लाप्लासियन ईगेनमैप्स
सवाल मुझे लाप्लासियन ईजेनमैप विधि में बहुत दिलचस्पी है। वर्तमान में, मैं इसका उपयोग अपने मेडिकल डेटा सेट पर आयाम में कमी करने के लिए कर रहा हूं। हालांकि, मैं विधि का उपयोग कर एक समस्या में चला गया हूं। उदाहरण के लिए, मेरे पास कुछ डेटा (स्पेक्ट्रा सिग्नल) हैं, …
11 pca  ica 

4
आप डेटा में कारण संबंध कैसे पाते हैं?
आइए कहते हैं कि मेरे पास "A", "B" कॉलम के साथ एक तालिका है क्या यह निर्धारित करने के लिए एक सांख्यिकीय तरीका है कि "ए" "बी" का कारण बनता है? कोई वास्तव में पियर्सन के आर का उपयोग नहीं कर सकता, क्योंकि: यह केवल मूल्यों के बीच संबंध का …

3
आर में स्वत: सहसंबद्ध यादृच्छिक मूल्य बनाना
हम स्वत: सहसंबद्ध यादृच्छिक मूल्यों को बनाने की कोशिश कर रहे हैं जिनका उपयोग समय के रूप में किया जाएगा। हमारे पास कोई मौजूदा डेटा नहीं है जिसे हम संदर्भित करते हैं और केवल खरोंच से वेक्टर बनाना चाहते हैं। एक तरफ हमें वितरण और उसके एसडी के साथ एक …

1
फिशर टेस्ट में आर
मान लें कि हमारे पास निम्नलिखित डेटा सेट है: Men Women Dieting 10 30 Non-dieting 5 60 अगर मैं R में फिशर सटीक परीक्षण चलाता हूं तो क्या alternative = greater(या कम) इंप्लीमेंट करता है? उदाहरण के लिए: mat = matrix(c(10,5,30,60), 2,2) fisher.test(mat, alternative="greater") मैं p-value = 0.01588और odds ratio …

2
समूहीकृत डेटा पर यादृच्छिक वन
मैं उच्च-आयामी समूहीकृत डेटा (50 संख्यात्मक इनपुट चर) पर यादृच्छिक वन का उपयोग कर रहा हूं, जिसमें एक श्रेणीबद्ध संरचना है। डेटा 70 अलग-अलग वस्तुओं के 30 पदों पर 6 प्रतिकृति के साथ एकत्र किए गए थे जिसके परिणामस्वरूप 12600 डेटा पॉइंट थे, जो स्वतंत्र नहीं हैं। ऐसा लगता है …


हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.