सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

3
Lindsay Smith के ट्यूटोरियल का उपयोग करते हुए R में PCA के चरणबद्ध तरीके से कार्यान्वयन
मैं लिंडसे I स्मिथ द्वारा एक उत्कृष्ट पीसीए ट्यूटोरियल के माध्यम से आर में काम कर रहा हूं और अंतिम चरण में फंस रहा हूं । नीचे दी गई आर स्क्रिप्ट हमें स्टेज पर ले जाती है (पी .१ ९ पर) जहां मूल डेटा (इस मामले में एकवचन) से प्रिंसिपल …
13 r  pca 

3
यदि दो (गैर-सामान्य) वितरण भिन्न हों तो मैं कैसे परीक्षण करूं?
मैंने छात्र के टी-टेस्ट के बारे में पढ़ा है, लेकिन यह तब काम करता है जब हम यह मान सकते हैं कि मूल वितरण सामान्य रूप से वितरित किए गए हैं। मेरे मामले में, वे निश्चित रूप से नहीं हैं। इसके अलावा, अगर मेरे पास 13 वितरण हैं, तो क्या …

1
MLE बनाम OLS का उपयोग करना
साधारण पशु वर्गों के बजाय अधिकतम संभावना अनुमान का उपयोग करना कब बेहतर होता है? प्रत्येक की ताकत और सीमाएं क्या हैं? मैं सामान्य परिस्थितियों में प्रत्येक का उपयोग करने के लिए व्यावहारिक ज्ञान इकट्ठा करने की कोशिश कर रहा हूं।

4
क्या कोई संभावना दूरी है जो मीट्रिक के सभी गुणों को संरक्षित करती है?
कुल्बैक-लीब्लर दूरी का अध्ययन करने में, दो चीजें हैं जो हम बहुत जल्दी सीखते हैं, यह है कि यह न तो त्रिकोण असमानता और न ही समरूपता, मीट्रिक के आवश्यक गुणों का सम्मान करता है। मेरा सवाल यह है कि क्या कोई संभावना घनत्व कार्यों का कोई मीट्रिक है जो …

3
क्या मुझे गैर-रैखिक डेटा के लिए कर्नेल ट्रिक का उपयोग करना चाहिए?
मैंने हाल ही में कर्नेल ट्रिक के उपयोग के बारे में सीखा, जो उन आयामों में डेटा को रैखिक बनाने के प्रयास में डेटा को उच्च आयामी स्थानों में मैप करता है। क्या ऐसे कोई मामले हैं जहां मुझे इस तकनीक का उपयोग करने से बचना चाहिए? क्या यह सही …

1
रैखिक गौसियन कलमैन फ़िल्टर के लिए लॉजिकेलिहाइड पैरामीटर व्यास का अनुमान
मैंने कुछ कोड लिखे हैं जो कि n-आयामी राज्य वेक्टर के लिए रेखीय गॉसियन स्टेट स्पेस एनालिसिस के लिए कलमन फ़िल्टरिंग (कई अलग-अलग कलमन-प्रकार फ़िल्टर [सूचना फ़िल्टर एट अल।] का उपयोग करके) कर सकते हैं। फ़िल्टर बहुत अच्छा काम करते हैं और मुझे कुछ अच्छा आउटपुट मिल रहा है। हालाँकि, …

1
क्या लाप्लास वितरण से पहले एक संयुग्म मौजूद है?
क्या लाप्लास वितरण से पहले एक संयुग्म मौजूद है ? यदि नहीं, तो क्या एक ज्ञात बंद फॉर्म अभिव्यक्ति है जो लाप्लास वितरण के मापदंडों के लिए पीछे है? मैं बहुत कुछ नहीं सफलता के साथ चारों ओर googled है तो मेरे वर्तमान अनुमान ऊपर दिए गए सवालों पर "नहीं" …

2
नॉनलाइन रिग्रेशन के लिए आत्मविश्वास और भविष्यवाणी अंतराल का आकार
क्या गैर-रेखीय प्रतिगमन के आसपास विश्वास और भविष्यवाणी बैंड प्रतिगमन रेखा के आसपास सममित माना जाता है? मतलब वे घंटे-कांच के आकार पर नहीं लेते हैं जैसा कि रैखिक प्रतिगमन के लिए बैंड के मामले में होता है। ऐसा क्यों है? यहाँ प्रश्न में मॉडल है: यहाँ आंकड़ा है: F(x)=⎛⎝⎜⎜A−D1+(xC)B⎞⎠⎟⎟+DF(x)=(A−D1+(xC)B)+D …

1
ANOVA के
इंट्रो: आज इस प्रश्न पर ध्यान दिए जाने के बाद, " क्या एनोवा महत्वपूर्ण हो सकती है जब कोई भी जोड़ीदार टी-टेस्ट नहीं है? ", मैंने सोचा कि मैं इसे एक दिलचस्प तरीके से फिर से नामांकित करने में सक्षम हो सकता हूं, जो उत्तर के अपने सेट के लायक …

2
दिए गए माध्य और मानक विचलन के एक सकारात्मक निरंतर चर के लिए अधिकतम एन्ट्रापी संभावना घनत्व फ़ंक्शन क्या है?
एक सकारात्मक निरंतर चर के लिए अधिकतम एन्ट्रापी वितरण क्या है , इसके पहले और दूसरे क्षण को देखते हुए? उदाहरण के लिए, एक गाऊसी वितरण एक अनबाउंड वैरिएबल के लिए अधिकतम एन्ट्रापी वितरण है, जिसका अर्थ और मानक विचलन है, और एक गामा वितरण एक सकारात्मक चर के लिए …

2
हर बार अलग-अलग मान लौटाने वाले आर में डननेट की परीक्षा
मैं डननेट के परीक्षण की गणना करने के लिए आर 'मल्टीकैम' लाइब्रेरी ( http://cran.r-project.org/web/packages/multcomp/ ) का उपयोग कर रहा हूं । मैं नीचे दी गई स्क्रिप्ट का उपयोग कर रहा हूं: Group <- factor(c("A","A","B","B","B","C","C","C","D","D","D","E","E","F","F","F")) Value <- c(5,5.09901951359278,4.69041575982343,4.58257569495584,4.79583152331272,5,5.09901951359278,4.24264068711928,5.09901951359278,5.19615242270663,4.58257569495584,6.16441400296898,6.85565460040104,7.68114574786861,7.07106781186548,6.48074069840786) data <- data.frame(Group, Value) aov <- aov(Value ~ Group, data) summary(glht(aov, linfct=mcp(Group="Dunnett"))) अब …

1
कैसे एक शो करता है की कोई निष्पक्ष आकलनकर्ता है कि वहाँ मतलब के साथ एक प्वासों बंटन के लिए ?
मान लीजिए कि iid यादृच्छिक चर हैं जो साथ वितरण का पालन करते हैं । मैं कैसे साबित कर सकता हूं कि मात्रा का कोई निष्पक्ष आकलनकर्ता नहीं है ?X0,X1,…,XnX0,X1,…,Xn X_{0},X_{1},\ldots,X_{n} λλ \lambda 1λ1λ \dfrac{1}{\lambda}

2
ARIMA बनाम ARMA विभेदित श्रृंखला पर
आर (2.15.2) में मैं एक बार श्रृंखला में एक बार एआरएमए (3,1,3) और एक बार अंतरित समय पर एक एआरएमए (3,3) फिट हुआ। फिट किए गए पैरामीटर अलग हैं, जिन्हें मैंने ARIMA में फिटिंग विधि के लिए जिम्मेदार ठहराया। इसके अलावा, ARMA (3,3) के समान डेटा पर ARIMA (3,0,3) को …
13 r  time-series  arima  fitting  arma 

1
एक लॉजिस्टिक रिग्रेशन मॉडल का मूल्यांकन
मैं एक लॉजिस्टिक मॉडल पर काम कर रहा हूं और मुझे परिणामों के मूल्यांकन में कुछ कठिनाइयां आ रही हैं। मेरा मॉडल एक द्विपद लॉगिट है। मेरे व्याख्यात्मक चर हैं: 15 स्तरों, एक द्विगुणित चर और 2 निरंतर चर वाले एक श्रेणीगत चर। मेरा N बड़ा> 8000 है। मैं निवेश …

2
आंशिक रैंकिंग की सूची को वैश्विक रैंकिंग में परिवर्तित करना
मैं निम्नलिखित समस्या की तरह कुछ पर काम कर रहा हूँ। मेरे पास उपयोगकर्ताओं और एन पुस्तकों का एक समूह है। प्रत्येक उपयोगकर्ता अपने द्वारा पढ़ी जाने वाली सभी पुस्तकों की क्रमबद्ध रैंकिंग बनाता है (जो संभवतः एन पुस्तकों का सबसेट है), उदाहरण के लिए, पुस्तक 1> पुस्तक 40> पुस्तक …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.