सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
Poisson प्रतिगमन से डेटा नमूने उत्पन्न करें
मैं सोच रहा था कि आप R में एक पोइसन रिग्रेशन समीकरण से डेटा कैसे उत्पन्न करेंगे? मैं उलझन में हूँ कि समस्या का सामना कैसे किया जाए। इसलिए अगर मुझे लगता है कि हमारे पास दो भविष्यवक्ता और X_2 हैं जिन्हें N (0,1) वितरित किया गया है । और …

1
एक पीसीए द्विध्रुवीय में तीर का क्या मतलब है?
निम्नलिखित पीसीए biplot पर विचार करें: library(mvtnorm) set.seed(1) x <- rmvnorm(2000, rep(0, 6), diag(c(5, rep(1,5)))) x <- scale(x, center=T, scale=F) pc <- princomp(x) biplot(pc) वहाँ लाल तीरों का एक गुच्छा लगाया जाता है, उनका क्या मतलब है? मुझे पता था कि "वर 1" के साथ लेबल किया गया पहला तीर …
14 r  pca  linear-algebra  biplot 

4
यादृच्छिकता क्या है?
संभाव्यता और आंकड़ों में, "यादृच्छिक" और "यादृच्छिकता" की अवधारणा का अक्सर उपयोग किया जाता है। अक्सर एक यादृच्छिक चर की अवधारणा का उपयोग उन मॉडल घटनाओं के लिए किया जाता है जो मौका के कारण होती हैं। मेरा प्रश्न "यादृच्छिक" शब्द का संबंध है। यादृच्छिक क्या है? क्या यादृच्छिकता वास्तव …

4
जाँच करना कि क्या सटीकता में सुधार महत्वपूर्ण है
मान लीजिए मेरे पास एक एल्गोरिथ्म है जो चीजों को दो श्रेणियों में वर्गीकृत करता है। मैं 1000 टेस्ट चीजों को कहने पर एल्गोरिथ्म की सटीकता को माप सकता हूं - मान लीजिए कि 80% चीजों को सही तरीके से वर्गीकृत किया गया है। मान लीजिए कि मैं एल्गोरिदम को …

2
तंत्रिका नेटवर्क से वास्तविक-मूल्यवान निरंतर उत्पादन कैसे प्राप्त करें?
अधिकांश उदाहरणों में मैंने अब तक तंत्रिका नेटवर्क को देखा है, नेटवर्क का उपयोग वर्गीकरण के लिए किया जाता है और नोड्स को सिग्मोइड फ़ंक्शन के साथ बदल दिया जाता है। हालांकि, मैं एक सतत वास्तविक मूल्य (वास्तविक रूप से आउटपुट आमतौर पर -5 से +5 की सीमा में होगा) …

2
आर में स्नातक वंशज बनाम एलएम () फ़ंक्शन?
मैं स्टैनफोर्ड में एंड्रयू एनजी के मुफ्त ऑनलाइन मशीन सीखने के पाठ्यक्रम में वीडियो के माध्यम से जा रहा हूं । उन्होंने यह प्रदर्शन करने के लिए ऑक्टेव में रैखिक प्रतिगमन और लेखन कार्यों को हल करने के लिए एक एल्गोरिथ्म के रूप में ग्रेडिएंट डिसेंट की चर्चा की। संभवत: …

2
सादे अंग्रेजी में R का उपयोग करके एक कॉक्स आनुपातिक खतरों प्रतिगमन मॉडल की व्याख्या और सत्यापन
क्या कोई मुझे सादे अंग्रेजी में मेरे कॉक्स मॉडल की व्याख्या कर सकता है? मैंने फ़ंक्शन का उपयोग करके अपने डेटा के सभी के लिए निम्न कॉक्स प्रतिगमन मॉडल फिट किया है cph। मेरा डेटा नामक ऑब्जेक्ट में सहेजा गया है Data। चर w, xऔर yनिरंतर हैं; zदो स्तरों का …

3
अक्सर इसे गौसियन वितरण क्यों माना जाता है?
एक भोली बेयस क्लासिफायर के लिए पैरामीटर अनुमान पर एक विकिपीडिया लेख से उद्धरण : "एक विशिष्ट धारणा यह है कि प्रत्येक वर्ग से जुड़े निरंतर मूल्यों को गौसियन वितरण के अनुसार वितरित किया जाता है।" मैं समझता हूं कि एक गाऊसी वितरण विश्लेषणात्मक कारणों के लिए सुविधाजनक है। हालाँकि, …

3
बड़ी संख्या की केंद्रीय सीमा प्रमेय बनाम कानून
केंद्रीय सीमा प्रमेय में कहा गया है कि रूप में आईड चर का मतलब अनंत तक जाता है, सामान्य रूप से वितरित किया जाता है।NNN इससे दो सवाल उठते हैं: क्या हम इससे बड़ी संख्या का कानून निकाल सकते हैं? बड़ी संख्या में कानून का कहना है कि एक यादृच्छिक …

4
आर [कोड और आउटपुट शामिल] में यादृच्छिक प्रभावों के साथ एक टूटी हुई छड़ी / टुकड़ा रेखीय मॉडल में ब्रेक पॉइंट का अनुमान लगाना
क्या कोई मुझे बता सकता है कि आर को एक टुकड़े-टुकड़े रैखिक मॉडल (एक निश्चित या यादृच्छिक पैरामीटर के रूप में) में ब्रेक प्वाइंट का अनुमान कैसे लगाया गया है, जब मुझे अन्य यादृच्छिक प्रभावों का अनुमान लगाने की आवश्यकता है? मैंने नीचे एक खिलौना उदाहरण को शामिल किया है …

8
कई अज्ञात समुद्री मील के साथ टुकड़ा करने योग्य रैखिक प्रतिगमन कैसे करें?
क्या टुकड़े करने वाले रैखिक प्रतिगमन करने के लिए कोई पैकेज हैं, जो स्वचालित रूप से कई समुद्री मील का पता लगा सकते हैं? धन्यवाद। जब मैं स्ट्रैचेंज पैकेज का उपयोग करता हूं। मैं बदलाव के बिंदुओं का पता नहीं लगा सका। मुझे नहीं पता कि यह परिवर्तन बिंदुओं का …

1
एक एनोवा को दोहराया उपायों के डिजाइन के लिए कैसे गणना किया जाता है: आर में एओवी () बनाम एलएम ()
शीर्षक यह सब कहता है, और मैं भ्रमित हूं। निम्नलिखित आर में एक दोहराया उपायों एनओवी () चलाता है, और जो मैंने सोचा था कि एक बराबर एलएम () कॉल चलाता है, लेकिन वे अलग-अलग त्रुटि अवशिष्ट (हालांकि वर्गों के योग समान हैं) वापस करते हैं। स्पष्ट रूप से एनओवी …

4
डेटा माइनिंग के बारे में पढ़ना कैसे शुरू करें?
मैं एक नौसिखिया हूं जो डेटा माइनिंग के बारे में पढ़ना शुरू करने जा रहा हूं। मुझे एआई और सांख्यिकी का बुनियादी ज्ञान है। चूँकि कई लोग कहते हैं कि मशीन लर्निंग डेटा माइनिंग में भी महत्वपूर्ण भूमिका निभाता है, क्या इससे पहले कि मैं डेटा माइनिंग के साथ चल …

4
k- साधन इनपुट में कस्टम दूरी मैट्रिक्स के साथ कार्यान्वयन
क्या कोई मुझे k- साधन के कार्यान्वयन के बारे में बता सकता है (यह बेहतर होगा अगर matlab में) इनपुट में दूरी मैट्रिक्स ले सकता है? मानक matlab कार्यान्वयन को इनपुट में अवलोकन मैट्रिक्स की आवश्यकता होती है और यह समानता माप को कस्टम रूप देना संभव नहीं है।

3
कैसे बेतुके बड़े Z- स्कोर के साथ जुड़े संभावना की गणना करने के लिए?
नेटवर्क मोटिफ डिटेक्शन के लिए सॉफ्टवेयर पैकेज अत्यधिक उच्च Z- स्कोर लौटा सकते हैं (मैंने जो सबसे अधिक 600,000+ देखा है, लेकिन 100 से अधिक के Z- स्कोर काफी सामान्य हैं)। मैं यह दिखाने की योजना बना रहा हूं कि ये जेड-स्कोर फर्जी हैं। विशाल जेड-स्कोर बहुत कम संबद्ध संभावनाओं …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.