सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
पीसीए का मतलब केवल बड़ी जोड़ीदार दूरी को संरक्षित करना है?
मैं वर्तमान में टी-एसएनई विज़ुअलाइज़ेशन तकनीक पर पढ़ रहा हूं और यह उल्लेख किया गया था कि उच्च-आयामी डेटा को विज़ुअलाइज़ करने के लिए प्रमुख घटक विश्लेषण (पीसीए) का उपयोग करने की एक खामी यह है कि यह केवल बिंदुओं के बीच बड़ी जोड़ीदार दूरी को संरक्षित करता है। अर्थ …

2
गिनती डेटा के रूप में स्केल चर - सही है या नहीं?
में इस पत्र (केंद्रीय PubMed के माध्यम से स्वतंत्र रूप से उपलब्ध), लेखकों 10 आइटम स्क्रीनिंग साधन पर स्कोर मॉडल करने के लिए नकारात्मक द्विपद प्रतिगमन का उपयोग 0-40 रन बनाए। यह प्रक्रिया गणना डेटा मानती है, जो स्पष्ट रूप से यहां मामला नहीं है। मुझे इस पर आपकी राय …

2
सांख्यिकीय रूप से परीक्षण कैसे करें कि मेरा नेटवर्क (ग्राफ) "छोटा-विश्व" नेटवर्क है या नहीं?
एक छोटा-विश्व नेटवर्क एक प्रकार का गणितीय ग्राफ है जिसमें अधिकांश नोड्स एक दूसरे के पड़ोसी नहीं होते हैं, लेकिन अधिकांश नोड्स को छोटी संख्या में हॉप्स या चरणों द्वारा हर दूसरे से पहुंचा जा सकता है। विशेष रूप से, एक छोटे से विश्व नेटवर्क को एक नेटवर्क के रूप …

4
रैखिक Classifiers के साथ ओवरफिटिंग
आज हमारे प्राध्यापक ने कक्षा में बताया कि "रेखीय वर्गीय अक्षरों के साथ ओवरफिटिंग संभव नहीं है"। मुझे लगता है कि गलत होने के लिए, चूंकि रैखिक सेटिफ़ायर प्रशिक्षण सेट में आउटलेर्स के लिए संवेदनशील हो सकते हैं - उदाहरण के लिए एक कठिन मार्जिन का सहारा लें वेक्टर मशीन: …

2
लॉजिस्टिक मॉडल के लिए RMSE (रूट मीन स्क्वैयर एरर)
मेरे पास विभिन्न लॉजिस्टिक मॉडल की तुलना करने के लिए RMSE (रूट मीन स्क्वेयर एरर) का उपयोग करने की वैधता के बारे में एक प्रश्न है। प्रतिक्रिया 0या तो है 1और भविष्यवाणियों के बीच संभावनाएं हैं 0- 1? क्या नीचे दिया गया तरीका द्विआधारी प्रतिक्रियाओं के साथ भी मान्य है? …

4
यह देखते हुए कि समान रूप से वितरित r.v की, सभी r rv की राशि से विभाजित एक rv के लिए PDF क्या है?
मैं निम्नलिखित प्रकार के मामले में दिलचस्पी रखता हूं: 'n' निरंतर यादृच्छिक चर हैं जिनका योग 1 होना चाहिए। किसी भी एक व्यक्ति के लिए पीडीएफ क्या होगा? इसलिए, यदि n=3n=3n=3 , तो मुझे X 1 के वितरण में दिलचस्पी हैX1X1+X2+X3X1X1+X2+X3\frac{X_1}{X_1+X_2+X_3} , जहांX1,X2X1,X2X_1, X_2औरX3X3 X_3 सभी समान रूप से वितरित …
10 uniform 

1
जब पुनर्मूल्यांकन की संभावना होती है, तो क्या यह चर चर के परिवर्तन के बजाय परिवर्तित चर में प्लग करने के लिए पर्याप्त है?
मान लीजिए कि मैं एक संभावना समारोह को फिर से करने की कोशिश कर रहा हूं जो तेजी से वितरित हो रहा है। यदि मेरा मूल संभावना कार्य है: p(y∣θ)=θe−θyp(y∣θ)=θe−θy p(y \mid \theta) = \theta e^{-\theta y} और मैं इसे फिर से इस्तेमाल करना चाहूँगा / करूँगी , क्योंकि एक …

2
औसत डेटा के बीच अंतर फिर फिटिंग और डेटा फिटिंग फिर औसत
यदि कोई है, तो कई अलग-अलग "प्रयोगों" के लिए एक लाइन फिटिंग के बीच फिट बैठता है, या अलग-अलग प्रयोगों से डेटा का औसत तो औसत डेटा फिटिंग। मुझे विस्तार से बताएं: मैं कंप्यूटर सिमुलेशन करता हूं जो एक वक्र उत्पन्न करता है, जो नीचे दिखाया गया है। हम एक …
10 error  fitting  average 

1
ग्राफ कर्नेल एसवीएम हाइपरपामेटर्स ट्यूनिंग के लिए क्या तरीके मौजूद हैं?
मेरे पास कुछ डेटा हैं जो एक ग्राफ । कोने दो वर्गों में से एक हैं , और मैं दो वर्गों के बीच अंतर करने के लिए एक एसवीएम प्रशिक्षण में रुचि रखता हूं। इसके लिए एक उपयुक्त कर्नेल है डिफ्यूजन कर्नेल , जहां का लाप्लासियन है और एक ट्यूनिंग …

3
जी-टेस्ट बनाम पियर्सन की ची-स्क्वेर्ड टेस्ट
मैं एक आकस्मिक तालिका में स्वतंत्रता का परीक्षण कर रहा हूं । मुझे नहीं पता कि जी-टेस्ट या पियर्सन की ची-स्क्वेर्ड टेस्ट बेहतर है या नहीं। नमूना आकार सैकड़ों में है, लेकिन कुछ कम सेल मायने रखता है। जैसा कि विकिपीडिया पृष्ठ पर कहा गया है कि पी -सन की …

1
इस अनुमानक का प्रसरण क्या है
मैं एक फ़ंक्शन f, यानी का अनुमान लगाना चाहता हूं , जहां X और Y स्वतंत्र यादृच्छिक चर हैं। मैं च के नमूने लेकिन नहीं आईआईडी: के लिए आईआईडी नमूने हैं Y 1 , वाई 2 , ... वाई एन और प्रत्येक के लिए वाई मैं देखते हैं n मैं …

2
फिशर या स्टॉफ़र की विधि का उपयोग करके पी-वैल्यू के संयोजन के लिए आर पैकेज
क्या एक आर पैकेज (या यहां तक ​​कि एक आधार आर फ़ंक्शन) है जो पी-मूल्यों के संयोजन के लिए फिशर या स्टॉफ़र की विधि को लागू करता है? कोडिंग यह लगभग तुच्छ होना चाहिए, लेकिन मैं पैकेज का उपयोग (और हवाला) करूंगा। इस प्रश्न में उदाहरण कोड: पी-मूल्यों को संयोजित …

3
लॉजिस्टिक रिग्रेशन में श्रेणीबद्ध भविष्यवक्ताओं का WOE परिवर्तन क्यों करना चाहिए?
प्रमाणिक भारों के साक्ष्य (WOE) परिवर्तन का वजन कब उपयोगी होता है? उदाहरण WOE परिवर्तन में देखा जा सकता है (तो एक प्रतिक्रिया के लिए , और के साथ एक स्पष्ट भविष्यवक्ता कश्मीर श्रेणियों, और y जे से बाहर सफलताओं एन जे भीतर परीक्षणों j इस भविष्यवक्ता की श्रेणी वें, …

1
क्या बड़े पैमाने पर पीसीए भी संभव है?
प्रिंसिपल कंपोनेंट एनालिसिस '(PCA) क्लासिकल तरीके से इसे इनपुट डेटा मैट्रिक्स पर किया जाता है, जिसमें कॉलम का मतलब शून्य होता है (तब PCA "वेरिएंट को अधिकतम कर सकता है")। इसे स्तंभों को केंद्रित करके आसानी से प्राप्त किया जा सकता है। हॉवेनवर, जब इनपुट मैट्रिक्स विरल होता है, तो …

1
मात्राओं के एक समारोह के रूप में अपेक्षित मूल्य?
मैं सोच रहा था, जहां एक सामान्य सूत्र एक ही आर.वी. की quantiles के एक समारोह के रूप में एक सतत यादृच्छिक चर के उम्मीद मूल्य से संबंधित है आर.वी. की उम्मीद मूल्य परिभाषित किया गया है के रूप में: ई ( एक्स ) = ∫ एक्स डी एफ एक्स …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.