सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
विशेष संभावना वितरण
यदि पर ग़ैर शून्य मान के साथ एक प्रायिकता वितरण है , किस प्रकार (ओं) के लिए वहाँ मौजूद है एक निरंतर ऐसी है कि सभी के लिए ?[ 0 , + ∞ ) पी ( एक्स ) ग > 0 ∫ ∞ 0 पी ( एक्स ) लॉग पी …

1
पॉइज़न बनाम क्वैसी-पॉइज़न मॉडल में अनुमानित गुणांक
मॉडलिंग के दावे में एक बीमा वातावरण में डेटा की गणना, मैंने पॉइसन के साथ शुरू किया, लेकिन फिर अतिविशिष्टता पर ध्यान दिया। एक अर्ध-पॉइसन ने मूल पॉइसन की तुलना में अधिक माध्य-विचरण संबंध को बेहतर ढंग से चित्रित किया, लेकिन मैंने देखा कि पॉइज़न और क्वैसी-पॉइज़न दोनों मॉडल में …

1
टी परीक्षणों के लिए "लगभग सामान्य" का आकलन
मैं वेल्च के टी-टेस्ट का उपयोग करके साधनों की समानता का परीक्षण कर रहा हूं। अंतर्निहित वितरण (एक संबंधित चर्चा में अधिक उदाहरण से विषम सामान्य से दूर है यहाँ )। मैं अधिक डेटा प्राप्त कर सकता हूं, लेकिन यह निर्धारित करने के कुछ राजसी तरीके चाहूंगा कि ऐसा किस …

4
सुराग जो एक समस्या रैखिक प्रतिगमन के लिए अच्छी तरह से अनुकूल है
मैं मॉन्टगोमरी, पेक और वीनिंग द्वारा रैखिक प्रतिगमन विश्लेषण के परिचय का उपयोग करके रैखिक प्रतिगमन सीख रहा हूं । मैं एक डेटा विश्लेषण परियोजना चुनना चाहता हूँ। मेरे पास भोला विचार है कि रैखिक प्रतिगमन केवल तभी उपयुक्त होता है जब कोई संदेह करता है कि व्याख्यात्मक चर और …

1
पायथन में साधारण लॉजिस्टिक रिग्रेशन
मैं पायथन में एक ऑर्डिनल लॉजिस्टिक रिग्रेशन चलाना चाहता हूं - तीन स्तरों के साथ एक प्रतिक्रिया चर के लिए और कुछ व्याख्यात्मक कारकों के साथ। statsmodelsपैकेज द्विआधारी logit और बहुपद logit (MNLogit) मॉडल नहीं, बल्कि आदेश दिया logit का समर्थन करता है। चूंकि अंतर्निहित गणित इतना अलग नहीं है, …

1
ताश का खेल: अगर मैं चार कार्ड बेतरतीब ढंग से खींचता हूं और आप छह खींचते हैं, तो क्या संभावना है कि मेरा उच्चतम कार्ड आपके उच्चतम से अधिक है?
जैसा कि शीर्षक में कहा गया है, अगर मैं बेतरतीब ढंग से 4 कार्ड खींचता हूं और आप एक ही डेक से 6 खींचते हैं, तो क्या संभावना है कि मेरा सर्वोच्च कार्ड आपके उच्चतम कार्ड को हरा देता है? अगर हम अलग-अलग डेक से ड्रा करेंगे तो यह कैसे …

1
लॉजिस्टिक रिग्रेशन में अच्छाई-की-फिट परीक्षण; हम किस 'फिट' को परखना चाहते हैं?
मैं सवाल और उसके जवाबों की बात कर रहा हूं: लॉजिस्टिक रिग्रेशन से विकसित मॉडल की भविष्यवाणी की क्षमता (संभावना) की तुलना कैसे करें? @ क्लार्क चोंग द्वारा और @ फ्रेंक हरेल द्वारा उत्तर / टिप्पणियां। और होम्स-लेमेशो परीक्षण और टिप्पणियों में की स्वतंत्रता की डिग्री परχ2χ2\chi^2 सवाल । मैंने …

2
रिग्रेशन फ्रेमवर्क में मशीन लर्निंग की समस्या का अनुवाद करना
मान लीजिए कि मेरे पास i = 1 के लिए व्याख्यात्मक चर का एक पैनल है । । । एन , टी = १ । । । टी , साथ ही द्विआधारी परिणाम पर निर्भर चर Y i T का एक वेक्टर । तो Y को केवल अंतिम समय T …

2
समय (RNN / LSTM) के माध्यम से छंटनी किए गए बैकप्रोगैजेशन का उपयोग करते समय प्रारंभिक पैटर्न को पकड़ना
यह कहें कि मैं एक RNN / LSTM का उपयोग भावना विश्लेषण करने के लिए करता हूं, जो कि कई-से-एक दृष्टिकोण है ( इस ब्लॉग को देखें )। नेटवर्क को समय (BPTT) के माध्यम से एक काट-छाँट backpropagation के माध्यम से प्रशिक्षित किया जाता है, जहां नेटवर्क को हमेशा की …

3
घटनाओं के बीच सहसंबंधों को खोजने के लिए मैं किस एल्गोरिथ्म का उपयोग कर सकता हूं?
मैं मशीन लर्निंग के लिए नया हूं इसलिए मैं कुछ साहित्य खोजने की कोशिश कर रहा हूं लेकिन मुझे यह भी पता नहीं है कि Google के लिए क्या है। मेरा डेटा निम्न रूप में है: User A performs Action P User B performs Action Q User C performs Action …

2
क्या "नो फ्री लंच प्रमेय" सामान्य सांख्यिकीय परीक्षणों पर लागू होता है?
मैं जिस महिला के लिए काम कर रही थी, उसने मुझे कुछ आंकड़ों पर एक तरफ़ा एनोवा करने के लिए कहा। मैंने जवाब दिया कि डेटा दोहराए गए उपाय (समय श्रृंखला) डेटा थे, और मुझे लगा कि स्वतंत्रता की धारणा का उल्लंघन किया गया था। उसने उत्तर दिया कि मुझे …

5
क्या स्वचालित मशीन एक सपना सीख रही है?
जैसा कि मैंने मशीन लर्निंग की खोज की है, मैं अलग-अलग दिलचस्प तकनीकों को देखता हूँ जैसे: स्वचालित रूप से इस तरह की तकनीकों के साथ एल्गोरिदम ट्यून grid search, एक ही "प्रकार" के विभिन्न एल्गोरिदम के संयोजन के माध्यम से अधिक सटीक परिणाम प्राप्त करें, यही है boosting, विभिन्न …

3
लॉजिस्टिक रिग्रेशन से ऑड्स अनुपात के लिए आत्मविश्वास अंतराल उत्पन्न करने के विभिन्न तरीके
मैं अध्ययन कर रहा हूं कि लॉजिस्टिक रिग्रेशन में प्राप्त गुणांक से बाधाओं के अनुपात के लिए 95% विश्वास अंतराल का निर्माण कैसे किया जाए। इसलिए, लॉजिस्टिक रिग्रेशन मॉडल पर विचार करते हुए, log(p1−p)=α+βxlog⁡(p1−p)=α+βx \log\left(\frac{p}{1 - p}\right) = \alpha + \beta x \newcommand{\var}{\rm Var} \newcommand{\se}{\rm SE} ऐसी है कि x=0x=0x …

2
संयुग्म पूर्व के लिए औचित्य?
प्रयोज्यता के अलावा, संयुग्म पुजारियों का उपयोग करने के लिए कोई महामारी संबंधी औचित्य (गणितीय, दार्शनिक, विधर्मी, आदि) है? या यह सिर्फ इतना है कि यह आमतौर पर एक अच्छा पर्याप्त सन्निकटन है और चीजों को बहुत आसान बनाता है?

1
MLP के साथ संयोजन में लोग RBF या RBF का उपयोग क्यों नहीं करते?
इसलिए जब रेडियल बेसिस फ़ंक्शन न्यूरल नेटवर्क्स को देखते हैं, तो मैंने देखा है कि लोग केवल 1 छिपी हुई परत के उपयोग की सलाह देते हैं, जबकि बहुपरत पर्सेप्ट्रॉन न्यूरल नेटवर्क के साथ अधिक परतों को बेहतर माना जाता है। यह देखते हुए कि RBF नेटवर्क को पीछे प्रचार …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.