सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
गैर-सूचनात्मक पुजारियों का क्या कहना है?
गैर-सूचनात्मक पुजारी भी क्यों हैं? वे बारे में जानकारी प्रदान नहीं करते हैं । तो उनका उपयोग क्यों करें? न केवल सूचनात्मक पुजारियों का उपयोग क्यों करें? उदाहरण के लिए, मान लें कि । तब एक गैर-सूचनात्मक है जो पूर्व में ?θθ\thetaθ ∈ [ 0 , 1 ]θ∈[0,1] \theta \in …

3
अतिविशिष्ट गणना डेटा के लिए पॉसन प्रतिगमन के विकल्प चुनना
मैं वर्तमान में व्यवहार प्रयोगों की एक श्रृंखला से डेटा का विश्लेषण कर रहा हूं जो सभी निम्नलिखित उपाय का उपयोग करते हैं। इस प्रयोग में भाग लेने वालों से ऐसे सुराग चुनने के लिए कहा जाता है जो (काल्पनिक) अन्य लोग 10 किलोग्राम की श्रृंखला को हल करने में …

1
आप प्रतिगमन मॉडल में चर का चयन कैसे करते हैं?
चर चयन के लिए पारंपरिक दृष्टिकोण उन चर को खोजना है जो एक नई प्रतिक्रिया की भविष्यवाणी करने में सबसे अधिक योगदान देते हैं। हाल ही में मुझे इसके विकल्प का पता चला। मॉडलिंग चर में जो एक उपचार के प्रभाव को निर्धारित करते हैं - उदाहरण के लिए एक …

3
अनिश्चितता का संचार करने के लिए सबसे अच्छा कैसे?
मीडिया और जनता के लिए सांख्यिकीय गणनाओं के परिणामों को संप्रेषित करने में एक बड़ी समस्या यह है कि हम अनिश्चितता का संचार कैसे करते हैं। निश्चित रूप से अधिकांश मास मीडिया को एक कठिन और तेज संख्या पसंद है, भले ही अपेक्षाकृत कम मामलों में, संख्याओं में हमेशा कुछ …

2
परस्पर संबंध मात्रात्मक समय
निम्नलिखित ग्राफ पर विचार करें: लाल रेखा (बाएं अक्ष) एक निश्चित स्टॉक की व्यापारिक मात्रा का वर्णन करता है। नीली रेखा (दायां अक्ष) उस स्टॉक के लिए ट्विटर संदेश की मात्रा का वर्णन करता है। उदाहरण के लिए, 9 मई (05-09) को लगभग 1.100 मिलियन ट्रेड और 4.000 ट्वीट किए …

1
लॉजिस्टिक क्वांटाइल रिग्रेशन - परिणामों को सर्वोत्तम रूप से कैसे व्यक्त करें
पिछली पोस्ट में मैंने सोचा है कि EQ-5D स्कोर के साथ कैसे व्यवहार किया जाए । हाल ही में मैं बोताई और मैककेन द्वारा सुझाए गए लॉजिस्टिक क्वांटाइल रिग्रेशन पर अड़ गया, जो बंधे हुए परिणामों से निपटने का एक सुंदर तरीका पेश करता है। सूत्र सरल है: एल ओ …

1
डेटा से वितरण का अनुमान लगाना
मेरे पास डेटा का एक नमूना Rहै rnorm(50,0,1), जिससे डेटा स्पष्ट रूप से एक सामान्य वितरण पर ले जाता है। हालाँकि, Rडेटा के बारे में इस वितरण संबंधी जानकारी को "नहीं" जानता है। क्या इसमें कोई विधि है Rजिससे यह अनुमान लगाया जा सकता है कि मेरा नमूना किस प्रकार …
12 r  distributions 

2
स्फूर्त सहसंबंध का अपेक्षित मूल्य
हम एक सामान्य वितरण से नमूने, प्रत्येक आकार स्वतंत्र रूप से खींचते हैं ।एन ( μ , σ 2 )NNNnnn(μ,σ2)(μ,σ2)(\mu,\sigma^2) से नमूने हम तो 2 नमूने जो उच्चतम (पूर्ण) पियर्सन एक दूसरे के साथ संबंध हो चुनें।NNN इस सहसंबंध का अपेक्षित मूल्य क्या है? धन्यवाद [पुनश्च यह होमवर्क नहीं है]


2
बूटस्ट्रैप बनाम बायेसियन तकनीक का उपयोग कब करें?
मेरे पास विश्वसनीयता परीक्षण और तार्किक दृष्टिकोण (बल्कि मेरे लिए) के बजाय एक जटिल निर्णय विश्लेषण समस्या है जो एक बायेसियन विश्लेषण का समर्थन करने के लिए एमसीएमसी का उपयोग करना शामिल है। हालांकि, यह सुझाव दिया गया है कि बूटस्ट्रैपिंग दृष्टिकोण का उपयोग करना अधिक उचित होगा। क्या कोई …

2
पदानुक्रमित बायेसियन मॉडल (?)
कृपया सांख्यिकीय लिंगो की मेरी कसौटी पर माफी माँगें :) मुझे यहाँ पर कुछ ऐसे प्रश्न मिले हैं जो विज्ञापन से संबंधित हैं और दरों पर क्लिक करते हैं। लेकिन उनमें से किसी ने भी मेरी पदानुक्रमित स्थिति की मेरी समझ के साथ बहुत मदद नहीं की। एक संबंधित सवाल …

3
पैरामीट्रिजेबल सहसंयोजक मैट्रिक्स के साथ सकारात्मक के-आयामी चतुर्थांश पर वितरण क्या हैं?
नकारात्मक सिमुलेशन के साथ उनकी समस्या पर zzk के सवाल के बाद , मैं सोच रहा हूं कि सकारात्मक के-आयामी क्वाड्रेंट, पर वितरण के पैरामीट्रिक परिवार क्या हैं, जिसके लिए सहसंयोजक मैट्रिक्स का सेट किया जा सकता है।आरक+R+k\mathbb{R}_+^kΣΣ\Sigma जैसा कि zzk के साथ चर्चा की गई है , पर वितरण …

1
गॉसियन मिश्रण मॉडल (जीएमएम) के साथ काम करने के लिए पायथन पैकेज
पायथन में गौसियन मिक्सचर मॉडल (जीएमएम) के साथ काम करने के लिए कई विकल्प उपलब्ध हैं। पहली नज़र में कम से कम हैं: मिश्रण मॉडलिंग के लिए PyMix - http://www.pymix.org/pymix/index.php टूल PyEM - http://www.ar.media.kyoto-u.ac.jp/members/david/softwares/em/ जो स्किप टूलबॉक्स का हिस्सा है और GMMs फ़ोकस पर ध्यान केंद्रित करता है : जिसे …

2
लॉजिस्टिक रिग्रेशन गुणांक का विश्लेषण
यहाँ लॉजिस्टिक रिग्रेशन गुणांक की एक सूची है (पहले एक अवरोधन है) -1059.61966694592 -1.23890500515482 -8.57185269220438 -7.50413155570413 0 1.03152408392552 1.19874787949191 -4.88083274930613 -5.77172565873336 -1.00610998453393 मुझे यह अजीब लगता है कि अवरोधन कितना कम है और मेरे पास एक गुणांक है जो वास्तव में 0. के बराबर है। मुझे पूरी तरह से यकीन …

2
मूल्य से सांख्यिकीय परीक्षण जनसंख्या से काफी अधिक होने का मतलब है: क्या यह जेड-टेस्ट या टी-टेस्ट है?
मूल्यों की सूची की तुलना में एक मूल्य कितना महत्वपूर्ण है? ज्यादातर मामलों में सांख्यिकीय परीक्षण में जनसंख्या के लिए एक नमूना सेट की तुलना करना शामिल है। मेरे मामले में नमूना एक मूल्य से बना है और हम इसकी तुलना जनसंख्या से करते हैं। मैं सांख्यिकीय परिकल्पना परीक्षण में …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.