सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
आम आदमी की शर्तों में थॉम्पसन नमूनाकरण क्या है?
मैं थॉम्पसन सैंपलिंग को समझने में असमर्थ हूं और यह कैसे काम करता है। मैं मल्टी आर्म बैंडिट के बारे में पढ़ रहा था और अपर कॉन्फिडेंस बाउंड अल्गोरिद्म पढ़ने के बाद, कई टेक्स्ट ने सुझाव दिया कि थॉम्पसन सैंपलिंग यूसीबी से बेहतर प्रदर्शन करता है। थोमसन सैंपलिंग, आम आदमी …

4
नेटफ्लिक्स जैसी फिल्म की सिफारिश करने के लिए क्या सांख्यिकीय तरीके हैं?
मैं एक उपयोगकर्ता को एक फिल्म की सिफारिश करने के लिए एक गतिशील मॉडल को लागू करने के लिए देख रहा हूं। सिफारिश को हर बार अपडेट किया जाना चाहिए जब उपयोगकर्ता किसी फिल्म को देखता है या उसे रेट करता है। इसे सरल रखने के लिए मैं दो कारकों …

3
जीएलएम में, संतृप्त मॉडल की लॉग संभावना हमेशा शून्य होती है?
सामान्यीकृत रैखिक मॉडल के आउटपुट के भाग के रूप में, मॉडल के मूल्यांकन के लिए नल और अवशिष्ट विचलन का उपयोग किया जाता है। मैं अक्सर संतृप्त मॉडल की लॉग संभावना के रूप में व्यक्त की गई इन राशियों के सूत्र देखता हूं, उदाहरण के लिए: /stats//a/113022/22199 , लॉजिस्टिक रिग्रेशन: …

3
कैसे एक संभावना घनत्व समारोह के मोड को खोजने के लिए?
मेरे अन्य प्रश्न से प्रेरित होकर , मैं पूछना चाहता हूं कि कोई व्यक्ति फ़ंक्शन प्रायिकता घनत्व फ़ंक्शन (PDF) की विधि कैसे खोजता है ?f(x)f(x)f(x) क्या इसके लिए कोई "कुक-बुक" प्रक्रिया है? जाहिरा तौर पर, यह कार्य पहले की तुलना में बहुत अधिक कठिन है।

1
भारी पूंछ वाले वितरण का उदाहरण जो लंबे समय से पूंछ वाले नहीं हैं
भारी-और लंबी-पूंछ वाले वितरणों के बारे में पढ़ने से, मैं समझ गया कि सभी लंबी-पूंछ वाले वितरण भारी-पूंछ वाले हैं , लेकिन सभी भारी-पूंछ वाले वितरण लंबे-पूंछ वाले नहीं हैं । क्या कोई इसका उदाहरण दे सकता है: एक निरंतर, सममित, शून्य-मतलब घनत्व फ़ंक्शन जो लंबे समय से पूंछ है …

2
लॉजिस्टिक रिग्रेशन प्रिडिक्शन का आउटपुट
मैंने निम्नलिखित कोड का उपयोग करके एक लॉजिस्टिक रिग्रेशन बनाया है: full.model.f = lm(Ft_45 ~ ., LOG_D) base.model.f = lm(Ft_45 ~ IP_util_E2pl_m02_flg) step(base.model.f, scope=list(upper=full.model.f, lower=~1), direction="forward", trace=FALSE) मैंने तब अंतिम मॉडल बनाने के लिए आउटपुट का उपयोग किया है: final.model.f = lm(Ft_45 ~ IP_util_E2pl_m02_flg + IP_util_E2_m02_flg + AE_NumVisit1_flg + OP_NumVisit1_m01_flg …

8
समान और विषम संख्याओं के बीच अंतर करने के लिए एक न्यूरल नेटवर्क को प्रशिक्षित करें
प्रश्न: क्या किसी एनएन को प्रशिक्षित करना संभव है कि वह विषम और सम संख्याओं के बीच अंतर कर सके और केवल संख्याओं को इनपुट के रूप में उपयोग कर सके? मेरे पास निम्नलिखित डेटासेट हैं: Number Target 1 0 2 1 3 0 4 1 5 0 6 1 …

1
क्या अंतर एन्ट्रापी हमेशा अनंत से कम होती है?
एक मनमाने ढंग से निरंतर यादृच्छिक चर के लिए, कहें , क्या इसका अंतर हमेशा से कम है ? (यह ठीक है अगर यह है ।) यदि नहीं, तो क्या आवश्यक है और इसके लिए पर्याप्त स्थिति से कम है ?XXX∞∞\infty−∞−∞-\infty∞∞\infty

2
आर: परिवार के साथ glm फ़ंक्शन = "द्विपद" और "वजन" विनिर्देश
मैं बहुत उलझन में हूं कि परिवार के साथ चमक में कैसे काम करता है = "द्विपद"। मेरी समझ में, परिवार के साथ glm की संभावना = "द्विपद" इस प्रकार निर्दिष्ट की गई है: जहां y "मनाया सफलता का अनुपात" है और n परीक्षणों की ज्ञात संख्या है।यnf(y)=(nny)pny(1−p)n(1−y)=exp(n[ylogp1−p−(−log(1−p))]+log(nny))f(y)=(nny)pny(1−p)n(1−y)=exp⁡(n[ylog⁡p1−p−(−log⁡(1−p))]+log⁡(nny)) f(y) = …

2
सटीकता = 1- परीक्षण त्रुटि दर
माफी अगर यह एक बहुत स्पष्ट सवाल है, लेकिन मैं विभिन्न पोस्ट पढ़ रहा हूं और एक अच्छी पुष्टि नहीं मिल सकती है। वर्गीकरण के मामले में, एक वर्गीकरण की सटीकता = 1- परीक्षण त्रुटि दर है ? मुझे लगता है कि सटीकता , लेकिन मेरा सवाल यह है कि …

5
Bayesian अर्थमिति के लिए पाठ्यपुस्तक
मैं बायेसियन अर्थमिति पर एक सैद्धांतिक रूप से कठोर पाठ्यपुस्तक की तलाश कर रहा हूं, जो लगातार अर्थशास्त्री की ठोस समझ है। मैं प्रति उत्तर एक काम का सुझाव देना चाहूंगा, ताकि सिफारिशों को व्यक्तिगत रूप से ऊपर या नीचे मतदान किया जा सके।

4
क्या कोई गैर-दूरी आधारित क्लस्टरिंग एल्गोरिदम हैं?
ऐसा लगता है कि K- साधन और अन्य संबंधित एल्गोरिदम के लिए, क्लस्टरिंग बिंदुओं के बीच की दूरी की गणना करने पर आधारित है। क्या कोई ऐसा है जो इसके बिना काम करता है?

2
पोइसन GLM परिणामों में पैरामीटर अनुमानों की व्याख्या कैसे करें [बंद]
बन्द है। यह सवाल ऑफ टॉपिक है । यह वर्तमान में उत्तर स्वीकार नहीं कर रहा है। इस प्रश्न को सुधारना चाहते हैं? प्रश्न को अपडेट करें ताकि यह क्रॉस मान्य के लिए विषय पर हो । 5 साल पहले बंद हुआ । Call: glm(formula = darters ~ river + …

3
पासा छोड़ने के लिए सूत्र (गैर-क्रूर बल)
सबसे पहले मुझे यकीन नहीं है कि यह सवाल कहां पोस्ट किया जाना चाहिए। मैं यह पूछ रहा हूं कि क्या कोई सांख्यिकी समस्या एनपी-पूर्ण है और यदि इसे प्रोग्रामेटिक रूप से हल करने के लिए नहीं है। मैं इसे यहाँ पोस्ट कर रहा हूँ क्योंकि सांख्यिकी समस्या केंद्र बिंदु …
14 dice  np 

4
वितरण दिखाने के लिए ऊर्ध्वाधर रेखाओं का उपयोग करके इस भूखंड का नाम क्या है?
क्या इस अत्यंत सरल कथानक का एक आधिकारिक नाम है, जिसमें ऊर्ध्वाधर रेखाएँ एक सीमा में कुछ नमूनों के वितरण का संकेत देती हैं?

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.