सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
तंत्रिका नेटवर्क का उपयोग करते हुए क्यू-लर्निंग के बारे में प्रश्न
मैंने क्यू-लर्निंग को इस रूप में वर्णित किया है, http://web.cs.swarthmore.edu/~meeden/cs81/s12/papers/MarkStevePaper.pdf लगभग करने के लिए। क्यू (एस, ए) मैं निम्नलिखित की तरह एक तंत्रिका नेटवर्क संरचना का उपयोग करता हूं, एक्टिवेशन सिग्मॉइड एक्शन न्यूरॉन्स के लिए इनपुट्स, इनपुट्स + 1 की संख्या (सभी इनपुट्स स्केल २. number) आउटपुट, एकल आउटपुट। क्यू …


1
"फंडामेंटल थ्योरम ऑफ फैक्टर एनालिसिस" पीसीए पर कैसे लागू होता है, या पीसीए लोडिंग को कैसे परिभाषित किया जाता है?
मैं वर्तमान में एक स्लाइड सेट के माध्यम से जा रहा हूं जो मेरे पास "कारक विश्लेषण" के लिए है (पीसीए जहां तक ​​मैं बता सकता हूं)। इसमें, "कारक विश्लेषण का मौलिक सिद्धांत" व्युत्पन्न है जो दावा करता है कि विश्लेषण ( ) में जाने वाले डेटा के सहसंबंध मैट्रिक्स …

2
वेल्च टी-टेस्ट के लिए स्वतंत्रता की रिपोर्टिंग की डिग्री
असमान रूपांतरों के लिए वेल्ड टी-टेस्ट (जिसे वेल्च-सैटरथवेट या वेल्च-एस्पिन के रूप में भी जाना जाता है) में आम तौर पर स्वतंत्रता की एक पूर्णांक डिग्री होती है । परीक्षण के परिणामों की रिपोर्ट करते समय स्वतंत्रता की इन डिग्री को कैसे उद्धृत किया जाना चाहिए? "विभिन्न स्रोतों के अनुसार …

1
एक सुसंगत अनुमानक की परिभाषा यह क्यों है? संगति की वैकल्पिक परिभाषा के बारे में क्या?
विकिपीडिया के उद्धरण: आंकड़ों में, एक सुसंगत अनुमानक या asymptotically संगत आकलनकर्ता एक आकलनकर्ता-एक कंप्यूटिंग एक पैरामीटर के अनुमानों के लिए नियम है θ∗θ∗θ^* संपत्ति -having कि डेटा बिंदुओं की संख्या का इस्तेमाल किया के रूप में बढ़ जाती है अनिश्चित काल के लिए, करने के लिए संभावना के अनुमान …

3
एयूसी और एफ 1-स्कोर के बीच अंतर क्या हैं?
एफ-स्कोर सटीक और रिकॉल का हार्मोनिक माध्य है। रिकॉल की y- एक्सिस सही पॉजिटिव रेट (जिसे रिकॉल भी किया जाता है) है। तो, कुछ समय के क्लासीफायर में कम रिकॉल, लेकिन बहुत अधिक एयूसी हो सकता है, इसका क्या मतलब है? एयूसी और एफ 1-स्कोर के बीच अंतर क्या हैं?


1
डेल्टा-विधि का उपयोग कैसे करें जबकि प्रथम-क्रम व्युत्पन्न शून्य है?
http://en.wikipedia.org/wiki/Delta_method विकिपीडिया लेख में, यह माना गया था कि का अस्तित्व होना चाहिए और यह कि g ′ ( θ ) गैर-शून्य मूल्यवान है। क्या यह संभव है के लिए asymptotic वितरण को खोजने के लिए √g′(θ)g′(θ)g'(\theta)g′(θ)g′(θ)g'(\theta) है जो दिए गएजी'(θ)शून्य और हो सकता है √n−−√(g(Xn)−g(θ))n(g(Xn)−g(θ))\sqrt{n}(g(X_n)-g(\theta)) g′(θ)g′(θ)g'(\theta)?n−−√(Xn−θ)→dN(0,σ2)n(Xn−θ)→dN(0,σ2)\sqrt{n}(X_n-\theta) \stackrel{d}{\rightarrow} N(0,\sigma^2)

5
क्या प्रसार की 'समरूपता' का एक उपाय है?
मैंने वेब पर देखा, लेकिन कुछ भी उपयोगी नहीं मिला। मैं मूल रूप से यह मापने का तरीका ढूंढ रहा हूं कि कैसे 'समान रूप से' एक मूल्य वितरित किया जाता है। जैसे, एक्स की तरह एक समान रूप से वितरित वितरण : और 'असमान' रूप से वितरित वितरण Y …

3
आइटम प्रतिक्रिया थ्योरी बनाम पुष्टिकारक कारक विश्लेषण
मैं सोच रहा था कि आइटम रिस्पांस थ्योरी और कन्फर्मेटरी फैक्टर एनालिसिस के बीच मुख्य, सार्थक अंतर क्या हैं। मैं समझता हूं कि गणना में भिन्नताएं हैं (आइटम बनाम सह-व्यवस्था पर अधिक ध्यान केंद्रित करना; लॉग-रैखिक बनाम रैखिक)। हालांकि, मुझे नहीं पता कि उच्च-स्तरीय परिप्रेक्ष्य से इसका क्या मतलब है …

5
सेंसर किए गए डेटा वास्तव में क्या हैं?
मैंने सेंसर डेटा के विभिन्न विवरण पढ़े हैं: ए) जैसा कि इस थ्रेड में बताया गया है , एक निश्चित सीमा से नीचे या उससे ऊपर के बिना अयोग्य डेटा को सेंसर किया गया है। अयोग्य का मतलब है कि डेटा एक निश्चित सीमा से ऊपर या नीचे है, लेकिन …

3
बूटस्ट्रैप: ओवरफिटिंग का मुद्दा
ड्राइंग द्वारा एक प्रदर्शन तथाकथित गैर पैरामीट्रिक बूटस्ट्रैप मान लीजिए आकार के नमूने मूल से प्रत्येक प्रतिस्थापन के साथ टिप्पणियों। मेरा मानना ​​है कि यह प्रक्रिया आनुभविक cdf द्वारा संचयी वितरण समारोह का आकलन करने के बराबर है:BBBnnnnnn http://en.wikipedia.org/wiki/Empirical_distribution_function और फिर एक पंक्ति में अनुमानित cdf बार से टिप्पणियों का …

1
QQ लाइन के लिए आत्मविश्वास बैंड
यह प्रश्न विशेष रूप से संबंधित नहीं है R, लेकिन मैंने Rइसे चित्रित करने के लिए उपयोग करना चुना । विश्वास बैंड के निर्माण के लिए कोड पर विचार करें (सामान्य) qq- लाइन: library(car) library(MASS) b0<-lm(deaths~.,data=road) qqPlot(b0$resid,pch=16,line="robust") मैं इन विवरण बैंडों का निर्माण कैसे कर रहा हूं (या किसी कागज …

2
k- का मतलब बनाम k-median?
मुझे पता है कि k- साधन क्लस्टरिंग एल्गोरिथ्म और k- मध्यिका है। एक जो मध्य के रूप में माध्य का उपयोग करता है और दूसरा माध्यिका का उपयोग करता है। मेरा प्रश्न है: कब / कहां उपयोग करना है?

4
जूरी चयन में पूर्वाग्रह?
एक दोस्त अपील पर एक ग्राहक का प्रतिनिधित्व कर रहा है, एक आपराधिक परीक्षण के बाद जिसमें यह प्रतीत होता है कि जूरी चयन नस्लीय पक्षपाती था। जूरी पूल में 4 नस्लीय समूहों में 30 लोग शामिल थे। अभियोजन पक्ष ने इनमें से 10 लोगों को पूल से बाहर करने …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.