सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

5
गैर-महत्वपूर्ण परिणामों की व्याख्या "रुझान" के रूप में
हाल ही में, दो अलग-अलग सहकर्मियों ने स्थितियों के बीच मतभेदों के बारे में एक तरह के तर्क का इस्तेमाल किया है जो मुझे गलत लगता है। ये दोनों सहकर्मी सांख्यिकी का उपयोग करते हैं, लेकिन वे सांख्यिकीविद् नहीं हैं। मैं आंकड़ों में नौसिखिया हूं। दोनों मामलों में, मैंने तर्क …

2
ट्रेन आने से पहले मॉडल समय पर उपयोग करने के लिए क्या वितरण?
मैं ट्रेन के आगमन के समय पर कुछ डेटा मॉडल करने की कोशिश कर रहा हूं। मैं एक ऐसे वितरण का उपयोग करना चाहता हूं जो "जितना अधिक समय तक प्रतीक्षा करता है, उतनी अधिक संभावना है कि ट्रेन दिखाई देने वाली है" । ऐसा लगता है कि इस तरह …

1
स्टेन बनाम गेलमैन-रूबिन परिभाषा
मैं स्टेन प्रलेखन से गुजर रहा था जिसे यहाँ से डाउनलोड किया जा सकता है । मुझे गेलमैन-रुबिन डायग्नोस्टिक के उनके कार्यान्वयन में विशेष रूप से दिलचस्पी थी। मूल पेपर गेलमैन एंड रुबिन (1992) संभावित स्केल रिडक्शन फैक्टर (PSRF) को निम्नानुसार परिभाषित करता है: चलो हो वें मार्कोव श्रृंखला नमूना …

1
उच्च-आयामी प्रतिगमन:
मैं उच्च-आयामी प्रतिगमन के क्षेत्र में अनुसंधान पर पढ़ने की कोशिश कर रहा हूं; जब ppp से भी बड़ा है nnn , कि है, p>>np>>np >> n । ऐसा लगता है कि प्रतिगमन अनुमानकों के लिए अभिसरण की दर के संदर्भ में शब्द logp/nlog⁡p/n\log p/n अक्सर दिखाई देता है। β^β^\hat{\beta}1n∥Xβ^−Xβ∥22=OP(σlogpn−−−−−√∥β∥1).1n‖Xβ^−Xβ‖22=OP(σlog⁡pn‖β‖1). …

3
मल्टी-लेयर परसेप्ट्रान बनाम गहरे तंत्रिका नेटवर्क
यह शब्दावली का प्रश्न है। कभी-कभी मैं लोगों को गहरे तंत्रिका नेटवर्क को "बहुस्तरीय अवधारणात्मक" के रूप में संदर्भित करता हूं, ऐसा क्यों है? एक अवधारणात्मक, मुझे सिखाया गया था, एक एकल परत क्लासिफायर (या रेजिस्टर) है जो बाइनरी थ्रेशोल्ड आउटपुट के साथ एक विशिष्ट तरीके से वेट प्रशिक्षण (बैक-प्रोप …

2
समय श्रृंखला में लापता डेटा कैसे भरें?
मेरे पास प्रदूषण के आंकड़ों का एक बड़ा समूह है जो 2 साल के कोर्स के लिए हर 10 मिनट में रिकॉर्ड किया गया है, हालांकि डेटा में कई अंतराल हैं (कुछ में जो एक समय में कुछ हफ्तों के लिए जाते हैं)। डेटा काफी मौसमी प्रतीत होता है और …

2
मार्कोव श्रृंखला और मार्कोव प्रक्रियाओं के बीच अंतर क्या है?
मार्कोव श्रृंखला और मार्कोव प्रक्रियाओं के बीच अंतर क्या है? मैं परस्पर विरोधी जानकारी पढ़ रहा हूं: कभी-कभी यह परिभाषा इस बात पर आधारित होती है कि क्या राज्य का स्थान असतत है या निरंतर है, और कभी-कभी यह इस पर आधारित होता है कि क्या समय निरंतर है। इस …

3
बीटा वितरण और लॉजिस्टिक रिग्रेशन मॉडल के बीच क्या संबंध है?
मेरा सवाल है: बीटा वितरण और लॉजिस्टिक रिग्रेशन मॉडल के गुणांकों के बीच गणितीय संबंध क्या है ? वर्णन करने के लिए: उपस्कर (सिग्मॉइड) फ़ंक्शन द्वारा दिया जाता है f(x)=11+exp(−x)f(x)=11+exp⁡(−x)f(x) = \frac{1}{1+\exp(-x)} और इसका उपयोग लॉजिस्टिक रिग्रेशन मॉडल में संभावनाओं को मॉडल करने के लिए किया जाता है। आज्ञा देना …

1
एक संभावना घनत्व समारोह के चर के परिवर्तन की व्युत्पत्ति?
पुस्तक पैटर्न मान्यता और मशीन लर्निंग (सूत्र 1.27) में, यह देता है जहाँx=g(y),px(x)वह पीडीएफ है जोचर के परिवर्तन के संबंध मेंpy(y)से मेल खाती है।py(y)=px(x)∣∣∣dxdy∣∣∣=px(g(y))|g′(y)|py(y)=px(x)|dxdy|=px(g(y))|g′(y)|p_y(y)=p_x(x) \left | \frac{d x}{d y} \right |=p_x(g(y)) | g'(y) |x=g(y)x=g(y)x=g(y)px(x)px(x)p_x(x)py(y)py(y)p_y(y) पुस्तकों का कहना है, क्योंकि है कि टिप्पणियों की सीमा में पड़ने वाले है , के …

1
स्टोकेस्टिक ग्रेडिएंट डिसेंट्रेंट कैसे मानक ढाल डिसेंट की तुलना में समय बचा सकता है?
मानक ढाल वंश पूरे प्रशिक्षण डाटासेट के लिए ढाल की गणना करेगा। for i in range(nb_epochs): params_grad = evaluate_gradient(loss_function, data, params) params = params - learning_rate * params_grad युगों की पूर्व-निर्धारित संख्या के लिए, हम पहले संपूर्ण डाटासेट के लिए नुकसान फ़ंक्शन के ग्रेडिएंट वेक्टर वेट्स_ग्रेड की गणना करते हैं, …

2
आरओसी वक्र के तहत सटीकता बनाम क्षेत्र
मैंने एक नैदानिक ​​प्रणाली के लिए एक आरओसी वक्र का निर्माण किया। वक्र के नीचे का क्षेत्र तब गैर-पैरामीट्रिक रूप से अनुमानित था AUC = 0.89। जब मैंने इष्टतम थ्रेशोल्ड सेटिंग (बिंदु के निकटतम बिंदु (0, 1)) पर सटीकता की गणना करने की कोशिश की, तो मुझे डायग्नोस्टिक सिस्टम की …

1
आंशिक कम से कम वर्गों, कम रैंक प्रतिगमन, और प्रमुख घटक प्रतिगमन के बीच क्या संबंध है?
क्या कम रैंक प्रतिगमन और प्रमुख घटक प्रतिगमन आंशिक कम से कम वर्गों के विशेष मामले हैं? यह ट्यूटोरियल (पृष्ठ 6, "उद्देश्यों की तुलना") कहता है कि जब हम एक्स या वाई (यानी, "आंशिक नहीं") को प्रोजेक्ट किए बिना आंशिक रूप से कम से कम वर्ग करते हैं, तो यह …

4
हम क्यों कहते हैं कि परिणामी चर "भविष्यवक्ता (ओं) पर पुनः अंकित है?"
क्या इस शब्दावली के लिए कुछ सहज व्याख्या है? यह इस तरह से क्यों है, और भविष्यवक्ता (नों) को परिणाम पर फिर से प्रभावित नहीं किया जा रहा है? आदर्श रूप से मैं उम्मीद कर रहा हूं कि यह शब्दावली क्यों मौजूद है, इसका उचित विवरण छात्रों को इसे याद …

2
लॉजिस्टिक फंक्शन और सिग्मॉइड फंक्शन के बीच अंतर क्या हैं?
अंजीर 1. तार्किक कार्य अंजीर 2. सिगमाइड फंक्शन यह सिग्मॉइड फ़ंक्शन के सामान्यीकृत प्रकार की तरह अधिक है जहां आपके पास अधिक से अधिक मूल्य हो सकता है?
16 logistic 

3
अधिकतम संभावना कब काम करती है और कब नहीं?
मैं अधिकतम संभावना पद्धति के बारे में उलझन में हूं, जैसे कि अंकगणितीय माध्य की गणना। कब और क्यों अधिकतम संभावना उदाहरण के अंकगणित की तुलना में "बेहतर" अनुमानों का उत्पादन करती है? यह कैसे सत्यापित होता है?

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.