सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

3
ACF & PACF MA और AR शब्दों के क्रम की पहचान कैसे करता है?
2 साल से अधिक हो गया है कि मैं अलग-अलग समय श्रृंखला पर काम कर रहा हूं। मैंने कई लेखों पर पढ़ा है कि AC शब्द का उपयोग MA शब्द के क्रम को पहचानने के लिए किया जाता है, और AR के लिए PACF को। एक अंगूठे का नियम है …

1
क्या एकतरफा विश्वास अंतराल में 95% कवरेज हो सकता है
मैं सोच रहा था कि अल्फा-स्तर के साथ एक तरफा (एक-पूंछ) परिकल्पना दी गई है .05, क्या हम 95% विश्वास अंतराल के बारे में बात कर सकते हैं? उदाहरण के लिए, हम कर सकते हैं का निर्माण अलग से "एक पक्षीय" और विश्वास के अंतराल "दोहरे" एक के लिए एक …

2
शोर लेबल के साथ वर्गीकरण?
मैं वर्गीकरण के लिए एक तंत्रिका नेटवर्क को प्रशिक्षित करने की कोशिश कर रहा हूं, लेकिन मेरे पास जो लेबल हैं वे शोरगुल हैं (लगभग 30% लेबल गलत हैं)। क्रॉस-एन्ट्रापी नुकसान वास्तव में काम करता है, लेकिन मैं सोच रहा था कि क्या इस मामले में कोई विकल्प अधिक प्रभावी …

4
क्या वर्गीकरण के लिए औसत चुकता त्रुटि का उपयोग किया जा सकता है?
मुझे पता है कि चुकता त्रुटि फार्मूला और इसकी गणना कैसे की जाती है। जब हम एक प्रतिगमन के बारे में बात करते हैं तो हम औसत चुकता त्रुटि की गणना कर सकते हैं। हालांकि हम एक वर्गीकरण समस्या के लिए एक एमएसई के बारे में बात कर सकते हैं …

2
मान-व्हिटनी यू परीक्षण असमान नमूना आकारों के साथ
मेरे पास दो असमान समूह (94 और 52) हैं और यह देखने के लिए मान-व्हिटनी यू-टेस्ट चलाना चाहते हैं कि क्या मापा चर पर उनके स्कोर अलग-अलग हैं। मैं देखता हूं कि क्रूसकॉल-वालिस के साथ ऐसा करना ठीक है, क्या यह मान-व्हिटनी पर भी लागू होता है?

2
कैसे एम्बेडिंग परत को केरस एम्बेडिंग परत में प्रशिक्षित किया जाता है
केरस एम्बेडिंग लेयर में एंबेडिंग लेयर को कैसे प्रशिक्षित किया जाता है? (टेंसरफ़्लो बैकएंड का उपयोग करते हुए कहते हैं, इसका अर्थ शब्द 2vec, दस्ताने या फास्टटेक्स के समान है) मान लें कि हम एक प्रीटेंडेड एम्बेडिंग का उपयोग नहीं करते हैं।

3
विश्वव्यापी नेटवर्क के लिए सार्वभौमिक सन्निकटन प्रमेय
सार्वभौमिक सन्निकटन प्रमेय तंत्रिका नेटवर्क के लिए एक बहुत प्रसिद्ध परिणाम है, मूल रूप से यह कहते हुए कि कुछ मान्यताओं के तहत, एक फ़ंक्शन को किसी भी सटीकता के भीतर तंत्रिका नेटवर्क द्वारा समान रूप से अनुमानित किया जा सकता है। क्या कुछ अनुरूप परिणाम होता है जो कन्वेन्शनल …

4
सुसंगत और asymptotically निष्पक्ष के बीच अंतर की सहज समझ
मैं एक सहज ज्ञान युक्त समझ पाने की कोशिश कर रहा हूं और लगातार और विषम रूप से निष्पक्ष शब्द के बीच अंतर और व्यावहारिक अंतर महसूस करता हूं। मैं उनकी गणितीय / सांख्यिकीय परिभाषा जानता हूं, लेकिन मैं कुछ सहज ज्ञान युक्त हूं। मेरे लिए, उनकी व्यक्तिगत परिभाषाओं को …

4
कई आउटपुट प्रतिगमन के लिए तंत्रिका नेटवर्क
मेरे पास 34 इनपुट कॉलम और 8 आउटपुट कॉलम वाले डेटासेट हैं। समस्या को हल करने का एक तरीका 34 आउटपुट लेना और प्रत्येक आउटपुट कॉलम के लिए व्यक्तिगत प्रतिगमन मॉडल बनाना है। मुझे आश्चर्य है कि क्या यह समस्या सिर्फ एक मॉडल का उपयोग करके हल की जा सकती …

2
कॉची वितरण के नमूने के वितरण का क्या मतलब है?
आमतौर पर जब कोई वितरण का यादृच्छिक नमूना औसत (30 से अधिक नमूना आकार के साथ) लेता है, तो औसत मूल्य के आसपास एक सामान्य वितरण को प्राप्त करता है। हालांकि, मैंने सुना है कि कॉची वितरण का कोई मतलब मूल्य नहीं है। कॉची वितरण का नमूना साधन प्राप्त करते …
14 cauchy 

1
श्रेणीबद्ध डेटा के साथ एक नकारात्मक द्विपद GLM से .L और .Q आउटपुट की व्याख्या
मैंने सिर्फ एक नकारात्मक द्विपद GLM चलाया और यह आउटपुट है: Call: glm.nb(formula = small ~ method + site + depth, data = size.dat, init.theta = 1.080668549, link = log) Deviance Residuals: Min 1Q Median 3Q Max -2.2452 -0.9973 -0.3028 0.3864 1.8727 Coefficients: Estimate Std. Error z value Pr(>|z|) (Intercept) …

3
सूत्र और R के फिशर से अनुपात क्यों भिन्न होते हैं। किसे चुनना चाहिए?
निम्नलिखित उदाहरण में > m = matrix(c(3, 6, 5, 6), nrow=2) > m [,1] [,2] [1,] 3 5 [2,] 6 6 > (OR = (3/6)/(5/6)) #1 [1] 0.6 > fisher.test(m) #2 Fisher's Exact Test for Count Data data: m p-value = 0.6699 alternative hypothesis: true odds ratio is not equal …

1
क्या लॉजिस्टिक रिग्रेशन अधिकतम होने की संभावना को भी रेखीय मॉडल से अधिक करता है?
बाइनरी परिणामों के साथ एक डेटा सेट को देखते हुए और कुछ भविष्यवाणिय मैट्रिक्स , मानक लॉजिस्टिक प्रतिगमन मॉडल गुणांक के बीटा +1 {MLE } जो द्विपद संभावना को अधिकतम करता है। जब एक्स पूर्ण रैंक है \ बीटा_ {एमएलई} अद्वितीय है; जब पूर्ण पृथक्करण मौजूद नहीं है, तो यह …

3
क्या आंकड़ों पर अत्यधिक उद्धृत कागजात हैं जो वास्तव में खराब सांख्यिकीय प्रथाओं का प्रसार कर चुके हैं?
सांख्यिकीय विधियों का दुरुपयोग करने के कई तरीके हैं। क्या आप खराब सांख्यिकीय अभ्यास के किसी भी उदाहरण के बारे में जानते हैं जो पहली बार स्पष्ट सलाह के रूप में प्रकाशित हुए थे (जैसे "आपको इस पद्धति का उपयोग करना चाहिए ..."), प्रतिष्ठित शैक्षणिक पत्रिकाओं में जो तब बार-बार …

1
"2.5 गुना RMSE" के आधार पर आउटलेर्स को छोड़ना
में Kahneman और Deaton (2010) † , लेखकों निम्नलिखित लिखें:††^\dagger यह प्रतिगमन 0.67852 के मूल माध्य वर्ग त्रुटि (RMSE) के साथ 37% विचरण को स्पष्ट करता है। आउटलेर्स और अनुमानित आय रिपोर्ट को समाप्त करने के लिए, हमने टिप्पणियों को छोड़ दिया जिसमें लॉग इनकम और इसकी भविष्यवाणी के बीच …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.