सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

1
महालनोबिस दूरी और उत्तोलन के बीच संबंध साबित करें?
मैंने विकिपीडिया पर सूत्र देखे हैं । वह महालनोबिस दूरी और उत्तोलन से संबंधित है: महालनोबिस दूरी लीवरेज स्टैटिस्टिक, जhh से निकटता से संबंधित है , लेकिन इसका एक अलग पैमाना है: डी2= ( एन- 1 ) ( एच - 1एन) का है ।D2=(N−1)(h−1N).D^2 = (N - 1)(h - \tfrac{1}{N}). …

2
लॉजिस्टिक रिग्रेशन कब उपयुक्त है?
मैं वर्तमान में खुद को सिखा रहा हूं कि कैसे वर्गीकरण करना है, और विशेष रूप से मैं तीन तरीकों को देख रहा हूं: वेक्टर मशीनों, तंत्रिका नेटवर्क और लॉजिस्टिक प्रतिगमन का समर्थन करें। मैं यह समझने की कोशिश कर रहा हूं कि लॉजिस्टिक रिग्रेशन कभी भी अन्य दो की …

2
प्रतिगमन जब
मैंने बनाया दो चर की माप एक्स और वाई । वे दोनों अनिश्चितताओं को जानते हैं σ एक्स और σ y उन लोगों के साथ जुड़ा हुआ है। मैं x और y के बीच संबंध खोजना चाहता हूं । मैं यह कैसे कर सकता हूं?nnnएक्सxxyyyσएक्सσx\sigma_xσyσy\sigma_yएक्सxxyyy संपादित करें : प्रत्येक एक …

1
जब वे एक स्वतंत्र चर हैं, तो अनुपात को बदलने के लिए सबसे उपयुक्त तरीका क्या है?
मुझे लगा कि मैं इस मुद्दे को समझ गया हूं, लेकिन अब मैं निश्चित नहीं हूं और आगे बढ़ने से पहले मैं दूसरों के साथ जांच करना चाहूंगा। मेरे पास दो चर हैं, Xऔर Y। Yएक अनुपात है, और यह 0 और 1 से घिरा नहीं है और आम तौर …

2
पॉसन रिग्रेशन के लिए लॉग लिंक वर्सेस आइडेंटिटी लिंक के पेशेवरों और विपक्ष
मैं की तुलना (और के अंतर देखकर) अपने मॉडल में दो कारक स्तरों के बीच भविष्यवाणी मतलब मायने रखता है के अंत लक्ष्य के साथ एक प्वासों प्रतिगमन बाहर ले जाने , अन्य मॉडल covariates दबाते हुए (जो सभी बाइनरी हैं ) लगातार। मैं सोच रहा था कि क्या कोई …

2
विभिन्न एआईसी की परिभाषा
विकिपीडिया से Akaike की सूचना मानदंड (AIC) की परिभाषा , जहाँ मापदंडों की संख्या है और मॉडल की लॉग-लाइबिलिटी है।k k log LA मैंसी= 2 k - 2 लॉगएलAIC=2k−2log⁡L AIC = 2k -2 \log L कkkलॉगएलlog⁡L\log L हालाँकि, हमारे इकोनोमेट्रिक्स ने एक अच्छी तरह से सम्मानित विश्वविद्यालय में नोट किया …

2
आईड गंबल वेरिएबल्स की अधिकतम की उम्मीद
मैं रैंडम यूटिलिटी मॉडल में इस्तेमाल किए गए एक विशेष परिणाम के बारे में अर्थशास्त्र की पत्रिकाओं में पढ़ता रहता हूं। परिणाम का एक संस्करण है: if Gumbel ( , तो:ϵi∼iid,ϵi∼iid,\epsilon_i \sim_{iid}, μ,1),∀iμ,1),∀i\mu, 1), \forall i E[maxi(δi+ϵi)]=μ+γ+ln(∑iexp{δi}),E[maxi(δi+ϵi)]=μ+γ+ln⁡(∑iexp⁡{δi}),E[\max_i(\delta_i + \epsilon_i)] = \mu + \gamma + \ln\left(\sum_i \exp\left\{\delta_i \right\} \right), जहां γ≈0.52277γ≈0.52277\gamma …

2
Bayesian अनुकूलन के लिए GP प्रतिगमन में बीमार-वातानुकूलित सहसंयोजक मैट्रिक्स
पृष्ठभूमि और समस्या मैं प्रतिगमन और बाद में बायेसियन अनुकूलन (बीओ) के लिए गॉसियन प्रोसेस (जीपी) का उपयोग कर रहा हूं। प्रतिगमन के लिए मैं कई कस्टम-निर्मित संशोधनों के साथ MATLAB के लिए gpml पैकेज का उपयोग करता हूं , लेकिन समस्या सामान्य है। यह एक सर्वविदित तथ्य है कि …

3
"रैखिक" बनाम "गैर-रैखिक" प्रतिगमन के बीच अंतर करना क्यों महत्वपूर्ण है?
रैखिक और गैर-रैखिक मॉडल के बीच अंतर का क्या महत्व है? प्रश्न Nonlinear बनाम सामान्यीकृत रैखिक मॉडल: आप लॉजिस्टिक, पॉइसन, आदि प्रतिगमन को कैसे देखते हैं? और इसका जवाब सामान्यीकृत रैखिक मॉडल की रैखिकता / गैर-रैखिकता का एक अत्यंत सहायक स्पष्टीकरण था। यह गैर-रैखिक मॉडल से रैखिक को अलग करने …

2
रेटिंग स्कोर का योग बनाम अनुमानित कारक स्कोर?
जब तराजू का निर्माण करते हैं, तो सादा राशि से अधिक " कारक स्कोर " का उपयोग करने के बारे में सुझाव प्राप्त करना चाहते हैं। एक कारक स्कोरिंग के "गैर-परिष्कृत" तरीकों पर Ie "परिष्कृत"। DiStefano एट अल से। (2009, pdf ), जोर जोड़ा गया: कारक स्कोर गणना विधियों के …

1
शून्य परिकल्पना के तहत, का अपेक्षित मूल्य , निर्धारण का गुणांक
मैं इस लेख में समायोजन के संबंध में पहले पृष्ठ के नीचे दिए गए कथन के बारे में उत्सुक हूंR2adjustedRadjusted2R^2_\mathrm{adjusted} R2adjusted=1−(1−R2)(n−1n−m−1).Radjusted2=1−(1−R2)(n−1n−m−1).R^2_\mathrm{adjusted} =1-(1-R^2)\left({\frac{n-1}{n-m-1}}\right). पाठ बताता है: समायोजन का तर्क निम्नलिखित है: सामान्य कई प्रतिगमन में, एक यादृच्छिक भविष्यवक्ता औसत रूप से प्रतिक्रिया की भिन्नता के अनुपात 1/(n–1)1/(n–1)1/(n – 1) की व्याख्या …

2
क्या स्लटस्की की प्रमेय अभी भी मान्य है जब दो अनुक्रम दोनों एक गैर-पतित यादृच्छिक चर में परिवर्तित होते हैं?
मैं स्लटस्की के प्रमेय के बारे में कुछ विवरणों को लेकर भ्रमित हूं : Let , अदिश / सदिश / मैट्रिक्स यादृच्छिक तत्वों के दो क्रम होते हैं।{ Y n }{Xn}{Xn}\{X_n\}{Yn}{Yn}\{Y_n\} यदि एक यादृच्छिक तत्व के वितरण में परिवर्तित होता है और एक निरंतर लिए प्रायिकता में होता है , …

3
क्यों अनैतिक शब्दों के लिए पदानुक्रमित सॉफ्टमैक्स बेहतर है, जबकि नकारात्मक नमूना लगातार शब्दों के लिए बेहतर है?
मुझे आश्चर्य है कि पदानुक्रमित सॉफ्टमैक्स, असंगत शब्दों के लिए बेहतर क्यों है, जबकि नकारात्मक नमूने लगातार शब्दों के लिए, वर्डवेव के सीबीओओ और स्किप-ग्राम मॉडल में बेहतर है। मैंने https://code.google.com/p/word2vec/ पर दावा पढ़ा है ।

2
संभावना मॉडल को कैलिब्रेट करते समय इष्टतम बिन चौड़ाई कैसे चुनें?
पृष्ठभूमि: कुछ महान प्रश्न / उत्तर यहां दिए गए हैं कि कैसे मॉडल को जांचना है जो किसी परिणाम की संभावनाओं की भविष्यवाणी करते हैं। उदाहरण के लिए बैरियर स्कोर , और संकल्प, अनिश्चितता और विश्वसनीयता में इसका अपघटन । अंशांकन भूखंड और आइसोटोनिक प्रतिगमन । इन विधियों को अक्सर …

2
एक गाऊसी प्रक्रिया के व्युत्पन्न
मेरा मानना ​​है कि गॉसियन प्रक्रिया (जीपी) का व्युत्पन्न एक और जीपी है, और इसलिए मैं यह जानना चाहूंगा कि क्या जीपी के व्युत्पन्न समीकरणों के पूर्वानुमान समीकरणों के लिए बंद फॉर्म समीकरण हैं? विशेष रूप से, मैं चुकता घातांक (जिसे गाऊसी भी कहा जाता है) कोवरियस कर्नेल का उपयोग …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.