सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
इंटरेक्शन मॉडल में सबसे अच्छी विशेषताएं ढूँढना
मेरे पास उनके फीचर वैल्यू के साथ प्रोटीन की सूची है। एक नमूना तालिका इस तरह दिखती है: ...............Feature1...Feature2...Feature3...Feature4 Protein1 Protein2 Protein3 Protein4 पंक्तियाँ प्रोटीन हैं और कॉलम विशेषताएं हैं। मेरे पास प्रोटीनों की एक सूची भी है जो आपस में बातचीत करते हैं; उदाहरण के लिए Protein3, Protein4 Protein1, …

2
पदानुक्रमित लॉजिस्टिक प्रतिगमन के लिए बर्नौली पैरामीटर पर बीटा वितरण का उपयोग क्यों करें?
मैं वर्तमान में क्रुश्के की उत्कृष्ट "डूइंग बायेसियन डेटा एनालिसिस" पुस्तक पढ़ रहा हूं। हालांकि, पदानुक्रमित लॉजिस्टिक रिग्रेशन (अध्याय 20) पर अध्याय कुछ भ्रामक है। चित्र 20.2 एक पदानुक्रमित लॉजिस्टिक रिग्रेशन का वर्णन करता है जहां बर्नौली पैरामीटर को सिग्मॉइड फ़ंक्शन के माध्यम से रूपांतरित किए गए गुणांक पर रैखिक …

1
क्यों स्क्वेरिंग समझाया विचरण करता है?
यह एक मूल प्रश्न हो सकता है, लेकिन मैं सोच रहा था कि एक प्रतिगमन मॉडल में एक मूल्य को केवल स्पष्ट गठबंधन का आंकड़ा देने के लिए क्यों चुकता किया जा सकता है?आरRR मैं समझता हूं कि गुणांक एक रिश्ते की ताकत दे सकता है, लेकिन मुझे समझ में …

2
E1071 libsvm के साथ समस्या?
मेरे पास दो ओवरलैपिंग वर्गों के साथ एक डेटासेट है, प्रत्येक कक्षा में सात अंक, अंक दो-आयामी स्थान में हैं। आर में, और मैं इन वर्गों के लिए एक अलग हाइपरप्लेन बनाने के svmलिए e1071पैकेज से चल रहा हूं । मैं निम्नलिखित कमांड का उपयोग कर रहा हूं: svm(x, y, …

1
हैलट अनुक्रम बनाम सोबोल अनुक्रम?
पिछले प्रश्न में एक उत्तर से , मुझे वैराग्य अनुक्रम की ओर निर्देशित किया गया था, वैक्टर का एक सेट बनाने के लिए जिसने समान रूप से एक समान नमूना स्थान को कवर किया। लेकिन विकिपीडिया पृष्ठ में उल्लेख किया गया है कि उच्चतर प्राइमर विशेष रूप से श्रृंखला में …

2
व्युत्पन्न विशेषताएं तंत्रिका नेटवर्क में क्यों उपयोग की जाती हैं?
उदाहरण के लिए, एक घर की कीमतों की भविष्यवाणी करना चाहता है और दो इनपुट सुविधाओं की लंबाई और चौड़ाई है। कभी-कभी, एक में 'व्युत्पन्न' बहुपद इनपुट विशेषताएं भी शामिल होती हैं, जैसे कि क्षेत्र, जो लंबाई * चौड़ाई है। 1) व्युत्पन्न सुविधाओं को शामिल करने का क्या मतलब है? …

1
किनेक्ट यादृच्छिक जंगलों का उपयोग कैसे करता है?
मैं इस साइट पर पढ़ता हूं कि जाहिरा तौर पर Kinect किसी तरह से मशीन सीखने के लिए यादृच्छिक जंगलों के एल्गोरिथ्म का उपयोग करता है । क्या कोई समझा सकता है कि इसके लिए यादृच्छिक जंगलों का उपयोग क्या है, और उनका दृष्टिकोण कैसे काम करता है?

2
मात्रात्मक प्रतिगमन भविष्यवाणी
मैं अपने कुछ मॉडलों के लिए मात्रात्मक प्रतिगमन का उपयोग करने में दिलचस्पी रखता हूं, लेकिन इस पद्धति का उपयोग करके मैं क्या हासिल कर सकता हूं, इस पर कुछ स्पष्टीकरण देना चाहूंगा। मैं समझता हूं कि मैं IV / DV संबंध का अधिक मजबूत विश्लेषण प्राप्त कर सकता हूं …

5
यह क्यों दावा किया जाता है कि एक नमूना अक्सर एक जनगणना की तुलना में अधिक सटीक होता है?
नमूना लेने के दौरान, मैं निम्नलिखित दो कथनों को पूरा करता हूं: 1) नमूनाकरण त्रुटि ज्यादातर परिवर्तनशीलता की ओर ले जाती है, nonsampling त्रुटियां पूर्वाग्रह की ओर ले जाती हैं। 2) nonsampling त्रुटि के कारण, एक नमूना अक्सर CENSUS की तुलना में अधिक सटीक होता है। मैं नहीं जानता कि …

7
सिफारिशकर्ता प्रणालियों के बारे में एक पुस्तक के लिए सिफारिश
क्या आप अच्छी जानकारी वाली पुस्तक की सिफारिश कर सकते हैं जो कि एक सिफारिश प्रणाली को विकसित करने के लिए लागू की जा सकती है?

4
सिदक या बोनफेरोनि?
मैं पौधों की 16 विभिन्न प्रजातियों पर कैटरपिलर (गैर-सामान्य, ट्वीडि वितरण का उपयोग करके) की औसत संख्या में अंतर को देखने के लिए एसपीएसएस में एक सामान्यीकृत रैखिक मॉडल का उपयोग कर रहा हूं। मैं कई तुलनाएं चलाना चाहता हूं, लेकिन मुझे यकीन नहीं है कि मुझे एक सिडक या …

1
स्पीयरमैन के रैंक सहसंबंध के लिए एक विश्वास अंतराल की गणना कैसे करें?
विकिपीडिया में स्पीयरमैन रैंक सहसंबंध का फिशर ट्रांसफ़ॉर्मेशन लगभग अनुमानित स्कोर है। शायद वह जेड-स्कोर अशक्त परिकल्पना (रैंक सहसंबंध 0) से अंतर है? इस पृष्ठ का निम्न उदाहरण है: 4, 10, 3, 1, 9, 2, 6, 7, 8, 5 5, 8, 6, 2, 10, 3, 9, 4, 7, 1 rank …

3
कैसे परीक्षण करें कि क्या एक सहसंयोजक मैट्रिक्स दो समय बिंदुओं पर बदल गया है?
मेरा काम यह परखना है कि 6 वेरिएबल्स के कोविरियस मैट्रिक्स में कोई बदलाव है या नहीं। 6 चर का मान समान विषयों (माप के बीच 3 वर्ष) से ​​दो बार मापा जाता है। मैं उसे कैसे कर सकता हूँ? मैं अपने अधिकांश काम एसएएस का उपयोग करके कर रहा …

5
lme4 या अन्य ओपन सोर्स R पैकेज कोड asreml-R के बराबर है
मैं lme4, nlme, baysian regression पैकेज या किसी भी उपलब्ध का उपयोग करके मिश्रित मॉडल फिट करना चाहता हूं। Asreml- R कोडिंग सम्मेलनों में मिश्रित मॉडल बारीकियों में जाने से पहले, हम ASREML कोड से अपरिचित लोगों के लिए asreml-R सम्मेलनों पर विवरण रखना चाहते हैं। y = Xτ + …
13 r 

1
सामान्य वितरण के संयोजन से मात्राएँ
मुझे अलग-अलग उम्र के बच्चों के लिए एंथ्रोपोमेट्रिक आयाम (जैसे कंधे की हड्डी) के वितरण की जानकारी है। प्रत्येक आयु और आयाम के लिए, मेरा मतलब है, मानक विचलन। (मेरे पास आठ मात्राएँ भी हैं, लेकिन मुझे नहीं लगता कि मैं उनसे जो चाहूंगा, प्राप्त कर सकूंगा।) प्रत्येक आयाम के …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.