सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
R में ggplot2 का उपयोग करते हुए दो कारकों के संबंध में बॉक्सप्लॉट
ताला लगा हुआ । यह सवाल और इसके जवाब बंद हैं क्योंकि यह सवाल ऑफ-टॉपिक है लेकिन इसका ऐतिहासिक महत्व है। यह वर्तमान में नए उत्तरों या इंटरैक्शन को स्वीकार नहीं कर रहा है। मैं R के लिए बहुत नया हूं और R में किसी भी पैकेज के लिए। मैंने …
13 r  boxplot  ggplot2 

4
प्रतिशत पर ANOVA का उपयोग?
मेरे पास स्वतंत्र चर (कारक) के रूप में चार समूहों (4 बीएमआई समूहों) के साथ एक तालिका है। मेरे पास एक आश्रित चर है जो "गर्भावस्था में प्रतिशत माँ धूम्रपान" है। क्या इसके लिए एनोवा का उपयोग करने की अनुमति है या क्या मुझे ची-स्क्वायर या किसी अन्य परीक्षण का …
13 anova 

6
एंडोजेनिटी बनाम अप्राप्य विषमता
एंडोजेनिटी और अनबॉस्स्ड हेट्रोजेनिटी में क्या अंतर है ? मुझे पता है कि अप्रचलित चर से उदाहरण के लिए आता है? लेकिन जहाँ तक मैं समझता हूँ, असम्बद्ध विषमता एक ही समस्या का कारण है। लेकिन वास्तव में इन दो धारणाओं के बीच अंतर कहां है?

1
एन-सशस्त्र डाकू समस्याओं को हल करने के लिए इष्टतम एल्गोरिदम?
मैंने एन-सशस्त्र दस्यु समस्याओं जैसे -greedy, softmax, और UCB1 को हल करने के लिए कई एल्गोरिदम के बारे में पढ़ा है , लेकिन मुझे खेद कम करने के लिए सबसे अच्छा तरीका क्या है के माध्यम से छंटनी करने में थोड़ी परेशानी हो रही है।ϵϵ\epsilon क्या एन-सशस्त्र डाकू समस्या को …

2
संरचनात्मक समीकरण मॉडल में एक बहुत छोटा नमूना होने की जटिलताओं
मैं अमोस 18 में एक संरचनात्मक समीकरण मॉडल (SEM) चला रहा हूं। मैं अपने प्रयोग के लिए 100 प्रतिभागियों की तलाश कर रहा था (शिथिल इस्तेमाल किया गया), जिसे माना जाता था कि सफल एसईएम का संचालन करने के लिए पर्याप्त नहीं है। मुझे बार-बार बताया गया है कि SEM …

4
विचरण का व्यावहारिक अनुप्रयोग क्या है?
मैं अपने आप को संभाव्यता सिद्धांत सिखा रहा हूं, और मुझे यकीन नहीं है कि मैं मानक विचलन के विपरीत, विचरण के लिए किसी भी उपयोग को समझता हूं। जिन अभ्यास स्थितियों में मैं देख रहा हूं, उनमें विचरण सीमा से बड़ा है, इसलिए यह सहज रूप से उपयोगी नहीं …
13 variance 

4
भविष्यवक्ताओं के विभिन्न सेटों के महत्व की तुलना करना
मैं एक विशेष समस्या के साथ एक शोध छात्र को सलाह दे रहा था, और मैं इस साइट पर दूसरों का इनपुट प्राप्त करने का इच्छुक था। प्रसंग: शोधकर्ता के तीन प्रकार के पूर्वसूचक चर थे। प्रत्येक प्रकार में एक अलग संख्या में भविष्यवाणियां होती हैं। प्रत्येक भविष्यवक्ता एक सतत …


3
अधिक से अधिक विचरण "बेहतर" के साथ एक भविष्यवक्ता है?
मेरे पास एक "बुनियादी आँकड़े" अवधारणा प्रश्न है। एक छात्र के रूप में मैं जानना चाहता हूं कि क्या मैं इस बारे में पूरी तरह से गलत सोच रहा हूं और क्यों, यदि ऐसा है: मान लें कि मैं काल्पनिक रूप से "क्रोध प्रबंधन के मुद्दों" के बीच संबंधों को …

4
चर के समूहों के बीच / के बीच सहसंबंध की गणना कैसे करें?
मेरे पास १००० अवलोकनों और ५० चरों का एक मैट्रिक्स है जो प्रत्येक ५-बिंदु पैमाने पर मापा जाता है। ये चर समूह में व्यवस्थित हैं, लेकिन प्रत्येक समूह में समान संख्या में चर नहीं हैं। मैं दो प्रकार के सहसंबंधों की गणना करना चाहता हूं: चर के समूहों के बीच …

2
"दुर्लभ" घटनाओं के साथ सीखने की निगरानी, ​​जब दुर्लभता बड़ी संख्या में काउंटर-तथ्यात्मक घटनाओं के कारण होती है
मान लीजिए कि आपको किसी बाज़ार में खरीदारों और विक्रेताओं के बीच "मैच" देखने को मिलते हैं। आप दोनों खरीदारों और विक्रेताओं की विशेषताओं का भी निरीक्षण कर सकते हैं, जिसका उपयोग आप भविष्य के मैचों की भविष्यवाणी करने और बाजार के दोनों किनारों पर सिफारिशें करने के लिए करना …

2
एक तालिका में डालने के लिए महत्वपूर्ण आंकड़ों की संख्या?
क्या प्रकाशित करने के लिए महत्वपूर्ण आंकड़ों की संख्या के लिए एक अच्छी तरह से स्थापित नियम है? यहाँ कुछ विशिष्ट उदाहरण / प्रश्न दिए गए हैं: क्या भिन्नता के गुणांक के लिए महत्वपूर्ण आंकड़ों की संख्या से संबंधित कोई तरीका है? उदाहरण के लिए, यदि अनुमान 12.3 है और …
13 tables 

5
क्या ची वर्ग का उपयोग अनुपातों की तुलना करने के लिए किया जा सकता है?
मैंने पढ़ा है कि ची वर्ग परीक्षण यह देखने के लिए उपयोगी है कि क्या नमूना अपेक्षित मूल्यों के एक सेट से काफी अलग है। उदाहरण के लिए, यहां लोगों के पसंदीदा रंगों (n = 15 + 13 + 10 + 17 = 55 कुल योग) के बारे में एक …

3
इसके हिस्टोग्राम द्वारा वितरण की पहचान करने में सहायता की आवश्यकता है
मेरे पास एक निश्चित सिग्नल के पंजीकृत आयाम मैक्सिमा की नमूना आबादी है। जनसंख्या लगभग 15 मिलियन नमूने हैं। मैंने जनसंख्या का एक हिस्टोग्राम का उत्पादन किया, लेकिन इस तरह के हिस्टोग्राम के साथ वितरण का अनुमान नहीं लगा सकता। EDIT1: कच्चे नमूने के मूल्यों के साथ फाइल यहाँ है: …

1
अतिव्यापी डेटा के साथ समय श्रृंखला प्रतिगमन
मुझे एक प्रतिगमन मॉडल दिखाई दे रहा है जो वर्ष-दर-वर्ष स्टॉक इंडेक्स रिटर्न पर पिछड़ रहा है (12 महीने) उसी स्टॉक इंडेक्स का वर्ष-दर-वर्ष रिटर्न, क्रेडिट स्प्रेड (मासिक जोखिम रहित बॉन्ड और कॉर्पोरेट बॉन्ड के बीच अंतर) पैदावार), YoY मुद्रास्फीति की दर और औद्योगिक उत्पादन के YoY सूचकांक। यह इस …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.