सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

2
एक गैर-रैखिक मॉडल के साथ एक समूह चर के प्रभाव का परीक्षण कैसे करें?
मेरे पास एक गैर-रैखिक मॉडल में एक समूह चर के उपयोग के संबंध में एक प्रश्न है। चूंकि nls () फ़ंक्शन फ़ैक्टर चर के लिए अनुमति नहीं देता है, मैं यह पता लगाने के लिए संघर्ष कर रहा हूं कि क्या कोई मॉडल फिट पर एक कारक के प्रभाव का …
15 r  mixed-model  nls 

1
कब / कहाँ कार्यात्मक डेटा विश्लेषण का उपयोग करें?
मैं कार्यात्मक डेटा विश्लेषण (एफडीए) के लिए बहुत नया हूं । मैं पढ़ रहा हु: रामसे, जेम्स ओ।, और सिल्वरमैन, बर्नार्ड डब्ल्यू। (2006), फ़ंक्शनल डेटा एनालिसिस, 2 डी एड, स्प्रिंगर, न्यूयॉर्क। हालांकि, मैं अभी भी बहुत स्पष्ट नहीं हूं कि एफडीए का उपयोग कहां / कब करना है? क्या कोई …

2
"बूटस्ट्रैप वेलिडेशन" के लिए प्रक्रिया क्या है (उर्फ "रेज़म्पलिंग क्रॉस-वेलिडेशन")?
"बूटस्ट्रैप वेलिडेशन" / "रीसम्प्लिंग क्रॉस-वेलिडेशन" मेरे लिए नया है, लेकिन इस प्रश्न के उत्तर से चर्चा की गई थी । मैं इसे इकट्ठा करता हूं इसमें 2 प्रकार के डेटा शामिल हैं: वास्तविक डेटा और सिम्युलेटेड डेटा, जहां सिम्युलेटेड डेटा का एक सेट वास्तविक डेटा से उत्पन्न होता है, जब …

3
आर का उपयोग करके आकर्षण की कल्पना करने का सबसे अच्छा तरीका?
इस साइट के माध्यम से मैंने हाल ही में Sankey Diagrams की खोज की है, जो एक पारंपरिक प्रवाह चार्ट में क्या हो रहा है, यह कल्पना करने का एक शानदार तरीका है । जॉर्ज एम। व्हाईटसाइड्स और जॉर्ज डब्ल्यू। क्रैब्री , स्रोत द्वारा सेंकेई आरेख का एक अच्छा उदाहरण …

4
समय श्रृंखला में सांख्यिकीय रूप से महत्वपूर्ण अंतर के लिए परीक्षण?
मेरे पास दो प्रतिभूतियों की कीमतों की समय श्रृंखला है, ए और बी, समय की एक ही अवधि में और एक ही आवृत्ति पर नमूना। मैं परीक्षण करना चाहूंगा कि क्या दोनों कीमतों के बीच समय के साथ कोई सांख्यिकीय महत्वपूर्ण अंतर है (मेरी अशक्त परिकल्पना यह होगी कि अंतर …

3
आर में डेटा फ्रेम का विस्तार कैसे करें
ताला लगा हुआ । यह सवाल और इसके जवाब बंद हैं क्योंकि यह सवाल ऑफ-टॉपिक है लेकिन इसका ऐतिहासिक महत्व है। यह वर्तमान में नए उत्तरों या इंटरैक्शन को स्वीकार नहीं कर रहा है। आर के साथ कुछ विश्लेषण करते समय मुझे निम्नलिखित समस्या हो रही है। मेरे पास इस …
15 r 

1
आकलनकर्ताओं की सूचना (टिल्ड बनाम हैट)
1. क्या आँकड़े में टोपी और टिल्ड प्रतीक के बारे में कोई नामकरण सम्मेलन है? मैंने पाया β के लिए एक आकलनकर्ता वर्णन है β ( विकिपीडिया ) लेकिन मैंने यह भी पाया ~ β के लिए एक आकलनकर्ता वर्णन है β ( Wolfram )। क्या अर्थ में कोई अंतर …
15 notation 

2
विभिन्न समायोजित
मेरे पास प्रस्तावित R- चुकता फार्मूले को ध्यान में रखना है: यहेजकेल (1930), जो मुझे विश्वास है कि वर्तमान में एसपीएसएस में उपयोग किया जाता है। R2adjusted=1−(N−1)(N−p−1)(1−R2)Radjusted2=1−(N−1)(N−p−1)(1−R2)R^2_{\rm adjusted} = 1 - \frac{(N-1)}{(N-p-1)} (1-R^2) ओल्किन और प्रैट (1958) R2unbiased=1−(N−3)(1−R2)(N−p−1)−2(N−3)(1−R2)2(N−p−1)(N−p+1)Runbiased2=1−(N−3)(1−R2)(N−p−1)−2(N−3)(1−R2)2(N−p−1)(N−p+1)R^2_{\rm unbiased} = 1 - \frac{(N-3)(1-R^2)}{(N-p-1)} - \frac{2(N-3)(1-R^2)^2}{(N-p-1)(N-p+1)} किन परिस्थितियों में (यदि कोई …

1
एक फिट फिट के लिए आर-स्क्वेर कैसे प्राप्त करें?
R-squared ( ) R के लिए और / या फ़ंक्शन आउटपुट में सांख्यिकीय की गणना कैसे करें ? इस डेटा के लिए उदाहरण के लिए:आर2आर2r^2loesspredict cars.lo <- loess(dist ~ speed, cars) cars.lp <- predict(cars.lo, data.frame(speed = seq(5, 30, 1)), se = TRUE) cars.lpfitमॉडल के लिए और se.fitमानक त्रुटि के लिए …
15 r  r-squared  loess 

5
क्या मैं रैखिक मॉडल में कारकों के गैर-महत्वपूर्ण स्तरों के लिए गुणांक की उपेक्षा कर सकता हूं?
यहाँ पर रैखिक मॉडल गुणांक के बारे में स्पष्टीकरण मांगने के बाद, मेरे पास फ़ैक्टर स्तरों के गुणांकों के लिए गैर-साइनफ़िकेंट (उच्च पी मान) से संबंधित प्रश्न है। उदाहरण: यदि मेरे रैखिक मॉडल में 10 स्तरों वाला कारक शामिल है, और उन स्तरों में से केवल 3 में महत्वपूर्ण p …

3
क्या CARET में पैरामीटर ट्यूनिंग (ग्रिड) सुविधा को अक्षम करने का एक तरीका है?
CARET अंतिम मॉडल का चयन करने से पहले विभिन्न मॉडलों के निर्माण के लिए स्वचालित रूप से पूर्व-निर्दिष्ट ट्यूनिंग ग्रिड का उपयोग करेगा, और फिर पूर्ण प्रशिक्षण डेटा पर अंतिम मॉडल का प्रशिक्षण देगा। मैं मापदंडों के केवल एक संयोजन के साथ अपनी खुद की ट्यूनिंग ग्रिड की आपूर्ति कर …
15 r  caret 

3
मैं मानक विचलन का मूल्यांकन कैसे करूं?
मैंने कुछ कार्यों को करने की क्षमता पर 85 लोगों से प्रतिक्रियाएं एकत्र की हैं। प्रतिक्रियाएं पांच बिंदु पर हैं पैमाने: 5 = बहुत अच्छा, 4 = अच्छा, 3 = औसत, 2 = गरीब, 1 = बहुत गरीब, औसत स्कोर 2.8 है और मानक विचलन 0.54 है। मैं समझता हूं …

1
एसएएस और आर में एनोवा में वर्गों के प्रकार III योग के विरोधी परिणाम
मैं दोनों के साथ एक असंतुलित factorial प्रयोग से डेटा का विश्लेषण कर रहा हूँ SASऔर R। दोनों SASऔर Rसमान प्रकार प्रदान करते हैं I वर्गों के योग लेकिन उनके प्रकार III के वर्ग एक दूसरे से भिन्न होते हैं। नीचे दिए गए हैं SASऔर Rकोड और आउटपुट। DATA ASD; …
15 r  anova  sas  sums-of-squares 

4
क्या विशेषज्ञ हानिकारक हैं?
मैं "आर्टिफिशियल इंटेलिजेंस रिसर्च में शतरंज की भूमिका" ( पीडीएफ ) पढ़ रहा हूं और दिलचस्प है, यह कहता है: अनुभव [...] का सुझाव है कि आम तौर पर उपयोगी, जबकि शतरंज विशेषज्ञों से इनपुट पर पूरी तरह भरोसा नहीं किया जा सकता है। इसका एक अच्छा उदाहरण डीप थॉट्स …

3
व्यावहारिक रूप से अच्छी डेटा विश्लेषण प्रक्रिया क्या है?
मैं जानना चाहता हूं, या संदर्भ हैं, विश्लेषण प्रक्रिया सांख्यिकीय डेटा विश्लेषकों के अधिकांश प्रत्येक डेटा विश्लेषण परियोजना के लिए गुजरते हैं। यदि मैं एक "सूची" बनाता हूं, तो डेटा विश्लेषण परियोजना को पूरा करने के लिए, एक विश्लेषक को यह करना होगा: परियोजना के लिए पहली आवश्यकताएं एकत्रित करें, …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.