सांख्यिकी और बिग डेटा

Q & A में सांख्यिकी, मशीन लर्निंग, डेटा विश्लेषण, डेटा माइनिंग और डेटा विज़ुअलाइज़ेशन में रुचि रखने वाले लोगों के लिए

4
क्या एयूसी प्रत्येक वर्ग से यादृच्छिक रूप से चयनित उदाहरण को सही ढंग से वर्गीकृत करने की संभावना है?
मैंने एक पेपर में इस कैप्शन को पढ़ा और कभी भी कहीं और इस तरह वर्णित AUC को नहीं देखा। क्या ये सच है? क्या यह देखने का कोई प्रमाण या सरल तरीका है? अंजीर। 2, रिसीवर-ऑपरेटिंग विशेषता वक्र (AUC) के तहत क्षेत्र के संदर्भ में व्यक्त किए गए द्विभाजनशील …

3
होल्ट-विंटर्स या ARIMA का उपयोग करें?
मेरा प्रश्न होल्ट-विंटर्स और ARIMA के बीच वैचारिक अंतर के आसपास है। जहां तक ​​मैं समझता हूं, होल्ट-विंटर्स ARIMA का एक विशेष मामला है। लेकिन एक एल्गोरिथ्म दूसरे पर कब पसंद किया जाता है? शायद होल्ट-विंटर्स वृद्धिशील है और इसलिए एक इनलाइन (तेज) एल्गोरिदम के रूप में कार्य करता है? …

3
स्टेप वाइज रिग्रेशन के क्या फायदे हैं?
मैं समस्या के प्रति अपने दृष्टिकोण में विविधता के लिए स्टेप वाइज रिग्रेशन का प्रयोग कर रहा हूं। तो, मेरे 2 सवाल हैं: स्टेप वाइज रिग्रेशन के क्या फायदे हैं? इसकी विशिष्ट ताकत क्या हैं? आप हाइब्रिड दृष्टिकोण के बारे में क्या सोचते हैं, जहां आप सुविधाओं का चयन करने …

2
LSTM का उपयोग करके भाषा मॉडलिंग कार्यों में अज्ञात शब्दों को संभालना
एक प्राकृतिक भाषा प्रसंस्करण (एनएलपी) कार्य के लिए अक्सर शब्दों के लिए एक एम्बेडिंग के रूप में शब्द 2vec वैक्टर का उपयोग किया जाता है। हालाँकि, ऐसे कई अज्ञात शब्द हो सकते हैं, जो शब्द 2vec vectors द्वारा कैप्चर नहीं किए गए हैं, क्योंकि ये शब्द अक्सर प्रशिक्षण डेटा में …

1
क्या यह रैंडम फ़ॉरेस्ट से पहले फीचर चयन का उपयोग करने के लिए समझ में आता है?
सब कुछ शीर्षक में है, क्या यह यादृच्छिक जंगल का उपयोग करने से पहले फीचर चयन का उपयोग करने के लिए समझ में आता है?

1
एक द्विपदीय GLMM (ग्लैमर) को एक अनुक्रिया चर के लिए फिट करना जो एक अनुपात या अंश है
मैं उम्मीद कर रहा हूं कि कोई ऐसा व्यक्ति हो सकता है जो मुझे लगता है कि यह एक अपेक्षाकृत सरल प्रश्न है, और मुझे लगता है कि मुझे उत्तर पता है, लेकिन पुष्टि के बिना यह कुछ ऐसा हो गया है, जिसके बारे में मैं निश्चित नहीं हो सकता। …

1
ट्रेन / वैध / परीक्षण सेट पर घटाव के बारे में प्रश्न
मैं डेटा प्रीप्रोसेस कर रहा हूं और बाद में अपने डेटा पर एक कॉनवॉनेट बनाने जा रहा हूं। मेरा प्रश्न है: कहो कि मेरे पास 100 छवियों के साथ कुल डेटा सेट है, मैं प्रत्येक 100 छवियों में से प्रत्येक के लिए माध्य की गणना कर रहा था और फिर …

4
स्वतंत्र दो नमूना टी-टेस्ट की कल्पना कैसे करें?
एक स्वतंत्र दो नमूना टी-परीक्षण के परिणामों की कल्पना करने के सबसे स्वीकृत तरीके क्या हैं? क्या एक संख्यात्मक तालिका अधिक बार उपयोग की जाती है या किसी प्रकार की साजिश है? लक्ष्य एक आकस्मिक पर्यवेक्षक के लिए आकृति को देखने और तुरंत देखने के लिए है कि वे संभवतः …

2
एआर ( ) मॉडल के लिए निष्पक्ष अनुमानक
एआर ( ) मॉडल पर विचार करें (सादगी के लिए शून्य का मतलब मानते हुए):पीपीp एक्सटी=φ1एक्सटी - 1+ … +φपीएक्सटी - पी+εटीएक्सटी=φ1एक्सटी-1+...+φपीएक्सटी-पी+εटी x_t = \varphi_1 x_{t-1} + \dotsc + \varphi_p x_{t-p} + \varepsilon_t OLS आकलनकर्ता ( अधिकतम सशर्त संभावना के बराबर ) को पक्षपाती के रूप में जाना जाता है, …

1
द्विआधारी साधन और एक द्विआधारी अंतर्जात चर के साथ वाद्य चर प्रतिगमन में दूसरे चरण के गुणांक की व्याख्या कैसे करें?
(काफी लंबी पोस्ट, क्षमा करें। इसमें बहुत सारी पृष्ठभूमि जानकारी शामिल है, इसलिए नीचे दिए गए सवाल पर बेझिझक जाएं।) परिचय: मैं एक ऐसी परियोजना पर काम कर रहा हूँ जहाँ हम एक द्विआधारी अंतर्जात चर के प्रभाव की पहचान करने की कोशिश कर रहे हैं,x1x1x_1निरंतर परिणाम पर, yyy। हम …

4
एक संख्यात्मक अनुकूलन तकनीक के रूप में मोंटे कार्लो के ग्रेडिएंट वंश बनाम का उपयोग करने के लिए
जब समीकरणों का एक सेट विश्लेषणात्मक रूप से हल नहीं किया जा सकता है, तो हम एक ढाल डिसेंट एल्गोरिथ्म का उपयोग कर सकते हैं। लेकिन ऐसा लगता है कि मोंटे कार्लो सिमुलेशन की विधि भी है जिसका उपयोग उन समस्याओं को हल करने के लिए किया जा सकता है …

2
दो स्वतंत्र सामान्य यादृच्छिक चर के अधिकतम (न्यूनतम) के लिए वितरण क्या है?
विशेष रूप से, मान लें कि और सामान्य यादृच्छिक चर हैं (स्वतंत्र लेकिन जरूरी नहीं कि समान रूप से वितरित किए गए हों)। किसी विशेष ए को देखते हुए , क्या पी (\ मैक्स (एक्स, वाई) \ लीक एक्स) या इसी तरह की अवधारणाओं के लिए एक अच्छा सूत्र है …

2
बहुत तिरछी, डेटा की गणना: किसी भी सुझाव के बारे में जाने के लिए (परिवर्तन आदि)?
मूल समस्या यहाँ मेरी मूल समस्या है: मैं एक डेटासेट को क्लस्टर करने की कोशिश कर रहा हूं जिसमें कुछ बहुत ही तिरछे वेरिएबल हैं, जो मायने रखते हैं। चर में कई शून्य होते हैं और इसलिए मेरी क्लस्टरिंग प्रक्रिया के लिए बहुत जानकारीपूर्ण नहीं हैं - जो कि k- …

1
क्रॉस टेबल विश्लेषण के लिए कौन सा परीक्षण: बॉश्लू या बरनार्ड?
मैं 30 रोगियों के छोटे डेटासेट से 2x2 तालिका का विश्लेषण कर रहा हूं। हम पूर्वव्यापी रूप से कुछ चर खोजने की कोशिश कर रहे हैं जो संकेत देते हैं कि किस उपचार को चुनना है। चर (सामान्य / अजीब) और उपचार निर्णय (ए / बी) विशेष रुचि के हैं …

3
नकारात्मक द्विपद जीएलएम से "गैर-पूर्णांक" चेतावनी से कैसे निपटें?
मैं एक नकारात्मक द्विपद मॉडल का उपयोग करके आर में एक मेजबान को प्रभावित करने वाले परजीवियों की औसत तीव्रता को मॉडल करने की कोशिश कर रहा हूं। मैं कहता हूं कि मुझे 50 या अधिक चेतावनी मिलती रहे: In dpois(y, mu, log = TRUE) : non-integer x = 251.529000 …

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.