পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

1
অনুপাতের দ্বি-নমুনা তুলনা, নমুনা আকারের অনুমান: আর বনাম স্টাতা
অনুপাতের দ্বি-নমুনা তুলনা, নমুনা আকারের অনুমান: আর বনাম স্টাতা আমি নমুনা আকারের জন্য বিভিন্ন ফলাফল পেয়েছি: ইন আর power.prop.test(p1 = 0.70, p2 = 0.85, power = 0.90, sig.level = 0.05) ফলাফল: প্রতিটি গ্রুপের জন্য (সুতরাং 161)।n = 160.7777এন=160.7777n = 160.7777 ইন Stata sampsi 0.70 0.85, power(0.90) alpha(0.05) ফলাফল: প্রতিটি গ্রুপের …

4
কেনএনএন "মডেল ভিত্তিক" নয়?
ইএসএল অধ্যায় ২.৪ লিনিয়ার রিগ্রেশনটিকে "মডেল ভিত্তিক" হিসাবে শ্রেণিবদ্ধ বলে মনে হচ্ছে, কারণ এটি , অন্যদিকে কে-নিকটবর্তী প্রতিবেশীদের জন্য অনুরূপ অনুরূপ বর্ণিত হয়নি। তবে উভয় পদ্ধতিই সম্পর্কে অনুমান করা যায় না ?চ( x ) ≈ x ⋅ βচ(এক্স)≈এক্স⋅βf(x) \approx x\cdot\betaচ( এক্স )চ(এক্স)f(x) পরে ২.৪-এ এটি আরও বলেছেন: সর্বনিম্ন স্কোয়ারগুলি ধরে …

1
এমএএনআইএসটিতে 2.8% পরীক্ষার ত্রুটির চেয়ে এলোমেলো বন কি আরও ভাল করতে পারে?
এমএনআইএসটি, সিআইএফএআর, এসটিএল -10 ইত্যাদিতে র্যান্ডম ফরেস্টের প্রয়োগের জন্য আমি কোনও সাহিত্যের সন্ধান পাইনি তাই আমি ভেবেছিলাম যে আমি নিজেই সেগুলি ক্রম- আক্রমণকারী এমএনআইএসটি দিয়ে চেষ্টা করব। ইন আর , আমি চেষ্টা: randomForest(train$x, factor(train$y), test$x, factor(test$y), ntree=500) এটি ২ ঘন্টা চালিয়েছে এবং ২.৮% পরীক্ষার ত্রুটি পেয়েছে। আমিও চেষ্টা scikit-শিখতে , …

1
একটি স্যাচুরেটেড মডেল কি একটি অতিমাত্রায়িত মডেলের একটি বিশেষ কেস?
আমি একটি স্যাচুরেটেড মডেল কী তা বোঝার চেষ্টা করছি। আপনার পর্যবেক্ষণের মতো অনেকগুলি বৈশিষ্ট্য উপস্থিত থাকলে এটি আফিক। আমরা কি বলতে পারি যে একটি স্যাচুরেটেড মডেল অত্যন্ত চূড়ান্ত মডেলের একটি বিশেষ-কেস?

2
কেবলমাত্র এক শ্রেণির জন্য শ্রেণিবদ্ধকারী
একটি সাধারণ শ্রেণিবিন্যাসে, আমাদের দুটি শ্রেণি রয়েছে: শ্রেণি -0 এবং শ্রেণী -1। কিছু ডেটাতে আমার কাছে কেবল ক্লাস -1 এর মান রয়েছে, সুতরাং ক্লাস -0 এর জন্য কোনওটিই নয়। এখন আমি ক্লাস -১ এর জন্য ডেটা মডেল করার জন্য একটি মডেল তৈরি করার কথা ভাবছি। সুতরাং, যখন নতুন ডেটা আসে, …

2
একাত্তরের বনাম স্বাধীনতার পরীক্ষা
আমি একটি মৌলিক পরিসংখ্যান কোর্স শিখিয়েছি এবং আজ আমি দুটি বিভাগের জন্য স্বাধীনতার চি-স্কোয়ার পরীক্ষা এবং এককতার জন্য পরীক্ষাটি কভার করব। এই দুটি দৃশ্য ধারণাগতভাবে পৃথক, তবে একই পরীক্ষার পরিসংখ্যান এবং বিতরণ ব্যবহার করতে পারে। সমজাতীয়তার পরীক্ষায়, বিভাগগুলির মধ্যে একটির জন্য প্রান্তিক মোটগুলি নিজেকে নকশারই অংশ বলে মনে করা হয় …

2
সর্বাধিক এবং বন্ধ ঘন ঘন - উত্তর অন্তর্ভুক্ত
My dataset:My dataset:My \ \ dataset: 1:A,B,C,E1:A,B,C,E1: A,B,C,E 2:A,C,D,E2:A,C,D,E2:A,C,D,E 3: B,C,E3: B,C,E3:\ \ \ \ \ B,C,E 4:A,C,D,E4:A,C,D,E4:A,C,D,E 5: C,D,E5: C,D,E5:\ \ \ \ C, D, E 6: A,D,E6: A,D,E6: \ \ \ \ A, D,E আমি সর্বাধিক ঘন ঘন আইটেম সেট এবং বন্ধ ঘন ঘন আইটেম সেটগুলি সন্ধান করতে …

3
সাধারণ রৈখিক মিশ্র মডেল: মডেল নির্বাচন
এই প্রশ্ন / বিষয়টি সহকর্মীর সাথে আলোচনায় উঠে এসেছিল এবং আমি এ সম্পর্কে কিছু মতামত খুঁজছিলাম: আমি একটি এলোমেলো প্রভাব লজিস্টিক রিগ্রেশন ব্যবহার করে কিছু ডেটা মডেলিং করছি, আরও স্পষ্টভাবে একটি এলোমেলো ইন্টারসেপ্ট লজিস্টিক রিগ্রেশন। স্থির প্রভাবগুলির জন্য আমার কাছে 9 টি ভেরিয়েবল রয়েছে যা আগ্রহী এবং বিবেচনায় আসবে। আমি …


1
কার্নেল পদ্ধতিগুলির সীমাবদ্ধতাগুলি কী এবং কখন কার্নেল পদ্ধতি ব্যবহার করা উচিত?
তত্ত্বাবধানের পদ্ধতিগুলি অনেক তত্ত্বাবধানে শ্রেণিবদ্ধকরণ কার্যগুলিতে খুব কার্যকর। সুতরাং কার্নেল পদ্ধতিগুলির সীমাবদ্ধতাগুলি কী এবং কখন কার্নেল পদ্ধতি ব্যবহার করা উচিত? বিশেষত বৃহত আকারের ডেটা যুগে কার্নেল পদ্ধতির অগ্রগতি কী? কার্নেল পদ্ধতি এবং একাধিক উদাহরণ শেখার মধ্যে পার্থক্য কী? যদি ডেটা হয় 500x10000, 500নমুনাগুলির গণনা 10000কি এবং প্রতিটি বৈশিষ্ট্যের মাত্রা হয়, …

1
জিন তালিকাগুলি সমৃদ্ধ করার জন্য কোন পরিসংখ্যানের পরীক্ষা ব্যবহার করতে হবে?
আমি নির্দিষ্ট ডিএনএ ক্ষতিগ্রস্থ এজেন্টের সেলুলার সংবেদনশীলতা পরীক্ষা করার জন্য একটি পরীক্ষা করেছি। আমরা 270 জিন খুঁজে পেয়েছি যেগুলি ড্রাগের প্রতি বিশেষ সংবেদনশীল ছিল এবং বিশ্লেষণ করা মোট জিনের সংখ্যা 3668 ছিল। 270 সংবেদনশীল জিনের মধ্যে 38 টি "ডিএনএ মেরামত জিন" হিসাবে শ্রেণিবদ্ধ করা হয়েছে। জিনোমে থাকা "ডিএনএ মেরামত জিন" …

1
সম্ভাবনা এবং অস্পষ্ট যুক্তি মধ্যে পার্থক্য কি?
আমি বছরের পর বছর ধরে অস্পষ্ট যুক্তি (এফএল) নিয়ে কাজ করে যাচ্ছি এবং আমি জানি যে এফএল অনিশ্চয়তার সাথে যেভাবে আচরণ করে বিশেষভাবে এফএল এবং সম্ভাবনার মধ্যে পার্থক্য রয়েছে। তবে, আমি জিজ্ঞাসা করতে চাই যে এফএল এবং সম্ভাবনার মধ্যে আরও কী পার্থক্য রয়েছে? অন্য কথায়, আমি যদি সম্ভাব্যতার সাথে ডিল …
10 bayes  fuzzy 

1
জিএলএমের জন্য সম্ভাবনা লগ করুন
নিম্নলিখিত কোডে আমি গ্ল্যাম ব্যবহার করে গ্রুপযুক্ত ডেটা এবং মাই 2 ব্যবহার করে "হাত দ্বারা" লজিস্টিক রিগ্রেশন করি। আর কেন লগলিক ফাংশন আমাকে লগের সম্ভাবনা লগ (ফিট.glm) = - ২.৩336 দেয় যা একটি লগলিক (ফিট.এমএল) = - 5.514 এর থেকে আলাদা? library(bbmle) #successes in first column, failures in second Y …

1
হোমেল হচবার্গ সংশোধনগুলি কী কী?
আমি সম্প্রতি হোমেল হচবার্গ সংশোধনের সাথে পরিচয় করিয়েছি। আমি আসলে এটি কী / কী তা সম্পর্কে একটি সহজ ব্যাখ্যা সন্ধান করার চেষ্টা করছি, তবে আমার ভাগ্য নেই। কেউ দয়া করে হোমেল হচবার্গ সংশোধন সম্পর্কে একটি সংক্ষিপ্ত এবং সাধারণ বর্ণনা দিতে পারেন?

3
অভিন্ন বিতরণের প্যারামিটার অনুমান করা: অনুপযুক্ত আগে?
আমরা এন নমুনা, have একটি অভিন্ন বিতরণ থেকে যেখানে হয় অজানা। আনুমানিক তথ্য থেকে।XiXiX_i[0,θ][0,θ][0,\theta]θθ\thetaθθ\theta সুতরাং, বয়েসের নিয়ম ... f(θ|Xi)=f(Xi|θ)f(θ)f(Xi)f(θ|Xi)=f(Xi|θ)f(θ)f(Xi)f(\theta | {X_i}) = \frac{f({X_i}|\theta)f(\theta)}{f({X_i})} এবং সম্ভাবনা হ'ল: f(Xi|θ)=∏Ni=11θf(Xi|θ)=∏i=1N1θf({X_i}|\theta) = \prod_{i=1}^N \frac{1}{\theta} (সম্পাদনা: যখন সবার জন্য , এবং 0 অন্যথায় - ধন্যবাদ whuber)0≤Xi≤θ0≤Xi≤θ0 \le X_i \le \thetaiii তবে অন্য কোনও তথ্য না …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.