পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
একাধিক রিগ্রেশন বিশ্লেষণে রৈখিক ধারণা অনুমান করার জন্য আমি কীভাবে
নীচের গ্রাফগুলি একটি রিগ্রেশন টেস্টের অবশিষ্টাংশ ছত্রভঙ্গ প্লট যার জন্য "স্বাভাবিকতা", "সমকামিতা" এবং "স্বাধীনতা" অনুমানগুলি ইতিমধ্যে নিশ্চিত হয়ে গেছে! "লিনিয়ারিটি" অনুমানটি পরীক্ষার জন্য , যদিও গ্রাফগুলি দেখেই অনুমান করা যায় যে সম্পর্কটি বক্ররেখার, তবে প্রশ্নটি হল: "আর 2 লিনিয়ার" এর মান লিনিয়ারিটি অনুমানটি পরীক্ষা করার জন্য কীভাবে ব্যবহার করা যেতে …

6
জমায়েত পদ্ধতিগুলি কীভাবে প্রয়োগ করতে হয় তা শেখার সংস্থানসমূহ
তারা কীভাবে কাজ করবে তাত্ত্বিকভাবে (বাছাই করা) আমি বুঝতে পারি, তবে কীভাবে আসল পদ্ধতিতে (যেমন ভোটদান, ওজনযুক্ত মিশ্রণ ইত্যাদি) ব্যবহার করা যায় তা নিশ্চিত নই। জমায়েত পদ্ধতি প্রয়োগের জন্য ভাল সংস্থানগুলি কী কী? পাইথনে বাস্তবায়ন সম্পর্কিত কোনও বিশেষ সংস্থান আছে কি? সম্পাদনা করুন: মন্তব্যে আলোচনার উপর ভিত্তি করে কিছু সাফ …

4
ডিওই সম্পর্কে ফিশারের উক্তিটির একটি সত্য চিত্রণ সন্ধান করা
আমার দল এবং আমি পরীক্ষার নকশার উপযোগিতা সম্পর্কে সংস্থার অ-পরিসংখ্যানবিদদের কাছে একটি উপস্থাপনা দিতে চাই। এই অ-পরিসংখ্যানবিদরাও আমাদের ক্লায়েন্ট এবং তারা তাদের তথ্য সংগ্রহের আগে সাধারণত আমাদের সাথে পরামর্শ করে না। আপনি কি এমন কিছু বাস্তব উদাহরণ জানেন যা ফিশারের বিখ্যাত উক্তিটি ভালভাবে তুলে ধরেছিল "পরীক্ষা-নিরীক্ষার পরে পরিসংখ্যানবিদকে ফোন করা …

2
কেন বৃহত্তর নমুনা মাপের জন্য বিশৃঙ্খলা সমস্যা জটিল?
ধরুন আমরা পয়েন্ট সেট আছে । প্রতিটি বিন্দু বিতরণ ব্যবহার করে তৈরি করা হয় generated জন্য উত্তর পেতে আমরা প্রত্যাশার প্রচারের উপর মিনকার কাগজ অনুসারে পোস্টেরিয়র পেতে আমাদের গণনা প্রয়োজন এবং সুতরাং, বড় আকারের নমুনা জন্য জটিলতা হয়ে যায় । তবে, আমি বুঝতে পারি না কেন আমাদের এত পরিমাণ গণনার …

1
বায়সিয়ান গ্ল্যামের
আমি এখানে ডেটাতে একটি বয়েশিয়ান লগিট চালানোর চেষ্টা করছি । আমি ব্যবহার করছি bayesglm()এ armআর দ্য কোডিং প্যাকেজ সহজবোধ্য যথেষ্ট: df = read.csv("http://dl.dropbox.com/u/1791181/bayesglm.csv", header=T) library(arm) model = bayesglm(PASS ~ SEX + HIGH, family=binomial(link="logit"), data=df) summary(model) নিম্নলিখিত আউটপুট দেয়: Coefficients: Estimate Std. Error z value Pr(>|z|) (Intercept) 0.10381 0.10240 1.014 0.311 …
13 r  bayesian  p-value 

2
গোষ্ঠীযুক্ত জোড় দেখানো টেবিলের টুকি এইচএসডি পোস্ট-হক পরীক্ষার ফলাফল কীভাবে পাবেন?
আমি আমার দ্বিমুখী আনোয়ার পরে আর-এর সাথে টুকিএইচএসডি পোস্ট-হক পরীক্ষা করতে পছন্দ করব, তাৎপর্যপূর্ণ পার্থক্যের ভিত্তিতে দলবদ্ধভাবে সাজানো জোড়যুক্ত একটি টেবিল পেয়েছি। (শব্দটি সম্পর্কে দুঃখিত, আমি এখনও পরিসংখ্যান সহ নতুন।) আমি এই জাতীয় কিছু পেতে চাই: সুতরাং, তারা বা অক্ষর সহ গ্রুপবদ্ধ। কোন ধারণা? আমি প্যাকেজ HSD.test()থেকে ফাংশনটি পরীক্ষা করেছি …

1
আর এ গ্ল্যামনেট ব্যবহারের পূর্বাভাস
আমি glmnetআর এর মধ্যে প্যাকেজটি ব্যবহার করে কিছু ডেটা মডেল করার চেষ্টা করছি Let's আসুন বলি আমার কাছে নিম্নলিখিত ডেটা রয়েছে training_x <- data.frame(variable1 = c(1, 2, 3, 2, 3), variable2 = c(1, 2, 3, 4, 5)) y <- c(1, 2, 3, 4, 5) (এটি একটি সরলীকরণ; আমার ডেটা আরও …
13 r  glmnet 

1
মজার পরিসংখ্যান পরীক্ষার উত্তর [বন্ধ]
বন্ধ থাকে। এই প্রশ্নটি অফ-টপিক । এটি বর্তমানে উত্তর গ্রহণ করছে না। এই প্রশ্নটি উন্নত করতে চান? প্রশ্নটি আপডেট করুন যাতে এটি ক্রস ভ্যালিডেটের জন্য অন-বিষয় । 7 বছর আগে বন্ধ ছিল । পরীক্ষা সংশোধন করা সম্ভবত কোনও শিক্ষকের সবচেয়ে বিরক্তিকর কাজ। তবে মজাদার পরিসংখ্যান পরীক্ষার উত্তরগুলি সংগ্রহ করা আমাদের …
13 teaching  humor 

3
একাধিক মাত্রায় অভিন্নতা কীভাবে পরীক্ষা করবেন?
অভিন্নতার জন্য পরীক্ষা করা কিছু সাধারণ বিষয়, তবে আমি বিস্মিত হই যে পয়েন্টগুলির বহুমাত্রিক মেঘের জন্য এটি করার পদ্ধতিগুলি কী।

4
ডেটাসেটের এলোমেলো সাবমেলগুলির মাধ্যমে কে-কেন্দ্র কেন্দ্রগুলি শুরু করছেন?
আমার যদি একটি নির্দিষ্ট ডেটাসেট থাকে তবে dat ডেটাসেটের এলোমেলো নমুনার মাধ্যম ব্যবহার করে গুচ্ছ কেন্দ্রগুলি শুরু করা কতটা স্মার্ট হবে? উদাহরণস্বরূপ, ধরুন আমি চাই 5 clusters। আমি মূল ডেটাসেটের 5 random samplesবলি size=20%। তাহলে আমি কি এই 5 টি এলোমেলো নমুনার প্রত্যেকটির গড় গ্রহণ করতে পারি এবং সেগুলি আমার …

1
লজিস্টিক রিগ্রেশন প্যারামিটার গণনা করার জন্য মুহুর্তগুলির সাধারণীকরণ পদ্ধতি (GMM) ব্যবহার করে
লজিস্টিক রিগ্রেশন-এর মতো অনুরূপ একটি রিগ্রেশনের সহগের গুণাগুলি গণনা করতে চাই (অন্য সহগের সাথে আসলে লজিস্টিক রিগ্রেশন: যখন দেওয়া যেতে পারে)। সহগের হিসাব করার জন্য আমি জিএমএম ব্যবহার করার কথা ভেবেছিলাম, তবে আমার যে মুহুর্তের পরিস্থিতি ব্যবহার করা উচিত তা আমি নিশ্চিত নই।এএকজন1 + ই- ( খ)0+ খ1এক্স1+ খ2এক্স2+ …

1
বিপুল সংখ্যক আইন কখন ব্যর্থ হয়?
প্রশ্নটি কেবল শিরোনামে যা বলা হয়েছে: বড় সংখ্যার আইন কখন ব্যর্থ হয়? আমার অর্থ হ'ল, কোন ক্ষেত্রে কোন ঘটনার ফ্রিকোয়েন্সি তাত্ত্বিক সম্ভাবনার দিকে ঝুঁকবে না?

3
মেশিন লার্নিংয়ের সর্বশেষ বিকাশগুলির উপর নজর রাখার জন্য ভাল, অবাধে উপলভ্য জার্নালগুলি কী কী?
জ্ঞানের অন্য কোনও দরকারী পোর্টালের জন্য 'জার্নালগুলি' নির্বিশেষে বোধ করবেন। ব্যবহারিক প্রয়োগসমূহের দৃষ্টিভঙ্গি নিয়ে আমি মেশিন লার্নিংয়ের নতুন উন্নয়নগুলিতে নজর রাখতে আগ্রহী। আমি আমার নিজের প্রকাশনা প্রকাশের জন্য একাডেমিক নই (অন্তত এই ক্ষেত্রে নয়) তবে আমি সম্ভাব্য নতুন অ্যালগরিদম বা কৌশলগুলি সম্পর্কে ব্যবহার করতে চাই যা ব্যবহারিক স্তরে কার্যকর। একমাত্র …

2
লিনিয়ার রিগ্রেশন যখন আপনি কেবল
ধরুন Xβ=YXβ=YX\beta =Y । আমরা জানি না YYY ঠিক, প্রতিটি predictor সঙ্গে শুধুমাত্র তার পারস্পরিক সম্পর্ক XtYXtYX^\mathrm{t}Y । সাধারণ লিস্ট স্কোয়ারগুলির (OLS ঔজ্জ্বল্যের প্রেক্ষাপটে) সমাধান β=(XtX)−1XtYβ=(XtX)−1XtY\beta=(X^\mathrm{t} X)^{-1} X^\mathrm{t}Y এবং একটি সমস্যা নয়। তবে ধরুন XtXXtXX^\mathrm{t}X একবাক্য (মাল্টিকোলাইনারিটি) এর নিকটবর্তী এবং আপনার সর্বোত্তম রিজ প্যারামিটারটি অনুমান করতে হবে। সমস্ত পদ্ধতিতে সঠিক …

6
এলোমেলো বন: পরীক্ষা সেটে নতুন ফ্যাক্টর মাত্রা কীভাবে পরিচালনা করতে হয়?
আমি আর এলোমেলো বন মডেল ব্যবহার করে পূর্বাভাস দেওয়ার চেষ্টা করছি am তবে আমি ত্রুটিগুলি পেয়েছি যেহেতু কিছু উপাদানগুলির প্রশিক্ষণ সংস্থার চেয়ে পরীক্ষার সেটে বিভিন্ন মান রয়েছে। উদাহরণস্বরূপ, পরীক্ষার সেটে কোনও ফ্যাক্টরের Cat_2মান 34, 68, 76ইত্যাদি থাকে যা প্রশিক্ষণ সেটে উপস্থিত হয় না। দুর্ভাগ্যক্রমে, টেস্ট সেটে আমার নিয়ন্ত্রণ নেই ... …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.