পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
পরিমাপ সরঞ্জামের কারণে সিলিং এফেক্টের সাথে কীভাবে মোকাবিলা করবেন?
আমি বিষয়গুলির (দুটি গ্রুপ) কম্পন অনুধাবন করার ক্ষমতা পরিমাপ করে সাইকোফিজিওলজিক্যাল ডেটা সংগ্রহ করেছি। একটি কম্পনকারী তদন্ত ত্বকের বিরুদ্ধে আরও ছোট এবং ছোট স্থানচ্যুতিতে সরানো হয় এবং বিষয়টি যখন তারা কম্পন অনুভব করে তখন ইঙ্গিত দেয়। দুর্ভাগ্যক্রমে, উচ্চ ফ্রিকোয়েন্সিগুলিতে, তদন্তটি কেবল একটি অল্প দূরত্ব সরিয়ে নিতে পারে এবং কখনও কখনও …

2
কোনও ডেটা সেট প্রদত্ত সম্ভাব্যতা বিতরণ স্বয়ংক্রিয়ভাবে নির্ধারণ করুন
একটি ডেটাসেট দেওয়া: x <- c(4.9958942,5.9730174,9.8642732,11.5609671,10.1178216,6.6279774,9.2441754,9.9419299,13.4710469,6.0601435,8.2095239,7.9456672,12.7039825,7.4197810,9.5928275,8.2267352,2.8314614,11.5653497,6.0828073,11.3926117,10.5403929,14.9751607,11.7647580,8.2867261,10.0291522,7.7132033,6.3337642,14.6066222,11.3436587,11.2717791,10.8818323,8.0320657,6.7354041,9.1871676,13.4381778,7.4353197,8.9210043,10.2010750,11.9442048,11.0081195,4.3369520,13.2562675,15.9945674,8.7528248,14.4948086,14.3577443,6.7438382,9.1434984,15.4599419,13.1424011,7.0481925,7.4823108,10.5743730,6.4166006,11.8225244,8.9388744,10.3698150,10.3965596,13.5226492,16.0069239,6.1139247,11.0838351,9.1659242,7.9896031,10.7282936,14.2666492,13.6478802,10.6248561,15.3834373,11.5096033,14.5806570,10.7648690,5.3407430,7.7535042,7.1942866,9.8867927,12.7413156,10.8127809,8.1726772,8.3965665) .. আমি পরামিতিগুলির অনুমানের সাথে সর্বাধিক মানানসই সম্ভাব্যতা বিতরণ (গামা, বিটা, সাধারণ, সূচকীয়, পোইসন, চি-স্কোয়ার ইত্যাদি) নির্ধারণ করতে চাই। আমি নীচের লিঙ্কটিতে ইতিমধ্যে প্রশ্নটি সম্পর্কে অবগত রয়েছি, যেখানে আর ব্যবহার করে একটি সমাধান সরবরাহ করা হয়েছে: /programming/ অবিচ্ছিন্ন-অবিচ্ছিন্ন-বিতরণ-চ সেরা প্রস্তাবিত সমাধানটি হ'ল: > library(MASS) …

1
অভিজ্ঞতামূলক বেয়েস এবং এলোমেলো প্রভাবের মধ্যে কি কোনও সংযোগ রয়েছে?
আমি সম্প্রতি অভিজ্ঞতামূলক বয়েস (কেসেলা, 1985, অভিজ্ঞতা বায়স ডেটা বিশ্লেষণের পরিচিতি) সম্পর্কে পড়তে পেরেছি এবং এটি অনেকটা এলোমেলো প্রভাবের মডেলের মতো দেখেছিল; এতে উভয়ই বিশ্বব্যাপী অনুমানকে সঙ্কুচিত করে। তবে আমি এটি পুরোপুরি পড়িনি ... তাদের মধ্যে মিল এবং পার্থক্য সম্পর্কে কারও কি অন্তর্দৃষ্টি আছে?

3
ভারী লেজ বিতরণ প্রক্রিয়া উল্লেখযোগ্যভাবে উন্নত হয়েছে কিনা তা নির্ধারণ করুন
পরিবর্তনের মাধ্যমে প্রক্রিয়াটি উন্নত হয়েছে কিনা তা জানতে, আমি পরিবর্তনের আগে এবং পরে কোনও প্রক্রিয়াজাতকরণের সময় পর্যবেক্ষণ করি। প্রক্রিয়াটির সময়টি হ্রাস করা হলে প্রক্রিয়াটি উন্নত হয়েছে। প্রক্রিয়াজাতকরণের সময় বিতরণ চর্বিযুক্ত, তাই গড়ের ভিত্তিতে তুলনা করা বুদ্ধিমানের নয়। পরিবর্তে আমি জানতে চাই যে পরিবর্তনের পরে কম প্রক্রিয়াকরণের সময়টি পর্যবেক্ষণের সম্ভাবনা উল্লেখযোগ্যভাবে …

1
সাধারণ বিতরণ পচা
ইতিবাচক-কেবল বিতরণ কি এখানে রয়েছে যে এই বিতরণ থেকে দুটি স্বতন্ত্র নমুনার পার্থক্য সাধারণত বিতরণ করা হয়? যদি তাই হয় তবে এর কি সরল রূপ রয়েছে?

2
আপেক্ষিক ঝুঁকি এবং পরম ঝুঁকির মধ্যে পার্থক্যটি কীভাবে ব্যাখ্যা করবেন?
অন্য দিন আমি এপিডেমিওলজিস্টের সাথে পরামর্শ করেছি। তিনি এপিডেমিওলজিতে জনস্বাস্থ্যের ডিগ্রি সহ এমডি এবং এতে প্রচুর পরিসংখ্যানের জ্ঞান রয়েছে। তিনি তার গবেষণা অনুগামী এবং বাসিন্দাদের পরামর্শদাতা এবং পরিসংখ্যানগত সমস্যাগুলির সাথে তাদের সহায়তা করেন। তিনি হাইপোথিসিস পরীক্ষার বিষয়টি বেশ ভালভাবে বোঝেন। কনজেসটিভ হার্ট ফেইলিওর (সিএইচএফ) হওয়ার ঝুঁকির মধ্যে কোনও পার্থক্য রয়েছে …

1
আরআর-তে স্বাধীনতা ডিগ্রিআরসিআরসি মিশ্রিত এবং lme / lmer এর মধ্যে পার্থক্য
দ্রষ্টব্য: এই প্রশ্নটি পুনরায় পোস্ট করা হয়েছে, কারণ আমার আগের প্রশ্নটি আইনি কারণে মুছে ফেলা হয়েছিল। আর- lmeএর nlmeপ্যাকেজ থেকে ফাংশনটির সাথে এসএএস থেকে প্রসকে মিক্সেড তুলনা করার সময় , আমি কিছু বরং বিভ্রান্তিকর পার্থক্যের উপর হোঁচট খেয়েছি। আরও সুনির্দিষ্টভাবে বলা যায় যে বিভিন্ন পরীক্ষায় স্বাধীনতার ডিগ্রিগুলির মধ্যে পার্থক্য রয়েছে …
12 r  mixed-model  sas  degrees-of-freedom  pdf  unbiased-estimator  distance-functions  functional-data-analysis  hellinger  time-series  outliers  c++  relative-risk  absolute-risk  rare-events  regression  t-test  multiple-regression  survival  teaching  multiple-regression  regression  self-study  t-distribution  machine-learning  recommender-system  self-study  binomial  standard-deviation  data-visualization  r  predictive-models  pearson-r  spearman-rho  r  regression  modeling  r  categorical-data  data-visualization  ggplot2  many-categories  machine-learning  cross-validation  weka  microarray  variance  sampling  monte-carlo  regression  cross-validation  model-selection  feature-selection  elastic-net  distance-functions  information-theory  r  regression  mixed-model  random-effects-model  fixed-effects-model  dataset  data-mining 

5
3 প্রো বিতরণের জন্য জেনসন-শ্যানন ডাইভার্জেন্স গণনা: এটি কি ঠিক আছে?
আমি তার 3 টি বিতরণ অনুসরণ করার জন্য জেনসেন-শ্যানন ডাইভার্জেন্স গণনা করতে চাই। নীচের হিসাবটি কি সঠিক? (আমি উইকিপিডিয়া থেকে জেএসডি সূত্র অনুসরণ করেছি ): P1 a:1/2 b:1/2 c:0 P2 a:0 b:1/10 c:9/10 P3 a:1/3 b:1/3 c:1/3 All distributions have equal weights, ie 1/3. JSD(P1, P2, P3) = H[(1/6, 1/6, …

1
স্কোয়ারিং কেন ব্যাখ্যা দেয়?
এটি একটি বেসিক প্রশ্ন হতে পারে, তবে আমি ভাবছিলাম যে কেন কোনও রিগ্রেশন মডেলটিতে একটি মান ব্যাখ্যা করা বৈকল্পিকের চিত্র দেওয়ার জন্য কেবল বর্গ করা যায়?আরRR আমি বুঝতে পেরেছি যে সহগ একটি সম্পর্কের শক্তি দিতে পারে, তবে আমি বুঝতে পারি না যে এই মানটিকে স্কোয়ারিংয়ের দ্বারা ব্যাখ্যা করা বৈকল্পিকতার একটি …

1
অ-তথ্যবহুল প্রিয়ারদের কী বক্তব্য?
এমনকি অ-তথ্যমূলক প্রিয়াররাও কেন? তারা সম্পর্কে তথ্য সরবরাহ করে না । তাহলে কেন তাদের ব্যবহার করবেন? কেন কেবল তথ্যবহুল প্রিয়ার ব্যবহার করবেন না? উদাহরণ স্বরূপ, ধরুন । তারপর একটি অ-তথ্যপূর্ণ পূর্ববর্তী ?θ ∈ [ 0 , 1 ] θ ∼ ইউ ( 0 , 1 ) θθθ\thetaθ∈[0,1]θ∈[0,1] \theta \in [0,1]θ∼U(0,1)θ∼U(0,1)\theta …

1
আপনি কীভাবে কোনও রিগ্রেশন মডেলটিতে ভেরিয়েবল নির্বাচন করেন?
পরিবর্তনশীল নির্বাচনের traditionalতিহ্যগত পদ্ধতির মধ্যে এমন পরিবর্তনশীলগুলি সন্ধান করা যা একটি নতুন প্রতিক্রিয়া পূর্বাভাস দেওয়ার ক্ষেত্রে সর্বাধিক অবদান রাখে। সম্প্রতি আমি এর বিকল্পটি শিখেছি। মডেলিং ভেরিয়েবলগুলিতে যা কোনও চিকিত্সার প্রভাব নির্ধারণ করে - যেমন কোনও ফার্মাসিউটিক্যালের ক্লিনিকাল ট্রায়ালে - ভেরিয়েবলকে গুণগতভাবে ইন্টারঅ্যাক্ট করতে বলা হয়চিকিত্সা সহ যদি অন্যান্য জিনিস স্থির …

3
অতিরিক্ত সংখ্যক গণনা ডেটার জন্য পয়সন রিগ্রেশনের বিকল্প নির্বাচন করা
আমি বর্তমানে ধারাবাহিক আচরণগত পরীক্ষাগুলির থেকে ডেটা বিশ্লেষণ করছি যা সকলেই নিম্নলিখিত পরিমাপটি ব্যবহার করে। এই পরীক্ষায় অংশগ্রহণকারীদের ক্লুগুলি নির্বাচন করতে বলা হয় যা (কল্পনাপ্রসূত) অন্যান্য ব্যক্তি 10 টি অ্যানাগ্রামের সিরিজ সমাধানে সহায়তা করতে পারে। অংশগ্রহনকারীদের বিশ্বাস করা হয় যে এই অন্যান্য ব্যক্তিরা হয় এনাগ্রামগুলি সমাধানের ক্ষেত্রে তাদের পারফরম্যান্সের উপর …

3
অনিশ্চয়তার যোগাযোগ কীভাবে করা যায়?
পরিসংখ্যান গণনার ফলাফল গণমাধ্যম এবং জনসাধারণের কাছে জানাতে একটি বিশাল সমস্যা হ'ল আমরা কীভাবে অনিশ্চয়তার যোগাযোগ করি। অবশ্যই বেশিরভাগ গণমাধ্যমগুলি একটি শক্ত এবং দ্রুত সংখ্যা পছন্দ করেছে বলে মনে হয় যদিও তুলনামূলকভাবে খুব কম সংখ্যক ক্ষেত্রে বাদে সংখ্যায় সর্বদা কিছুটা অনিশ্চয়তা থাকে। সুতরাং, আমরা কীভাবে, পরিসংখ্যানবিদ (বা পরিসংখ্যান সংক্রান্ত কাজের …

2
ভলিউম টাইমসরিগুলি সংযুক্ত করে
নিম্নলিখিত গ্রাফটি বিবেচনা করুন: লাল রেখা (বাম অক্ষ) একটি নির্দিষ্ট স্টকের ব্যবসায়ের পরিমাণ বর্ণনা করে। নীল রেখা (ডান অক্ষ) স্টকটির জন্য টুইটার বার্তার ভলিউম বর্ণনা করে। উদাহরণস্বরূপ, 9 ই মে (05-09) প্রায় 1.100 মিলিয়ন ব্যবসা এবং 4.000 টুইট করা হয়েছিল। একই দিনে বা ল্যাগের সাথে টাইমসারিগুলির মধ্যে কোনও সম্পর্ক রয়েছে …

1
লজিস্টিক কোয়ান্টাইল রিগ্রেশন - ফলাফলগুলি কীভাবে সেরাভাবে জানাতে হয়
পূর্ববর্তী পোস্টে আমি ভেবে দেখেছি কীভাবে EQ-5D স্কোরগুলি মোকাবেলা করতে হয় । সম্প্রতি আমি বটতাই এবং ম্যাককাউন দ্বারা প্রস্তাবিত লজিস্টিক কোয়ান্টাইল রিগ্রেশনকে হোঁচট খেয়েছি যা সীমান্তের ফলাফলগুলি মোকাবেলার জন্য একটি দুর্দান্ত উপায় উপস্থাপন করে। সূত্রটি সহজ: l ও জিআমি টি ( y)) = l ও জি( y)- yমি i এনYআমি …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.