পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

1
দুটি পিয়ারসন পারস্পরিক সম্পর্কের শক্তি কীভাবে তুলনা করবেন?
আমাকে একজন সমালোচক জিজ্ঞাসা করেছেন যে কোনও টেবিলে উপস্থাপিত পিয়ারসন সম্পর্ক (আর-মানগুলি) একে অপরের সাথে তুলনা করা যায় যাতে কেউ দাবি করতে পারে যে একজন অন্যের চেয়ে "শক্তিশালী" (কেবলমাত্র আসল আর-মানগুলিকে চোখের সামনে রেখে) । আপনি কিভাবে এই সম্পর্কে যেতে হবে? আমি এই পদ্ধতিটি খুঁজে পেয়েছি http://vassarstats.net/rdiff.html তবে এটি প্রযোজ্য …

1
এলোমেলো ভেরিয়েবলের ফাংশনগুলির সম্ভাব্যতা বন্টন?
আমার একটি সন্দেহ আছে: সম্ভাব্যতার জায়গাতে সংজ্ঞায়িত সত্যিকারের মূল্যবান র্যান্ডম ভেরিয়েবলগুলি এবং উভয় বিবেচনা করুন ।XXXZZZ(Ω,F,P)(Ω,F,P)(\Omega, \mathcal{F},\mathbb{P}) যাক , যেখানে একটি আসল-মূল্যবান ফাংশন। যেহেতু র্যান্ডম ভেরিয়েবলের একটি ক্রিয়াকলাপ এটি এলোমেলো পরিবর্তনশীল।Y:=g(X,Z)Y:=g(X,Z)Y:= g(X,Z)g(⋅)g(⋅)g(\cdot)YYY যাক অর্থাৎ উপলব্ধি ।x:=X(ω)x:=X(ω)x:=X(\omega)XXX Is থেকে সমান ?P(Y|X=x)=P(g(X,Z)|X=x)P(Y|X=x)=P(g(X,Z)|X=x)\mathbb{P}(Y|X=x)=\mathbb{P}(g(X,Z)|X=x)P(g(x,Z))P(g(x,Z))\mathbb{P}(g(x,Z))

2
এক সেটের নমুনা ব্যবহার করে একাধিক সেটের ছেদ আকারের অনুমান করা
আমি একটি অ্যালগরিদম নিয়ে কাজ করছি যা কমপক্ষে 2 টি সেট ছেদ দ্বারা উত্পন্ন একটি সেট আকার গণনা করা প্রয়োজন। আরো নির্দিষ্টভাবে: z=|A0∩…∩An|z=|A0∩…∩An| z = \left |A_0 \cap \ldots \cap A_n \right | ছেদ করা সেটগুলি এসকিউএল কোয়েরি দ্বারা উত্পাদিত হয় এবং জিনিসগুলি দ্রুত রাখার প্রয়াসে আমি প্রতিটি প্রশ্নের আগে …
10 error  sample 

1
জিএএম পি-মানগুলি কীভাবে ব্যাখ্যা করবেন?
আমার নাম হিউ, এবং আমি পিএইচডি শিক্ষার্থী কিছু অনুসন্ধানী বিশ্লেষণ করতে সাধারণীকরণমূলক মডেলগুলি ব্যবহার করছি। আমি এমজিসিভি প্যাকেজ থেকে আগত পি-মানগুলি কীভাবে ব্যাখ্যা করব এবং আমার বোধগম্যতা পরীক্ষা করতে চেয়েছি (আমি সংস্করণটি 1.7-29 ব্যবহার করছি, এবং সাইমন উডের কয়েকটি ডকুমেন্টেশন নিয়ে পরামর্শ করেছি) I'm আমি প্রথমে অন্যান্য সিভি প্রশ্নগুলির সন্ধান …
10 p-value  mgcv 

2
নীতি পুনরাবৃত্তির অ্যালগরিদম কেন সর্বোত্তম নীতি এবং মান ফাংশনে রূপান্তর করে?
আমি পুনর্বহাল শেখার বিষয়ে অ্যান্ড্রু এনগের বক্তৃতা নোটগুলি পড়ছিলাম এবং আমি কেন নীতির পুনরাবৃত্তিকে সর্বোত্তম মান ফাংশনে রূপান্তরিত করে তা বোঝার চেষ্টা করছিলামভী*V∗V^* এবং সর্বোত্তম নীতি π*π∗\pi^*। পুনরুদ্ধার নীতি পুনরাবৃত্তি হ'ল: Initialize π randomlyRepeat{Let V:=Vπ \for the current policy, solve bellman's eqn's and set that to the current VLet π(s):=argmaxa∈A∑s′Psa(s′)V(s′)}Initialize …

2
মিশ্রিত প্রভাব মডেলগুলিতে lme4 ব্যবহার করে ইন্টারঅ্যাকশন শব্দটির জন্য পি মান
আমি ব্যবহার কিছু আচরণগত ডেটা বিশ্লেষণ করছি lme4মধ্যে Rবেশিরভাগই নিম্নলিখিত বোডো উইন্টার'স চমৎকার টিউটোরিয়াল , কিন্তু আমি বুঝতে পারছি না আমি যদি পারস্পরিক ক্রিয়ার হ্যান্ডলিং করছি সঠিকভাবে। সবচেয়ে খারাপ বিষয়, এই গবেষণার সাথে জড়িত অন্য কেউ মিশ্র মডেল ব্যবহার করেন না, তাই জিনিসগুলি সঠিক হওয়ার বিষয়টি নিশ্চিত হওয়ার সময় আমি …

3
ডেটা সম্ভাব্যতা বন্টন অনুমান করার জন্য বিভিন্ন নন-প্যারাম্যাট্রিক পদ্ধতি
আমার কিছু তথ্য আছে এবং এটিতে একটি মসৃণ বক্ররেখার ফিট করার চেষ্টা করছিলাম। যাইহোক, আমি এটির উপর পূর্ববর্তী অনেকগুলি বিশ্বাস বা খুব দৃ strong় প্রাক ধারণাগুলি (আমার বাকী বাকী দ্বারা আবদ্ধ হওয়া ব্যতীত) বা কোনও নির্দিষ্ট বিতরণ প্রয়োগ করতে চাই না। আমি কেবল এটি কিছু মসৃণ বক্ররেখার সাথে ফিট করতে …

1
অ-রৈখিক সমীকরণের জন্য 95% আত্মবিশ্বাসের ব্যবধান কীভাবে গণনা করবেন?
আমার বয়স থেকেই মানেটিজের ওজন সম্পর্কে, দিনগুলিতে (ডায়াস, পর্তুগিজ ভাষায়) পূর্বাভাস দেওয়ার সমীকরণ রয়েছে: R <- function(a, b, c, dias) c + a*(1 - exp(-b*dias)) আমি এনএসএল () ব্যবহার করে এটি আর-তে মডেল করেছি এবং এই গ্রাফিকটি পেয়েছি: এখন আমি 95% আত্মবিশ্বাসের ব্যবধান গণনা করতে এবং গ্রাফিকটিতে এটি প্লট করতে …

2
কোন প্রতিকূল অনুপাত এবং বিপদ অনুপাতের মধ্যে কোনও কার্যকরী পার্থক্য রয়েছে?
লজিস্টিক রিগ্রেশনে, 2 এর একটি বিভেদ অনুপাতের অর্থ হ'ল ভবিষ্যদ্বাণীকের এক-ইউনিট বৃদ্ধি পেয়ে ইভেন্টটি 2 বার বেশি সম্ভাব্য। কক্স রিগ্রেশনে, 2 এর একটি বিপদ অনুপাত মানে ভবিষ্যদ্বাণীকের এক-ইউনিট বৃদ্ধি পেয়ে ইভেন্টটি প্রতিটি সময়ে প্রায় দ্বিগুণ হয়ে থাকে। এগুলি কি বাস্তবে একই জিনিস নয়? তাহলে আমরা যদি লজিস্টিক রিগ্রেশন-এর প্রতিকূল অনুপাত …

1
সম্মতিযুক্ত র‌্যাঙ্কিংয়ের নির্ভরযোগ্যতা কীভাবে পরিমাপ করা যায় (কেমেনি-স্নেল বইয়ের সমস্যা)
ধরা যাক বিশেষজ্ঞদের প্রত্যেককে ক্রমানুসারে বা পছন্দ অনুসারে বস্তুর একটি সেটকে র‌্যাঙ্ক করতে বলা হয়েছে । র‌্যাঙ্কিংয়ে সম্পর্কের অনুমতি দিন।টটkএনএনn জন কেমেনি এবং লরি স্নেল তাদের 1962 বছরের বই "সামাজিক বিজ্ঞানে গণিতের মডেলগুলি" পরবর্তী সমস্যা সমাধানের প্রস্তাব দিয়েছেন: প্রকল্প । বিশেষজ্ঞদের দ্বারা ক্যমত্য র‌্যাঙ্কিংয়ের নির্ভরযোগ্যতার একটি পরিমাপ বিকাশ করুন । …

2
Lme4 এ এলোমেলো-প্রভাবের জন্য ভেরিয়েন্স-কোভারিয়েন্স কাঠামো
র্যান্ডম-প্রতিক্রিয়া জন্য ডিফল্ট ভ্যারিয়েন্স-সহভেদাংক গঠন কি glmerবা lmerমধ্যে lme4প্যাকেজ? কোডটিতে এলোমেলো-প্রভাবের জন্য কীভাবে কোনও অন্যান্য বৈকল্পিক-সমবায় কাঠামো নির্দিষ্ট করে? lme4ডকুমেন্টেশনে এ সম্পর্কিত কোনও তথ্য আমি খুঁজে পাইনি ।

3
কোনটি ভাল, স্টল বা পচা?
আমি আর ব্যবহার করে টাইম সিরিজ বিশ্লেষণ করছি I আমাকে আমার ডেটা ট্রেন্ড, মরসুমী এবং এলোমেলো উপাদানগুলিতে দ্রবীভূত করতে হবে। আমার কাছে 3 বছর সাপ্তাহিক ডেটা রয়েছে। আমি আর দুই ফাংশন পাওয়া যায় - stl()এবং decompose()। আমি পড়েছি এটি stl()গুণক পচন জন্য ভাল নয়। এই ফাংশনগুলি কোন দৃশ্যে ব্যবহার করা …
10 r  time-series 

3
"সত্যিকারের কভারেজ সম্ভাবনা" গণনা করা কি একটি "বিশ্বাসযোগ্য ব্যবধান" গণনা হিসাবে একই জিনিস?
আমি একটি এন্ট্রি স্তরের পরিসংখ্যান পাঠ্যপুস্তকটি পড়ছিলাম। দ্বিপদী বিতরণের সাথে ডেটাতে সাফল্যের অনুপাতের সর্বাধিক সম্ভাবনা অনুমানের অধ্যায়ে, এটি একটি আত্মবিশ্বাসের ব্যবধান গণনা করার জন্য একটি সূত্র দিয়েছে এবং তারপরে অচিরেই উল্লেখ করা হয়েছে এর প্রকৃত কভারেজ সম্ভাবনা বিবেচনা করুন, এটি হ'ল সম্ভাবনাটি যে পদ্ধতিটি একটি বিরতি তৈরি করে যা সত্য …

3
বুটস্ট্র্যাপ রিগ্রেশন থেকে সহগের পি-মানগুলি কীভাবে পাবেন?
রবার্ট কাবাাকফের কুইক-আর থেকে আমার কাছে এসেছে # Bootstrap 95% CI for regression coefficients library(boot) # function to obtain regression weights bs <- function(formula, data, indices) { d <- data[indices,] # allows boot to select sample fit <- lm(formula, data=d) return(coef(fit)) } # bootstrapping with 1000 replications results <- boot(data=mtcars, …

3
একই জনসংখ্যার একাধিক নমুনা থেকে ছেদ হওয়ার সম্ভাবনা
এখানে একটি উদাহরণ কেস: আমার 10,000 জন আইটেম রয়েছে। প্রতিটি আইটেম একটি অনন্য আইডি আছে। আমি এলোমেলোভাবে 100 টি আইটেম বাছাই করে আইডিগুলি রেকর্ড করি আমি 100 টি আইটেম আবার জনসংখ্যার মধ্যে রেখেছি আমি এলোমেলোভাবে আবার 100 আইটেম বাছাই করি, আইডিগুলি রেকর্ড করে প্রতিস্থাপন করব। মোট, আমি 5 বার এই …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.