পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

3
একটি জনগোষ্ঠীর একটি এলোমেলো সদস্যের ভিন্ন জনগোষ্ঠীর এলোমেলো সদস্যের চেয়ে "ভাল" হওয়ার সম্ভাবনা আমি কীভাবে অনুমান করতে পারি?
ধরুন আমার দুটি স্বতন্ত্র জনসংখ্যার নমুনা রয়েছে। যদি আমি পরিমাপ করি যে কোনও সদস্যকে প্রতিটি সদস্যের কাজ করতে কতক্ষণ সময় লাগে তবে আমি প্রতিটি জনসংখ্যার গড় এবং তারতম্যটি সহজেই অনুমান করতে পারি। আমি যদি এখন প্রতিটি জনগোষ্ঠীর একজনের সাথে একটি এলোমেলো জোড় অনুমান করে, তবে আমি কি দ্বিতীয়টির চেয়ে প্রথমের …

4
কিভাবে এলোমেলো অটো সংযুক্ত বাইনারি সময় সিরিজের ডেটা জেনারেট করবেন?
আমি কীভাবে বাইনারি সময় সিরিজ তৈরি করতে পারি যে: 1 পর্যবেক্ষণের গড় সম্ভাব্যতা নির্দিষ্ট করা হয়েছে (5% বলুন); সময়ে 1 পালনের শর্তসাপেক্ষ সম্ভাব্যতা মান দেওয়া (বলুন 30% যদি মান ছিল 1)?tttt−1t−1t-1t−1t−1t-1

2
একটি 'বার্তা পাসিং পদ্ধতি' কী?
আমার কাছে একটি বার্তা পাস করার পদ্ধতিটি সম্পর্কে একটি অস্পষ্ট ধারণা আছে: একটি অ্যালগরিদম যা পুনরুত্পাদন করে অন্যান্য সমস্ত কারণগুলির সমস্ত অনুমানের উপর শর্তসাপেক্ষে বিতরণের প্রতিটি কারণগুলির আনুমানিকতা তৈরি করে একটি বিতরণের একটি সান্নিধ্য তৈরি করে। আমি বিশ্বাস করি যে উভয়ই ভেরিয়েশনাল মেসেজ পাসিং এবং প্রত্যাশার প্রচারের উদাহরণ । আরও …

1
কীভাবে আনোভা আর-এ গাড়ী প্যাকেজটির সাথে বিপরীতে সেটআপ এবং ব্যাখ্যা করবেন?
ধরা যাক আমার কাছে একটি সাধারণ 2x2 ঘটনামূলক পরীক্ষা রয়েছে যা আমি আনোভা করতে চাই। এটি পছন্দ করুন, উদাহরণস্বরূপ: d <- data.frame(a=factor(sample(c('a1','a2'), 100, rep=T)), b=factor(sample(c('b1','b2'), 100, rep=T))); d$y <- as.numeric(d$a)*rnorm(100, mean=.75, sd=1) + as.numeric(d$b)*rnorm(100, mean=1.2, sd=1) + as.numeric(d$a)*as.numeric(d$b)*rnorm(100, mean=.5, sd=1) + rnorm(100); উল্লেখযোগ্য মিথস্ক্রিয়া অনুপস্থিতি ডিফল্টরূপে (অর্থাত ইন contr.treatment) আউটপুট …
15 r  anova  contrasts 

2
আর-তে কার্নেল ঘনত্বের অনুমানের মধ্যে "পিডিএফ" এর অধীন অঞ্চল
আমি কার্নেলের ঘনত্বের অনুমান করতে আর-তে ' ঘনত্ব ' ফাংশনটি ব্যবহার করার চেষ্টা করছি । ফলাফলগুলি ব্যাখ্যা করতে এবং বিভিন্ন ডেটাসেটের তুলনা করতে আমার কিছুটা সমস্যা হচ্ছে কারণ মনে হয় বক্ররেখার অধীনে অঞ্চলটি অগত্যা 1 নয়। কোনও সম্ভাবনার ঘনত্ব ফাংশন (পিডিএফ) জন্য আমাদের অঞ্চলটি ∫ ∞ - ∞ ϕ ( …

4
ভোটদানের উপর খ্যাতির প্রভাব সম্পর্কে কীভাবে আমি আমার বিশ্লেষণ উন্নত করতে পারি?
সম্প্রতি আমি আপভোটগুলিতে সুনামের প্রভাবগুলির কিছু বিশ্লেষণ করেছি ( ব্লগ-পোস্ট দেখুন ) এবং পরবর্তীকালে আমার সম্ভবত আরও আলোকিতকরণ (বা আরও উপযুক্ত) বিশ্লেষণ এবং গ্রাফিক্স সম্পর্কে কয়েকটি প্রশ্ন ছিল। সুতরাং কয়েকটি প্রশ্ন (এবং বিশেষত কারও কাছে সাড়া দিতে নির্দ্বিধায় এবং অন্যকে উপেক্ষা করুন): অবতারের বর্তমানটিতে, আমি পোস্ট নম্বরটি কেন্দ্র করে বোঝাতে …

1
অ্যালগরিদমিকভাবে (সিমুলেশন) বনাম গাণিতিকভাবে কোনও বিতরণ সম্পর্কে শেখার পক্ষে কি মতামত রয়েছে?
গণিতের তুলনায় অ্যালগোরিদমিকভাবে (কম্পিউটার সিমুলেশনগুলির মাধ্যমে) ডিস্ট্রিবিউশনের বৈশিষ্ট্য সম্পর্কে শেখার কী কী উপকারিতা আছে? দেখে মনে হচ্ছে কম্পিউটার সিমুলেশনগুলি বিকল্প শিক্ষার পদ্ধতি হতে পারে, বিশেষত যারা নতুন শিক্ষার্থীরা ক্যালকুলাসে দৃ strong় বোধ করেন না তাদের পক্ষে। এছাড়াও মনে হয় কোডিং সিমুলেশনগুলি বিতরণের ধারণার একটি পূর্ববর্তী এবং আরও স্বজ্ঞাত উপলব্ধি দিতে …

1
কোয়ান্টাইল নরমালাইজেশন কীভাবে কাজ করে?
জিনের এক্সপ্রেশন অধ্যয়নগুলিতে মাইক্রোরেজে ব্যবহার করে, তীব্রতার ডেটাগুলিকে নরমাল করতে হয় যাতে তীব্রতার সাথে জিনের মধ্যে ব্যক্তিদের মধ্যে তুলনা করা যায়। ধারণাগতভাবে এবং অ্যালগোরিদমিকভাবে, "কোয়ান্টাইল নরমালাইজেশন" কীভাবে কাজ করে এবং আপনি কীভাবে এটি একটি অ-পরিসংখ্যানবিদকে ব্যাখ্যা করবেন?

5
ডেটাতে স্কোয়ার রুটের রূপান্তর ব্যবহারের কারণ কী হতে পারে?
বর্গমূল দিয়ে ডেটা রুপান্তরিত করার জন্য, আমি যা ভাবতে পারি তার কোনও কারণ আছে? আমি যা বোঝাতে চাইছি তা হ'ল আর। 2 বৃদ্ধি পায়। তবে এটি সম্ভবত কেবলমাত্র তথ্য কেন্দ্রিকতার কারণে! কোন চিন্তা প্রশংসা করা হয়!

2
কুলব্যাক two দুটি গামা বিতরণের মধ্যে লেবেলার বিচ্যুতি
পিডিএফ জি ( x ; বি , সি ) = 1 দ্বারা গামা বিতরণ প্যারামিটারাইজ করতে বেছে নেওয়া হচ্ছেΓ(b,c)Γ(b,c)\Gamma(b,c)g(x;b,c)=1Γ(c)xc−1bce−x/bg(x;b,c)=1Γ(c)xc−1bce−x/bg(x;b,c) = \frac{1}{\Gamma(c)}\frac{x^{c-1}}{b^c}e^{-x/b} মধ্যে Kullback-Leibler বিকিরণΓ(bq,cq)Γ(bq,cq)\Gamma(b_q,c_q)এবংΓ(bp,cp)Γ(bp,cp)\Gamma(b_p,c_p)দ্বারা [1] হিসাবে দেওয়া হয় KLGa(bq,cq;bp,cp)=(cq−1)Ψ(cq)−logbq−cq−logΓ(cq)+logΓ(cp)+cplogbp−(cp−1)(Ψ(cq)+logbq)+bqcqbpKLGa(bq,cq;bp,cp)=(cq−1)Ψ(cq)−log⁡bq−cq−log⁡Γ(cq)+log⁡Γ(cp)+cplog⁡bp−(cp−1)(Ψ(cq)+log⁡bq)+bqcqbp\begin{align} KL_{Ga}(b_q,c_q;b_p,c_p) &= (c_q-1)\Psi(c_q) - \log b_q - c_q - \log\Gamma(c_q) + \log\Gamma(c_p)\\ &\qquad+ c_p\log b_p - (c_p-1)(\Psi(c_q) + \log b_q) + …

2
"মিশ্র প্রভাবসমূহের মডেলিং" এবং "ল্যাটেন্ট গ্রোথ মডেলিং" এর মধ্যে পার্থক্য কী?
আমি মিশ্র প্রভাবগুলির মডেল (এমইএম) এর সাথে শালীনভাবে পরিচিত, তবে একজন সহকর্মী সম্প্রতি আমাকে জিজ্ঞাসা করেছেন এটি কীভাবে সুপ্ত বৃদ্ধির মডেলগুলির (এলজিএম) সাথে তুলনা করে LG আমি কিছুটা গুগল করেছিলাম, এবং দেখে মনে হয় যে এলজিএম স্ট্রাকচারাল সমীকরণ মডেলিংয়ের একটি বৈকল্পিক যা পরিস্থিতিগুলিতে প্রয়োগ হয় যেখানে কমপক্ষে একটি এলোমেলো প্রভাবের …

1
জিএসভিডি কি সমস্ত লিনিয়ার মাল্টিভারিয়েট কৌশল প্রয়োগ করে?
আমি জেনারেলাইজড এসভিডি সম্পর্কে হার্ভে আব্বির নিবন্ধটি জুড়ে এসেছি । লেখক উল্লেখ করেছেন: জেনারালাইজড এসভিডি (জিএসভিডি) একটি আয়তক্ষেত্রাকার ম্যাট্রিক্সকে পচে যায় এবং ম্যাট্রিক্সের সারি এবং কলামগুলিতে আরোপিত প্রতিবন্ধকতাগুলিকে বিবেচনা করে। জিএসভিডি নিম্ন স্তরের ম্যাট্রিক্সের দ্বারা প্রদত্ত ম্যাট্রিক্সের একটি ওজনযুক্ত সাধারণতম ন্যূনতম বর্গের প্রাক্কলন দেয় এবং অতএব, সীমাবদ্ধতার পর্যাপ্ত পছন্দ সহ, …

2
আর-তে ইগেনভ্যালু এবং ইগেনভেেক্টর থেকে উপবৃত্তের পরিকল্পনা কীভাবে করা যায়? [বন্ধ]
বন্ধ থাকে। এই প্রশ্নটি অফ-টপিক । এটি বর্তমানে উত্তর গ্রহণ করছে না। এই প্রশ্নটি উন্নত করতে চান? প্রশ্নটি আপডেট করুন যাতে এটি ক্রস ভ্যালিডেটের জন্য অন-বিষয় । 2 বছর আগে বন্ধ । নিম্নলিখিত ম্যাট্রিক্স এ = ( 2.2 0.4 0.4 2.8 ) এর ইগেনভ্যালুগুলি এবং ইগেনভেেক্টরগুলির কাছ থেকে একটি উপবৃত্তের …

8
কীভাবে পরিসংখ্যান ব্যবহার করবেন না
এটি একটি মুক্ত সমাপ্ত প্রশ্নের ধরণের তবে আমি পরিষ্কার হতে চাই। পর্যাপ্ত জনসংখ্যার দেওয়া আপনি হয়ত কিছু শিখতে সক্ষম হবেন (এটি উন্মুক্ত অংশ) তবে আপনি আপনার জনসংখ্যা সম্পর্কে যা কিছু শিখুন, এটি কখনই জনসংখ্যার সদস্যের জন্য প্রযোজ্য? পরিসংখ্যান সম্পর্কে যা আমি বুঝি তা থেকে এটি কখনই কোনও জনগোষ্ঠীর একক সদস্যের …

1
রাষ্ট্রের স্পেস টাইম সিরিজ বিশ্লেষণে কোন মডেলটি আরও ভাল তা কীভাবে পরীক্ষা করবেন?
আমি রাষ্ট্রের স্থান পদ্ধতি দ্বারা সময় সিরিজের ডেটা বিশ্লেষণ করছি। আমার ডেটা দিয়ে স্টোকাস্টিক স্থানীয় স্তরের মডেল নির্মূলটিকে পুরোপুরি ছাড়িয়েছে। তবে ডিটারমিনিস্টিক স্তর এবং opeালু মডেল স্টোকাস্টিক স্তর এবং স্টোকাস্টিক / ডিটারমিনিস্টিক opeালের চেয়ে ভাল ফলাফল দেয়। এটা কি কিছু স্বাভাবিক? আর-এর সমস্ত পদ্ধতির প্রাথমিক মানগুলির প্রয়োজন হয় এবং আমি …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.