পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
বুটস্ট্র্যাপ বনাম বায়সিয়ান কৌশল কখন ব্যবহার করবেন?
আমার নির্ভরযোগ্যতা পরীক্ষার সাথে যুক্ত একটি জটিল জটিল বিশ্লেষণ সমস্যা রয়েছে এবং বায়সীয় বিশ্লেষণ সমর্থন করার জন্য এমসিএমসি ব্যবহার করে জড়িত বলে মনে হয় (আমার কাছে)। তবে এটি পরামর্শ দেওয়া হয়েছে যে এটি একটি বুটস্ট্র্যাপিং পদ্ধতির ব্যবহার করা আরও উপযুক্ত। কেউ কি এমন কোনও রেফারেন্স (বা তিন) প্রস্তাব দিতে পারেন …

1
তথ্য থেকে বিতরণ অনুমান করা
আমার Rদ্বারা উত্পন্ন ডেটার একটি নমুনা রয়েছে rnorm(50,0,1), সুতরাং ডেটা স্পষ্টভাবে একটি সাধারণ বিতরণ গ্রহণ করে। যাইহোক, Rডেটা সম্পর্কে এই বিতরণযোগ্য তথ্য "জানেন না"। এর মধ্যে কী এমন কোনও পদ্ধতি Rঅনুমান করতে পারে যে আমার নমুনাটি কোন ধরণের বিতরণ থেকে আসে? যদি তা না হয় তবে আমি shapiro.testফাংশনটি ব্যবহার করব …
12 r  distributions 

2
উদ্দীপনা সম্পর্কিত প্রত্যাশিত মান
আমরা আঁকা নমুনা আকার প্রতিটি একটি সাধারন থেকে স্বাধীনভাবে বন্টন।এন ( μ , σ 2 )NNNnnn(μ,σ2)(μ,σ2)(\mu,\sigma^2) থেকে নমুনা আমরা কি তবে 2 নমুনা যা সর্বোচ্চ (পূর্ণ) পিয়ারসন একে অপরের সাথে পারস্পরিক সম্পর্ক আছে চয়ন।NNN এই পারস্পরিক সম্পর্কের প্রত্যাশিত মান কী? ধন্যবাদ [পিএস এটি হোমওয়ার্ক নয়]


3
প্যারামেট্রাইজেবল কোভারিয়েন্স ম্যাট্রিক্স সহ ধনাত্মক কে-মাত্রিক কোয়াড্রেন্টে বিতরণগুলি কী কী?
অনুসরণ করছেন zzk এর প্রশ্ন নেতিবাচক সিমিউলেশন সঙ্গে তার সমস্যা উপর, আমি অবাক হচ্ছি কি ইতিবাচক K-মাত্রিক পাদ, উপর ডিস্ট্রিবিউশন এর parametrized পরিবারগোষ্ঠীর অন্তর্ভুক্ত যার জন্য সহভেদাংক ম্যাট্রিক্স নির্ধারণ করা যাবে।Rk+R+k\mathbb{R}_+^kΣΣ\Sigma Zzk এর সাথে আলোচিত হিসাবে , বিতরণ থেকে শুরু করে এবং লিনিয়ার ট্রান্সফর্ম কাজ করে না।Rk+R+k\mathbb{R}_+^kX⟶Σ1/2(X−μ)+μX⟶Σ1/2(X−μ)+μX \longrightarrow\Sigma^{1/2} (X-\mu) + …

2
লজিস্টিক রিগ্রেশন সহগ বিশ্লেষণ
এখানে লজিস্টিক রিগ্রেশন সহগগুলির একটি তালিকা রয়েছে (প্রথমটি একটি ইন্টারসেপ্ট) -1059.61966694592 -1.23890500515482 -8.57185269220438 -7.50413155570413 0 1.03152408392552 1.19874787949191 -4.88083274930613 -5.77172565873336 -1.00610998453393 আমি এটিকে অদ্ভুত বলে মনে করি যে কীভাবে ইন্টারসেপটিটি এত কম এবং আমার একটি সহগ রয়েছে যা আসলে 0 এর সমান I আমি কীভাবে এটি ব্যাখ্যা করব তা সম্পর্কে আমি …

1
গাউসিয়ান মিশ্রণ মডেলগুলির সাথে কাজ করার জন্য পাইথন প্যাকেজগুলি (জিএমএম)
পাইথনে গাউসীয় মিশ্রণ মডেলস (জিএমএম) এর সাথে কাজ করার জন্য বেশ কয়েকটি বিকল্প উপলব্ধ রয়েছে বলে মনে হয়। প্রথম নজরে কমপক্ষে: পাইমিক্স - http://www.pymix.org/pymix/index.php মিশ্রণ মডেলিংয়ের সরঞ্জাম পাইম - http://www.ar.media.kyoto-u.ac.jp/ মেম্বারস / ডেভিড / softwares / em / যা স্কিপি টুলবক্সের অংশ এবং জিএমএম আপডেটে ফোকাস বলে মনে হচ্ছে আপডেট: …

2
জনসংখ্যার চেয়ে উল্লেখযোগ্যভাবে আরও বেশি হওয়ার মানের পরিসংখ্যানগত পরীক্ষাটির অর্থ: এটি কি জেড-পরীক্ষা বা টি-পরীক্ষা?
মানগুলির তালিকার তুলনায় একটি মান কতটা গুরুত্বপূর্ণ? বেশিরভাগ ক্ষেত্রে পরিসংখ্যানগত পরীক্ষার মধ্যে একটি জনসংখ্যার সাথে একটি নমুনা সেটকে তুলনা করা জড়িত। আমার ক্ষেত্রে নমুনাটি একটি মান দ্বারা তৈরি করা হয় এবং আমরা এটি জনসংখ্যার সাথে তুলনা করি। আমি সম্ভবত সবচেয়ে মৌলিক সমস্যার মুখোমুখি পরিসংখ্যান অনুমান পরীক্ষার একটি দ্বিধাদ্বন্ধী। এটি কেবল …

2
শ্রেণিবদ্ধ বায়েশিয়ান মডেল (?)
দয়া করে আমার পরিসংখ্যানীয় লিঙ্গো কসাইয়ের জন্য ক্ষমা প্রার্থনা করুন :) আমি এখানে বেশ কয়েকটি প্রশ্ন পেয়েছি যা বিজ্ঞাপন সম্পর্কিত এবং হারের মাধ্যমে ক্লিক করে। তবে তাদের মধ্যে কেউই আমার শ্রেণিবিন্যাসের পরিস্থিতি সম্পর্কে বুঝতে আমার খুব বেশি সহায়তা করেনি। একটি সম্পর্কিত প্রশ্ন আছে এই একই শ্রেণিবদ্ধ বায়েশিয়ান মডেল সমতুল্য উপস্থাপনা? …

2
ক্রস বৈধকরণ এবং সাধারণ লজিস্টিক রিগ্রেশন reg
আমি অর্ডিনাল লজিস্টিক রিগ্রেশনটির জন্য ক্রস-বৈধতা বোঝার চেষ্টা করছি। গেমটির লক্ষ্য হ'ল একটি বিশ্লেষণে ব্যবহৃত মডেলটিকে বৈধতা দেওয়া ... আমি প্রথমে খেলনা ডেটা সেট তৈরি করি: set.seed(1) N <- 10000 # predictors x1 <- runif(N) x2 <- runif(N) x3 <- runif(N) # coeffs in the model a <- c(-2,-1) x …

1
আর এর মধ্যে আংশিক সর্বনিম্ন স্কোয়ার রিগ্রেশন: মানকৃত ডেটাতে পিএলএস কেন সর্বোচ্চ সংযুক্তির সমান নয়?
আমি আংশিক লিস্ট স্কোয়ার (পিএলএস) খুব নতুন এবং আমি আর ফাংশনের আউটপুট বোঝার চেষ্টা plsr()মধ্যে plsপ্যাকেজ। আসুন আমরা ডেটা অনুকরণ করি এবং পিএলএস চালাব: library(pls) n <- 50 x1 <- rnorm(n); xx1 <- scale(x1) x2 <- rnorm(n); xx2 <- scale(x2) y <- x1 + x2 + rnorm(n,0,0.1); yy <- scale(y) …

1
কোনও বিশ্লেষণাত্মক ফর্ম রাখা যথেষ্ট সহজ হতে পারে যখন কোনও পোস্টারিওর ডিস্ট্রিবিউশন বের করার পদক্ষেপগুলি?
এটি কম্পিউটেশনাল সায়েন্সেও জিজ্ঞাসা করা হয়েছিল। আমি 11 টি নমুনা সহ একটি স্বাবলম্বীকরণের জন্য কিছু সহগের একটি বয়েসিয়ান অনুমান গণনা করার চেষ্টা করছি: যেখানে mean গড় 0 এবং বৈকল্পিক সহ গাউসিয়ান the ভেক্টরের উপর পূর্ব বিতরণ গড় সহ গাউসিয়ান এবং এর সাথে একটি তির্যক কোভারিয়েন্স ম্যাট্রিক্স তির্যক টি এন্ট্রির মধ্যে …

1
একটি বিরল প্রশিক্ষণ সেট কি কোনও এসভিএমকে বিরূপ প্রভাবিত করে?
আমি একটি এসভিএম ব্যবহার করে বার্তাগুলিকে বিভিন্ন বিভাগে শ্রেণিবদ্ধ করার চেষ্টা করছি। আমি প্রশিক্ষণের সেট থেকে পছন্দসই শব্দ / প্রতীকগুলির একটি তালিকা তৈরি করেছি। প্রতিটি ভেক্টরের জন্য, যা একটি বার্তা উপস্থাপন করে, আমি 1শব্দটি উপস্থিত থাকলে সংশ্লিষ্ট সারিটি সেট করে রেখেছি : "কর্পাস" হ'ল: [মেরি, ছোট, ভেড়া, তারকা, পলক] প্রথম …

1
দুদা এট আল-এর প্যাটার্ন শ্রেণিবিন্যাসে কোনও নিখরচায় মধ্যাহ্নভিত্তিক উপপাদ্য বোঝা যাচ্ছে না
ডুডা, হার্ট এবং স্টার্কের প্যাটার্ন শ্রেণিবিন্যাসের যে কোনও শ্রেণিবদ্ধের সহজাত উচ্চতরত্বের অধ্যায় 9.2 বিভাগে ব্যবহৃত স্বরলিপিগুলি সম্পর্কে আমার কিছু প্রশ্ন রয়েছে । প্রথমে বইটি থেকে কিছু প্রাসঙ্গিক পাঠ্য উদ্ধৃত করি: সরলতার জন্য দুই বিভাগ সমস্যা, যেখানে ট্রেনিং সেট বিবেচনা DDD নিদর্শন নিয়ে গঠিত xixix^i এবং সংশ্লিষ্ট বিভাগ লেবেল yi=±1yi=±1y_i = …

2
ডোমেন-অজোনস্টিক ফিচার ইঞ্জিনিয়ারিং যা অর্থগত অর্থ ধরে রাখে?
ফিচার ইঞ্জিনিয়ারিং প্রায়শই মেশিন লার্নিংয়ের একটি গুরুত্বপূর্ণ উপাদান (এটি ২০১০ সালের কেডিডি কাপ জয়ের জন্য বেশি ব্যবহৃত হয়েছিল )। তবে, আমি দেখতে পাই যে বেশিরভাগ বৈশিষ্ট্য ইঞ্জিনিয়ারিং কৌশলগুলি অন্তর্নিহিত বৈশিষ্ট্যগুলির কোনও স্বজ্ঞাত অর্থ বা ধ্বংস করুন একটি নির্দিষ্ট ডোমেন বা এমনকি বিশেষ ধরণের বৈশিষ্ট্যগুলির জন্য খুব নির্দিষ্ট। প্রাক্তনটির একটি সর্বোত্তম …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.