পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

3
দ্বিপদী প্রভাব প্রভাব প্রদর্শন (BESD) প্রভাব আকারের একটি বিভ্রান্তিকর উপস্থাপনা?
আমার পক্ষে এটা মেনে নেওয়া শক্ত যে ডোনাল্ড রুবিন কখনই কোনও কৌশলটির সত্যিকারের লেবু নিয়ে আসবেন। তবুও, এটি বিএসডি সম্পর্কে আমার ধারণা [ 1 , 2 , 3 ]। রোজেন্থাল এবং রুবিনের (১৯৮২) মূল কাগজ দাবি করেছিল যে "মূল ডেটা ধারাবাহিক বা শ্রেণিবদ্ধ কিনা তা" এই জাতীয় [২x2] ডিসপ্লেতে কোনও …

2
সময়ের সাথে সাথে ফাংশনটির আনুমানিক পরিবর্তন হওয়ার সাথে সাথে গাউসিয়ান প্রক্রিয়া রিগ্রেশন কীভাবে সম্পাদন করবেন?
সময়ের সাথে সাথে আনুমানিক পরিবর্তনের জন্য যখন ফাংশনটি চেষ্টা করছি তখন গাউসিয়ান প্রক্রিয়া রিগ্রেশন করার জন্য ভাল কৌশলগুলি কী কী? আমার মনের দিকে ছড়িয়ে পড়ার মতো নিষ্পাপ দৃষ্টিভঙ্গি হ'ল রিগ্রেশন সঞ্চালনের জন্য কেবলমাত্র এন এর সাম্প্রতিক ডেটা পয়েন্টগুলি ব্যবহার করা। আরও ভাল কৌশল কি?

1
এসইএম মডেলিংয়ে সহায়তা (ওপেনএমএক্স, পলিকর)
আমি ডেটা সেট করে যা SEM প্রয়োগ করার চেষ্টা করছি তাতে আমার প্রচুর সমস্যা আছে। আমরা ধরে নিই যে সূচকগুলি সহ 5 টি সুপ্ত কারণের A, B, C, D, E এর অস্তিত্ব রয়েছে। এ 1 থেকে এ 5 (অর্ডারযুক্ত ফ্যাক্টর), বি 1 থেকে বি 3 (পরিমাণগত), সি 1, ডি 1, …

3
অনিয়মিত বিরতিতে কীভাবে একীভূত তথ্যের ভিত্তিতে পূর্বাভাস দেওয়া যায়?
আমি ভেন্ডিং মেশিনে পণ্য বিক্রির পূর্বাভাস দেওয়ার চেষ্টা করছি। সমস্যাটি হ'ল মেশিনটি অনিয়মিত বিরতিতে ভরাট হয় এবং প্রতিটি ভরাতে আমরা কেবলমাত্র মেশিনের শেষ ভরাট (অর্থাত্ আমাদের প্রতিদিনের বিক্রয় ডেটা নেই) থেকে সমষ্টিগত বিক্রয় রেকর্ড করতে পারি। সুতরাং মূলত আমাদের কাছে অনিয়মিত বিরতিতে একীভূত বিক্রয়ের জন্য ডেটা রয়েছে। ব্যবধানগুলি সাধারণত 2 …

1
ফিশার কার্নেলগুলি ছাড়িয়ে
কিছুক্ষণের জন্য, মনে হয়েছিল যে ফিশার কার্নেলগুলি সম্ভবত জনপ্রিয় হতে পারে, কারণ তারা সম্ভবত সম্ভাব্য মডেলগুলি থেকে কার্নেলগুলি নির্মাণ করার একটি উপায় বলে মনে হয়েছিল। যাইহোক, আমি এগুলিকে ব্যবহারের ক্ষেত্রে খুব কমই দেখেছি, এবং আমার এটি ভাল কর্তৃত্বের উপর রয়েছে যে তারা খুব ভালভাবে কাজ করতে চান না। তারা ফিশার …

1
খুব বড় সময়-সিরিজের ডেটাসেটগুলির সাথে ডিল করা
আমার একটি খুব বড় ডেটাসেট অ্যাক্সেস রয়েছে। চারটি জেনারগুলির মধ্যে একটির থেকে সংগীত অংশগুলি শোনার লোকদের এমইজি রেকর্ডিং থেকে ডেটা । তথ্য নিম্নরূপ: 6 বিষয় 3 পরীক্ষামূলক পুনরাবৃত্তি (যুগ) যুগে যুগে 120 ট্রায়াল 275 মেগা চ্যানেল থেকে 500Hz (= 4000 নমুনা) এ পরীক্ষার জন্য 8 সেকেন্ডের ডেটা সুতরাং এখানে প্রতিটি …

3
বিশাল ডেটাসেট থেকে শিখতে পারা যায়?
মূলত, বিশাল ডেটাসেটের বিরুদ্ধে শেখার দুটি সাধারণ উপায় রয়েছে (যখন আপনি সময় / স্থানের বিধিনিষেধের মুখোমুখি হন): প্রতারণা :) - প্রশিক্ষণের জন্য কেবলমাত্র "পরিচালনযোগ্য" সাবসেট ব্যবহার করুন। হ্রাসকারী রিটার্নের আইনের কারণে নির্ভুলতার ক্ষতি নগণ্য হতে পারে - সমস্ত প্রশিক্ষণের ডেটা এতে অন্তর্ভুক্ত করার আগে মডেলের ভবিষ্যদ্বাণীপূর্ণ অভিনয় প্রায়শই দীর্ঘ হয়ে …

3
স্বয়ংক্রিয় ডেটা সাফ করা
একটি সাধারণ সমস্যা হ'ল এমএল হ'ল ডেটাগুলির নিম্নমান: বৈশিষ্ট্যর মানগুলিতে ত্রুটি, ভুল শৃঙ্খলাবদ্ধকরণ ইত্যাদি etc. এই সমস্যার সমাধানের একটি উপায় হ'ল ম্যানুয়ালি ডেটা দিয়ে গিয়ে পরীক্ষা করে দেখা, তবে কি অন্য কৌশল আছে? (আমি বাজি রেখেছি!) কোনটি ভাল এবং কেন?

1
এমএফসিসি কি পুনরুদ্ধার সিস্টেমে সংগীত উপস্থাপনের সর্বোত্তম পদ্ধতি?
একটি সিগন্যাল প্রক্রিয়াজাতকরণ কৌশল, মেল ফ্রিকোয়েন্সি সিপস্ট্রাম প্রায়শই একটি যন্ত্র শেখার কাজে ব্যবহারের জন্য একটি বাদ্যযন্ত্রের টুকরোগুলি থেকে তথ্য আহরণের জন্য ব্যবহৃত হয়। এই পদ্ধতিটি একটি স্বল্প-মেয়াদী পাওয়ার বর্ণালী দেয় এবং সহগগুলি ইনপুট হিসাবে ব্যবহৃত হয়। সংগীত পুনরুদ্ধার সিস্টেমগুলি ডিজাইনের ক্ষেত্রে, এই জাতীয় সহগগুলি একটি অংশের বৈশিষ্ট্য হিসাবে বিবেচিত হয় …

2
চি-স্কোয়ারের জন্য আত্মবিশ্বাসের ব্যবধান
আমি দুটি "ধার্মিকতার সাথে ফিট চি-স্কোয়ার" পরীক্ষার তুলনা করার জন্য একটি সমাধান খুঁজতে চাইছি। আরও স্পষ্টভাবে, আমি দুটি স্বতন্ত্র পরীক্ষার ফলাফলের সাথে তুলনা করতে চাই। এই পরীক্ষাগুলিতে লেখকরা পর্যবেক্ষণের ফ্রিকোয়েন্সিগুলির সাথে এলোমেলো অনুমানের (প্রত্যাশিত ফ্রিকোয়েন্সি) তুলনা করার জন্য উপযুক্ততা-চিত্ততা-চি-স্কয়ার ব্যবহার করেছেন। দুটি পরীক্ষা একই সংখ্যক অংশগ্রহণকারীকে পেয়েছে এবং পরীক্ষামূলক পদ্ধতিগুলি …

3
স্ট্রাকচারাল সমীকরণ মডেলিংয়ের পুনরাবৃত্তি করে
আমার ক্লিনিকাল রিহ্যাবিলিটেশন ডেটার একটি ডেটাসেট বিশ্লেষণ করা দরকার। আমি পরিমাণযুক্ত "ইনপুট" (থেরাপির পরিমাণ) এবং স্বাস্থ্যের অবস্থার পরিবর্তনের মধ্যে অনুমান-চালিত সম্পর্কের বিষয়ে আগ্রহী। যদিও ডেটাসেট তুলনামূলকভাবে ছোট (এন ~ 70) আমাদের উভয়ের মধ্যে সাময়িক পরিবর্তনগুলি প্রতিবিম্বিত ডেটা পুনরাবৃত্তি করেছে। আমি আর-তে নন-লিনিয়ার মিশ্র প্রভাবগুলির মডেলিংয়ের সাথে পরিচিত তবে এখানে ইনপুট …

3
যখন এলএমের পূর্বাভাসকৃত মানটির কোনও তাত্পর্য না থাকে তখন কেন একটি আর ^ 2 মান হয় (এবং এটি কী নির্ধারণ করছে)?
নিম্নলিখিত আর কোড বিবেচনা করুন: example <- function(n) { X <- 1:n Y <- rep(1,n) return(lm(Y~X)) } #(2.13.0, i386-pc-mingw32) summary(example(7)) #R^2 = .1963 summary(example(62)) #R^2 = .4529 summary(example(4540)) #R^2 = .7832 summary(example(104))) #R^2 = 0 #I did a search for n 6:10000, the result for R^2 is NaN for #n …
10 r  regression 

3
ধারাবাহিকভাবে এম দেওয়া, টানা এন পাওয়ার জন্য প্রত্যাশিত কয়েনের সংখ্যা
সাক্ষাত্কারের জানুয়ারিতে তাদের দ্বিতীয় কোডসপ্রিন্ট ছিল যা নীচের প্রশ্নটি অন্তর্ভুক্ত করেছিল। প্রোগ্রাম্যাটিক উত্তর পোস্ট করা হয় তবে একটি পরিসংখ্যানগত ব্যাখ্যা অন্তর্ভুক্ত করা হয় না। (আপনি মূল সমস্যাটি দেখতে পাচ্ছেন এবং গুগল শংসাপত্রের সাথে ইন্টারভিউস্ট্রেট ওয়েবসাইটে সাইন ইন করে এবং তারপরে এই পৃষ্ঠা থেকে কয়েন টোসেস সমস্যায় গিয়ে সমাধানটি পোস্ট করতে …

4
আর-তে ভেরিয়েবল / বৈশিষ্ট্য নির্বাচন করতে ক্রস বৈধতা ব্যবহার করার কোনও উপায় আছে কি?
আমার প্রায় 70 টি ভেরিয়েবলের সাথে একটি ডেটা সেট রয়েছে যা আমি কাটাতে চাই। আমি যা দেখতে চাইছি তা হল নিম্নলিখিত ফ্যাশনে সবচেয়ে দরকারী ভেরিয়েবলগুলি খুঁজে পেতে সিভি ব্যবহার করা। 1) এলোমেলোভাবে 20 ভেরিয়েবল নির্বাচন করুন। 2) সবচেয়ে গুরুত্বপূর্ণ ভেরিয়েবল চয়ন করতে stepwise/ LASSO/ lars/ ইত্যাদি ব্যবহার করুন । 3) …

4
পরিসংখ্যানমূলক সিমুলেশন ব্যাখ্যা
আমি কোনও পরিসংখ্যানবিদ নই। সুতরাং, দয়া করে আমার কোনও ভুল থাকলে তা সহ্য করুন। সিমুলেশন কীভাবে হয় তা আপনি একটি সহজ পদ্ধতিতে ব্যাখ্যা করতে পারেন? আমি জানি যে এটি একটি সাধারণ বিতরণ থেকে কিছু এলোমেলো নমুনা বেছে নেয় এবং অনুকরণের জন্য ব্যবহার করে। তবে, পরিষ্কার বুঝতে পারছি না।
10 simulation 

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.