পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

3
গত মাসের রেকর্ডের ভিত্তিতে বিক্রয় পূর্বাভাস দেওয়ার জন্য একটি উপযুক্ত সময় সিরিজের মডেল বিকাশ করা হচ্ছে
আমি এখন একটানা দু'বছর ধরে একটি অনলাইন ব্যবসায় পরিচালনা করছি, তাই আমার প্রায় দুই বছর ধরে আমার মাসিক বিক্রয় ডেটা রয়েছে। প্রতিমাসের জন্য আমার ব্যবসা অবশ্যই মৌসুমী দোল (ক্রিসমাসে আরও ভাল পারফর্মেন্স ইত্যাদি) দ্বারা প্রভাবিত হয় এবং সম্ভবত এমন কিছু অন্যান্য কারণও যা আমি অবগত নই। ভবিষ্যতে বিক্রয় আরও ভালভাবে …

2
প্রধান উপাদানগুলির সংখ্যা নির্ধারণের জন্য পিসিএর জন্য ক্রস-বৈধতা কীভাবে সম্পাদন করবেন?
প্রধান উপাদান উপাদান বিশ্লেষণের জন্য আমি নিজের ফাংশনটি লেখার চেষ্টা করছি, পিসিএ (অবশ্যই ইতিমধ্যে অনেক কিছু লেখা আছে তবে আমি কেবল নিজের দ্বারা স্টাফ বাস্তবায়নে আগ্রহী)। আমি যে প্রধান সমস্যার মুখোমুখি হয়েছি তা হ'ল ক্রস-বৈধকরণ পদক্ষেপ এবং বর্গাকার পূর্বাভাসের সমষ্টি গণনা (প্রেস)। আমি কোন ক্রস-বৈধতা ব্যবহার করি তা বিবেচ্য নয়, …

1
স্বাভাবিকতার জন্য বড় ডেটাসেট পরীক্ষা করা - এটি কীভাবে এবং নির্ভরযোগ্য?
আমি আমার ডেটাসেটের একটি অংশ যাচাই করছি যা 46840 দ্বিগুণ রয়েছে যা 1 থেকে 1690 এর মধ্যে দুটি গ্রুপে গ্রুপযুক্ত। এই গোষ্ঠীর মধ্যে পার্থক্য বিশ্লেষণ করার জন্য আমি সঠিক পরীক্ষা বাছাইয়ের জন্য মানগুলির বন্টন পরীক্ষা করে শুরু করেছি। স্বাভাবিকতার জন্য পরীক্ষার বিষয়ে গাইড অনুসরণ করে আমি একটি কিউকিপ্লট, হিস্টোগ্রাম এবং …

3
আধা-সংযুক্ত এবং শর্তাধীন কনজুগেট প্রিয়ারগুলির সংজ্ঞা কী?
আধা-কনজুগেট প্রিয়ার এবং শর্তাধীন কনজুগেট প্রিয়ারগুলির সংজ্ঞা কী ? আমি সেগুলি গেলম্যানের বেয়েসিয়ান ডেটা অ্যানালাইসিসে পেয়েছি, কিন্তু আমি তাদের সংজ্ঞাটি পাইনি।
12 bayesian 

2
MCMC পদ্ধতি - জ্বলনের নমুনা?
ইন এমসিএমসি পদ্ধতি, আমি পড়া রাখা burn-inসময় বা নমুনার সংখ্যা "burn"। এটি ঠিক কী এবং কেন এটির প্রয়োজন? হালনাগাদ: একবার MCMC স্থিতিশীল হয়ে গেলে, এটি কি স্থিতিশীল থাকে? burn-inসময়ের ধারণাটি মিশ্র সময়ের সাথে সম্পর্কিত কীভাবে ?
12 sampling  mcmc 

4
কেবলমাত্র একটি দূরত্বের ম্যাট্রিক্স দিয়ে পিসিএ সম্পাদন করছেন
আমি একটি বৃহদায়তন ডেটাসেট ক্লাস্টার করতে চাই যার জন্য আমার কাছে কেবল জোড়াযুক্ত দূরত্ব রয়েছে। আমি একটি কে-মেডয়েড অ্যালগরিদম প্রয়োগ করেছি, তবে এটি চালাতে খুব বেশি সময় লাগছে তাই আমি পিসিএ প্রয়োগ করে আমার সমস্যার মাত্রা হ্রাস করে শুরু করতে চাই। যাইহোক, এই পদ্ধতিটি সম্পাদন করতে আমি কেবল জানতে পারি …

1
বিভিন্ন ডেটা সেট জুড়ে একই মডেলের রিগ্রেশন সহগের তুলনা করা
আমি একই দুটি রেফ্রিজারেশন সিস্টেমে ব্যবহৃত দুটি (২) ফ্রিজ (গ্যাস) মূল্যায়ন করছি। মূল্যায়নের জন্য আমার কাছে স্যাচুরেটেড সাকশন তাপমাত্রা ( এসএসS ), ঘনীভূত তাপমাত্রা ( ), এবং এম্পারেজ ( ) ডেটা রয়েছে। ডেটা দুটি (2) সেট আছে; 1 ম রেফ্রিজারেন্ট ( ) এবং 2 য় রেফ্রিজারেন্ট ( )। আমি রিগ্রেশন …

1
গুরুত্বের নমুনা দেওয়ার অন্তর্নিহিত উদাহরণ
আমার পটভূমি কম্পিউটার বিজ্ঞান। আমি কার্লো স্যাম্পলিং পদ্ধতিগুলিতে মন্টে মোটামুটি নতুন এবং আমি গণিতটি বুঝতে পেরেও গুরুত্বপূর্ণ নমুনা দেওয়ার জন্য স্বজ্ঞাত উদাহরণ দিয়ে আসতে আমার খুব কষ্ট হয়েছে। আরও স্পষ্টভাবে, কেউ উদাহরণ দিতে পারে: একটি আসল বিতরণ এক থেকে নমুনা করতে পারে না তবে একটি অনুমান করতে পারে একটি গুরুত্বপূর্ণ …

2
'পরিশ্রমী ডেটা' তৈরির জন্য সেরা অভ্যাস
হ্যাডলি উইকহাম বিশ্লেষণ করার জন্য জেএসএসে "পরিশ্রমী ডেটা" ( লিংক ) নামে একটি স্টার্লার আর্টিকেল লিখেছিলেন বিশ্লেষণ করার জন্য ডেটা ম্যানিপুলেশন এবং ডেটাটিকে "অনুকূল" অবস্থাতে নিয়ে আসার বিষয়ে। যাইহোক, আমি ভাবছিলাম যে কোনও কাজের সেটিংয়ে টবুলার ডেটা উপস্থাপনের ক্ষেত্রে সর্বোত্তম অভ্যাসগুলি কী ছিল? ধরা যাক আপনার সহকর্মী আপনাকে তাকে কিছু …
12 dataset  tables 

1
ফিশারের নির্ভুল পরীক্ষা এবং হাইপারজিম্যাট্রিক বিতরণ
আমি ফিশারদের সঠিক পরীক্ষাটি আরও ভালভাবে বুঝতে চেয়েছিলাম, তাই আমি নীচের খেলনাটির উদাহরণটি প্রস্তুত করেছি, যেখানে f এবং m পুরুষ এবং মহিলা এর সাথে মিলে যায় এবং n এবং y এর সাথে "সোডা সেবন" এর সাথে মিলে যায়: > soda_gender f m n 0 5 y 5 0 স্পষ্টতই, এটি …

2
টমাস বায়েস বায়েসের উপপাদ্যকে এত চ্যালেঞ্জী কেন পেলেন?
এটি বিজ্ঞানের প্রশ্নের ইতিহাসের আরও একটি বিষয়, তবে আমি আশা করি এটি এখানে অন টপিকের বিষয়। আমি পড়েছি যে থমাস বয়েস কেবলমাত্র ইউনিফর্মের বিশেষ ক্ষেত্রে বায়েসের উপপাদ্যটি আবিষ্কার করতে পেরেছিল এবং তারপরেও তিনি এ নিয়ে লড়াই করেছিলেন, স্পষ্টতই। আধুনিক চিকিত্সায় জেনারেল বেয়েসের উপপাদ্য কতটা তুচ্ছ, তা বিবেচনা করে কেন সে …

3
পোইসন বিতরণের সাধারণ অনুমান
এখানে উইকিপিডিয়ায় বলা হয়েছে: এর যথেষ্ট বৃহৎ মানের জন্য (বলতে λ> 1000 ), গড় সঙ্গে সাধারণ বণ্টনের λ এবং ভ্যারিয়েন্স λ (আদর্শ বিচ্যুতি যদি \ sqrt {\ ল্যামডা} ), পইসন বিতরণের একটি চমৎকার পড়তা হয়। তাহলে λ 10 সম্পর্কে তার চেয়ে অনেক বেশী হয়, তাহলে সাধারণ বণ্টনের একটি ভাল পড়তা …

1
ক্যারেট প্যাকেজ সহ র‌্যান্ডমফোরেস্টের ফাইনালমোডেল ব্যবহারের পূর্বাভাসের পূর্বে প্রিপ্রোসেসিংয়ের দরকার আছে?
আমি 10x10CV দিয়ে একটি র্যান্ডমফোরস্ট অবজেক্ট প্রশিক্ষণের জন্য ক্যারেট প্যাকেজটি ব্যবহার করি। library(caret) tc <- trainControl("repeatedcv", number=10, repeats=10, classProbs=TRUE, savePred=T) RFFit <- train(Defect ~., data=trainingSet, method="rf", trControl=tc, preProc=c("center", "scale")) এর পরে, আমি একটি টেস্টসেটে নতুন র্যান্ডমফোরস্টটি পরীক্ষা করি (নতুন ডেটা) RF.testSet$Prediction <- predict(RFFit, newdata=testSet) কনফিউশন ম্যাট্রিক্স আমাকে দেখায়, যে মডেলটি …

3
এআইসিকে হ্রাস করে মডেলগুলি নির্বাচন করা কখন উপযুক্ত?
এটি সুপ্রতিষ্ঠিত, কমপক্ষে কিছু উচ্চতর ক্যালিবারের পরিসংখ্যানবিদদের মধ্যে যে, ন্যূনতম মানের একটি নির্দিষ্ট প্রান্তিকের মধ্যে এআইসি পরিসংখ্যানের মানগুলির সাথে মডেলগুলিকে এআইসি পরিসংখ্যানকে হ্রাস করার মডেল হিসাবে উপযুক্ত হিসাবে বিবেচনা করা উচিত। উদাহরণস্বরূপ, [1, p.221] এ আমরা খুঁজে পাই তারপরে ছোট ছোট জিসিভি বা এআইসি সহ মডেলগুলি সেরা হিসাবে বিবেচিত হবে। …

2
'আংশিক' এবং 'প্রান্তিক' নামগুলির সাথে সম্পর্কিত অন্তর্নিহিত u
2 ভেরিয়েবলের মধ্যে শর্তাধীন পারস্পরিক সম্পর্ককে "আংশিক" পারস্পরিক সম্পর্ক বলা হয় এবং এগুলির মধ্যে সহজ সম্পর্ককে (সুতরাং, অন্য কোনও ভেরিয়েবলের শর্তযুক্ত না হলে) "প্রান্তিক" পারস্পরিক সম্পর্ক বলা হয় সে সম্পর্কে কারও কি ধারণা আছে? "আংশিক" এবং "প্রান্তিক" শব্দের পিছনে অন্তর্দৃষ্টি কী? তারা "অংশগুলি" বা "মার্জিন" দিয়ে কী করবে? এই ধারণাগুলি …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.