পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
মন্টি কার্লো সিমুলেশন অনুমানের নির্ভুলতা সন্ধান করা
পটভূমি আমি একটি মন্টি কার্লো সিমুলেশন ডিজাইন করছি যা মডেলগুলির সিরিজগুলির ফলাফলগুলির সাথে মিলিত হয় এবং আমি নিশ্চিত হতে চাই যে সিমুলেশন আমাকে সিমুলেটেড ফলাফলের সম্ভাব্যতা এবং সেই সম্ভাবনার প্রাক্কলনের যথার্থতা সম্পর্কে যুক্তিসঙ্গত দাবি করতে অনুমতি দেবে। সিমুলেশন সম্ভাব্যতা খুঁজে পাবে যে নির্দিষ্ট সম্প্রদায়ের কাছ থেকে আঁকা একটি জুরি একটি …

1
অ-নেস্টেড মডেলগুলির পরীক্ষার সমতুল্যতা
ধরা যাক হল এবং একটি ডামি এর লিনিয়ার ফাংশন । আমার হাইপোথিসিসটি হ'ল নিজেই অন্যান্য ভেরিয়েবলের ভেক্টর ভেক্টরের হডোনাস্টিক ইনডেক্সের মতো । আমি এই জন্য সমর্থন আছে এর (অর্থাত , , ..., দিকে) । এই দুটি মডেলের সমতুল্যতা পরীক্ষা করার কোনও উপায় আছে :yyyxxxddddddZZZMANOVAMANOVAMANOVAZZZz1z1z_1z2z2z_2znznz_nddd মডেল 1:y=b0+b1⋅x+b2⋅d+e1y=b0+b1⋅x+b2⋅d+e1y = b_0 + b_1 …

3
গাণিতিক সমীকরণ বোঝার জন্য স্ট্যাটিস্টিকাল সফটওয়্যার ব্যবহার থেকে রূপান্তর?
প্রসঙ্গ: আমি একজন সাইকোলজি পিএইচডি ছাত্র। অনেক মনস্তত্ত্বের পিএইচডি শিক্ষার্থীর মতো, আমি জানি যে কীভাবে পিসিএ, শ্রেণিবদ্ধকরণ গাছ এবং ক্লাস্টার বিশ্লেষণের মতো কৌশলগুলি পরিসংখ্যান সংক্রান্ত সফটওয়্যার ব্যবহার করে বিভিন্ন পরিসংখ্যান বিশ্লেষণ করা যায়। তবে এটি সত্যই সন্তোষজনক নয় কারণ আমি কেন বিশ্লেষণ করেছি এবং সূচকগুলির অর্থ কী তা ব্যাখ্যা করতে …

2
দুটি অ-নেস্টেড মডেলের এআইসির পার্থক্য পরীক্ষা করে
এআইসির সম্পূর্ণ বিষয় বা অন্য কোনও তথ্যের মানদণ্ডটি এটিই কম ভাল। সুতরাং আমার যদি দুটি মডেল M1 থাকে: y = a0 + XA + e এবং M2: y = b0 + ZB + u, এবং যদি প্রথম (A1) এর AIC দ্বিতীয় (A2) এর চেয়ে কম হয়, তবে এম 1 আছে …
12 regression  aic 

4
পিয়ারসন ডেটার পারস্পরিক সম্পর্কের সাথে সম্ভবত শূন্য স্ট্যান্ডার্ড বিচ্যুতি?
আমি সম্ভবত শূন্য স্ট্যান্ডার্ড বিচ্যুতি (অর্থাত্ সমস্ত ডেটার একই মান রয়েছে) দিয়ে ডেটা সেটগুলির পার্সার রিলেশনশিটি সহগের গণনা করতে সমস্যা হচ্ছে। মনে করুন যে আমার কাছে নিম্নলিখিত দুটি ডেটা সেট রয়েছে: float x[] = {2, 2, 2, 3, 2}; float y[] = {2, 2, 2, 2, 2}; পারস্পরিক সম্পর্ক সহগ …

3
3-স্তরের आकस्मिक টেবিলটি মোকাবেলা করার উপযুক্ত উপায়
আমার কাছে একটি তিন স্তরের কন্টিনজেন্সি টেবিল রয়েছে, বেশ কয়েকটি প্রজাতির গণনা তথ্য, যে হোস্ট প্ল্যান্ট থেকে তারা সংগ্রহ করা হয়েছিল এবং সেই সংগ্রহটি কোনও বৃষ্টির দিনে ঘটেছিল কিনা (এটি আসলে গুরুত্বপূর্ণ!)। আর, জাল তথ্য ব্যবহার করা কিছু হতে পারে: count <- rpois(8, 10) species <- rep(c("a", "b"), 4) host …

2
এক্স কীভাবে এক্স এক্স নমুনা পাবেন (এক্স) am গামা?
আমার স্যাম্পলিংয়ের একটি সহজ সমস্যা রয়েছে, যেখানে আমার অভ্যন্তরীণ লুপটি দেখতে দেখতে: v = sample_gamma(k, a) যেখানে sample_gammaগামা বিতরণ থেকে নমুনাগুলি একটি ডিরিচলেট নমুনা গঠন করে। এটি ভালভাবে কাজ করে, তবে কে / এ এর ​​কয়েকটি মানগুলির জন্য, কিছু প্রবাহিত গণনা আন্ডারফ্লো হয়। আমি এটিকে লগ স্পেস ভেরিয়েবলগুলি ব্যবহার করার …

1
বারবার জমা হওয়া ডেটা পরীক্ষা করার সময় সামগ্রিক টাইপ আই ত্রুটি
গ্রুপ সিক্যুয়াল পদ্ধতি সম্পর্কে আমার একটি প্রশ্ন আছে । উইকিপিডিয়া অনুসারে: দুটি চিকিত্সা গ্রুপগুলির সাথে একটি এলোমেলোভাবে পরীক্ষায়, ধ্রুপদী গোষ্ঠীর ক্রমগত পরীক্ষাগুলি নিম্নলিখিত পদ্ধতিতে ব্যবহৃত হয়: প্রতিটি গ্রুপে এন বিষয় উপলব্ধ থাকলে 2n বিষয়গুলির উপর একটি অন্তর্বর্তী বিশ্লেষণ পরিচালিত হয়। দুটি গোষ্ঠীর তুলনা করার জন্য পরিসংখ্যানগত বিশ্লেষণ করা হয় এবং …

2
একটি ভাল হাইব্রিড / হ্যামিলটোনিয়ান মন্টি কার্লো অ্যালগরিদম ডিজাইন করার বিষয়ে আমার কী জানা উচিত?
আমি পিএমসির জন্য একটি হাইব্রিড মন্টি কার্লো স্যাম্পলিং অ্যালগরিদম ডিজাইন করছি , এবং আমি এটিকে যথাসম্ভব ফাস এবং বিনামূল্যে করার চেষ্টা করছি, তাই আমি এইচএমসি অ্যালগরিদম ডিজাইনের বিষয়ে ভাল পরামর্শ খুঁজছি। আমি র‌্যাডফোর্ডের জরিপ অধ্যায় এবং বেসকোস ইত্যাদি পড়েছি। আল এর সাম্প্রতিক কাগজটি এইচএমসির সর্বোত্তম (পদক্ষেপের আকার) টিউনিংয়ের জন্য এবং …

7
আর এর জন্য পাঠ্য-খনন প্যাকেজগুলি কী কী এবং সেখানে অন্যান্য ওপেন সোর্স টেক্সট-মাইনিং প্রোগ্রাম রয়েছে?
আপনি কি আর-তে কোনও পাঠ্য খনির প্যাকেজটি সুপারিশ করতে পারেন যা প্রচুর পরিমাণে ডেটা ব্যবহার করতে পারে? দ্বিতীয়ত, আর-তে কোনও পাঠ্য খনির প্যাকেজগুলির জন্য কি জিইউআই উপলব্ধ? তৃতীয়ত, আরও একটি ওপেন সোর্স টেক্সট মাইনিং প্রোগ্রাম রয়েছে যা ব্যবহার করা সহজ এবং স্বজ্ঞাত?
12 r  text-mining 

2
মডেল নির্বাচন বা নিয়মিতকরণের পরে জিএলএম
আমি এই প্রশ্নটি দুটি অংশে বলতে চাই। উভয়ই জেনারেলাইজড লিনিয়ার মডেলের সাথে লেনদেন করে তবে প্রথমটি মডেল নির্বাচনের সাথে এবং অন্যান্যগুলি নিয়মিতকরণের সাথে ডিল করে। পটভূমি: আমি পূর্বাভাস এবং বর্ণনা উভয় জন্য GLMs (লিনিয়ার, লজিস্টিক, গামা রিগ্রেশন) মডেল ব্যবহার করি। যখন আমি " সাধারণ জিনিসগুলি একটি প্রতিরোধের সাথে করায়" উল্লেখ …

1
অনলাইন, স্কেলেবল পরিসংখ্যান পদ্ধতি
এটি দক্ষ অনলাইন লিনিয়ার রিগ্রেশন দ্বারা অনুপ্রাণিত হয়েছিল , যা আমি খুব আকর্ষণীয় বলে মনে করি। বড় মাপের পরিসংখ্যানগত কম্পিউটিংয়ের জন্য এমন কোনও পাঠ্য বা সংস্থান রয়েছে যা মুখ্য স্মৃতিতে ফিট করার জন্য খুব বেশি ডেটাসেটের সাথে কম্পিউটিং রয়েছে এবং কার্যকরভাবে নমুনার ক্ষেত্রেও এটি বিচিত্র। উদাহরণস্বরূপ, কোনও অনলাইন ফ্যাশনে মিক্সড …

4
সোয়েভ, আর, লেটেক্স, অ্যাকলিপস স্টেটেট স্থাপন করা [বন্ধ]
বন্ধ থাকে। এই প্রশ্নটি অফ-টপিক । এটি বর্তমানে উত্তর গ্রহণ করছে না। এই প্রশ্নটি উন্নত করতে চান? প্রশ্নটি আপডেট করুন যাতে এটি ক্রস ভ্যালিডেটের জন্য অন-বিষয় । 3 বছর আগে বন্ধ । কিছু দিন আগে আমি একটি সোয়েভআর সেটআপ করার জন্য একটি পোস্ট দেখেছিলাম, যা কোনও ব্যবহারকারীকে সরাসরি টেবিল, গ্রাফ …
12 r 

2
একক ভেরিয়েবলের ৮০% হারানো ডেটা
আমার ডেটাতে একটি ভেরিয়েবলের রয়েছে 80% হারানো ডেটা। অস্তিত্বের কারণে ডেটাগুলি অনুপস্থিত (অর্থাত্ সংস্থাটি কত ব্যাংক bankণ গ্রহণ করে)। আমি একটি নিবন্ধ জুড়ে এসেছি যে ডামি ভেরিয়েবল সামঞ্জস্য পদ্ধতি এই সমস্যার সমাধান। এর অর্থ যে এই ক্রমাগত পরিবর্তনশীলটিকে শ্রেণিবদ্ধে রূপান্তর করা দরকার? এটাই কি একমাত্র সমাধান? আমি তাত্ত্বিকভাবে মনে করি …

2
প্যারামিটার অনুমানের কোন পদ্ধতিটি নির্বাচন করব তা আমি কীভাবে জানতে পারি?
প্যারামিটার অনুমানের জন্য বেশ কয়েকটি পদ্ধতি রয়েছে। এমএলই, উমভিউ, এমওএম, সিদ্ধান্ত-তাত্ত্বিক এবং অন্যান্য সকলের কাছে মনে হয় যে তারা পরামিতি অনুমানের জন্য কেন কার্যকর for অন্যদের চেয়ে যে কোনও একটি পদ্ধতি ভাল, বা এটি "বেস্ট ফিটিং" অনুমানকারী কী হিসাবে সংজ্ঞায়িত করা যায় (অরথোগোনাল ত্রুটিগুলি হ্রাস করার সাথে একটি সাধারণ ন্যূনতম …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.