পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

6
একটি বৃহত টেক্সট কর্পাস কোথায় পাবেন? [বন্ধ]
বন্ধ থাকে। এই প্রশ্নটি অফ-টপিক । এটি বর্তমানে উত্তর গ্রহণ করছে না। এই প্রশ্নটি উন্নত করতে চান? প্রশ্নটি আপডেট করুন যাতে এটি ক্রস ভ্যালিডেটের জন্য অন-বিষয় । 6 বছর আগে বন্ধ ছিল । আমি ডাউনলোড করতে বৃহত (> 1000) পাঠ্য কর্পাস খুঁজছি। বাঞ্ছনীয় সঙ্গে বিশ্ব সংবাদ বা কোন ধরণের রিপোর্ট …
16 dataset 

2
দ্বি-পুচ্ছ পরীক্ষা ব্যাখ্যা
আমি আমার শিক্ষার্থীদের (প্রাথমিক পরিসংখ্যান কোর্সে) একটি দুটি লেজযুক্ত পরীক্ষা কী এবং এর পি মান কীভাবে গণনা করা হয় তা ব্যাখ্যা করার বিভিন্ন উপায় সন্ধান করছি। আপনি কীভাবে আপনার শিক্ষার্থীদের দ্বি-বনাম এক-লেজযুক্ত পরীক্ষাটি ব্যাখ্যা করবেন?

2
সংক্ষেপণের পরিসংখ্যানগত ন্যায়সঙ্গততা কী?
মনে করুন যে আমাদের দুটি পয়েন্ট রয়েছে (নিম্নলিখিত চিত্র: কালো চেনাশোনা) এবং আমরা তাদের (ক্রস) মধ্যে তৃতীয় পয়েন্টের জন্য একটি মান খুঁজে পেতে চাই। প্রকৃতপক্ষে আমরা আমাদের পরীক্ষামূলক ফলাফল, কালো পয়েন্টগুলির উপর ভিত্তি করে এটি অনুমান করতে যাচ্ছি। সবচেয়ে সহজ কেসটি হল একটি লাইন আঁকুন এবং তারপরে মানটি (যেমন লিনিয়ার …

5
স্ব-অধ্যয়নের জন্য সম্ভাব্য তত্ত্বের বই
সম্ভাব্যতা তত্ত্বের গুরুত্বপূর্ণ ধারণা যেমন সম্ভাব্যতা বন্টন ফাংশন এবং ক্রমবর্ধমান বিতরণ ফাংশনগুলির ব্যাখ্যা করে এমন কোনও ভাল বই আছে? দয়া করে জন রাইসের "গাণিতিক পরিসংখ্যান এবং ডেটা অ্যানালাইসিস" এর মতো বইগুলি উল্লেখ করা থেকে বিরত থাকুন যা হঠাৎ (২ য় অধ্যায়ে) বাস্তব বিশ্লেষণ, একাধিক এবং পৃষ্ঠের অবিচ্ছেদ্য বিষয়ে একটি লাফ …

3
বড়, স্মার্ট (এর) বেট তৈরি করা
আমি 1X2 (ওজনযুক্ত) গেমগুলিতে বেট সুপারিশ করতে একটি অ্যালগরিদম কোড করার চেষ্টা করেছি। মূলত, প্রতিটি গেমের ম্যাচের একটি সেট থাকে (হোম বনাম দূরে দলগুলি): 1: হোম জিত X: আঁকুন 2: দূরে জয় প্রতিটি ম্যাচ এবং প্রতীক (জন্য 1, Xএবং 2), আমি শতকরা যে প্রতীক সঠিক ম্যাচ ফলাফল হবার সম্ভাবনা / …

4
ক্লাস্টারিং 1 ডি ডেটা
আমার একটি ডেটাসেট রয়েছে, আমি কেবলমাত্র একটি ভেরিয়েবলের উপর ভিত্তি করে সেই ডেটাতে ক্লাস্টার তৈরি করতে চাই (কোনও অনুপস্থিত মান নেই)। আমি সেই ভেরিয়েবলের উপর ভিত্তি করে 3 টি ক্লাস্টার তৈরি করতে চাই। কোন ক্লাস্টারিং অ্যালগরিদম, কে-মানে, ইএম, ডিবিএসসিএন ইত্যাদি ব্যবহার করতে হবে? আমার মূল প্রশ্নটি হল, কোন পরিস্থিতিতে আমি …
16 clustering 

11
আর এর সাথে আরম্ভ করার উপায়?
আমি "নিজে থেকে নিজেই যেতে" বেশ কয়েকবার চেষ্টা করেছি - তবে সীমিত সাফল্যের সাথে। আমি নৈমিত্তিক এসপিএসএস ব্যবহারকারী এবং কিছু এসএএস অভিজ্ঞতা আছে। একই পটভূমি রয়েছে এবং এখন আর ব্যবহার করে এমন কারও কাছ থেকে পয়েন্টার বা দু'জনের প্রশংসা করবে Would
16 r  references 

1
আমি কি দুটি অভিজ্ঞতামূলক বিতরণের তুলনা করতে কলমোগোরভ-স্মারনভ ব্যবহার করতে পারি?
প্রাক-নির্দিষ্ট রেফারেন্স ডিস্ট্রিবিউশনের সাথে একটি অভিজ্ঞতাবাদী বিতরণকে তুলনা না করে একই আন্ডারলাইং ডিস্ট্রিবিউশন থেকে এসেছেন কিনা তা নির্ধারণ করার জন্য দুটি অভিজ্ঞতাবাদী বিতরণকে তুলনা করার জন্য কোলমোগোরভ-স্মারনভ ধার্মিকতা-অফ-ফিট পরীক্ষাটি ব্যবহার করা ঠিক কি? আমাকে এই অন্যভাবে জিজ্ঞাসা করার চেষ্টা করুন। আমি এক জায়গায় কিছু বিতরণ থেকে এন নমুনা সংগ্রহ করি। …

2
আমরা কখন ক্লাস্টারিংয়ের সাথে মাত্রিকতা হ্রাস একত্রিত করব?
আমি নথি-স্তরের ক্লাস্টারিংয়ের চেষ্টা করছি। আমি টার্ম-ডকুমেন্ট ফ্রিকোয়েন্সি ম্যাট্রিক্সটি তৈরি করেছি এবং আমি কে-মাধ্যম ব্যবহার করে এই উচ্চ মাত্রিক ভেক্টরগুলিকে ক্লাস্টার করার চেষ্টা করছি। সরাসরি ক্লাস্টারিংয়ের পরিবর্তে, আমি যা করেছি তা হ'ল প্রথমে ইউ, এস, ভিটি ম্যাট্রিকেসগুলি অর্জনের জন্য এলএসএ'র (প্রচ্ছন্ন সিমেটিক বিশ্লেষণ) একক ভেক্টর পচন প্রয়োগ করতে হবে এবং …

2
'পুল ডেটা' বলতে আসলে কী বোঝায়?
আমি ভেবেছিলাম যে 'পুলিং ডেটা'র অর্থ কেবল এমন ডেটাগুলি একত্রিত করা যা পূর্বে বিভাগগুলিতে বিভক্ত ছিল ... মূলত, বিভাগগুলি উপেক্ষা করে ডেটাটিকে ডেটার একটি বিশাল' পুল 'সেট করে। আমার ধারণা, পরিসংখ্যান প্রয়োগের চেয়ে পরিভাষা সম্পর্কে এটি একটি প্রশ্ন। উদাহরণস্বরূপ: আমি 2 টি সাইটের তুলনা করতে চাই এবং প্রতিটি সাইটের মধ্যে …

1
একটি কাস্টম বিতরণ থেকে এলোমেলো নমুনা তৈরি করা
আমি আর কাস্টম পিডিএফ থেকে এলোমেলো নমুনা উত্পন্ন করার চেষ্টা করছি। আমার পিডিএফ হ'ল: fX(x)=32(1−x2),0≤x≤1fX(x)=32(1−x2),0≤x≤1f_{X}(x) = \frac{3}{2} (1-x^2), 0 \le x \le 1 আমি অভিন্ন নমুনা তৈরি করেছি এবং তারপরে এটিকে আমার কাস্টম বিতরণে রূপান্তরিত করার চেষ্টা করেছি। আমি আমার ডিস্ট্রিবিউশনের সিডিএফ ( ) সন্ধান করে এবং এটি ইউনিফর্ম নমুনায় …
16 r  sampling  uniform 

2
আর ব্যবহার করে "সমান্তরাল সেট" প্লট তৈরি করা সম্ভব?
লক । এই প্রশ্নটি এবং এর উত্তরগুলি লক করা আছে কারণ প্রশ্নটি অফ-টপিক তবে historicalতিহাসিক তাত্পর্যপূর্ণ। এটি বর্তমানে নতুন উত্তর বা মিথস্ক্রিয়া গ্রহণ করছে না। টর্মোড প্রশ্নের ( এখানে পোস্ট করা ) ধন্যবাদ আপনাকে সমান্তরাল সেট প্লট জুড়ে এসেছিল । এটি কীভাবে দেখাচ্ছে তার উদাহরণ এখানে: (এটি টাইটানিক ডেটাসেটের একটি …


2
প্রশ্নাবলীর নির্ভরযোগ্যতার মূল্যায়ন: মাত্রা, সমস্যাযুক্ত আইটেম এবং আলফা, ল্যাম্বডএ 6 বা অন্য কোনও সূচক ব্যবহার করবেন কিনা?
আমি একটি পরীক্ষায় অংশ নেওয়া অংশগ্রহণকারীদের দ্বারা প্রদত্ত স্কোরগুলি বিশ্লেষণ করছি। আমি আমার প্রশ্নাবলীর নির্ভরযোগ্যতাটি অনুমান করতে চাই যা একটি পণ্যের প্রতি অংশগ্রহণকারীদের মনোভাব অনুমানের উদ্দেশ্যে 6 টি আইটেম দ্বারা গঠিত। আমি ক্রোনবাচের আলফা সমস্ত আইটেমকে একক স্কেল হিসাবে চিকিত্সা হিসাবে গণনা করেছি (আলফা প্রায় 0.6 ছিল) এবং একবারে একটি …

6
আমি কীভাবে কোনও আর ডেটা ফ্রেমে একটি নির্দিষ্ট ডুপ্লিকেট রেকর্ড ছাড়া সমস্ত মুছে ফেলব? [বন্ধ]
বন্ধ থাকে। এই প্রশ্নটি অফ-টপিক । এটি বর্তমানে উত্তর গ্রহণ করছে না। এই প্রশ্নটি উন্নত করতে চান? প্রশ্নটি আপডেট করুন যাতে এটি ক্রস ভ্যালিডেটের জন্য অন-বিষয় । 4 বছর আগে বন্ধ ছিল । আমার একটি ডেটা ফ্রেম রয়েছে যাতে কিছু নকল আইড থাকে। আমি সর্বাধিক মান দিয়ে সারি রেখে নকল …
16 r 

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.