পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

1
ফ্যাক্টর বিশ্লেষণে ভেরিম্যাক্স এবং ওব্লিমিন ঘূর্ণনের মধ্যে পার্থক্য
ফ্যাক্টর বিশ্লেষণে ভেরিম্যাক্স রোটেশন এবং ওব্লিমিন রোটেশনের মধ্যে পার্থক্য কী? এছাড়াও, আমি তত্ত্বীয় এবং এসপিএসএস উভয় ক্ষেত্রে মূল উপাদান বিশ্লেষণ, ভেরিম্যাক্স রোটেশন এবং অনুসন্ধানকারী ফ্যাক্টর বিশ্লেষণের মধ্যে সম্পর্ক সম্পর্কে বিভ্রান্ত হয়ে পড়েছি। তারা কিভাবে সম্পর্কিত?

5
ডুর্বিন ওয়াটসন পরীক্ষার পরিসংখ্যান
আমি আর-তে আমার রিগ্রেশন মডেলে ডিডাব্লু টেস্টটি প্রয়োগ করেছিলাম এবং আমি একটি ডিডাব্লু পরীক্ষার পরিসংখ্যান পেয়েছি 1.78 এবং একটি পি-ভ্যালু 2.2e-16 = 0। এর অর্থ কি এই অবশিষ্টাংশের মধ্যে অটোকোরিলেশন নেই কারণ স্টাটটি একটি ছোট পি-মানের সাথে 2 এর কাছাকাছি বা এর অর্থ যদিও স্ট্যাটটি 2 পি-মানটি খুব কম এবং …

1
রিগ্রেশন সহগের অনুমানগুলি কি সম্পর্কহীন?
একটি সাধারণ রিগ্রেশন বিবেচনা করুন (স্বাভাবিকতা ধরে নেওয়া হয় না): যেখানে গড় এবং স্ট্যান্ডার্ড বিচ্যুতি । এবং এর ন্যূনতম স্কোয়ার অনুমানগুলি কি সম্পর্কহীন?Yi=a+bXi+ei,Yi=a+bXi+ei,Y_i = a + b X_i + e_i,eieie_i000σσ\sigmaaaabbb

2
পিসিএ কেন প্রক্ষেপণের মোট বৈকল্পিকতা সর্বাধিক করে?
ক্রিস্টোফার বিশপ তার প্রমাণ প্যাটার্ন রিকগনিশন অ্যান্ড মেশিন লার্নিং প্রুফ গ্রন্থে লিখেছেন যে পূর্ববর্তী নির্বাচিত উপাদানগুলিতে ডেটা অরথোগোনাল স্পেসে প্রত্যাশিত হওয়ার পরে প্রতিটি পর পরের মূল উপাদানটি একটি মাত্রার প্রক্ষেপণের বৈচিত্রকে সর্বাধিক করে তোলে। অন্যরা অনুরূপ প্রমাণ দেখায়। যাইহোক, এটি কেবল প্রমাণ করে যে প্রতিটি ক্রমাগত উপাদানই একটি মাত্রার সর্বাধিক …

2
চ-পরিমাপটি কি নির্ভুলতার সমার্থক?
আমি বুঝতে পেরেছি যে চ-পরিমাপ (নির্ভুলতা এবং পুনরুদ্ধারের উপর ভিত্তি করে) কোনও শ্রেণিবদ্ধকারী কতটা সঠিক তার অনুমান। এছাড়াও, যখন আমাদের ভারসাম্যহীন ডেটাসেট থাকে তখন নির্ভুলতার চেয়ে এফ-পরিমাপ অনুকূল হয় । আমার একটি সাধারণ প্রশ্ন রয়েছে (যা প্রযুক্তি সম্পর্কে সঠিক পরিভাষা ব্যবহার সম্পর্কে বেশি)। আমার একটি ভারসাম্যহীন ডেটাসেট রয়েছে এবং আমি …

2
শতাংশ তথ্য জন্য বিতরণ
আমার ডেটা সহ একটি মডেল তৈরি করার জন্য ব্যবহার করার সঠিক বিতরণ সম্পর্কে আমার একটি প্রশ্ন রয়েছে। আমি 50 টি প্লট সহ বনাঞ্চল পরিচালনা করেছিলাম, প্রতিটি প্লট 20m × 50m পরিমাপ করে। প্রতিটি প্লটের জন্য, আমি গাছের ছাঁটাইয়ের শতাংশের পরিমাণ অনুমান করে যা মাটি ছায়ায় es প্রতিটি চক্রান্তের ক্যানোপি কভারের …

3
আমি কেন 1 এর চেয়ে বেশি এনট্রপি তথ্য পাচ্ছি?
এন্ট্রপি গণনা করার জন্য আমি নিম্নলিখিত ফাংশনটি প্রয়োগ করেছি: from math import log def calc_entropy(probs): my_sum = 0 for p in probs: if p > 0: my_sum += p * log(p, 2) return - my_sum ফলাফল: >>> calc_entropy([1/7.0, 1/7.0, 5/7.0]) 1.1488348542809168 >>> from scipy.stats import entropy # using a built-in …

1
কেন্দ্রহীনতার প্যারামিটার - এটি কী, এটি কী করে, একটি প্রস্তাবিত মান কী হবে?
আমি আমার পরিসংখ্যান জ্ঞান, বিশেষত নমুনা আকার নির্ধারণ এবং পরিসংখ্যান শক্তি বিশ্লেষণ সম্পর্কিত ক্ষেত্রে ব্রাশ করার চেষ্টা করা হয়েছে। তবে মনে হয় আমি যত বেশি পড়ি তত বেশি পড়ার দরকার পড়ে। যাইহোক আমি জি * পাওয়ার নামে একটি সরঞ্জাম পেয়েছি যা আমার যা কিছু প্রয়োজন তা মনে করে তবে ননসেন্ট্রালটি …

1
লিনিয়ার রিগ্রেশন-এ সাধারণ ধারণা
লিনিয়ার রিগ্রেশন অনুমান হিসাবে, ত্রুটি বিতরণের স্বাভাবিকতা কখনও কখনও ভুলভাবে "প্রসারিত" বা y বা x এর স্বাভাবিকতার প্রয়োজনীয়তা হিসাবে ব্যাখ্যা করা হয়। এক্স এবং ওয়াইটি স্বাভাবিক নয় তবে ত্রুটি শব্দটি এবং সুতরাং প্রাপ্ত লিনিয়ার রিগ্রেশন প্রাক্কলনগুলি বৈধ কিনা এমন কোনও দৃশ্য / ডেটাসেট নির্মাণ করা সম্ভব?

3
রৈখিক বৈষম্যমূলক বিশ্লেষণ (এলডিএ) এর স্কেলিং মানগুলি কি লিনিয়ার বৈষম্যমূলক ব্যক্তির উপর ব্যাখ্যামূলক পরিবর্তনশীল চক্রান্ত করতে ব্যবহার করা যেতে পারে?
মূল উপাদান বিশ্লেষণের মাধ্যমে প্রাপ্ত মূল্যগুলির দ্বি-দ্বি ব্যবহার করে, প্রতিটি নীতি উপাদান তৈরি করে এমন ব্যাখ্যামূলক ভেরিয়েবলগুলি অন্বেষণ করা সম্ভব। লিনিয়ার বৈষম্যমূলক বিশ্লেষণের মাধ্যমেও কি এটি সম্ভব? প্রদত্ত উদাহরণগুলি ব্যবহার করে ডেটা হ'ল "এডগার অ্যান্ডারসনের আইরিস ডেটা" ( http://en.wikedia.org/wiki/Iris_flower_data_set )। আইরিস ডেটা এখানে : id SLength SWidth PLength PWidth species …

2
দুই ডেকে কার্ডের মধ্যে সম্পর্ক?
আমি একটি ওভারহ্যান্ড কার্ডের সাফল্যের অনুকরণ করার জন্য একটি প্রোগ্রাম লিখেছি । প্রতিটি কার্ডের নাম্বার দেওয়া হয়, স্যুট থেকে আসা হয় CLUBS, DIAMONDS, HEARTS, SPADESএবং টু থেকে দশ পর্যন্ত র‌্যাঙ্ক হয় জ্যাক, কুইন, কিং এবং এস। সুতরাং ক্লাব দুটি ক্লাবের একটি সংখ্যা আছে 1, থ্রি ক্লাব দুটি একটি 2 .... …

3
ফ্রেডম্যান পরীক্ষার পরে কীভাবে সঠিকভাবে নিমেনিয় পোস্ট-হক পরীক্ষা করতে হবে
আমি একাধিক ডেটা সেটগুলিতে একাধিক অ্যালগরিদমের পারফরম্যান্স তুলনা করছি। যেহেতু এই পারফরম্যান্স পরিমাপগুলি সাধারণত বিতরণ করার গ্যারান্টিযুক্ত না, তাই আমি ডিমের (২০০ based ) ভিত্তিক নিমেনেই পোস্ট-হক পরীক্ষার সাথে ফ্রেডম্যান টেস্টটি বেছে নিয়েছি । আমি তখন অন্য একটি কাগজ পেয়েছি যা কোয়েড পরীক্ষার মতো অন্যান্য পদ্ধতিগুলি পরবর্তী শাফার পোস্ট-হক পরীক্ষার …

1
বুটস্ট্র্যাপ তাত্পর্যপূর্ণ দুটি পদ্ধতি
বুটস্ট্র্যাপ ব্যবহার করে আমি দুটি পদ্ধতি ব্যবহার করে তাত্পর্যের p এর মান গণনা করি: নাল অনুমানের অধীনে পুনঃনির্মাণ এবং ফলাফলগুলি আসল তথ্য থেকে প্রাপ্ত ফলাফল হিসাবে কমপক্ষে চূড়ান্ত গণনা করা বিকল্প অনুমানের অধীনে পুনঃনির্মাণ এবং নাল অনুমানের সাথে সম্পর্কিত মান হিসাবে মূল ফলাফল থেকে কমপক্ষে দূরত্বে ফলাফলগুলি গণনা করা আমি …

4
কার্যকারণ অনুমানের জন্য কার্যকারণ দর্শনের অনলাইন সংস্থানগুলি
আপনি কোনও বই, নিবন্ধ, প্রবন্ধ, অনলাইন টিউটোরিয়াল / কোর্স ইত্যাদির সুপারিশ করতে পারেন যা কোনও মহামারী বিশেষজ্ঞ / বায়োস্ট্যাটিস্টিস্টের পক্ষে কার্যকারণ / কার্যকারণ সূত্রের দর্শন সম্পর্কে জানতে আগ্রহী এবং দরকারী হবে? আমি আসলে একটি এপি এবং বায়োস্ট্যাটস কাঠামো থেকে কার্যকারণ সূচনা করার বিষয়ে বেশ কিছুটা জানি, তবে আমি দর্শনের বিষয়ে …

2
প্রতিদিনের টাইম সিরিজের ডেটাতে কীভাবে মাস থেকে মাসের প্রভাবগুলি মডেল করবেন?
আমার কাছে প্রতিদিনের ডেটা দু'বারের সিরিজ রয়েছে। একটি sign-upsএবং terminationsসাবস্ক্রিপশন অন্য । আমি উভয় ভেরিয়েবলের মধ্যে থাকা তথ্য ব্যবহার করে পরবর্তীটির পূর্বাভাস দিতে চাই। এই সিরিজের গ্রাফের দিকে তাকালে এটা স্পষ্ট হয় যে কয়েক মাস আগে সাইন-আপের বহুগুণের সাথে টার্মিনেশনগুলি সম্পর্কযুক্ত। অর্থাৎ, 10 ই মে সাইন-আপগুলি স্পাইকের ফলে 10 ই …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.