পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

3
ট্রিমিং শতাংশ বনাম ছাঁটাইযুক্ত গড়ের প্লটটি কীভাবে ব্যাখ্যা করব?
একটি হোমওয়ার্ক প্রশ্নের অংশ হিসাবে, আমাকে সবচেয়ে ছোট এবং বৃহত্তম পর্যবেক্ষণ মুছে ফেলে একটি ডেটাসেটের জন্য ছাঁটাই করা গড় গণনা করতে এবং ফলাফলটি ব্যাখ্যা করতে বলা হয়েছিল। ছাঁটাই করা গড়টি নিরবচ্ছিন্ন গড়ের চেয়ে কম ছিল। আমার ব্যাখ্যাটি হ'ল এটি হ'ল কারণ অন্তর্নিহিত বিতরণটি ইতিবাচকভাবে আঁকানো ছিল, তাই বাম লেজটি ডান …


4
অপারীদের অপসারণ করার জন্য ভাল ফর্ম?
আমি সফটওয়্যার তৈরির জন্য পরিসংখ্যান নিয়ে কাজ করছি। পাস / ব্যর্থ এবং অতিবাহিত সময়ের প্রতিটি বিল্ডের জন্য আমার কাছে ডেটা রয়েছে এবং আমরা এই / সপ্তাহের 200 ডলার উত্পন্ন করি। সাফল্যের হার একত্রিত করা সহজ, আমি বলতে পারি যে 45% কোনও নির্দিষ্ট সপ্তাহ পেরিয়ে গেছে। তবে আমি পাশাপাশি সময় অতিবাহিত …

3
মুক্তির
সংক্ষিপ্তসার: স্ট্যান্ডার্ড স্বাভাবিক বিতরণ না করে লজিস্টিক রিগ্রেশন কোঅফিসিয়েন্টগুলির পরীক্ষার জন্য ডিস্ট্রিবিউশনের (অবশিষ্ট ডিগ্রি ভিত্তিক স্বাধীনতার ডিগ্রি সহ) ব্যবহারের সমর্থন করার জন্য কোনও পরিসংখ্যানগত তত্ত্ব আছে কি ?টিtt কিছু সময় আগে আমি আবিষ্কার করেছি যে ডিএল ডিফল্ট সেটিংসের অধীনে এসএএসসিসি জিসিআইএমএমএক্স-এ কোনও লজিস্টিক রিগ্রেশন মডেলটি ফিট করার সময়, লজিস্টিক রিগ্রেশন …

2
SAS PROC GLIMMIX কেন আমাকে দ্বিপদী গ্লিমের জন্য গ্ল্যামার (lme4) এর চেয়ে অনেক বেশি এলোমেলো giveাল দেয়?
আমি আর এর সাথে আরও পরিচিত একজন ব্যবহারকারী এবং প্রায় চার বছরের আবাসস্থল ভেরিয়েবলের জন্য প্রায় 35 জন ব্যক্তির জন্য এলোমেলো slালু (নির্বাচন সহগ) অনুমান করার চেষ্টা করছি। প্রতিক্রিয়ার পরিবর্তনশীল হ'ল কোনও অবস্থান "ব্যবহৃত" (1) বা "উপলব্ধ" (0) আবাস (নীচে "ব্যবহার") ছিল কিনা। আমি একটি উইন্ডোজ -৪-বিট কম্পিউটার ব্যবহার করছি। …

1
আর-তে মধ্যস্থতা বিশ্লেষণ থেকে আউটপুট বোঝা যাচ্ছে
আমি প্যাকেজটির জন্য ভিগনেট ব্যবহার করে আর-তে মধ্যস্থতা প্যাকেজটি পেতে চেষ্টা করব। আমি mediate()ফাংশনটির আউটপুট বুঝতে সংগ্রাম করছি । require("mediation") require("sandwich") data("framing") med.fit <- lm(emo ~ treat + age + educ + gender + income, data = framing) out.fit <- glm(cong_mesg ~ emo + treat + age + educ + …
12 r  mediation 

3
ডেটা তৈরির ধারণাটির শূন্য-গড় রয়েছে
আমি প্রায়শই লোককে সমস্ত উপাদান থেকে মধ্যবর্তীতা সরিয়ে শূন্য-গড়ের একটি ডেটাসেটের একটি মাত্রা / বৈশিষ্ট্য তৈরি করতে দেখি। তবে আমি কখনই বুঝতে পারি নি কেন এমন করব? প্রাকপ্রসেসিং পদক্ষেপ হিসাবে এটি করার প্রভাব কী? এটি শ্রেণিবিন্যাসের পারফরম্যান্সকে উন্নত করে? এটি ডেটাসেট সম্পর্কে কিছু উত্তর দিতে সাহায্য করে? ডেটা বোঝার জন্য …

4
ট্রেন্ডের স্টেশনারি সিরিজগুলি কি আরিমার সাথে মডেল করা যায়?
আরিমা (এক্স) এর সাথে মডেলিংয়ের জন্য প্রয়োজনীয় স্টেশনারি সিরিজ সম্পর্কে আমার একটি প্রশ্ন / বিভ্রান্তি রয়েছে। আমি অনুমানের ক্ষেত্রে (হস্তক্ষেপের প্রভাব) এর ক্ষেত্রে এটি আরও ভাবছি, তবে অনুমানের তুলনায় পূর্বাভাস দেওয়া কোনও প্রতিক্রিয়া দেখায় কিনা তা জানতে চাই। প্রশ্ন: আমি যে সমস্ত প্রারম্ভিক সংস্থান পড়েছি তা জানিয়েছে যে সিরিজটি স্থিতিশীল …

2
পৃথক ডেটা জন্য লাইন প্লট ব্যবহার করা কি ভুল?
আমি প্রায়শই লাইন প্লট হিসাবে কাঠামোযুক্ত ডেটাসেটগুলি দেখেছি, তবে এটি আমার কাছে ঘটে যায় যে রেখাটি পরিমাপের ব্যবধানগুলির মধ্যে একটি বিন্দুতে মূল্য নির্ধারণ করে যা পৃথক ডেটাসেটের জন্য অর্থহীন। অতএব এটি কি পৃথক ডেটার জন্য লাইন প্লট ব্যবহার ভুল? উদাহরণস্বরূপ, দুটি টাইম-সিরিজ ডেটাসেট নিন, একটি অবিচ্ছিন্ন (আমার ওজন, প্রতিদিন সকালে …

3
পুনর্নির্মাণ / পুনর্গঠন ডেটার সেরা উপায় কী?
আমি একটি ল্যাব (স্বেচ্ছাসেবক) এর গবেষণা সহায়ক am একটি বিশাল অধ্যয়ন থেকে টানা এক সেট ডেটার জন্য আমি এবং একটি ছোট গ্রুপকে ডেটা বিশ্লেষণের দায়িত্ব দিয়েছি। দুর্ভাগ্যক্রমে ডেটাগুলি একরকম একটি অনলাইন অ্যাপ্লিকেশন সহ একত্রিত হয়েছিল এবং এটি সবচেয়ে ব্যবহারযোগ্য আকারে ডেটা আউটপুট দেওয়ার জন্য প্রোগ্রাম করা হয়নি। নীচের ছবিগুলি মূল …
12 r  excel  data-cleaning 

2
সাধারণত বিতরণ করা হয় এক্স এবং ওয়াইয়ের ফলে সাধারণত বিতরণকৃত অবশিষ্টাংশের সম্ভাবনা বেশি থাকে?
এখানে লিনিয়ার রিগ্রেশন-এ স্বাভাবিকতা অনুমানের ভুল ব্যাখ্যা করা হয়েছে (যে '' নরমালটি '' বাকীটি বরং এক্স এবং / অথবা ওয়াইকে বোঝায়) এবং পোস্টারটি জিজ্ঞাসা করে যে অ-সাধারণভাবে বিতরণ করা সম্ভব এক্স এবং ওয়াই এবং এখনও সাধারণভাবে অবশিষ্টাংশ বিতরণ করেছি। আমার প্রশ্ন হয়: সাধারণত বিতরণ করা হয় X এবং Y সম্ভাবনা …

3
এ / বি পরীক্ষার জন্য কোন পরিসংখ্যান পরীক্ষা করতে হবে?
আমাদের কাছে দুটি করে 1000 টি নমুনা রয়েছে। আমরা প্রতিটি গোষ্ঠীতে 2 পরিমাণ পরিমাপ করি। প্রথমটি একটি বাইনারি পরিবর্তনশীল। দ্বিতীয়টি একটি আসল সংখ্যা যা ভারী লেজ বিতরণ অনুসরণ করে। আমরা প্রতিটি মেট্রিকের জন্য কোহর্ট সেরা সঞ্চালন করে তা মূল্যায়ন করতে চাই। নির্বাচনের জন্য প্রচুর পরিসংখ্যানগত পরীক্ষা রয়েছে: লোকেরা জেড-টেস্টের পরামর্শ …
12 ab-test 

3
ঘৃণ্য উপরের সীমা
মনে করুন আমাদের কাছে আইআইডি র‌্যান্ডম ভেরিয়েবলগুলি বিতরণ সহ । আমরা একটি নমুনা পালন করতে যাচ্ছি 'নিম্নলিখিত পদ্ধতিতে S: দিন স্বাধীন হতে র্যান্ডম ভেরিয়েবল, আমি অনুমান যে সব ' s এবং এর স্বতন্ত্র এবং নমুনার আকার । এর ইঙ্গিত যার এর নমুনা রয়েছে, এবং আমরা নমুনা দ্বারা সংজ্ঞায়িত সফলতাগুলি ভগ্নাংশ …

1
পিসিএতে প্রাপ্ত পদক্ষেপের তুলনায় ফ্যাক্টর বিশ্লেষণে পদক্ষেপগুলি
আমি কীভাবে পিসিএ (মূল উপাদান বিশ্লেষণ) সম্পাদন করতে জানি তা জানি, তবে আমি ফ্যাক্টর বিশ্লেষণের জন্য ব্যবহার করা উচিত এমন পদক্ষেপগুলি জানতে চাই। পিসিএ করার জন্য, আসুন উদাহরণস্বরূপ কয়েকটি ম্যাট্রিক্স বিবেচনা করা যাক :একজনএকজনA 3 1 -1 2 4 0 4 -2 -5 11 22 20 আমি এর পারস্পরিক সম্পর্ক …

3
কীভাবে অজানা বিতরণের ডেটা সাধারণ করা যায়
আমি একটি নির্দিষ্ট ধরণের পুনরাবৃত্তি পরিমাপের ডেটার সর্বাধিক উপযুক্ত বৈশিষ্ট্যযুক্ত বিতরণ সন্ধান করার চেষ্টা করছি। মূলত, ভূতত্ত্বের আমার শাখায়, আমরা প্রায়শই কোনও ঘটনা ঘটেছিল তা জানতে (নমুনা তাপমাত্রার নীচে শৈলটি শীতল হয়ে যায়) স্যাম্পলগুলি (শিলার অংশগুলি) থেকে খনিজগুলির রেডিওমেট্রিক ডেটিং ব্যবহার করি। সাধারণত, প্রতিটি নমুনা থেকে বেশ কয়েকটি (3-10) পরিমাপ …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.