পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
একাধিক রিগ্রেশন এবং একাধিক তুলনা
বলুন আমি p ব্যাখ্যামূলক ভেরিয়েবলগুলির একাধিক রিগ্রেশন ফিট করি। টি-টেস্ট আমাকে সেগুলির মধ্যে কোনও একক তাৎপর্যপূর্ণ কিনা তা পরীক্ষা করার অনুমতি দেবে ( )। কিছু উপসেট তাৎপর্যপূর্ণ কিনা তা পরীক্ষা করতে আমি আংশিক এফ-টেস্ট করতে পারি ( )।এইচ 0 : β i = β জে = । । । = …

1
দুটি ভিন্ন ফলাফলের জন্য একজন ভবিষ্যদ্বাণীকের জন্য দুটি রিগ্রেশন opালকে কীভাবে তুলনা করবেন?
আমার দুটি রিগ্রেশন opালগুলির সাথে তুলনা করা দরকার যেখানে: $ y_1 ~ a + b_1x y_2 ~ a + b_2x $ আমি কীভাবে বি 1 এবং বি 2 তুলনা করতে পারি? অথবা ইঁদুরগুলিতে আমার নির্দিষ্ট উদাহরণের ভাষায়, আমি তুলনা করতে চাই antero-posterior diameter ~ a + b1 * humeral length …

1
লুসের পছন্দ অ্যাক্সিয়াম, শর্তসাপেক্ষ সম্ভাবনা সম্পর্কে প্রশ্ন [বন্ধ]
বন্ধ । এই প্রশ্নের বিশদ বা স্পষ্টতা দরকার । এটি বর্তমানে উত্তর গ্রহণ করছে না। এই প্রশ্নটি উন্নত করতে চান? বিশদ যুক্ত করুন এবং এই পোস্টটি সম্পাদনা করে সমস্যাটি পরিষ্কার করুন । 2 বছর আগে বন্ধ । আমি লুস (1959) পড়ছি । তারপরে আমি এই বিবৃতিটি পেয়েছি: যখন কোনও ব্যক্তি …

3
স্থির বনাম র্যান্ডম প্রভাবসমূহ
আমি খুব সম্প্রতি জেনারালাইজড লিনিয়ার মিক্সড মডেলগুলি সম্পর্কে শিখতে শুরু করেছি এবং গ্রুপের সদস্যপদটিকে স্থির বা এলোমেলো প্রভাব হিসাবে গণ্য করার ক্ষেত্রে কী পার্থক্য রয়েছে তা অন্বেষণ করতে আর ব্যবহার করছি। বিশেষত, আমি এখানে আলোচিত উদাহরণস্বরূপ ডেটাসেটটি দেখছি: http://www.ats.ucla.edu/stat/mult_pkg/glmm.htm http://www.ats.ucla.edu/stat/r/dae/melogit.htm এই টিউটোরিয়ালে বর্ণিত হিসাবে, ডক্টর আইডির প্রভাব প্রশংসনীয় এবং আমি …

1
কোনটি আরও সঠিক গ্লোম বা গ্ল্যামনেট?
আর গ্ল্যাম এবং গ্ল্যামনেট বিভিন্ন অ্যালগরিদম ব্যবহার করে। আমি যখন উভয় ব্যবহার করি তখন অনুমিত সহগের মধ্যে অপ্রকাশ্য পার্থক্য লক্ষ্য করি। যখন আমি একজনের চেয়ে অন্যের চেয়ে বেশি নির্ভুল হয় তখন এবং আগ্রহ / ব্যবসায় সঠিকভাবে বন্ধ করার সময় নিয়ে আমি আগ্রহী। বিশেষত আমি সেই ক্ষেত্রে উল্লেখ করছি যেখানে গ্ল্যামনেট …

2
কার্যকারণ অনুমান এবং পূর্বাভাসের মধ্যে কী সম্পর্ক?
কার্যকারিতা অনুমান এবং পূর্বাভাস (শ্রেণিবদ্ধতা এবং প্রতিরোধ উভয়) এর মধ্যে সম্পর্ক এবং পার্থক্য কী? পূর্বাভাস প্রসঙ্গে, আমাদের কাছে ভবিষ্যদ্বাণী / ইনপুট ভেরিয়েবল এবং প্রতিক্রিয়া / আউটপুট ভেরিয়েবল রয়েছে। এর অর্থ কি এই যে ইনপুট এবং আউটপুট ভেরিয়েবলের মধ্যে কার্যকারিতা রয়েছে? তাহলে, ভবিষ্যদ্বাণীটি কার্যকারণ মূল্যের সাথে সম্পর্কিত? যদি আমি সঠিকভাবে বুঝতে …

1
ল্যান্সো কীভাবে কলিনের পূর্বাভাসকারীদের মধ্যে নির্বাচন করেন?
আমি একটি স্বজ্ঞাত উত্তরের সন্ধান করছি কেন একটি জিএলএম লাসো মডেল অত্যন্ত সংযুক্তদের একটি গ্রুপের মধ্যে থেকে একটি নির্দিষ্ট ভবিষ্যদ্বাণীকে নির্বাচন করে এবং কেন এটি সর্বোত্তম উপসেট বৈশিষ্ট্য নির্বাচন করে তা এত আলাদাভাবে করে। তিবশিরানী ১৯৯।-এর চিত্র ২-এ দেখানো লাসোর জ্যামিতি থেকে আমি বিশ্বাস করতে পরিচালিত করেছি যে লাসো আরও …

2
ইতিবাচক এবং নেতিবাচক মানগুলির সাথে ডেটা ব্যবহার করার সময় কেন প্রকরণের সহগ বৈধ নয়?
আমি আমার প্রশ্নের সুনির্দিষ্ট উত্তর খুঁজে পাচ্ছি না। আমার ডেটাতে পরিমাপ করা অর্থ সহ বেশ কয়েকটি প্লট রয়েছে 0.27 থেকে 0.57 পর্যন্ত। আমার ক্ষেত্রে, সমস্ত ডেটা মানগুলি ইতিবাচক, তবে পরিমাপটি নিজেই প্রতিফলন মানগুলির অনুপাতের উপর ভিত্তি করে যা -1 থেকে +1 পর্যন্ত হতে পারে। প্লটগুলি NDVI এর মানগুলি উপস্থাপন করে …

1
পৃথক সময়ের বিপত্তি মডেল (ক্লোগলগ) আর
survivalপ্যাকেজ Rপ্রদর্শিত হয় একটানা সময় বেঁচে থাকা মডেলের উপর ফোকাস করার। আমি আনুপাতিক ঝুঁকিপূর্ণ মডেল, পরিপূরক লগ-লগ মডেলটির একটি পৃথক সময়ের সংস্করণ অনুমান করতে আগ্রহী। সরল ডান সেন্সরিং সহ আমার মোটামুটি সোজা বেঁচে থাকার মডেল রয়েছে। আমি জানি যে এই মডেলটি অনুমান করার একটি উপায় হ'ল একটি ডেটা সেট তৈরি …
10 r  survival 

2
একটি নির্দিষ্ট দূরত্বের মধ্যে পয়েন্ট সংখ্যা সর্বাধিকীকরণকারী চেনাশেন্দ্রগুলির একটি পরিচিত সংখ্যা সন্ধান করা
আমার কাছে 2-ডি ডেটার একটি সেট রয়েছে যেখানে আমি নির্দিষ্ট বৃত্তের ( ) কেন্দ্রের নির্দিষ্ট সংখ্যক কেন্দ্রগুলির কেন্দ্রগুলি সন্ধান করতে চাই যা নির্দিষ্ট দূরত্বে ( ) এর মধ্যে মোট পয়েন্টের সংখ্যা সর্বাধিক করে দেয় ।NNNRRR উদাহরণস্বরূপ আমার 10,000 টি ডাটা পয়েন্ট রয়েছে এবং আমি সার্কেলের কেন্দ্রগুলি খুঁজে পেতে চাই যা …
10 r  clustering  distance 

1
ইউনিফর্ম বনাম অ-ইউনিফর্ম বিন সহ হিস্টোগ্রাম
এই প্রশ্নটি একটি ইউনিফর্ম এবং নন-ইউনিট হিস্টোগ্রামের মধ্যে মূল পার্থক্য বর্ণনা করে। এবং এই প্রশ্নটিতে অভিন্ন হিস্টোগ্রামের বিনের সংখ্যা বাছাইয়ের জন্য থাম্বের নিয়ম নিয়ে আলোচনা করা হয়েছে যা হিস্টগ্রাম সেই ডিগ্রিটি উপস্থাপন করে যা থেকে ডেটা নমুনাগুলি আঁকানো হয়েছিল optim ইউনিফর্ম বনাম অ-ইউনিফর্ম হিস্টোগ্রামগুলি সম্পর্কে আমি একই ধরণের "অনুকূলতা" আলোচনার …

5
আপনার ট্রেন, বৈধতা এবং পরীক্ষার শতাংশ কী কীভাবে আপনি ঠিক করবেন?
আমার লেবেলযুক্ত ডেটা প্রশিক্ষণ, বৈধকরণ এবং পরীক্ষার সেটগুলিতে বিভক্ত করার সময়, আমি 50/25/25 থেকে 85/5/10 পর্যন্ত সমস্ত কিছু শুনেছি। আমি নিশ্চিত যে এটি আপনি কীভাবে আপনার মডেলটি ব্যবহার করতে যাচ্ছেন এবং আপনার শেখার অ্যালগরিদমকে কীভাবে উপভোগ করতে পারেন তার উপর নির্ভর করে। থাম্বের বিধি দ্বারা সিদ্ধান্ত নেওয়ার কোনও উপায় আছে …

1
রৈখিক মিশ্র প্রভাবগুলির মডেলগুলির জন্য কীভাবে সংগ্রহ / গণনা লিভারেজ এবং কুকের দূরত্ব পাবেন
merক্লাস অবজেক্টের ( lme4প্যাকেজের মাধ্যমে প্রাপ্ত ) কীভাবে লিভারেজ এবং কুকের দূরত্ব গণনা (বা এক্সট্রাক্ট) করা যায় তা কি কেউ জানেন ? আমি একটি অবশিষ্টাংশ বিশ্লেষণের জন্য এগুলি পরিকল্পনা করতে চাই।

1
একজন অনুমানকারীকে কেন প্যারামিটার থেকে স্বতন্ত্র থাকতে হবে?
এটি ডিভোর এট আল দ্বারা "অ্যাপ্লিকেশন সহ আধুনিক গাণিতিক পরিসংখ্যান" এর একটি উদ্ধৃতি। আমার কাছে কী ধাঁধা আছে যে অনুমানকটি উপর নির্ভরশীল হতে সহায়তা করতে পারে না , কারণ নমুনাটি প্যারামিটারের উপর নির্ভর করে।θθ\theta
10 estimation 

3
সময়রেখা বিশ্লেষণ
আমি কোনও ব্যক্তির জন্ম আদেশ এবং পরে বেশ কয়েকটি 1 বছরের জন্মসূত্রে (যেমন http://www.ncbi.nlm.nih.gov/pmc/articles/PMC2908417/ ) তথ্য ব্যবহার করে স্থূলত্বের ঝুঁকির মধ্যে সম্পর্কের বিষয়ে গবেষণা চালিয়ে যাচ্ছি । একটি মূল চ্যালেঞ্জ হ'ল জন্ম আদেশটি অন্যান্য বৈশিষ্ট্যগুলির সাথে যুক্ত হয় যেমন মাতৃ বয়স, ছোট এবং / বা বড় ভাইবোনের সংখ্যা এবং জন্মের …
10 timelines 

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.