পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

1
ডেটাতে একটি ক্ষতিকারক মডেল ফিট করা
এই প্রশ্নটি স্ট্যাক ওভারফ্লো থেকে স্থানান্তরিত হয়েছিল কারণ ক্রস ভ্যালিডেটে উত্তর দেওয়া যেতে পারে। 8 বছর আগে স্থানান্তরিত । আমার দুটি ভেরিয়েবল রয়েছে, উভয়ই "সংখ্যার" ক্লাস থেকে: > head(y) [1] 0.4651804 0.6185849 0.3766175 0.5489810 0.3695258 0.4002567 > head(x) [1] 59.32820 68.46436 80.76974 132.90824 216.75995 153.25551 আমি তাদের চক্রান্ত করেছি, এবং …
21 r 

1
সময় সিরিজের জন্য লজিস্টিক রিগ্রেশন
অতীতের পর্যবেক্ষণের ভিত্তিতে সবেমাত্র উপস্থিত হওয়া ডেটা (অর্থাৎ সারি) এর নির্ভরশীল ভেরিয়েবলের মান পূর্বাভাস দেওয়ার জন্য আমি স্ট্রিমিং ডেটা (বহুমাত্রিক সময় সিরিজ) এর প্রসঙ্গে একটি বাইনারি লজিস্টিক রিগ্রেশন মডেলটি ব্যবহার করতে চাই। যতদূর আমি জানি, লজিস্টিক রিগ্রেশন traditionতিহ্যগতভাবে পোস্টমর্টেম বিশ্লেষণের জন্য ব্যবহৃত হয়, যেখানে প্রতিটি নির্ভরশীল পরিবর্তনশীল ইতিমধ্যে সেট করা …

3
প্রতিদিনের ডেটা সহ অটো.রিমা: মৌসুমী / পর্যায়ক্রমিকতা কীভাবে ধরা যায়?
আমি একটি দৈনিক সময় সিরিজে একটি আরিমা মডেল ফিট করছি। ডেটা 02-01-2010 থেকে 30-07-2011 পর্যন্ত প্রতিদিন সংগ্রহ করা হয় এবং খবরের কাগজ বিক্রয় সম্পর্কে। যেহেতু বিক্রয়ের একটি সাপ্তাহিক প্যাটার্ন পাওয়া যায় (দৈনিক গড় কপি বিক্রি হয় সোমবার থেকে শুক্রবার পর্যন্ত একই হয়, তারপরে শনি ও রবিবার বৃদ্ধি হয়), তাই আমি …

4
সিদ্ধান্ত গাছ প্রায় সবসময় বাইনারি গাছ হয়?
প্রায় প্রতিটি সিদ্ধান্ত গাছের উদাহরণটি আমি জুড়ে এসেছি বাইনারি ট্রি হিসাবে ঘটে। এটি কি বেশ সার্বজনীন? বেশিরভাগ মানক অ্যালগোরিদম (সি 4.5, কার্ট ইত্যাদি) কেবল বাইনারি গাছকে সমর্থন করে? আমি যা সংগ্রহ করি তা থেকে CHAID বাইনারি গাছগুলির মধ্যে সীমাবদ্ধ নয় তবে এটি একটি ব্যতিক্রম বলে মনে হয়। একটি দ্বি-দ্বি দ্বিধা …

4
গুগলের সাথে সম্পর্ক এবং কারণের মধ্যে পার্থক্য কতটা?
প্রসঙ্গ এই সাইটে একটি জনপ্রিয় প্রশ্ন হ'ল " সাধারণ পরিসংখ্যানগত পাপগুলি কি? " উল্লিখিত পাপগুলির মধ্যে একটি হ'ল "পারস্পরিক সম্পর্ক কার্যকারণ ..." লিঙ্কটি ধরে নিচ্ছে তারপরে, 5 টি সমীক্ষার সাথে মন্তব্যগুলিতে পরামর্শ দেওয়া হয় যে: "গুগল পার্থক্যটি যত্ন না করে এক বছরে $ 65B করে" " হালকা তদন্তের অতিরিক্ত বিশ্লেষণের …

3
স্বজ্ঞাতভাবে "পক্ষপাত" কি?
আমি লিনিয়ার রিগ্রেশন বিশ্লেষণের প্রসঙ্গে পক্ষপাতের ধারণাটি উপলব্ধি করতে সংগ্রাম করছি ling পক্ষপাতের গাণিতিক সংজ্ঞা কী? ঠিক পক্ষপাতদুষ্ট এবং কেন / কীভাবে? উদাহরণস্বরূপ উদাহরণ?

2
আর ফাংশন এলএম-এ ওজন কীভাবে ব্যবহার করবেন?
লক । এই প্রশ্নটি এবং এর উত্তরগুলি লক করা আছে কারণ প্রশ্নটি অফ-টপিক তবে historicalতিহাসিক তাত্পর্যপূর্ণ। এটি বর্তমানে নতুন উত্তর বা মিথস্ক্রিয়া গ্রহণ করছে না। weightsআর এর lmফাংশনে আর্গুমেন্টটি কীভাবে ব্যবহার করবেন সে সম্পর্কে কেউ কি কিছু পয়েন্টার সরবরাহ করতে পারেন ? বলুন, উদাহরণস্বরূপ, আপনি ট্র্যাফিক ডেটাতে একটি মডেল ফিট …
21 r  regression 

3
পয়সন রিগ্রেশন বনাম লগ-গণনা সর্বনিম্ন-স্কোয়ার রিগ্রেশন?
লগ-লিঙ্ক ফাংশন সহ একটি পয়সন রিগ্রেশন একটি জিএলএম । সাধারণভাবে বিতরণ করা গণনা উপাত্তকে মডেল করার বিকল্প উপায় হ'ল লগ (বা বরং, 0 এর পরিচালনা করতে লগ (1 + গণনা) গ্রহণ করে প্রিপ্রোসেস করা। লগ-কাউন্টের প্রতিক্রিয়াগুলিতে আপনি যদি সর্বনিম্ন-স্কোয়ারের রিগ্রেশন করেন তবে তা কি পইসন রিগ্রেশন সম্পর্কিত? এটি কি একইরকম …

1
বিপরীত উইশার্ট বিতরণের ম্যাট্রিক্সের ত্রিভুজটির প্রান্তিক বিতরণ
ধরুন । আমি তির্যক উপাদানগুলির ডায়াগন ( এক্স ) = ( x 11 , … , এক্স পি পি ) এর প্রান্তিক বিতরণে আগ্রহী । এক্সের সাবমেট্রিকগুলি বিতরণের কয়েকটি সাধারণ ফলাফল রয়েছে (কমপক্ষে কিছু উইকিপিডিয়ায় তালিকাভুক্ত)। এ থেকে আমি অনুধাবন করতে পারি যে ত্রিভুজটিতে যে কোনও একক উপাদানের প্রান্তিক বিতরণ …

2
রিগ্রেশনে রৈখিক পরীক্ষার অসুবিধা
ইন পরিসংখ্যানগত মডেলিং: দুই সংস্কৃতি লিও Breiman লিখেছেন বর্তমান প্রয়োগ অনুশীলন হ'ল ধার্মিকতা-ফিট-টেস্ট এবং অবশিষ্ট বিশ্লেষণগুলি ব্যবহার করে ডেটা মডেল ফিট fit এক পর্যায়ে, কয়েক বছর আগে, আমি নিয়ন্ত্রিত পরিমাণে অন-লাইনের সাথে সাতটি মাত্রায় একটি সিমুলেটেড রিগ্রেশন সমস্যা সেট আপ করেছি। ননলাইনারিটি চূড়ান্ত না হওয়া পর্যন্ত ধার্মিকতার মানক পরীক্ষাগুলি লিনিয়ারিকে …

7
একটি নমুনা টি-পরীক্ষার মধ্যে পার্থক্যটির আত্মবিশ্বাসের ব্যবধানকে কীভাবে ব্যাখ্যা করবেন?
এসপিএসএস আউটপুট সরবরাহ করে "পার্থক্যটির মানে আত্মবিশ্বাসের ব্যবধান"। আমি কয়েকটি স্থানে পড়েছি যে এর অর্থ "100 এর মধ্যে 95 বার, আমাদের নমুনার গড় পার্থক্য এই সীমার মধ্যে থাকবে" আমি এই বিষয়টি অস্পষ্ট বলে মনে করি। "এর মধ্যকার পার্থক্যের আত্মবিশ্বাসের ব্যবধান" বোঝাতে কি কেউ পরিষ্কার শব্দটির পরামর্শ দিতে পারে? এই আউটপুটটি …

2
অ্যালগরিদম শেখার মধ্যে কীভাবে চয়ন করবেন
আমার এমন একটি প্রোগ্রাম বাস্তবায়ন করতে হবে যা কিছু প্রশিক্ষণের ডেটার ভিত্তিতে রেকর্ডগুলিকে 2 বিভাগে (সত্য / মিথ্যা) শ্রেণিবদ্ধ করবে এবং আমি ভাবছিলাম যে কোন অ্যালগরিদম / পদ্ধতিটি আমার উচিত at তাদের মধ্যে অনেকগুলি বেছে নেবেন বলে মনে হয় - কৃত্রিম নিউরাল নেটওয়ার্ক, জেনেটিক অ্যালগোরিদম, মেশিন লার্নিং, বয়েসিয়ান অপটিমাইজেশন ইত্যাদি …

5
তত্ত্ব পরিমাপের ভূমিকা
আমি ননপ্যারমেট্রিক বায়েশিয়ান (এবং সম্পর্কিত) কৌশলগুলি সম্পর্কে আরও শিখতে আগ্রহী। আমার পটভূমি কম্পিউটার বিজ্ঞানে এবং যদিও আমি কখনও পরিমাপ তত্ত্ব বা সম্ভাবনা তত্ত্বের উপর কোর্স করিনি, তবে আমার সম্ভাবনা এবং পরিসংখ্যান সম্পর্কে সীমিত পরিমাণে আনুষ্ঠানিক প্রশিক্ষণ ছিল। কেউ আমাকে শুরু করার জন্য এই ধারণাগুলির একটি পাঠযোগ্য ভূমিকা প্রস্তাব করতে পারেন?


2
মডেল নির্বাচনের পরে ক্রস বৈধকরণ (ত্রুটি সাধারণকরণ)
দ্রষ্টব্য: কেস হল এন >> পি আমি পরিসংখ্যানগত শিক্ষার উপাদানগুলি পড়ছি এবং ক্রস বৈধকরণের "ডান" উপায় সম্পর্কে বিভিন্ন উল্লেখ রয়েছে (যেমন পৃষ্ঠা 60, পৃষ্ঠা 245)) বিশেষত, আমার প্রশ্ন হল যখন কোনও মডেল অনুসন্ধান হয়েছে তখন কে-ফোল্ড সিভি বা বুটস্ট্র্যাপিং ব্যবহার করে চূড়ান্ত মডেলটিকে (পৃথক পরীক্ষার সেট ছাড়াই) কীভাবে মূল্যায়ন করা …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.