পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

1
পিসিএ উপাদান (একটি বিপ্লট / লোডিং প্লটের উপর) সহ একটি ভেরিয়েবলের সঠিক সমিতি মাপ কী?
আমি FactoMineRসুপ্ত ভেরিয়েবলগুলিতে আমার ডেটার পরিমাপের সেটটি হ্রাস করতে ব্যবহার করছি । উপরের পরিবর্তনশীল মানচিত্রটি ব্যাখ্যা করার জন্য আমার কাছে স্পষ্ট, তবে ভেরিয়েবল এবং উপাদান 1 এর মধ্যে সংযুক্তিগুলি আসার সময় আমি বিভ্রান্ত হয়ে পড়েছি ভেরিয়েবল মানচিত্রের দিকে তাকানো, ddpএবং মানচিত্রের অংশটির covখুব কাছাকাছি অবস্থিত, এবং ddpAbsআরও কিছুটা সামান্য দূরে। …

2
ম্যাথিউস পারস্পরিক সম্পর্ক সহগ (এমসিসি) কীভাবে ব্যাখ্যা করবেন?
প্রশ্নের উত্তর ফাই, ম্যাথিউ এবং পিয়ারসন পারস্পরিক সম্পর্কের সহগগুলির মধ্যে সম্পর্ক? দেখায় যে তিনটি সহগ পদ্ধতি সমস্ত সমতুল্য। আমি পরিসংখ্যান থেকে নই, সুতরাং এটি একটি সহজ প্রশ্ন হওয়া উচিত। ম্যাথিউস পেপার (www.senderdirect.com/science/article/pii/0005279575901099) নিম্নলিখিত বর্ণনা করে: "A correlation of: C = 1 indicates perfect agreement, C = 0 is expected for …

2
রিজ রিগ্রেশনকে মানীকরণ সম্পর্কে প্রশ্ন
ওহে ছেলেরা আমি এক বা দুটি কাগজপত্র পেয়েছি যা রিজ রিগ্রেশন (বাস্কেটবলের ডেটার জন্য) ব্যবহার করে। যদি আমি একটি রিজ রিগ্রেশন চালাই তবে আমাকে সর্বদা আমার ভেরিয়েবলগুলি মানীকরণ করতে বলা হয়েছিল, তবে আমাকে কেবল এটি করতে বলা হয়েছিল কারণ রিজ স্কেল ভেরিয়েন্ট ছিল (রিজ রিগ্রেশন আসলেই আমাদের কোর্সের অংশ ছিল …

4
কেএনএন কি বৈষম্যমূলক শিক্ষার অ্যালগরিদম?
দেখে মনে হচ্ছে কেএনএন একটি বৈষম্যমূলক শিক্ষার অ্যালগরিদম তবে আমি এটির নিশ্চয়তা দেওয়ার মতো কোনও অনলাইন উত্স খুঁজে পাচ্ছি না। কেএনএন কি বৈষম্যমূলক শিক্ষার অ্যালগরিদম?

2
বহুগুণ রিগ্রেশন জন্য বৈপরীত্য
রিগ্রেশন ফিটিংয়ে বহুবর্ষীয় বিপরীতে ব্যবহার বুঝতে পারি না। বিশেষত, আমি এই পৃষ্ঠায়R বর্ণিত একটি ইন্টারভাল ভেরিয়েবল (সমান দুরত্বের স্তর সহ অরডিনাল ভেরিয়েবল) প্রকাশ করার জন্য ব্যবহৃত একটি এনকোডিংয়ের উল্লেখ করছি । এই পৃষ্ঠাটির উদাহরণে , যদি আমি সঠিকভাবে বুঝতে পারি, আর একটি অন্তর্বর্তী ভেরিয়েবলের জন্য একটি মডেল ফিট করে, এমন …

1
উত্তরোত্তর বিতরণের এই দৃষ্টান্তটিতে কী ভুল?
আমার নীচের চিত্রটি যা আমাকে বলা হয়েছে তা হল উত্তরের সম্ভাবনা বন্টন কীভাবে পূর্ব এবং সম্ভাব্য বিতরণের সমন্বয়। আমাকে বলা হয়েছে যে চিত্রটির সাথে কিছু ভুল আছে, যথা: উত্তরোত্তর বিতরণে ফর্ম থাকতে পারে না এটি সম্ভাবনা ফাংশনের রূপ দেয়। তবে আমি চিত্রটির মধ্যে কী ভুল তা ভেবে লড়াই করে যাচ্ছি। …

4
"সময় ধারাবাহিক বিশ্লেষণ" এবং "অনুদায়ী তথ্য বিশ্লেষণ" পদগুলির মধ্যে পার্থক্যগুলি কী?
দ্রাঘিমাংশ সম্পর্কিত তথ্য সম্পর্কে কথা বলার সময় আমরা একই বিষয় / অধ্যয়ন ইউনিট থেকে বারবার সংগৃহীত তথ্যগুলি বারবার উল্লেখ করতে পারি, সুতরাং একই বিষয়টির মধ্যে পর্যবেক্ষণের জন্য পারস্পরিক সম্পর্ক রয়েছে, অর্থাত্-বিষয়গুলির মধ্যে মিল রয়েছে। সময়-সিরিজের ডেটা সম্পর্কে কথা বলার সময়, আমরা বেশ কয়েকটি সময়ের মধ্যে সংগৃহীত ডেটাগুলিও উল্লেখ করি এবং …

2
আমি সংখ্যাসূচক / শ্রেণিবদ্ধ মান উভয়ের সাথে আর-র মধ্যে অর্ডিনাল লজিস্টিক রিগ্রেশন বিশ্লেষণ কীভাবে চালাব?
বেস ডেটা : আমার কাছে মূল্যায়নগুলি সহ ~ 1000 জন চিহ্নিত রয়েছে: '1,' [ভাল] '2,' [মাঝারি] বা '3' [খারাপ] - এই মানগুলি আমি ভবিষ্যতে মানুষের জন্য ভবিষ্যদ্বাণী করার চেষ্টা করছি । এছাড়াও, আমার কাছে কিছু জনসংখ্যার তথ্য আছে: লিঙ্গ (শ্রেণিবদ্ধ: এম / এফ), বয়স (সংখ্যাসূচক: 17-80), এবং জাতি (বিভাগীয়: কালো …

2
আমি এই লাগানো বনাম অবশিষ্টাংশের প্লটটিকে কীভাবে ব্যাখ্যা করব?
আমি সত্যই হিটারোসিসেস্টাস্টিটি বুঝতে পারি না। আমি জানতে চাই যে আমার এই মডেলটি এই প্লট অনুসারে উপযুক্ত কিনা।

3
আমাদের অটোনকোডারগুলি কেন দরকার?
সম্প্রতি, আমি অটোনকোডারগুলি নিয়ে পড়াশোনা করেছি। যদি আমি সঠিকভাবে বুঝতে পারি তবে একটি স্বয়ংক্রিয়কোডার হ'ল একটি নিউরাল নেটওয়ার্ক যেখানে ইনপুট স্তর আউটপুট স্তরের অনুরূপ। সুতরাং, নিউরাল নেটওয়ার্কটি ইনপুটটিকে সোনার মান হিসাবে ব্যবহার করে ভবিষ্যদ্বাণী করার চেষ্টা করে। এই মডেলটির দরকারীতা কী? কিছু আউটপুট উপাদান পুনর্নির্মাণের চেষ্টা করার ফলে কী কী …

2
কীভাবে সম্ভব যে পয়সন জিএলএম অ-পূর্ণসংখ্যার সংখ্যা গ্রহণ করে?
পোইসন জিএলএম অ-পূর্ণসংখ্যার সংখ্যা গ্রহণ করে আমি সত্যিই হতবাক! দেখুন: ডেটা (বিষয়বস্তু data.txt): 1 2001 0.25 1 1 2002 0.5 1 1 2003 1 1 2 2001 0.25 1 2 2002 0.5 1 2 2003 1 1 আর স্ক্রিপ্ট: t <- read.table("data.txt") names(t) <- c('site', 'year', 'count', 'weight') tm <- …

2
র্যান্ডম অরণ্যের সাথে বৈশিষ্ট্য নির্বাচন
আমার বেশিরভাগ আর্থিক ভেরিয়েবল (120 বৈশিষ্ট্য, 4 কে উদাহরণ) সহ একটি ডেটাসেট রয়েছে যা বেশিরভাগ ক্ষেত্রে অত্যন্ত সম্পর্কিত এবং খুব কোলাহলযুক্ত (প্রযুক্তিগত সূচক, উদাহরণস্বরূপ) তাই আমি মডেল প্রশিক্ষণের সাথে পরবর্তী ব্যবহারের জন্য সর্বাধিক 20-30 টি নির্বাচন করতে চাই (বাইনারি শ্রেণিবদ্ধকরণ) - বৃদ্ধি হ্রাস). আমি বৈশিষ্ট্য র‌্যাঙ্কিংয়ের জন্য এলোমেলো বন ব্যবহার …

4
এবং এফ-টেস্টের মধ্যে কী সম্পর্ক ?
আমি ভাবছিলাম যে R2R2R^2 এবং এফ-টেস্টের মধ্যে কোনও সম্পর্ক আছে কিনা । সাধারণত R2=∑(Y^t−Y¯)2/T−1∑(Yt−Y¯)2/T−1R2=∑(Y^t−Y¯)2/T−1∑(Yt−Y¯)2/T−1R^2=\frac {\sum (\hat Y_t - \bar Y)^2 / T-1} {\sum( Y_t - \bar Y)^2 / T-1} এবং এটি রিগ্রেশনে লিনিয়ার সম্পর্কের শক্তি পরিমাপ করে। একটি এফ-টেস্ট কেবল একটি অনুমানকে প্রমাণ করে। R2R2R^2 এবং এফ-টেস্টের মধ্যে কি সম্পর্ক …

1
বোরেলের প্যারাডক্সের সাথে মানসিকভাবে আমার কীভাবে व्यवहार করা উচিত?
শর্তযুক্ত সম্ভাবনার সাথে আমি কীভাবে বোরেলের প্যারাডক্স এবং অন্যান্য সম্পর্কিত "প্যারাডক্স" এর সাথে মানসিকভাবে আচরণ করেছি তা নিয়ে আমি কিছুটা অস্বস্তি বোধ করি। যারা এটি পড়ছেন যা এর সাথে পরিচিত নয় তাদের জন্য এই লিঙ্কটি দেখুন । এই মুহুর্তে আমার মানসিক প্রতিক্রিয়াটি এটিকে বেশিরভাগ ক্ষেত্রে এড়িয়ে যাওয়া হয়েছে কারণ এটি …

3
দৃশ্যত বহু মাত্রিক ক্লাস্টার ডেটা প্লট করা
আমার কাছে 16 টি ভেরিয়েবলের সাথে একটি ডেটা সেট রয়েছে এবং কামেন দ্বারা ক্লাস্টার করার পরে, আমি দুটি গ্রুপ প্লট করতে চাই। দুটি প্লাস্টারটি দৃশ্যত উপস্থাপন করার জন্য আপনি কোন প্লটকে পরামর্শ দিচ্ছেন?

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.