পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
ছুটি-এক-আউট ক্রস-বৈধকরণের উচ্চ প্রকরণ
আমি বারবার পড়েছি যে "লেভ-ওয়ান-আউট" ক্রস-বৈধকরণের প্রশিক্ষণের ভাঁজগুলির বৃহত ওভারল্যাপের কারণে উচ্চ বৈচিত্র রয়েছে। তবে আমি বুঝতে পারি না কেন এটি: প্রশিক্ষণ সেটগুলি প্রায় অভিন্ন হওয়ার কারণে ক্রস-বৈধকরণের পারফরম্যান্সটি খুব স্থিতিশীল (কম বৈকল্পিক) হওয়া উচিত নয়? বা আমার কী পুরোপুরি "বৈকল্পিক" ধারণাটি সম্পর্কে ভুল ধারণা রয়েছে? আমিও সম্পূর্ণরূপে বুঝতে পারি …

2
দূরত্ব পারস্পরিক সম্পর্ক গণনা বোঝা
যতদূর আমি বুঝতে পেরেছি, দূরত্বের পারস্পরিক সম্পর্ক দুটি সংখ্যক ভেরিয়েবলের মধ্যে কোনও সম্পর্ক আছে কিনা তা যাচাই করার একটি মজবুত এবং সর্বজনীন উপায়। উদাহরণস্বরূপ, যদি আমাদের সংখ্যার জোড়া থাকে: (x1, y1) (x2, y2) ... (xn, yn) দুটি ভেরিয়েবল ( xএবং y) এর মধ্যে কোনও (অগত্যা রৈখিক নয়) সম্পর্ক আছে কিনা …

3
শূন্যে ক্লাম্পিং সহ অ-নেতিবাচক ডেটাগুলির একটি মডেল (টুইডি জিএলএম, শূন্য-স্ফীত জিএলএম ইত্যাদি) সঠিক জিরোগুলির পূর্বাভাস দিতে পারে?
প্যারামিটার (গড়-বিবর্তনের সম্পর্কের ঘাঁটিঘটিত) 1 এবং 2 এর মধ্যে থাকা হলে একটি ট্যুইডি বিতরণ শূন্যের পয়েন্টযুক্ত ভর সহ স্কিউ ডেটা মডেল করতে পারে ।ppp একইভাবে শূন্য-স্ফীত (অন্যথায় অবিচ্ছিন্ন বা বিযুক্ত) মডেলটিতে প্রচুর পরিমাণে জিরো থাকতে পারে। আমার বুঝতে সমস্যা হচ্ছে কেন এমন হয় যে আমি যখন এই ধরণের মডেলগুলির সাথে …

2
মার্কভ চেইন এবং মার্কভ চেইন মন্টি কার্লোর মধ্যে কী সংযোগ রয়েছে
আমি এসএএস ব্যবহার করে মার্কভ চেইনগুলি বোঝার চেষ্টা করছি। আমি বুঝতে পেরেছি যে একটি মার্কভ প্রক্রিয়া এমন এক যেখানে ভবিষ্যতের অবস্থা কেবল বর্তমান রাষ্ট্রের উপর নির্ভর করে কেবল অতীতের রাষ্ট্রের উপর নয় এবং সেখানে একটি ট্রানজিশন ম্যাট্রিক্স রয়েছে যা একটি রাজ্য থেকে অন্য রাজ্যে রূপান্তর সম্ভাবনাটি ধারণ করে। তবে আমি …

5
কার্নেল এসভিএম: আমি একটি উচ্চ-মাত্রিক বৈশিষ্ট্য স্পেসে ম্যাপিংয়ের একটি স্বজ্ঞাত ধারণা চাই এবং এটি কীভাবে লিনিয়ার পৃথকীকরণকে সম্ভব করে তোলে
আমি কার্নেল এসভিএম এর অন্তর্নিহিত বোঝার চেষ্টা করছি। এখন, আমি বুঝতে পারি কিভাবে লিনিয়ার এসভিএমের কাজ, এর মাধ্যমে সিদ্ধান্তের লাইন তৈরি করা হয় যা ডেটাটিকে যথাসম্ভব বিভক্ত করে তোলে। আমি একটি উচ্চ-মাত্রিক স্থানে ডেটা পোর্ট করার পিছনের নীতিটিও বুঝতে পারি এবং এটি কীভাবে এই নতুন স্থানটিতে লিনিয়ার সিদ্ধান্তের লাইন খুঁজে …

1
দুটি গণনার মধ্যে পার্থক্যের তাত্পর্য
1 সময় রোড দুর্ঘটনার একটি গণনার মধ্যে পার্থক্য 2 সময় গণনা থেকে উল্লেখযোগ্যভাবে পৃথক কিনা তা নির্ধারণ করার উপায় আছে? বিভিন্ন সময়ে পর্যবেক্ষণের গোষ্ঠীগুলির মধ্যে পার্থক্য নির্ধারণের জন্য আমি বিভিন্ন পদ্ধতি খুঁজে পেয়েছি (উদাহরণস্বরূপ পিসন মানে তুলনা করা) তবে কেবল দুটি সংখ্যা তুলনা করার জন্য নয়। বা এমনকি চেষ্টা করাও …

1
আমার কাছে এক লাইনের সেরা ফিট রয়েছে। আমার এমন ডেটা পয়েন্ট দরকার যা আমার সেরা ফিটের লাইন পরিবর্তন করবে না
আমি ফিটিং লাইন সম্পর্কে একটি উপস্থাপনা দিচ্ছি। আমার একটি সাধারণ লিনিয়ার ফাংশন, y=1x+by=1x+by=1x+b । আমি ছড়িয়ে ছিটিয়ে থাকা ডেটা পয়েন্ট পাওয়ার চেষ্টা করছি যা আমি একটি স্কেটার প্লটে রাখতে পারি যা আমার লাইনটিকে একই সমীকরণের সাথে ফিট রাখবে। আমি এই কৌশলটি আর বা এক্সেল উভয়ের মধ্যেই শিখতে চাই - যে …

2
এলোমেলো অর্থ একটি এলোমেলো ভেরিয়েবলকে "জালিস" হিসাবে সংজ্ঞায়িত করার পিছনে কী?
সম্ভাব্যতার তত্ত্বে, একটি অ-নেগেটিভ র‌্যান্ডম ভেরিয়েবল ল্যাটিসXXX বলা হয় তবে সেখানে ডি ≥ 0 এর মতো থাকে যে ∑ ∞ n = 0 পি ( এক্স = এন ডি ) = 1d≥0d≥0d \geq 0∑∞n=0P(X=nd)=1∑n=0∞P(X=nd)=1\sum_{n=0}^{\infty}P(X=nd) = 1 । এই সংজ্ঞাটিকে কেন জালিক বলা হয় তার জন্য কোনও জ্যামিতিক ব্যাখ্যা আছে?

1
উচ্চ বৈধতা নির্ভুলতা তবে গবেষণায় কম পরীক্ষার নির্ভুলতা কী হবে?
মেশিন লার্নিং গবেষণায় বৈধতা সম্পর্কে আমার একটি নির্দিষ্ট প্রশ্ন আছে। যেমনটি আমরা জানি, মেশিন লার্নিং সিস্টেম গবেষকদের তাদের মডেলগুলি প্রশিক্ষণের ডেটাতে প্রশিক্ষণ দিতে, বৈধতা সেট দ্বারা প্রার্থী মডেলগুলি থেকে চয়ন করতে এবং পরীক্ষার সেটটিতে নির্ভুলতার প্রতিবেদন করতে বলে। খুব কঠোর গবেষণায়, পরীক্ষার সেটটি কেবল একবার ব্যবহার করা যেতে পারে। তবে …

3
স্প্লাইস বনাম গাউসিয়া প্রক্রিয়া রিগ্রেশন
আমি জানি যে গাউসিয়ান প্রসেস রিগ্রেশন (জিপিআর) হ'ল নমনীয় ননলাইনার মডেলগুলির জন্য ফিট করার জন্য স্প্লাইনগুলি ব্যবহার করার বিকল্প। আমি জানতে চাই কোন পরিস্থিতিতে অন্যগুলির তুলনায় বিশেষত বায়েশিয়ান রিগ্রেশন কাঠামোর ক্ষেত্রে কোনটি উপযুক্ত। আমি ইতিমধ্যে দেখেছি স্প্লাইনস, স্মুথড স্প্লাইনস এবং গাউসিয়ান প্রক্রিয়া ইমুলেটরগুলি ব্যবহার করার সুবিধা / অসুবিধাগুলি কী? তবে …

2
জ্যাকনিফ বনাম এলইউসিভি
সত্যিই কি জ্যাকনিফের মধ্যে কোনও পার্থক্য রয়েছে এবং একের বাইরে ক্রস বৈধতা রয়েছে? পদ্ধতিটি অদৃশ্য বলে মনে হচ্ছে আমি কি কিছু মিস করছি?

1
পরে বিশ্লেষণ করার জন্য কি পিসিএ দ্বারা গৃহীত কোনও প্রয়োজনীয় পরিমাণের বৈকল্পিকতা রয়েছে?
আমার কাছে 11 টি ভেরিয়েবল সহ একটি ডেটাসেট রয়েছে এবং ডেটা হ্রাস করার জন্য পিসিএ (অर्थোগোনাল) করা হয়েছিল। বিষয়টি রাখার জন্য উপাদানগুলির সংখ্যা সম্পর্কে সিদ্ধান্ত নেওয়া আমার পক্ষে বিষয়টি সম্পর্কে আমার জ্ঞান এবং স্ক্রি প্লট (নীচে দেখুন) থেকে প্রমাণিত হয়েছিল যে দুটি মূল উপাদান (পিসি) তথ্য ব্যাখ্যা করার জন্য যথেষ্ট …
15 variance  pca 

1
সিএনএন কীভাবে বিলীন গ্রেডিয়েন্ট সমস্যা এড়াতে পারে
আমি সংমিশ্রণীয় নিউরাল নেটওয়ার্কগুলি সম্পর্কে অনেকগুলি পড়ছি এবং ভাবছিলাম যে তারা কীভাবে নষ্ট হওয়া গ্রেডিয়েন্ট সমস্যাটিকে এড়িয়ে চলে। আমি জানি গভীর বিশ্বাস নেটওয়ার্কগুলি একক স্তরের অটো-এনকোডার বা অন্যান্য প্রাক-প্রশিক্ষিত অগভীর নেটওয়ার্কগুলি স্ট্যাক করে এবং এই সমস্যাটি এড়াতে পারে তবে সিএনএন-তে কীভাবে এড়ানো যায় তা আমি জানি না। উইকিপিডিয়া অনুসারে : …

4
কনভ্যুশনাল নিউরাল নেটওয়ার্কের জন্য আপনার কতটা ডেটা দরকার?
যদি আমার কাছে কনভোলসনাল নিউরাল নেটওয়ার্ক (সিএনএন) থাকে, যার প্রায় 1,000,000 প্যারামিটার রয়েছে, তবে কত প্রশিক্ষণের ডেটা প্রয়োজন (ধরুন আমি স্টোকাস্টিক গ্রেডিয়েন্ট বংশোদ্ভূত করছি)? থাম্বের কোনও নিয়ম আছে? অতিরিক্ত নোট: আমি যখন স্টোকাস্টিক গ্রেডিয়েন্ট বংশোদ্ভূত (উদাহরণস্বরূপ, 1 পুনরাবৃত্তির জন্য 64 প্যাচগুলি) সম্পাদনা করি, তখন, 10000 পুনরাবৃত্তির পরে, শ্রেণিবদ্ধের যথার্থতা মোটামুটি …

3
কেএনএন-এর জন্য অনুকূল কে নির্বাচন করা হচ্ছে
আমি কেএনএন-এর জন্য অনুকূল কে নির্বাচন করতে একটি 5-গুণ সিভি করিয়েছি। এবং দেখে মনে হচ্ছে যে বড় কে পেয়েছে তত ত্রুটি ... দুঃখিত, আমার কোনও কিংবদন্তি ছিল না, তবে বিভিন্ন বর্ণগুলি বিভিন্ন পরীক্ষার প্রতিনিধিত্ব করে। মোট 5 টি রয়েছে এবং মনে হয় তাদের মধ্যে সামান্যতম পার্থক্য রয়েছে। কে বড় হলে …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.