পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

1
এমন কোনও মন্টি কার্লো / এমসিসিএম স্যাম্পলার প্রয়োগ করা হয়েছে যা উত্তরোত্তর বিতরণের বিচ্ছিন্ন স্থানীয় ম্যাক্সিমাকে মোকাবেলা করতে পারে?
আমি বর্তমানে বেশ কয়েকটি ওডিইএস নিয়ে গঠিত মডেলের প্যারামিটারগুলি অনুমান করার জন্য একটি বেয়েসিয়ান পদ্ধতির ব্যবহার করছি। আমার কাছে অনুমান করার মতো 15 টি প্যারামিটার রয়েছে, আমার স্যাম্পলিংয়ের স্থানটি 15-মাত্রিক এবং আমার উত্তরোত্তর বিতরণের জন্য অনুসন্ধানে অনেকগুলি স্থানীয় ম্যাক্সিমা রয়েছে যা খুব কম সম্ভাবনার বৃহত অঞ্চলগুলি দ্বারা বিচ্ছিন্ন very এটি …

1
জেনেরিক অপ্টিমাইজার ব্যবহার করে গ্ল্যামনেট লিনিয়ার রিগ্রেশনের ফলাফলগুলি প্রতিরূপ করা
শিরোনাম অনুসারে, আমি লাইব্রেরি থেকে LBFGS অপ্টিমাইজার ব্যবহার করে গ্ল্যামনেট লিনিয়ার থেকে ফলাফলগুলি প্রতিলিপি করার চেষ্টা করছি lbfgs। এই অপটিমাইজারটি ততক্ষণ আমাদের বিচ্ছিন্নতা সম্পর্কে চিন্তা না করে একটি এল 1 নিয়ন্ত্রক পদ যুক্ত করতে দেয়, যতক্ষণ না আমাদের উদ্দেশ্যমূলক ফাংশন (এল 1 নিয়ন্ত্রক শব্দটি ব্যতীত) উত্তল থাকে। মধ্যে ইলাস্টিক নেট …

4
একটি লেবারসনের কাছে নিরপেক্ষ অনুমানক কী তা কীভাবে ব্যাখ্যা করবেন?
ধরুন একটি পক্ষপাতিত্বহীন মূল্নির্ধারক হয় । তারপরে অবশ্যই, । θই[ θ |θ]=θθ^θ^\hat{\theta}θθ\thetaই [ θ^| Θ ] = θE[θ^∣θ]=θ\mathbb{E}[\hat{\theta} \mid \theta] = \theta একজন কীভাবে একটি ল্যাপারসনকে এটি ব্যাখ্যা করে? অতীতে, আমি যা বলেছি তা হ'ল যদি আপনি গড় of এর মানগুলির একগুচ্ছ গড় হন, যেমন নমুনার আকারটি আরও বড় হয়, …

4
নিউরাল নেটওয়ার্ক এবং গভীর শেখার মধ্যে পার্থক্য
নিউরাল নেটওয়ার্ক এবং গভীর শিক্ষার মধ্যে পার্থক্যের দিক থেকে, আমরা বেশ কয়েকটি আইটেমের তালিকা করতে পারি, যেমন আরও স্তর অন্তর্ভুক্ত করা হয়, বিশাল ডেটা সেট করা যায়, প্রশিক্ষণকে জটিল মডেলটিকে সম্ভব করার জন্য শক্তিশালী কম্পিউটার হার্ডওয়্যার এগুলি ছাড়াও, এনএন এবং ডিএল এর মধ্যে পার্থক্য সম্পর্কে আরও বিস্তারিত ব্যাখ্যা রয়েছে?

5
সর্বাধিক ব্যাখ্যামূলক শ্রেণিবদ্ধকরণ মডেল
সিদ্ধান্ত গাছ এবং লজিস্টিক রিগ্রেশন ব্যতীত অন্যান্য শ্রেণিবদ্ধকরণের মডেলগুলি কী ভাল ব্যাখ্যা দেয়? আমি নির্ভুলতা বা অন্যান্য পরামিতিগুলিতে আগ্রহী নই, কেবল ফলাফলগুলির ব্যাখ্যাটি গুরুত্বপূর্ণ।

1
শেখার হার এবং লুকানো স্তরগুলির সংখ্যার মধ্যে সম্পর্ক?
নিউরাল নেটওয়ার্কের গভীরতা এবং শেখার হারের মধ্যে কোনও থাম্বের কোনও নিয়ম আছে? আমি লক্ষ্য করছি যে নেটওয়ার্কটি যত গভীর, তত শিক্ষার হার কম হবে। যদি এটি সঠিক হয় তবে তা কেন?

2
গ্রাফিক্যাল মডেল এবং বোল্টজম্যান মেশিনগুলি গাণিতিকভাবে সম্পর্কিত?
আমি আসলে একটি পদার্থবিদ্যার ক্লাসে বল্টজম্যান মেশিনগুলির সাথে কিছু প্রোগ্রামিং করেছি, আমি তাদের তাত্ত্বিক বৈশিষ্ট্যের সাথে পরিচিত নই। বিপরীতে, আমি গ্রাফিকাল মডেলগুলির তত্ত্ব সম্পর্কে একটি পরিমিত পরিমাণ জানি (লরিজেনের গ্রাফিকাল মডেলগুলির বইয়ের প্রথম কয়েকটি অধ্যায় সম্পর্কে )। প্রশ্ন: গ্রাফিকাল মডেল এবং বোল্টজম্যান মেশিনের মধ্যে কি কোনও অর্থপূর্ণ সম্পর্ক রয়েছে? বোল্টজম্যান …

2
রেফারেন্সের অনুরোধ: কর্মরত ডেটা বিজ্ঞানীদের জন্য ধ্রুপদী পরিসংখ্যান
আমি রিগ্রেশন, অন্যান্য মেশিন লার্নিং টাইপ অ্যালগরিদম এবং প্রোগ্রামিং (ডেটা বিশ্লেষণ এবং সাধারণ সফ্টওয়্যার বিকাশের জন্য উভয়) এর দৃ experience় অভিজ্ঞতা সহ একটি কর্মরত তথ্য বিজ্ঞানী। আমার বেশিরভাগ কর্মজীবন জীবনের ভবিষ্যদ্বাণীমূলক নির্ভুলতার জন্য মডেল তৈরি করতে (বিভিন্ন ব্যবসায়ের সীমাবদ্ধতার অধীনে কাজ করা), এবং আমার নিজের (এবং অন্যের) কাজের সমর্থন করার …

3
আপনি শ্রেণিবিন্যাসে এলডিএর পরিবর্তে পিসিএ কখন ব্যবহার করবেন?
আমি এই নিবন্ধটি মূল উপাদান উপাদান বিশ্লেষণ এবং একাধিক বৈষম্য বিশ্লেষণ (লিনিয়ার বৈষম্য বিশ্লেষণ) এর মধ্যে পার্থক্য নিয়ে পড়ছি এবং আমি কেন এমডিএ / এলডিএর চেয়ে পিসিএ ব্যবহার করবে তা বোঝার চেষ্টা করছি। ব্যাখ্যাটির সংক্ষিপ্তসার নিম্নরূপ: মোটামুটি পিসিএ ভাষায় আমরা সর্বোচ্চ বৈকল্পের অক্ষগুলি সন্ধান করার চেষ্টা করছি যেখানে ডেটা সর্বাধিক …

1
আরটিতে আরিমা সময় সিরিজে ভবিষ্যদ্বাণী করা মানগুলি প্লট করা হচ্ছে
এই প্রশ্নে সম্ভবত একাধিক গুরুতর ভুল বোঝাবুঝি রয়েছে, তবে এটি গণনাগুলি সঠিকভাবে পরিচালিত করার জন্য নয়, বরং সময়কে কেন্দ্র করে কিছুটা বিবেচনায় রেখে শিখতে উদ্বুদ্ধ করা। সময় সিরিজের প্রয়োগ বোঝার চেষ্টা করার সময়, দেখে মনে হয় যেন ডে-ট্রেন্ডিং ডেটা ভবিষ্যতের ভবিষ্যদ্বাণীগুলিকে অনুজ্ঞাযোগ্য করে তোলে। উদাহরণস্বরূপ, প্যাকেজ gtempথেকে সময় সিরিজটি astsaদেখতে …

2
আর এ দুটি বহুপদী রিগ্রেশনগুলির মধ্যে পার্থক্যের পরিসংখ্যানগত তাত্পর্য তুলনা করুন
সুতরাং সবার আগে আমি এই ফোরামে কিছু গবেষণা করেছি এবং আমি জানি যে অত্যন্ত অনুরূপ প্রশ্ন জিজ্ঞাসা করা হয়েছিল তবে তাদের সাধারণত সঠিকভাবে উত্তর দেওয়া হয় না বা কখনও কখনও উত্তরগুলি আমার পক্ষে বোঝার পক্ষে যথেষ্ট বিশদ হয় না। এবার আমার প্রশ্নটি হ'ল: আমার কাছে দুটি সেট ডেটা রয়েছে, প্রতিটিটিতে …

1
বক্স প্লট নোট বনাম টুকি-ক্র্যামার অন্তর
'আর' -র বক্সপ্লট থেকে "খাঁজ" সহায়তা নথি ( বা মূল পাঠ্য ) নিম্নলিখিতটি দেয়: যদি দুটি প্লটের খাঁজগুলি ওভারল্যাপ না হয় তবে এটি 'দৃ evidence় প্রমাণ' যে দুটি মিডিয়ানের পার্থক্য রয়েছে (চেম্বারস এট আল, 1983, পৃষ্ঠা 62)। ব্যবহৃত গণনাগুলির জন্য boxplot.stats দেখুন। এবং ' boxplot.stats ' নিম্নলিখিতটি দেয়: Notches (যদি …

2
একই বর্গের পাঁচটি শিশুর একই নাম দেওয়া হওয়ার সম্ভাবনা
বাচ্চা-নামকরণ ফোরামে, সম্ভাব্য বাবা-মায়েরা তাদের ভয় ভয় জেনিফারের সর্বদা কিছুটা পুনরাবৃত্তি করে: "আমি চাই না যে আমার সন্তান তার নামের সাথে তার ক্লাসে 5 জনের একজন হোক।" কথাটি হ'ল, আর কোনও নামই এই ধরণের জনপ্রিয়তার কাছাকাছি আসে না, এমনকি জেনিফার ক্রেজের উচ্চতায়ও আপনি তাদের মধ্যে পাঁচটি কোনও ক্লাসে পাননি। নামের …

1
পর্যায়ক্রমিক ডেটা ফিট করার জন্য পর্যায়ক্রমিক স্প্লাইনস
এই প্রশ্নের একটি মন্তব্যে ব্যবহারকারী @ হুবহু পর্যায়ক্রমিক ডেটা ফিট করার জন্য স্প্লাইজের একটি পর্যায়ক্রমিক সংস্করণ ব্যবহারের সম্ভাবনার উল্লেখ করেছেন। আমি এই পদ্ধতিটি সম্পর্কে আরও জানতে চাই, বিশেষত স্প্লাইনগুলি সংজ্ঞায়িত সমীকরণগুলি এবং কীভাবে সেগুলি বাস্তবে প্রয়োগ করা যায় (আমি বেশিরভাগই একজন Rব্যবহারকারী, তবে যদি প্রয়োজন হয় তবে আমি ম্যাটল্যাব বা …

1
পিসিএ ইগেনভেেক্টর নয় এমন ভেক্টরগুলির "ইগেনভ্যালুগুলি" (ব্যাখ্যাযোগ্য বৈকল্পের শতাংশ) কীভাবে পাবেন?
আমি বুঝতে চাই যে কীভাবে আমি পিসিএ দ্বারা সরবরাহিত স্থানাঙ্ক স্থানে নয়, (ঘোরানো) ভেক্টরগুলির সামান্য পৃথক গোষ্ঠীর বিপরীতে কোনও ডেটা সেটের বৈকল্পিকতার শতাংশ পেতে পারি। set.seed(1234) xx <- rnorm(1000) yy <- xx * 0.5 + rnorm(1000, sd = 0.6) vecs <- cbind(xx, yy) plot(vecs, xlim = c(-4, 4), ylim = …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.