পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

3
গুচ্ছ সমাধানগুলি মূল্যায়নের জন্য দুটি গাউসিয়ান মিশ্রণের মধ্যে দূরত্ব
আমি বিভিন্ন ক্লাস্টারিং পদ্ধতির তুলনা করার জন্য একটি দ্রুত সিমুলেশন চালাচ্ছি এবং বর্তমানে ক্লাস্টার সমাধানগুলি মূল্যায়নের চেষ্টা করে একটি ছিটকেছি hit আমি বিভিন্ন বৈধতা মেট্রিকগুলি জানি (অনেকগুলি ক্লাস্টার.স্ট্যাটসে ( আর-তে পাওয়া যায় ) ) তবে আমি অনুমান করি যে ক্লাস্টারের আনুমানিক সংখ্যা প্রকৃত সংখ্যার ক্লাস্টারের সংখ্যার সমান হলে সেগুলি সবচেয়ে …

1
এলোমেলো বন অ্যালগরিদম পদক্ষেপের পিছনে প্রেরণা
এলোমেলো বন গঠনের জন্য আমি যে পদ্ধতিটির সাথে পরিচিত সেগুলি নিম্নরূপ: ( http://www.stat.berkeley.edu/~breiman/RandomForests/cc_home.htm থেকে ) বনে একটি গাছ তৈরি করতে আমরা: আকার N এর একটি নমুনা বুটস্ট্র্যাপ করুন যেখানে N আমাদের প্রশিক্ষণের সেটের আকার। এই গাছের প্রশিক্ষণ সেট হিসাবে বুটস্ট্র্যাপযুক্ত নমুনাটি ব্যবহার করুন। গাছের প্রতিটি নোডে এলোমেলোভাবে আমাদের এম বৈশিষ্ট্যগুলির …

2
কেন এলোমেলো প্রভাবের মডেলগুলির প্রভাবগুলিকে ইনপুট ভেরিয়েবলগুলির সাথে সম্পর্কযুক্ত করা প্রয়োজন, যখন স্থির প্রভাবের মডেলগুলি পারস্পরিক সম্পর্ক স্থাপনের অনুমতি দেয়?
উইকিপিডিয়া থেকে পৃথক নির্দিষ্ট প্রভাব সম্পর্কে দুটি সাধারণ অনুমান করা হয়, এলোমেলো প্রভাব অনুমিতি এবং স্থির প্রভাব অনুমিতি। র্যান্ডম প্রভাব ধৃষ্টতা (একটি র্যান্ডম প্রভাব মডেল তৈরি করা) যে ব্যক্তি নির্দিষ্ট প্রভাব হয় সম্পর্কহীন স্বাধীন ভেরিয়েবল সঙ্গে। নির্দিষ্ট প্রভাব অনুমান হ'ল পৃথক নির্দিষ্ট প্রভাবটি স্বাধীন ভেরিয়েবলের সাথে সম্পর্কিত হয়। যদি র্যান্ডম …

3
ক্রমবর্ধমান / ক্রমবর্ধমান প্লট (বা "একটি লরেঞ্জ কার্ভ ভিজ্যুয়ালাইজিং")
আমি জানি না যে এই জাতীয় প্লট কী বলা হয় এবং এইভাবে আমি এই প্রশ্নটিকে একটি নির্বোধ শিরোনাম দিয়েছি। ধরা যাক আমার কাছে নিম্নরূপে অর্ডার করা ডেটাসেট রয়েছে 4253 4262 4270 4383 4394 4476 4635 ... প্রতিটি নম্বর কোনও নির্দিষ্ট ব্যবহারকারী কোনও ওয়েবসাইটে অবদানের পোস্টের পরিমাণের সাথে সঙ্গতিপূর্ণ। আমি এখানে …

2
পূর্ববর্তী ঘনত্বের সম্ভাবনা কার্যকারণের পূর্ববর্তী ঘনত্ব কেন সমানুপাতিক?
বয়েসের উপপাদ্য অনুসারে, । তবে আমার একনোমেট্রিক পাঠ অনুসারে, এটি বলে যে পি ( θ | y ) ∝ পি ( y | θ ) পি ( θ ) । কেন এমন হয়? আমি কেন পাবেন না পি ( Y ) উপেক্ষা করা হয়।পি( y)| θ)পি( θ ) = পি( …

3
একটি সাধারণ সমীকরণ প্রমাণ সম্পর্কে প্রশ্ন
আপনি কীভাবে প্রমাণ করতে পারেন যে সাধারণ সমীকরণ: এক্স বা অবিশ্বাস্য ধারণা ব্যতীত এক বা একাধিক সমাধান রয়েছে?( এক্সটিএক্স) β= এক্সটিওয়াই(XTX)β=XTY(X^TX)\beta = X^TY আমার একমাত্র অনুমান যে এটির সাধারণীকরণ বিপরীতে কিছু করার আছে তবে আমি সম্পূর্ণ হারিয়ে ফেলেছি।
11 regression  proof 

1
স্প্লাইন / স্মুথ রিগ্রেশন সহ নতুন ডেটা কীভাবে পূর্বাভাস দেওয়া যায়
ভবিষ্যদ্বাণীমূলক মডেলটির জন্য মসৃণতা / স্প্লিং ব্যবহার করার সময় কীভাবে নতুন ডেটা-র জন্য ভবিষ্যদ্বাণী করা হয় তার একটি ধারণামূলক ব্যাখ্যা দিতে সহায়তা করতে পারে? উদাহরণস্বরূপ, পি-স্প্লিনস সহ আর- gamboostএ mboostপ্যাকেজটি ব্যবহার করে তৈরি করা একটি মডেল দেওয়া হলে কীভাবে নতুন ডেটার পূর্বাভাস দেওয়া হয়? প্রশিক্ষণ তথ্য থেকে কি ব্যবহার করা …

2
ডামিদের জন্য ফিশার?
সংক্ষিপ্ত সংস্করণ: পরিসংখ্যান নিয়ে রোনাল্ড ফিশারের লেখার (কাগজপত্র এবং বই) কোনও ভূমিকা আছে যা সংখ্যার অল্প বা পটভূমি নেই তাদের লক্ষ্য? আমি স্ট্যাটিস্টিস্টিয়ানদের লক্ষ্য করে একটি "এনোটোটেড ফিশার রিডার" এর মতো কিছু ভাবছি of আমি নীচে এই প্রশ্নের অনুপ্রেরণাটি বর্নিত করছি, তবে সতর্ক করা হবে যে এটি দীর্ঘ-বায়ুযুক্ত (এটি কীভাবে …

4
পরিসংখ্যান পরীক্ষা যা পরিমাপের অনিশ্চয়তা অন্তর্ভুক্ত করে
ধরুন আমাকে ভর পরিমাপের দুটি গ্রুপ দেওয়া হয়েছে (মিলিগ্রামে), যাকে y1 এবং y2 হিসাবে উল্লেখ করা হয়েছে। দুটি মাধ্যম বিভিন্ন উপায়ে জনসংখ্যা থেকে আঁকা কিনা তা নির্ধারণ করতে আমি একটি পরীক্ষা করতে চাই। উদাহরণস্বরূপ (আরে) এর মতো কিছু: y1 <- c(10.5,2.9,2.0,4.4,2.8,5.9,4.2,2.7,4.7,6.6) y2 <- c(3.8,4.3,2.8,5.0,9.3,6.0,7.6,3.8,6.8,7.9) t.test(y1,y2) আমি 0.3234 এর একটি পি-ভ্যালু …

3
ক্রেডিট স্কোরিং সম্পর্কিত ভাল বই / কাগজপত্র
আমি ক্রেডিট স্কোরিং সম্পর্কিত বইগুলির পুনঃসংশোধন খুঁজছি। আমি এই সমস্যার সব দিক সম্পর্কে আগ্রহী, তবে বেশিরভাগ ক্ষেত্রে: 1) ভাল বৈশিষ্ট্যগুলি। এগুলি কীভাবে তৈরি করবেন? কোনটি ভাল প্রমাণিত হয়েছে? 2) নিউরাল নেটওয়ার্কগুলি। ক্রেডিট স্কোরিং সমস্যাটিতে তাদের অ্যাপ্লিকেশন। 3) আমি নিউরাল নেটওয়ার্কগুলি বেছে নিয়েছি, তবে আমি অন্যান্য পদ্ধতিতেও আগ্রহী।

1
দুটি কোভেরিয়েন্স ম্যাট্রিক্সের সম্মিলন
আমি সমান্তরালভাবে একটি বিতরণের covariance গণনা করছি এবং আমি একক গৌসিয়ান মধ্যে বিতরণ ফলাফল একত্রিত করা প্রয়োজন। আমি কীভাবে দুজনকে একত্রিত করব? প্রায় একইভাবে বিতরণ ও আকারের হয়ে গেলে দু'জনের মধ্যে রৈখিকভাবে ইন্টারপোলটিং হয়। উইকিপিডিয়া সংমিশ্রনের জন্য নীচে একটি ফোরামেলা সরবরাহ করে তবে এটি ঠিক মনে হয় না; দুটি সমানভাবে …

2
আর এম মধ্যে মডেল জন্য সংক্ষিপ্ত ফাংশন ব্যাখ্যা
আর- এ লিনিয়ার রিগ্রেশন মডেলটিতে ফাংশনটি ব্যবহার করার অর্থ t valueএবং এর অর্থ কী ?Pr(>|t|)summary() Coefficients: Estimate Std. Error t value Pr(>|t|) (Intercept) 10.1595 1.3603 7.469 1.11e-13 *** log(var) 0.3422 0.1597 2.143 0.0322 *

2
সর্বাধিক সম্ভাবনার প্রাক্কলন বুঝতে কত ক্যালকুলাস প্রয়োজন?
আমি এমএলই শেখার জন্য একটি স্টাডি পরিকল্পনা করার পরিকল্পনা করছি। এটি করার জন্য আমি ক্যালকুলাসের ন্যূনতম স্তরের কী তা বোঝার চেষ্টা করছি যা এমএলই বোঝার জন্য প্রয়োজনীয়। এমএলই বোঝার জন্য ক্যালকুলাসের বেসিকগুলি (যেমন ন্যূনতম এবং সর্বাধিক কার্যকারিতা সন্ধান করা) বোঝার পক্ষে যথেষ্ট?

2
কক্স পিএইচ বিশ্লেষণ এবং কোভারিয়েট সিলেকশনে প্রোপেনসিটি স্কোর ওজন
সময়ের-থেকে-ইভেন্ট বেঁচে থাকার ডেটা কক্স আনুপাতিক বিপদ মডেলিংয়ের সময় প্রপেনসিটি স্কোর ওয়েটিং (আইপিটিডাব্লু) সম্পর্কিত: আমার কাছে সম্ভাব্য রেজিস্ট্রি ডেটা রয়েছে যেখানে আমরা কোনও ওষুধের চিকিত্সার প্রভাবটি দেখতে আগ্রহী যা বেশিরভাগ ক্ষেত্রে রোগীরা ইতিমধ্যে বেসলাইন গ্রহণ করছিল। অতএব আমি নিশ্চিত নই কিভাবে কীভাবে ডেটা বিশ্লেষণ করা যায়। সম্ভাব্যভাবে, কিছু বেসলাইন ভেরিয়েবলগুলি …

1
অস্বাভাবিকভাবে সীমাবদ্ধ প্রতিক্রিয়ার ভেরিয়েবলের রিগ্রেশন নিয়ে কাজ করা
আমি এমন একটি প্রতিক্রিয়া পরিবর্তনশীল মডেল করার চেষ্টা করছি যা তাত্ত্বিকভাবে -225 এবং +225 এর মধ্যে আবদ্ধ। পরিবর্তনশীল হ'ল একটি গেম খেলার সময় সাবজেক্টের মোট স্কোর। যদিও তাত্ত্বিকভাবে বিষয়গুলির পক্ষে +225 স্কোর করা সম্ভব। এটি সত্ত্বেও যে স্কোরটি কেবলমাত্র বিষয়গুলির ক্রিয়াগুলির উপর নির্ভর করে না তবে অন্য যে কোন ক্রিয়াকলাপের …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.