পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

11
স্ট্যান্ডার্ড বিচ্যুতি কি সম্পূর্ণ ভুল? আপনি কীভাবে উচ্চতা, গণনা এবং ইত্যাদি (ধনাত্মক সংখ্যা) এর জন্য স্ট্যান্ড গণনা করতে পারেন?
ধরা যাক আমি উচ্চতা গণনা করছি (সেমি থেকে) এবং সংখ্যাগুলি অবশ্যই শূন্যের চেয়ে বেশি হতে হবে। এখানে নমুনা তালিকা: 0.77132064 0.02075195 0.63364823 0.74880388 0.49850701 0.22479665 0.19806286 0.76053071 0.16911084 0.08833981 Mean: 0.41138725956196015 Std: 0.2860541519582141 এই উদাহরণে, সাধারণ বিতরণ অনুযায়ী, মানগুলির 99.7% হতে হবে গড় থেকে মান বিচ্যুতি। 3 এর মধ্যে। যাইহোক, …

1
গাউসীয় মিশ্রণ মডেলগুলির জন্য বিভিন্ন সমবায় প্রকরণ
এখানে গাউসিয়ান মিশ্রণ মডেলগুলি চেষ্টা করার সময় আমি এই 4 ধরণের সমবায় দেখতে পেলাম। 'full' (each component has its own general covariance matrix), 'tied' (all components share the same general covariance matrix), 'diag' (each component has its own diagonal covariance matrix), 'spherical' (each component has its own single variance). আমি …

2
এলএসটিএম ইউনিট সহ আরএনএনগুলি কেন "বিস্ফোরিত গ্রেডিয়েন্টস" থেকে ভুগতে পারে?
আরএনএনগুলি (এবং, বিশেষত, এলএসটিএম ইউনিট সহ) কীভাবে কাজ করে সে সম্পর্কে আমার একটি প্রাথমিক জ্ঞান রয়েছে। আমার কাছে একটি এলএসটিএম ইউনিটের আর্কিটেকচারের সচিত্র চিত্র রয়েছে, এটি একটি ঘর এবং কয়েকটি গেট, যা মানগুলির প্রবাহকে নিয়ন্ত্রণ করে। যাইহোক, আপাতদৃষ্টিতে, আমি সম্পূর্ণরূপে বুঝতে পারি নি যে এলএসটিএম কীভাবে "নিখোঁজ এবং বিস্ফোরিত গ্রেডিয়েন্টস" …

1
আর-তে দ্বিপদী গ্ল্যামের প্রতিক্রিয়ার জন্য ইনপুট ফর্ম্যাট
ইন R, glmফাংশনটি ব্যবহার করে লজিস্টিক রিগ্রেশনটির জন্য ইনপুট ডেটা ফর্ম্যাট করার জন্য তিনটি পদ্ধতি রয়েছে : প্রতিটি পর্যবেক্ষণের জন্য ডেটা "বাইনারি" ফর্ম্যাটে থাকতে পারে (উদাহরণস্বরূপ, প্রতিটি পর্যবেক্ষণের জন্য y = 0 বা 1); ডেটা "উইলকিনসন-রজার্স" ফর্ম্যাটে থাকতে পারে (যেমন, y = cbind(success, failure)) প্রতিটি সারিতে একটি করে চিকিত্সা উপস্থাপন …

5
বৃহত্তর ডেটা সেটের জন্য গ্রেডিয়েন্ট বংশদ্ভুত অক্ষম কেন?
আসুন ধরা যাক আমাদের ডেটা সেটটিতে 1 মিলিয়ন উদাহরণ রয়েছে, যেমন, and, এবং আমরা এই ডেটা সেটটিতে লজিস্টিক বা লিনিয়ার রিগ্রেশন সঞ্চালনের জন্য গ্রেডিয়েন্ট ব্যবহার করতে চাই।x1,…,x106x1,…,x106x_1, \ldots, x_{10^6} গ্রেডিয়েন্ট বংশোদ্ভূত পদ্ধতিটি কী এটি এটি অদক্ষ করে তোলে? রিকল যে সময়ে গ্রেডিয়েন্ট বংশদ্ভুত ধাপ দেওয়া হয়:ttt wt+1=wt+ηt∇f(x)wt+1=wt+ηt∇f(x)w_{t+1} = w_{t} + …

3
এমসিএমসি বোঝা: বিকল্প কী হবে?
প্রথমবারের মতো বায়েশিয়ান পরিসংখ্যান শেখা; এমসিএমসি বোঝার দিকে কোণ হিসাবে আমি ভাবলাম: এটি কি এমন কিছু করছে যা মৌলিকভাবে অন্যভাবে করা যায় না, বা এটি বিকল্পগুলির চেয়ে আরও দক্ষতার সাথে কিছু করছে? উদাহরণস্বরূপ, ধরা যাক আমরা বিপরীতে, পি ( ডি | এক্স , ওয়াই , জেড ) কে গণনা করে …
13 bayesian  mcmc 

2
স্পাসি-র মধ্যে কীভাবে একইতা পদ্ধতি গণনা করা হয়?
এটি সঠিক স্ট্যাক সাইট কিনা তা নিশ্চিত নয়, তবে এখানে রয়েছে। .সিমরিটিসিটি পদ্ধতি কীভাবে কাজ করে? বাহ স্পাইসি দুর্দান্ত! এর টিডিআইডিএফ মডেলটি আরও সহজ হতে পারে, তবে কেবলমাত্র এক লাইনের কোডের সাথে ডাব্লু 2 ভি ?! স্পাইসি অ্যান্ড্রাজিবার্নিকের তাঁর 10 লাইনের টিউটোরিয়ালে আমাদের .s মিলিটির পদ্ধতিটি টোকেন, সেন্ট, শব্দ শঙ্ক …

4
যদি নিউরাল নেটওয়ার্কের প্রতিটি নিউরন মূলত একটি লজিস্টিক রিগ্রেশন ফাংশন হয় তবে মাল্টি লেয়ার কেন ভাল?
আমি কৌসরের ডিপিএআই কোর্সটি (সপ্তাহের ভিডিও 1 "" নিউরাল নেটওয়ার্ক ওভারভিউ ") এবং অ্যান্ড্রু এনজি ব্যাখ্যা দিচ্ছেন যে কীভাবে নিউরাল নেটওয়ার্কের প্রতিটি স্তরটি কেবল অন্য লজিস্টিক রিগ্রেশন, তবে কীভাবে এটি জিনিসটিকে আরও সঠিক করে তোলে তা তিনি ব্যাখ্যা করেন না। সুতরাং একটি 2 স্তর নেটওয়ার্কে, লজিস্টিক একাধিকবার গণনা কিভাবে এটি …

1
নিষ্কলুষ বেয়াস শ্রেণিবদ্ধ কেন 0-1 লোকসানের জন্য অনুকূল?
নাইভ বেইস শ্রেণিবদ্ধকারীটি শ্রেণিবদ্ধকারী যা ক্লাস-সদস্যতার জন্য উত্তরাধিকারী পি ( সি | এক্স ) সর্বাধিক করার উপর ভিত্তি করে ক্লাস সিতে আইটেম বরাদ্দ করে এবং ধরে নেয় যে আইটেমের বৈশিষ্ট্যগুলি স্বাধীন।xxxCCCP(C|x)P(C|x)P(C|x) 0-1 ক্ষতি হ'ল ক্ষতি যা কোনও মিস-শ্রেণিবিন্যাসকে "1" এর ক্ষতি এবং যে কোনও সঠিক শ্রেণিবিন্যাসের জন্য "0" এর ক্ষতির …

1
অনুশীলনে কেন "স্যাডল-ফ্রি নিউটন" বংশদ্ভুত অ্যালগরিদম ব্যবহার করা হচ্ছে না?
সম্প্রতি আমি ইয়ান ডাউফিন এট আল-র একটি কাগজ পড়েছি। হাই-ডাইমেনশনাল নন-কনভেক্স অপটিমাইজেশনে স্যাডল পয়েন্ট সমস্যার সনাক্তকরণ এবং আক্রমণ করা , যেখানে তারা স্যাডল-ফ্রি নিউটন নামে একটি আকর্ষণীয় বংশদ্ভুত অ্যালগরিদম প্রবর্তন করে , যা ঠিক নিউরাল নেটওয়ার্ক অপ্টিমাইজেশনের জন্য উপযুক্ত বলে মনে হয় এবং স্যাডল পয়েন্টগুলিতে আটকা পড়তে হবে না ভ্যানিলা …

1
জাস্ট-শনাক্তকৃত 2 এসএলএস মিডিয়ান-নিরপেক্ষ?
ইন একটি প্রয়োগবাদী এর কম্প্যানিয়ন: প্রায় নিরীহ অর্থনীতি (Angrist এবং Pischke, 2009: পৃষ্ঠা 209) আমি নিম্নলিখিত পড়ুন: (...) প্রকৃতপক্ষে, সুনির্দিষ্টভাবে চিহ্নিত 2 এসএলএস (বলুন, সহজ ওয়াল্ড অনুমানকারী) প্রায় পক্ষপাতহীন । এটি আনুষ্ঠানিকভাবে দেখা শক্ত কারণ কারণ কেবলমাত্র চিহ্নিত 2 এসএলএসের কোনও মুহুর্ত নেই (অর্থাত, নমুনা বিতরণে ফ্যাট টেইল রয়েছে)। তবুও, …


2
এমন কোনও পরিস্থিতি রয়েছে যেখানে ধাপে ধাপে রিগ্রেশন ব্যবহার করা উচিত?
অতীতে বহু বায়োমেডিকাল কাগজপত্রে স্টেপওয়াইজ রিগ্রেশনকে অতিরিক্ত ব্যবহার করা হয়েছিল তবে এটি এর বিভিন্ন বিষয়গুলির আরও ভাল শিক্ষার সাথে উন্নত হবে বলে মনে হয়। অনেক পুরানো পর্যালোচক অবশ্য এখনও এটি চেয়েছেন। পদক্ষেপের প্রতিরোধের একটি ভূমিকা আছে এবং যদি তা ব্যবহার করা উচিত তবে কী কী পরিস্থিতিতে আছে ?

1
মডেলটি সত্য না হলেও এমএলই অনুমানটি কি অ্যাসিম্পোটোটিকভাবে স্বাভাবিক এবং দক্ষ?
জায়গা: এটি একটি বোকা প্রশ্ন হতে পারে। আমি কেবল এমএলই অ্যাসিপটোটিক বৈশিষ্ট্য সম্পর্কে বিবৃতি জানি, তবে আমি কখনই তার প্রমাণগুলি অধ্যয়ন করি নি। যদি আমি তা করি, তবে আমি এই প্রশ্নগুলি জিজ্ঞাসা করব না, বা আমি বুঝতে পারি যে এই প্রশ্নগুলির কোনও অর্থ হয় না ... তাই দয়া করে আমার …

1
রিজ রিগ্রেশনের এআইসি: প্যারামিটারের সংখ্যা ও স্বাধীনতার ডিগ্রি
আমি একটি রিজ রিগ্রেশন মডেলের AICc গণনা করতে চাই। সমস্যাটি পরামিতিগুলির সংখ্যা of লিনিয়ার রিগ্রেশনের জন্য, বেশিরভাগ লোকেরা পরামর্শ দেন যে পরামিতিগুলির সংখ্যা অনুমান সহগের সংখ্যা সিগমা (ত্রুটির প্রকরণ) এর সমান। যখন রিজ রিগ্রেশনটির কথা আসে তখন আমি পড়লাম যে টুপি ম্যাট্রিক্সের ট্রেস - স্বাধীনতার ডিগ্রি (ডিএফ) - এআইসি সূত্রে …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.