পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
আমার কি ব্রিটিশ ইংরেজিতে "নরমাল ডিস্ট্রিবিউশন" তে "এন" কে মূলধন করা উচিত?
এই প্রশ্নটি কিছুটা বাম-ক্ষেত্র, তবে আমি অনুভব করেছি যে এখানে সম্প্রদায়ের সম্ভবত এই বিষয়ে দৃ strong় মতামত রয়েছে! আমি আমার পিএইচডি থিসিস লিখছি। ধারাবাহিকভাবে, গৌসীয় বিতরণের সাথে আনুষ্ঠানিকভাবে সম্পর্কিত পরিমাণগুলির বিষয়ে কথা বলার সময়, আমি তাদের উল্লেখ করার জন্য "নরমাল" এ "এন" কে মূলধন করেছিলাম। উদাহরণস্বরূপ, "[... এইরকম পরিস্থিতিতে] ফলাফল …

1
ব্রিজ পেনাল্টি বনাম ইলাস্টিক নেট নিয়মিতকরণ
কিছু শাস্তি ফাংশন এবং অনুমান ভাল যেমন Lasso (যেমন চর্চিত হয়, L1L1L_1 ) এবং রিজ ( ) এবং কিভাবে এইসব রিগ্রেশনে তুলনা করুন।L2L2L_2 আমি ব্রিজ পেনাল্টি সম্পর্কে পড়ছি, যা the জেনারেলাইজড পেনাল্টি। এটিকে লাসো-এর সাথে তুলনা করুন, যার এবং রিজকে, সাথে তুলনা করুন, যাতে তাদের বিশেষ কেস তৈরি করে।∑∥βj∥γ∑‖βj‖γ\sum \|\beta_{j}\|^{\gamma}γ=1γ=1\gamma …

1
পারস্পরিক সম্পর্ককে দূরত্বের মেট্রিক হিসাবে ব্যবহার করুন (শ্রেণিবিন্যাসের ক্লাস্টারিংয়ের জন্য)
আমি আমার ডেটা হায়ারার্কিকভাবে ক্লাস্টার করতে চাই, তবে ইউক্লিডিয়ান দূরত্ব ব্যবহার না করে, আমি পারস্পরিক সম্পর্ক ব্যবহার করতে চাই। এছাড়াও, যেহেতু আমার গবেষণায় -1 এবং 1 উভয় "সহ-নিয়ন্ত্রণ" নির্দেশ করে সহ-সম্পর্কিত সহগের সীমা -1 থেকে 1, সুতরাং আমি -1 এবং 1 উভয়কে ডি = 0 হিসাবে গণ্য করছি। সুতরাং আমার …

2
ভবিষ্যদ্বাণীমূলক অনুক্রমের জন্য নন-বায়েশিয়ান পদ্ধতিগুলি কী কী?
বায়সিয়ান ইনফারেন্সনে ভবিষ্যতের ডেটাগুলির জন্য একটি ভবিষ্যদ্বাণীমূলক বিতরণ অজানা প্যারামিটারগুলি সংহত করে উদ্ভূত হয়; এই প্যারামিটারগুলির উত্তরোত্তর বিতরণকে সংহত করার পরে একটি পূর্ববর্তী ভবিষ্যদ্বাণীমূলক বিতরণ দেয় already যা ইতিমধ্যে পর্যবেক্ষণ করা হয়েছে তাদের ভবিষ্যতের ডেটা শর্তাধীন। ভবিষ্যদ্বাণীমূলক অনুমানের জন্য বেইসিয়ান-এর কোন পদ্ধতি নেই যা প্যারামিটারের অনুমানগুলিতে অনিশ্চয়তা বিবেচনা করে (অর্থাত্ …

2
কনভোলশনাল নিউরাল নেটওয়ার্ক হাইপারপ্যারামিটারগুলি নির্বাচনের নিয়ম
ফিল্টারগুলির জন্য মাত্রা বাছাই, ইউনিটগুলিতে পুলিং এবং কনভোলজিকাল স্তরগুলির সংখ্যা নির্ধারণের কিছু পদ্ধতিগত উপায় রয়েছে এমন কোনও ভাল কাগজপত্র রয়েছে কি?

2
ন্যূনতম স্কোয়ারগুলি রিগ্রেশন ধাপে ধাপে লিনিয়ার বীজগণিত গণনা
আর-তে লিনিয়ার-মিশ্র মডেলগুলি সম্পর্কে একটি প্রশ্নের পূর্ববর্তী হিসাবে এবং প্রাথমিক / মধ্যবর্তী পরিসংখ্যান আফিকোনাডোর জন্য একটি রেফারেন্স হিসাবে ভাগ করার জন্য, আমি "ম্যানুয়াল" গণনার সাথে জড়িত পদক্ষেপগুলিকে একটি স্বাধীন "প্রশ্নোত্তর ও এ-স্টাইল" হিসাবে পোস্ট করার সিদ্ধান্ত নিয়েছি একটি সাধারণ রৈখিক প্রতিরোধের সহগ এবং পূর্বাভাসিত মান। উদাহরণটি আর-ইন-বিল্ট ডেটাসেটের সাথে রয়েছে, …

1
সঠিক স্কোরিং নিয়মের মধ্যে নির্বাচন করা
সঠিক স্কোরিং নিয়মের বেশিরভাগ সংস্থানগুলিতে লগ-ক্ষতি, বেরিয়ার স্কোর বা গোলাকৃতির স্কোরিংয়ের মতো বিভিন্ন স্কোরিং নিয়মের উল্লেখ রয়েছে। তবে তারা প্রায়শই তাদের মধ্যে পার্থক্য সম্পর্কে খুব বেশি দিকনির্দেশনা দেয় না। (প্রদর্শনী এ: উইকিপিডিয়া ।) লগারিদমিক স্কোরকে সর্বাধিক করে তোলে এমন মডেলটি বাছাই করা সর্বাধিক সম্ভাবনার মডেল বাছাইয়ের সাথে মিলে যায়, যা …

2
কাঁচুমাচু বনাম পক্ষপাতিত্বহীন : এর estimators
পিয়ারসন পারস্পরিক সম্পর্ক সহগের জনসংখ্যার মূল্য সম্পর্কে দুই ধরণের অনুমানকারী সম্পর্কে আমার মাথায় কিছুটা বিভ্রান্তি দেখা দিয়েছে। উ: ফিশার (1915) দেখিয়েছেন যে bivariate স্বাভাবিক জনসংখ্যা গবেষণামূলক জন্য একটি হল নেতিবাচকভাবে পক্ষপাতমূলক এর মূল্নির্ধারক , যদিও পক্ষপাত শুধুমাত্র ছোট নমুনা আকার (বাস্তবে যথেষ্ট পরিমাণ হতে পারে )। নমুনা underestimates অর্থে এটা …

4
आकस्मिक টেবিলগুলির জন্য সেরা ভিজ্যুয়ালাইজেশন কোনটি?
কোন এককটিজেন্সি টেবিলটি দেখানোর জন্য পরিসংখ্যানগত দিক থেকে সেরা চক্রান্ত কোনটি , যা সাধারণত চি-স্কোয়ার পরীক্ষা দ্বারা বিশ্লেষণ করা হয়? এটি কি ডজড বারপ্লট, স্ট্যাকড বারপ্লট, হিটম্যাপ, কনট্যুর প্লট, জিটারড স্ক্রেটারপ্লট, একাধিক লাইনের প্লট বা অন্য কিছু? কারও কি পরম মান বা শতাংশ দেখাতে হবে? সম্পাদনা করুন: বা @ ফোরকাস্টার …

2
"হ্রাস-র‌্যাঙ্কের রিগ্রেশন" কী?
আমি স্ট্যাটিস্টিকাল লার্নিং এর উপাদানগুলি পড়ছি এবং আমি বুঝতে পারি না যে বিভাগ 3.7 "একাধিক ফলাফল সংকোচন এবং নির্বাচন" কী is এটি আরআরআর (হ্রাস-র‌্যাঙ্কের রিগ্রেশন) সম্পর্কে আলোচনা করে, এবং আমি কেবল বুঝতে পারি যে ভিত্তিটি একটি সাধারণীকৃত মাল্টিভারিয়েট লিনিয়ার মডেল সম্পর্কে যেখানে সহগগুলি অজানা (এবং অনুমান করা যায়) তবে তার …

1
যদি মাত্রাগুলির সংখ্যা হয় তবে
পিসিএ সালে যখন এর মাত্রা সংখ্যা চেয়ে বড় (অথবা এমনকি সমান করার জন্য) নমুনা সংখ্যা কেন যেগুলি আপনি থাকতে হবে নন-জিরো eigenvectors? অন্য কথায়, ডের ডাইমেনশনের মধ্যে কোভেরিয়েন্স ম্যাট্রিক্সের র‌্যাঙ্কটি ।dddNNNN−1N−1N-1d≥Nd≥Nd\ge NN−1N−1N-1 উদাহরণ: আপনার নমুনাগুলি ভেক্টরাইজড ইমেজ, যা ডাইমেনশন , , তবে আপনার কেবল চিত্র রয়েছে।d=640×480=307200d=640×480=307200d = 640\times480 = 307\,200N=10N=10N=10

6
অ্যাডভান্সড রিগ্রেশন মডেলিংয়ের উদাহরণ
আমি জিএলএম বা ওএলএস ব্যবহার করে জটিল, একাধিক অ-রৈখিক সম্পর্ককে মডেল করার প্রয়োজনীয় পদক্ষেপগুলি চিত্রিত করে একটি উন্নত লিনিয়ার রিগ্রেশন কেস স্টাডি খুঁজছি। প্রাথমিক বিদ্যালয়ের উদাহরণগুলির বাইরে যে সম্পদগুলি পাওয়া যায় তা অবাক করা কঠিন: আমি যে বইগুলি পড়েছি সেগুলির বেশিরভাগই কোনও ভবিষ্যদ্বাণীকারীর বক্সকক্সের সাথে মিলিত প্রতিক্রিয়াটির লগ রূপান্তর বা …

2
প্রদত্ত নমুনা কোভেরিয়েন্স ম্যাট্রিক্স সহ ডেটা তৈরি করা
একটি কোভেরিয়েন্স ম্যাট্রিক্স ΣগুলিΣs\boldsymbol \Sigma_s , কীভাবে এমন ডেটা তৈরি করা যায় যাতে এতে নমুনা কোভারিয়েন্স ম্যাট্রিক্স Σ^= ΣগুলিΣ^=Σs\hat{\boldsymbol \Sigma} = \boldsymbol \Sigma_s ? আরও সাধারণভাবে: আমরা প্রায়শই ঘনত্বের ফ (x \ উল্ট \ বোল্ডসিম্বল \ থিতা) থেকে ডেটা উত্পন্ন করতে আগ্রহী চ( x | θ )f(x|θ) f(x \vert \boldsymbol\theta) …

3
ঘনত্বের অনুমানের জন্য কি কোনও বায়েশিয়ান পদ্ধতি রয়েছে?
আমি ক্রমাগত র্যান্ডম ভেরিয়েবল ঘনত্ব অনুমান করতে আগ্রহী । আমি শিখেছি এটি করার একটি উপায় হ'ল কার্নেল ঘনত্ব অনুমানের ব্যবহার।XXX তবে এখন আমি নীচের লাইনের পাশাপাশি একটি বায়েশিয়ান পদ্ধতির প্রতি আগ্রহী আমি প্রাথমিকভাবে বিশ্বাস করি যে একটি বিতরণ অনুসরণ করে । আমি রিডিং নিই । আমার নতুন পঠনের উপর ভিত্তি …

3
আমি এলোমেলো প্রভাবগুলিতে (বা পুনরাবৃত্তি ব্যবস্থা) কীভাবে একটি র্যান্ডমফোরস্টে অন্তর্ভুক্ত করব
আমি এমনকি নিশ্চিত নই যে প্রশ্নটি বেশি অর্থবোধ করে, তবে আমি মনে করি যে আমি বেশ কয়েকটি কাগজপত্র দেখেছি যেখানে তারা এলোমেলো প্রভাব সহ এলোমেলো বন প্রস্তাব করেছিল। এটি কি আর-তে সম্ভব?

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.