পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

1
কীভাবে এসভিএমস = টেমপ্লেট মিলছে?
আমি এসভিএম সম্পর্কে পড়েছি এবং শিখেছি যে তারা একটি অপ্টিমাইজেশান সমস্যা সমাধান করছে এবং সর্বাধিক মার্জিন ধারণাটি খুব যুক্তিসঙ্গত ছিল। এখন, কার্নেলগুলি ব্যবহার করে তারা এমনকি অ-রৈখিক বিভাজন সীমানাও খুঁজে পেতে পারে যা দুর্দান্ত ছিল। এখনও অবধি, আমার কী ধারণা নেই যে এসভিএম (একটি বিশেষ কার্নেল মেশিন) এবং কার্নেল মেশিনগুলি …

1
কে-অর্থ: ব্যবহারিক পরিস্থিতিতে কতটি পুনরাবৃত্তি?
ডেটা মাইনিং বা বড় ডেটাতে আমার শিল্পের অভিজ্ঞতা নেই তাই আপনাকে কিছু অভিজ্ঞতা ভাগ করে নিতে শুনে ভালো লাগবে। লোকেরা কি আসলেই বড়-বড় ডেটাসেটে কে-মানে, প্যাম, ক্লারা ইত্যাদি চালায়? অথবা তারা এলোমেলোভাবে এটি থেকে একটি নমুনা বাছাই করে? যদি তারা কেবল ডেটাসেটের একটি নমুনা নেন, তবে ডাটাসেটটি সাধারণত বিতরণ না …

1
ভবিষ্যদ্বাণীটির জন্য এলোমেলো প্রভাবগুলি বাদ দিয়ে কেন আপনি একটি মিশ্র প্রভাব মডেল থেকে ভবিষ্যদ্বাণী করবেন?
এটি একটি ধারণাগত প্রশ্ন বেশি, তবে আমি ব্যবহার Rকরার সাথে সাথে প্যাকেজগুলিকে উল্লেখ করব R। যদি ভবিষ্যদ্বাণী করার উদ্দেশ্যে লিনিয়ার মডেলটি ফিট করার লক্ষ্য থাকে এবং তারপরে এমন ভবিষ্যদ্বাণী করা যায় যেখানে এলোমেলো প্রভাবগুলি পাওয়া যায় না, তবে কোনও মিশ্র প্রভাবগুলির মডেল ব্যবহারের কোনও সুবিধা আছে কি, বা পরিবর্তে একটি …

3
কেন হ্যামিলটোনীয় গতিবিদ্যা এমসিএমসিতে কিছু ক্ষেত্রে র্যান্ডম ওয়াক প্রস্তাবের চেয়ে ভাল?
হ্যামিলটোনীয় গতিশীলতা কিছু ক্ষেত্রে মেট্রোপলিস অ্যালগরিদমের এলোমেলো হাঁটার চেয়ে সর্বদা পারফর্ম করে। কেউ কি খুব বেশি গণিত ছাড়াই সাধারণ শব্দ দিয়ে কারণ ব্যাখ্যা করতে পারেন?
10 mcmc 

2
অ্যাডজাস্টেড র্যান্ড ইনডেক্স বনাম অ্যাডজাস্টেড মিউচুয়াল ইনফরমেশন
আমি ক্লাস্টারিং কর্মক্ষমতা মূল্যায়ন করার চেষ্টা করছি। আমি মেট্রিকগুলিতে স্কিসিট-লার ডকুমেন্টেশন পড়ছিলাম । আমি এআরআই এবং এএমআইয়ের মধ্যে পার্থক্য বুঝতে পারি না। আমার কাছে মনে হয় তারা একই কাজ দুটি ভিন্ন উপায়ে করে। ডকুমেন্টেশন থেকে উদ্ধৃত: গ্রাউন্ড ট্রুথ ক্লাস অ্যাসাইনমেন্ট লেবেল_ট্রু এবং একই নমুনার লেবেল_প্রেডের আমাদের ক্লাস্টারিং অ্যালগরিদম অ্যাসাইনমেন্টের জ্ঞান …

3
শব্দার্থক বিভাজন জন্য ক্ষয় ফাংশন
প্রযুক্তিগত পদগুলির অপব্যবহারের জন্য আবেদন করে। আমি কনভ্যুশনাল নিউরাল নেটওয়ার্কের (সিএনএন) মাধ্যমে শব্দার্থ বিভাগের প্রকল্পে কাজ করছি; এনকোডার-ডিকোডার প্রকারের একটি আর্কিটেকচার বাস্তবায়নের চেষ্টা করছে, সুতরাং আউটপুটটি ইনপুটটির সমান আকার। আপনি কীভাবে লেবেলগুলি ডিজাইন করেন? কোন ক্ষতির ফাংশন প্রয়োগ করা উচিত? বিশেষত ভারী শ্রেণীর ভারসাম্যহীন অবস্থায় (তবে ক্লাসগুলির মধ্যে অনুপাতটি চিত্র …

2
সাধারণ এবং দ্বিপদী মডেলগুলিতে, সর্বদা পূর্বের বৈকল্পিকের তুলনায় উত্তর বৈকল্পিক কম হয়?
বা কি পরিস্থিতিতে গ্যারান্টি দেয়? সাধারণভাবে (এবং কেবলমাত্র সাধারণ এবং দ্বিপদী মডেলই নয়) আমি মনে করি যে এই দাবিটি ভেঙে যাওয়ার মূল কারণটি হল যে স্যাম্পলিং মডেল এবং পূর্ববর্তীগুলির মধ্যে অসঙ্গতি রয়েছে, তবে আর কী? আমি এই বিষয়টি দিয়ে শুরু করছি, তাই আমি সহজ উদাহরণগুলির পক্ষে সত্যই প্রশংসা করি

1
রিগ্রেশন মডেলগুলিতে বাম-হাত এবং ডানদিকে নামকরণ
y=β0+β1x1+ε0y=β0+β1x1+ε0y = \beta_{0} + \beta_{1}x_{1} + \varepsilon_{0} রিগ্রেশন মডেলগুলি বর্ণনার ভাষা যেমন উপরে বর্ণিত খুব সাধারণ লিনিয়ার রিগ্রেশন প্রায়শই পরিবর্তিত হয় এবং এই ধরনের প্রকরণগুলি প্রায়শই অর্থের সাথে সূক্ষ্ম শিফট বহন করে। উদাহরণস্বরূপ, সমীকরণের বাম দিকে মডেলটির অংশটি বন্ধনীগুলিতে অর্থ এবং স্বরলিপি সহ (অন্যদের মধ্যে আমি অজ্ঞ নই) বলা যেতে …

1
এল 2 নিয়মিতকরণের সাথে আরএনএন শেখা বন্ধ করে দেয়
ভারসাম্যহীন ঘটনার কোনও ইভেন্ট সনাক্ত করতে আমি দ্বি নির্দেশমূলক আরএনএন ব্যবহার করি। Theণাত্মক শ্রেণীর চেয়ে ধনাত্মক শ্রেণি প্রায় 100 গুণ কম is কোনও নিয়মিতকরণ ব্যবহার না করা অবস্থায় আমি ট্রেনের সেটটিতে 100% এবং বৈধতা সেটটিতে 30% নির্ভুলতা পেতে পারি। আমি l2 নিয়মিতকরণ চালু করি এবং ফলাফলটি দীর্ঘতর শেখার পরিবর্তে ট্রেনের …

2
মার্কভ চেইনের জন্য কেন্দ্রীয় সীমাবদ্ধ উপপাদ্য
\newcommand{\E}{\mathbb{E}}ম্যাথবিবি {ই}} \ নিউ কম্যান্ড \} পি} {\ ম্যাথবিবি {পি}\newcommand{\P}{\mathbb{P}} states কেন্দ্রীয় সীমাবদ্ধ উপপাদ্য (সিএলটি) বলে যে এক্স1,এক্স2, …এক্স1,এক্স2,...X_1,X_2,\dots স্বাধীন এবং অভিন্নভাবে বিতরণ করা হয়েছে (আইআইডি) ই [এক্সআমি] = 0ই[এক্সআমি]=0\E[X_i]=0 এবং var(এক্সআমি) &lt; ∞var⁡(এক্সআমি)&lt;∞\operatorname{ Var} (X_i)<\infty , যোগফলটি একটি সাধারণ বন্টনে n \ থেকে \ infty হিসাবে রূপান্তর করে n …

1
জটিল বিশ্লেষণ, গভীর বোঝার জন্য মেশিন লার্নিংয়ের কার্যকরী বিশ্লেষণ
আমি মেশিন লার্নিংয়ের (গভীরে তত্ত্ব এবং প্রয়োগের) আরও গভীর হতে চাই। আমি জানতে চাই মেশিন লার্নিংয়ের ভিত্তি হিসাবে জটিল বিশ্লেষণ এবং কার্যকরী বিশ্লেষণ কতটা প্রাসঙ্গিক ? আমার কি এই বিষয়গুলি শেখার দরকার আছে বা অন্য বিষয়গুলিতে নিজেকে কেন্দ্রীভূত করা উচিত (যদি তাই হয় তবে কোনটি?)

3
ন্যূনতম, গড় এবং সর্বোচ্চ থেকে বিতরণ গণনা করা হচ্ছে
ধরা যাক, আমার কাছে ন্যূনতম, গড় এবং সর্বোচ্চ কিছু ডেটা সেট রয়েছে, বলুন, 10, 20 এবং 25। এই ডেটা থেকে একটি বিতরণ তৈরি করুন, এবং জনসংখ্যার কত শতাংশ সম্ভবত গড়ের উপরে বা নীচে রয়েছে তা জেনে নিন সম্পাদনা: গ্লেনের পরামর্শ অনুসারে, ধরুন আমাদের একটি 200 আকারের নমুনা রয়েছে।

4
1 মান থেকে বীজ এন স্বতন্ত্র এলোমেলো সংখ্যা জেনারেটর সেরা উপায়
আমার প্রোগ্রামে আমার প্রতিটি নিজস্ব আরএনজি দিয়ে এন আলাদা আলাদা থ্রেড চালানো দরকার যা বড় ডেটাসেটের নমুনার জন্য ব্যবহৃত হয়। আমার এই পুরো প্রক্রিয়াটি একটি একক মান দিয়ে বীজ করতে সক্ষম হওয়া দরকার যাতে আমি ফলাফলগুলি পুনরুত্পাদন করতে পারি। প্রতিটি সূচকের জন্য কেবল ক্রমানুসারে বীজ বাড়ানো কি যথেষ্ট? বর্তমানে আমি …

2
সম্ভাবনার ঘনঘনবাদী সংজ্ঞা; একটি আনুষ্ঠানিক সংজ্ঞা আছে?
ঘনত্ববিদরা '' সম্ভাবনা '' এর অধীনে কী বোঝেন তার কোনও আনুষ্ঠানিক (গাণিতিক) সংজ্ঞা আছে? আমি পড়েছি এটি দীর্ঘমেয়াদে '' ঘটনার আপেক্ষিক ফ্রিকোয়েন্সি '' তবে এটি সংজ্ঞায়নের কোনও আনুষ্ঠানিক উপায় আছে কি? এমন কোনও উল্লেখ আছে যেখানে আমি সেই সংজ্ঞাটি পেতে পারি? সম্পাদনা করুন: ঘন ঘন বিশেষজ্ঞের সাথে (@ ভোবারের মন্তব্য …

2
প্যারামেট্রিক মডেলগুলিতে আনুপাতিক বিপদ অনুমানের পরীক্ষা করা
আমি কক্স পিএইচ মডেলগুলির প্রসঙ্গে আনুপাতিক বিপদ অনুমানের পরীক্ষা করার বিষয়ে সচেতন, কিন্তু প্যারামেট্রিক মডেলগুলির সাথে আমার কোনও কিছুর মুখোমুখি হয়নি? নির্দিষ্ট প্যারামেট্রিক মডেলগুলির পিএইচ অনুমান পরীক্ষা করার জন্য কি কোনও সম্ভাব্য উপায় আছে? দেখে মনে হচ্ছে যে এখানে দেওয়া উচিত যে প্যারামেট্রিক মডেলগুলি আধা-প্যারামেট্রিক কক্স মডেলগুলির চেয়ে কিছুটা আলাদা? …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.