পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

3
কে-ফোল্ড বনাম মন্টি কার্লো ক্রস-বৈধকরণ
আমি মূলত তত্ত্বাবধানে মাল্টিভারিয়েট বিশ্লেষণ কৌশলগুলিতে প্রয়োগ করার অভিপ্রায় সহ বিভিন্ন ক্রস বৈধকরণের পদ্ধতিগুলি শেখার চেষ্টা করছি। দু'টি আমি এসেছি হ'ল কে-ফোল্ড এবং মন্টি কার্লো ক্রস-বৈধকরণের কৌশল। আমি পড়েছি যে মন্টে কার্লোতে কে-ফোল্ড একটি ভিন্নতা তবে আমি নিশ্চিত নই যে মন্টে কার্লোয়ের সংজ্ঞাটি কীভাবে তৈরি করে তা আমি পুরোপুরি বুঝতে …

2
কীভাবে পরিসংখ্যানগতভাবে মেশিন লার্নিং ক্লাসিফায়ারগুলির পারফরম্যান্সের তুলনা করবেন?
আনুমানিক শ্রেণিবদ্ধকরণ নির্ভুলতার ভিত্তিতে, আমি পরীক্ষা করতে চাই যে কোনও শ্রেণিবদ্ধকারী অন্য শ্রেণিবদ্ধের তুলনায় বেস সেটে পরিসংখ্যানগতভাবে আরও ভাল কিনা। প্রতিটি শ্রেণিবদ্ধের জন্য, আমি বেস সেট থেকে এলোমেলোভাবে একটি প্রশিক্ষণ এবং পরীক্ষার নমুনা নির্বাচন করি, মডেলকে প্রশিক্ষণ দিয়েছি এবং মডেলটি পরীক্ষা করি। আমি প্রতিটি শ্রেণিবদ্ধের জন্য দশ বার এটি করি। …

2
কার্নেল ঘনত্বের অনুমানকারীগুলির জন্য একটি ব্যান্ডউইথ নির্বাচন করা
অবিভাজনীয় কার্নেল ঘনত্বের অনুমানের জন্য (কেডিএ), আমি গণনার জন্য সিলভারম্যানের নিয়মটি ব্যবহার করি :জজh 0.9 মিনিট ( গুলি d), আমিপ্রশ্ন আর / 1.34 ) × n- 0.20.9সর্বনিম্ন(গুলিঘ,আমিপ্রশ্নঃআর/1.34)×এন-0.2\begin{equation} 0.9 \min(sd, IQR/1.34)\times n^{-0.2} \end{equation} মাল্টিভারিয়েট কে.ডি. (একটি সাধারণ কার্নেল ধরে নিলে) এর মানক বিধিগুলি কি?

4
অ্যান্ড্রু এনজি কেন পিসিএ করার জন্য এসভিডি এবং কোভারিয়েন্স ম্যাট্রিক্সের ইআইজি নয়?
আমি অ্যান্ড্রু এনজির কোরাসেরা কোর্স এবং অন্যান্য উপকরণ থেকে পিসিএ অধ্যয়ন করছি। স্ট্যানফোর্ড এনএলপি কোর্সে CS224n এর প্রথম অ্যাসাইনমেন্ট এবং অ্যান্ড্রু এনগের বক্তৃতার ভিডিওতে তারা কোভরিয়েন্স ম্যাট্রিক্সের ইগেনভেেক্টর পচানোর পরিবর্তে একক মানের মূল্য পচন করে এবং এনজিও বলেছে যে এসভিডি ইজেনডিকোপজিশনের চেয়ে সংখ্যাগতভাবে আরও স্থিতিশীল। আমার বোঝার থেকে, পিসিএ আমরা …

4
লজিস্টিক রিগ্রেশন থেকে কীভাবে ব্যয় হয় তা ব্যয় করা হয়
আমি কোর্সেরাতে মেশিন লার্নিং স্ট্যানফোর্ড কোর্স করছি। লজিস্টিক রিগ্রেশন সম্পর্কিত অধ্যায়ে, ব্যয় কার্যকারিতাটি হ'ল: তারপরে, এটি এখানে উদ্ভূত: আমি ব্যয় ফাংশনের ডেরাইভেটিভ পাওয়ার চেষ্টা করেছি তবে আমি সম্পূর্ণ আলাদা কিছু পেয়েছি। কীভাবে ডেরাইভেটিভ প্রাপ্ত হয়? মধ্যস্থতাকারী পদক্ষেপগুলি কোনটি?

3
আর: র‌্যান্ডম ফরেস্ট ডায়েসেটে কোনও এনএএন না থাকা সত্ত্বেও "বিদেশী ফাংশন কল" ত্রুটিতে NaN / Inf নিক্ষেপ করছে [বন্ধ]
বন্ধ থাকে। এই প্রশ্নটি অফ-টপিক । এটি বর্তমানে উত্তর গ্রহণ করছে না। এই প্রশ্নটি উন্নত করতে চান? প্রশ্নটি আপডেট করুন যাতে এটি ক্রস ভ্যালিডেটের জন্য অন-বিষয় । 2 বছর আগে বন্ধ । আমি একটি ডেটাসেটের উপরে ক্রস বৈধতাযুক্ত এলোমেলো বন চালানোর জন্য ক্যারেট ব্যবহার করছি। Y পরিবর্তনশীল একটি ফ্যাক্টর। আমার …

1
স্কলারনের শ্রেণিবিন্যাসের রিপোর্টে সংখ্যাগুলি কী বোঝায়?
আমার কাছে স্কেলের্নের স্ক্লার্ন.মেট্রিক্স.ক্লাসিফিকেশন_রপোর্ট ডকুমেন্টেশন থেকে টানা একটি উদাহরণ রয়েছে। আমি যা বুঝতে পারি না কেন প্রতিটি ক্লাসের জন্য কেন এফ 1-স্কোর, যথার্থতা এবং রিক্যাল মান রয়েছে যেখানে আমি বিশ্বাস করি যে ক্লাসটি প্রিডিক্টর লেবেল? আমি ভেবেছিলাম f1 স্কোর আপনাকে মডেলের সামগ্রিক যথার্থতা বলে। এছাড়াও, সমর্থন কলাম আমাদের কী বলে? …

2
কোনও গ্ল্যাম চালানোর সময় ত্রুটি "সিস্টেমটি কম্পিউটেশনালি একবচন"
আমি গ্লোব অনুমান চালাতে রবস্টবেস প্যাকেজটি ব্যবহার করছি । তবে আমি যখন এটি করি তখন আমি নিম্নলিখিত ত্রুটিটি পাই: Error in solve.default(crossprod(X, DiagB * X)/nobs, EEq) : system is computationally singular: reciprocal condition number = 1.66807e-16 এর অর্থ / ইঙ্গিত কী? এবং আমি কীভাবে এটি ডিবাগ করতে পারি? গীত। উত্তর …

3
যে শ্রেণিবদ্ধের চেয়ে বেশি নির্ভুল তার চেয়ে কম নির্ভুল এমন শ্রেণিবদ্ধের জন্য কেন এউসি উচ্চতর?
আমার দুটি ক্লাসিফায়ার আছে উ: নিষ্পাপ বায়েশিয়ান নেটওয়ার্ক বি: ট্রি (এককভাবে সংযুক্ত) বায়েশিয়ান নেটওয়ার্ক নির্ভুলতা এবং অন্যান্য ব্যবস্থার ক্ষেত্রে, এ বিয়ের তুলনায় তুলনামূলকভাবে খারাপ সম্পাদন করে তবে আমি যখন আরওসি বিশ্লেষণ সম্পাদন করতে আর প্যাকেজগুলি আরআরসিআর এবং এউসি ব্যবহার করি তখন দেখা যায় যে এ-এর জন্য এটিসি বি এর জন্য …

4
কীভাবে কেউ একটি বন্টনের অ-অভিন্নতা পরিমাপ করে?
আমি যে পরীক্ষা চালাচ্ছি তার জন্য বিতরণের অ-অভিন্নতা পরিমাপ করার জন্য একটি মেট্রিক নিয়ে আসার চেষ্টা করছি। আমার একটি এলোমেলো পরিবর্তনশীল রয়েছে যা বেশিরভাগ ক্ষেত্রে সমানভাবে বিতরণ করা উচিত এবং আমি ভেরিয়েবলটি কিছু মার্জিনের মধ্যে অভিন্নভাবে বিতরণ না করা তথ্য সেটগুলির উদাহরণগুলি সনাক্ত করতে (এবং সম্ভবত ডিগ্রি পরিমাপ করতে সক্ষম) …

2
স্ট্যাটিস্টিক্স ডট কম কী ভুল উত্তর প্রকাশ করেছে?
পরিসংখ্যান ডটকম সপ্তাহের একটি সমস্যা প্রকাশ করেছে: আবাসিক বীমা জালিয়াতির হার 10% (দশটি দাবির মধ্যে একটি জালিয়াতি)। একজন পরামর্শদাতা দাবি পর্যালোচনা করতে এবং এগুলিকে প্রতারণা বা নন-জালিয়াতি হিসাবে শ্রেণিবদ্ধ করার জন্য একটি মেশিন লার্নিং সিস্টেমের প্রস্তাব দিয়েছেন। জালিয়াতি দাবিগুলি সনাক্ত করতে সিস্টেমটি 90% কার্যকর, তবে নন-জালিয়াতি দাবিগুলি সঠিকভাবে শ্রেণিবদ্ধ করতে …

2
এসভিএম অ্যালগরিদমের পিছনে পরিসংখ্যানের মডেলটি কী?
আমি শিখেছি যে, মডেল-ভিত্তিক পদ্ধতির ব্যবহার করে ডেটা নিয়ে কাজ করার সময়, প্রথম পদক্ষেপটি একটি পরিসংখ্যানের মডেল হিসাবে ডেটা প্রক্রিয়াটিকে মডেলিং করা হয়। তারপরে পরবর্তী পদক্ষেপটি এই পরিসংখ্যানের মডেলের উপর ভিত্তি করে দক্ষ / দ্রুত সূচনা / শেখার অ্যালগরিদম বিকাশ করছে। সুতরাং আমি জিজ্ঞাসা করতে চাই কোন সমর্থন সংক্রান্ত ভেক্টর …

3
মস্তিষ্ক-টিজার: ইউনিফর্মের [0,1] বন্টন থেকে আঁকা যখন একরকম বৃদ্ধি হয় এমন একটি আইড ক্রমের প্রত্যাশিত দৈর্ঘ্য কত?
এটি একটি পরিমাণগত বিশ্লেষক পদের জন্য একটি সাক্ষাত্কারের প্রশ্ন, এখানে রিপোর্ট করা হয়েছে । মনে করুন আমরা একটি ইউনিফর্ম বিতরণ থেকে আঁকছি এবং অঙ্কনগুলি আইড হয়, একঘেয়েভাবে বর্ধনশীল বিতরণের প্রত্যাশিত দৈর্ঘ্য কত? অর্থাৎ, বর্তমান অঙ্কনটি পূর্ববর্তী অঙ্কনের চেয়ে ছোট বা সমান হলে আমরা অঙ্কন বন্ধ করি।[0,1][0,1][0,1] আমি প্রথম কয়েকটি পেয়েছি: …

1
অর্ডিনাল বা বাইনারি ডেটার জন্য ফ্যাক্টর বিশ্লেষণ বা পিসিএ আছে?
আমি অবিচ্ছিন্ন হিসাবে প্রধান উপাদান উপাদান বিশ্লেষণ (পিসিএ), অনুসন্ধানের ফ্যাক্টর বিশ্লেষণ (ইএফএ) এবং কনফার্মেটরি ফ্যাক্টর অ্যানালাইসিস (সিএফএ) সম্পন্ন করেছি পরিবর্তনশীল। তারপরে, লাভায়ান ব্যবহার করে, আমি সিএফএর পুনরাবৃত্তিটি ভেরিয়েবলগুলি শ্রেণীবদ্ধ হিসাবে সংজ্ঞায়িত করেছি। আমি জানতে চাই কী ধরণের বিশ্লেষণগুলি উপযুক্ত হবে এবং পিসিএ এবং ইএফএ এর সমতুল্য হবে যখন ডেটা প্রকৃতির …

3
সাধারণত দুটি বিতরণযোগ্য ভেরিয়েবলগুলির মিশ্রণ কেন কেবল বিমোডাল হয় যদি তাদের স্ট্যান্ডার্ড বিচ্যুতির কমপক্ষে দুই গুণ পৃথক পৃথক হয়?
দুটি সাধারণ বিতরণের মিশ্রণে: https://en.wikipedia.org/wiki/Multimodal_distribution#Mixture_of_two_normal_distributions "দুটি সাধারণ বিতরণের মিশ্রণটির অনুমানের জন্য পাঁচটি প্যারামিটার রয়েছে: দুটি উপায়, দুটি বৈকল্পিক এবং মিশ্রণ পরামিতি standard সমমানের আদর্শ বিচ্যুতির সাথে দুটি সাধারণ বিতরণের মিশ্রণ কেবল তখনই বিমোডাল হয় যদি সাধারণ মানের বিচ্যুতির চেয়ে কমপক্ষে দ্বিগুণ হয়ে থাকে তবে তাদের উপায় পৃথক হয় im । …
28 bimodal 

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.