পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

1
হাই-ডাইমেনশনাল রিগ্রেশন: বিশেষ কেন?
আমি উচ্চ-মাত্রিক রিগ্রেশন অঞ্চলে গবেষণাটি পড়তে চেষ্টা করছি; যখন চেয়ে বড় হয়, । মনে হচ্ছে শব্দটি প্রায়শই রিগ্রেশন আনুমানিকের জন্য রূপান্তর হারের ক্ষেত্রে দেখা যায় termsএন পি > > এন লগ পি / এনpppnnnp>>np>>np >> nlogp/nlog⁡p/n\log p/n উদাহরণস্বরূপ, এখানে সমীকরণ (17) বলছে যে লাসো ফিট, সন্তুষ্ট 1β^β^\hat{\beta}1n∥Xβ^−Xβ∥22=OP(σlogpn−−−−−√∥β∥1).1n‖Xβ^−Xβ‖22=OP(σlog⁡pn‖β‖1). \dfrac{1}{n}\|X\hat{\beta} - X …

3
মাল্টি-লেয়ার পারসেপেট্রন বনাম গভীর নিউরাল নেটওয়ার্ক
এটি পরিভাষার প্রশ্ন। কখনও কখনও আমি দেখি লোকেরা গভীর নিউরাল নেটওয়ার্কগুলিকে "মাল্টি-লেয়ার্ড পারসেপ্ট্রনস" হিসাবে উল্লেখ করে, এটি কেন? একটি পেরসেপট্রন, যা আমাকে শেখানো হয়েছিল, এটি একটি একক স্তরের শ্রেণিবদ্ধ (বা রেগ্রসর) বাইনারি থ্রেশহোল্ড আউটপুট সহ ওজন প্রশিক্ষণের নির্দিষ্ট উপায় (ব্যাক-প্রপ নয়) ব্যবহার করে। যদি পেরসেপট্রনের আউটপুট লক্ষ্য আউটপুটটির সাথে মেলে …

2
টাইম সিরিজে হারিয়ে যাওয়া তথ্য কীভাবে পূরণ করবেন?
আমার কাছে দূষণের ডেটাগুলির একটি বিশাল সেট রয়েছে যা 2 বছর ধরে প্রতি 10 মিনিটে রেকর্ড করা হয়, তবে তথ্যগুলিতে অনেকগুলি ফাঁক রয়েছে (কিছু কিছু যা একসাথে কয়েক সপ্তাহের জন্য যায়)। রাতের তুলনায় ডেটাটি বেশ মৌসুমী বলে মনে হয় এবং দিনের বেলাতে একটি বিশাল পার্থক্য রয়েছে যেখানে মানগুলির মধ্যে খুব …

2
মার্কভ চেইন এবং মার্কভ প্রসেসের মধ্যে পার্থক্য কী?
মার্কভ চেইন এবং মার্কভ প্রসেসের মধ্যে পার্থক্য কী? আমি বিবাদমান তথ্য পড়ছি: কখনও কখনও সংজ্ঞাটি রাষ্ট্রের স্থানটি পৃথক বা অবিচ্ছিন্ন কিনা তার উপর ভিত্তি করে তৈরি হয় এবং কখনও কখনও এটি সময়কে অবিচ্ছিন্নভাবে পৃথক করে কিনা তার উপর ভিত্তি করে। এই নথির 20 স্লাইড : রাষ্ট্রের স্থানটি পৃথক, অর্থাত্ সীমাবদ্ধ …

3
বিটা বিতরণ এবং লজিস্টিক রিগ্রেশন মডেলের মধ্যে কী সম্পর্ক?
আমার প্রশ্নটি হল: বিটা বিতরণ এবং লজিস্টিক রিগ্রেশন মডেলের সহগগুলির মধ্যে গাণিতিক সম্পর্ক কী ? উদাহরণস্বরূপ: লজিস্টিক (সিগময়েড) ফাংশন দ্বারা সরবরাহ করা হয়েছে f(x)=11+exp(−x)f(x)=11+exp⁡(−x)f(x) = \frac{1}{1+\exp(-x)} এবং এটি লজিস্টিক রিগ্রেশন মডেলটিতে সম্ভাব্যতা মডেল করতে ব্যবহৃত হয়। যাক AAA একটি dichotomous হতে (0,1)(0,1)(0,1) রান ফলাফল এবং XXX একটি নকশা ম্যাট্রিক্স। লজিস্টিক …

1
একটি সম্ভাব্যতা ঘনত্ব ফাংশন এর ভেরিয়েবল পরিবর্তনের বিকাশ?
বইয়ের প্যাটার্ন স্বীকৃতি এবং মেশিন লার্নিংয়ে (সূত্র 1.27), এটি দেয় py(y)=px(x)∣∣∣dxdy∣∣∣=px(g(y))|g′(y)|py(y)=px(x)|dxdy|=px(g(y))|g′(y)|p_y(y)=p_x(x) \left | \frac{d x}{d y} \right |=p_x(g(y)) | g'(y) | যেখানে , হল সেই পিডিএফ যা ভেরিয়েবলের পরিবর্তনের সাথে সাথে সম্পর্কিত।p x ( x ) p y ( y )x=g(y)x=g(y)x=g(y)px(x)px(x)p_x(x)py(y)py(y)p_y(y) বই বলছেন কারণ যে পর্যবেক্ষণ সীমার মধ্যে পতনশীল এর …

2
আরওসি বক্ররেখার অধীনে যথার্থতা বনাম অঞ্চল
আমি ডায়াগনস্টিক সিস্টেমের জন্য একটি আরওসি বক্ররেখা তৈরি করেছি। বক্ররেখার অধীনে অঞ্চলটি তখন প্যারামিট্রিক্যালি অনুমান করা হয় এটিউসি = 0.89। আমি যখন সর্বোত্তম প্রান্তিক মান (বিন্দু (0, 1) এর নিকটতম বিন্দু) এ নির্ভুলতা গণনা করার চেষ্টা করেছি, তখন ডায়াগনস্টিক সিস্টেমের যথার্থতা 0.8 পেয়েছি, যা এটিসির চেয়ে কম! আমি যখন অন্য …

4
কেন আমরা বলি যে ফলাফল পরিবর্তনশীল ভবিষ্যদ্বাণী (গুলি) উপর "পুনরায় চাপিত হয়"?
এই পরিভাষার জন্য কিছু স্বজ্ঞাত ব্যাখ্যা আছে? কেন এটি এইভাবে হয়, এবং ভবিষ্যদ্বাণী (গুলি) ফলাফলের উপর চাপ দেওয়া হয় না? আদর্শভাবে আমি আশা করছি যে এই পরিভাষাটি কেন বিদ্যমান তার সঠিক ব্যাখ্যা শিক্ষার্থীদের এটি মনে রাখতে সহায়তা করে এবং এটিকে চারপাশে ভুল উপায়ে বলতে বাধা দেয়।

1
আংশিক সর্বনিম্ন বর্গক্ষেত্র, হ্রাস র‌্যাঙ্ক রিগ্রেশন এবং প্রধান উপাদানগুলির রিগ্রেশনগুলির মধ্যে সংযোগ কী?
হ্রাস র‌্যাঙ্কের রিগ্রেশন এবং প্রধান উপাদানগুলির রিগ্রেশন কেবলমাত্র আংশিক ন্যূনতম স্কোয়ারগুলির বিশেষ ক্ষেত্রে? এই টিউটোরিয়াল (পৃষ্ঠা,, "উদ্দেশ্যগুলির তুলনা") বলেছে যে আমরা যখন এক্স বা ওয়াই (যেমন "আংশিক নয়") প্রজেক্ট না করে আংশিক ন্যূনতম স্কোয়ারগুলি করি তখন এটি একইভাবে হ্রাস র‌্যাঙ্ক রিগ্রেশন বা মূল উপাদানগুলির রিগ্রেশন হয়ে যায়। এই এসএএস ডকুমেন্টেশন …


3
সর্বাধিক সম্ভাবনা কখন কাজ করে এবং কখন হয় না?
আমি অঙ্কের তুলনায় উদাহরণস্বরূপ সর্বাধিক সম্ভাবনা পদ্ধতি সম্পর্কে বিভ্রান্ত কখন এবং কেন সুনির্দিষ্ট সম্ভাবনা যেমন গাণিতিক মানে তুলনায় "আরও ভাল" অনুমান উত্পাদন করে? এটি কীভাবে যাচাইযোগ্য?

1
অ-নেতিবাচক শূন্য-স্ফীত ক্রমাগত ডেটা কীভাবে মডেল করবেন?
আমি বর্তমানে family = gaussianজীববৈচিত্রের একটি সূচকে লিনিয়ার মডেল ( ) প্রয়োগ করার চেষ্টা করছি যা শূন্যের চেয়ে কম মান নিতে পারে না, এটি শূন্য-স্ফীত এবং অবিচ্ছিন্ন। মানগুলি 0 থেকে সামান্য 0.25 এর মধ্যে থাকে। ফলস্বরূপ, মডেলটির অবশিষ্টাংশগুলিতে বেশ একটি সুস্পষ্ট নিদর্শন রয়েছে যা আমি মুক্তি পেতে সক্ষম হইনি: কীভাবে …

2
বৈকল্পিকের রৈখিকতা
আমি মনে করি নিম্নলিখিত দুটি সূত্র সত্য: Var(aX)=a2Var(X)Var(aX)=a2Var(X) \mathrm{Var}(aX)=a^2 \mathrm{Var}(X) যখন একটি একটি ধ্রুবক সংখ্যা Var(X+Y)=Var(X)+Var(Y)Var(X+Y)=Var(X)+Var(Y) \mathrm{Var}(X + Y)=\mathrm{Var}(X)+\mathrm{Var}(Y) যদিXXX ,YYY স্বাধীন তবে নীচের সাথে কী ভুল তা আমি নিশ্চিত নই: যা 2 2 V a r ( X ) এর সমান নয়, অর্থাৎ 4 V a r ( এক্স …

3
বৈষম্যমূলক বিশ্লেষণ বনাম লজিস্টিক রিগ্রেশন
আমি বৈষম্যমূলক বিশ্লেষণের কিছু কৌশল পেয়েছি এবং সেগুলি সম্পর্কে আমার কাছে প্রশ্ন রয়েছে। তাই: যখন ক্লাসগুলি ভালভাবে পৃথক করা হয়, লজিস্টিক রিগ্রেশনের জন্য প্যারামিটারের অনুমানগুলি আশ্চর্যজনকভাবে অস্থির হয়। গুণাগুণগুলি অনন্ত যেতে পারে। এলডিএ এই সমস্যায় ভুগছে না। বৈশিষ্ট্যগুলির সংখ্যা যদি ছোট হয় এবং প্রতিটি শ্রেণীর মধ্যে পূর্বাভাসকারীদের বিতরণ প্রায় স্বাভাবিক …


আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.