পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

1
গড় এবং প্রান্তিক চিকিত্সার প্রভাবের মধ্যে পার্থক্য
আমি কিছু কাগজপত্র পড়ছি, এবং গড় চিকিত্সা প্রভাব (এটিই) এবং প্রান্তিক চিকিত্সা প্রভাব (এমটিই) এর নির্দিষ্ট সংজ্ঞা সম্পর্কে আমি অস্পষ্ট। তারা কি একই? অস্টিনের মতে ... একটি শর্তসাপেক্ষ প্রভাবটি সাবজেক্টটি ট্রিটমেন্ট থেকে চিকিত্সা থেকে সরানোর বিষয়ে বিষয় পর্যায়ে গড় প্রভাব average একটি মাল্টিভেরিয়েবল রিগ্রেশন মডেল থেকে চিকিত্সা অ্যাসাইনমেন্ট ইন্ডিকেটর ভেরিয়েবলের …

3
গভীর নিউরাল নেটওয়ার্কগুলি - কেবল চিত্র শ্রেণিবদ্ধের জন্য?
গভীর বিশ্বাস বা কনভোলশনাল নিউরাল নেটওয়ার্কগুলি ব্যবহার করে আমি যে সমস্ত উদাহরণ পেয়েছি সেগুলি তাদের চিত্রের শ্রেণিবদ্ধকরণ, চ্যাট্যাক্টর সনাক্তকরণ বা বক্তৃতা স্বীকৃতির জন্য ব্যবহার করে। উচ্চতর নিউরাল নেটওয়ার্কগুলি কি ধ্রুপদী পুনর্বিবেচনামূলক কাজের জন্যও কার্যকর, যেখানে বৈশিষ্ট্যগুলি কাঠামোগত নয় (উদাহরণস্বরূপ, ক্রম বা গ্রিডে সাজানো নয়)? যদি হ্যাঁ, আপনি একটি উদাহরণ দিতে …

3
কীভাবে ডেটা বৃদ্ধি এবং ট্রেন-বৈধতা বিভক্ত করা যায়?
আমি মেশিন লার্নিং ব্যবহার করে চিত্রের শ্রেণিবিন্যাস করছি। ধরুন আমার কাছে কিছু প্রশিক্ষণ ডেটা (চিত্র) রয়েছে এবং ডেটাটিকে প্রশিক্ষণ এবং বৈধতা সেটগুলিতে বিভক্ত করব। এবং আমি এলোমেলো ঘোরাঘুরি এবং শব্দ ইঞ্জেকশন দ্বারা ডেটা (মূল চিত্রগুলি থেকে নতুন চিত্রগুলি তৈরি করতে) বৃদ্ধি করতে চাই। অগমেন্টেশনটি অফলাইনে করা হয়। ডেটা বৃদ্ধির সঠিক …

4
আপনি যখন একটি আদর্শ পরীক্ষা তৈরি করতে না পারেন তখন কি করতে হবে তার পাঠ্যপুস্তক / পাঠক?
আমার পরিসংখ্যানগত প্রশিক্ষণ গাণিতিক পরিসংখ্যানগুলিতে নিহিত এবং এই পদ্ধতিগুলিকে আমার এমএসে নেওয়া ক্লাস নেওয়া এই মুহূর্তে কিছুটা ধাক্কা; শিল্পে আমার অভিজ্ঞতা না থাকায় বর্তমানে এই কয়েকটি "প্রয়োগকৃত" পদ্ধতির কিছু বুঝতে সক্ষম হওয়া আমার পক্ষে শক্ত। আমরা আমার পদ্ধতিগুলির ক্লাসে যে বিষয়গুলির বিষয়ে কথা বলছি তার মধ্যে একটি হ'ল পরীক্ষামূলক ডিজাইনের …

1
অসীম মাত্রিক ভিত্তি ফাংশন ভিউয়ের মাধ্যমে গাউসিয়ান প্রক্রিয়া রিগ্রেশন বোঝা
প্রায়শই বলা হয় যে গাউসিয়া প্রক্রিয়া রিগ্রেশন (জিপিআর) বেইসিয়ান লিনিয়ার রিগ্রেশনকে (সম্ভবত) অসীম পরিমাণ ভিত্তির ফাংশনগুলির সাথে সম্পর্কিত করে। আমি জিপিআর ব্যবহার করে কোন ধরণের মডেল প্রকাশ করতে পারি তার একটি অন্তর্দৃষ্টি পেতে আমি এটি বিশদটি বোঝার চেষ্টা করছি। আপনি কি মনে করেন যে জিপিআর বোঝার চেষ্টা করার জন্য এটি …

5
বিশ্লেষণ ব্যাকগ্রাউন্ড ছাড়াই গাণিতিক পরিসংখ্যানের পথ: স্ব অধ্যয়নের জন্য আদর্শ পাঠ্যপুস্তিকা
আমি মোটামুটিভাবে গাণিতিকভাবে ঝুঁকছি - আমার আন্ডারগ্র্যাডে ম্যাথের se টি সেমিস্টার ছিল - যদিও আমি আধ্যাত্মিক ডিফারেনশিয়াল সমীকরণ এবং পথের অবিচ্ছেদ্যতার সাথে ধীরে ধীরে অনুশীলনের বাইরে আছি এবং আমার ধারণাগুলি কিছুটা অনুশীলনের সাথে ফিরে আসে। আমি গাণিতিক প্রমাণ (গাণিতিক চিন্তা) বা বিশ্লেষণের উপর একটি কোর্স করিনি। আমি স্নাতক স্তরের সম্ভাবনাও …

3
কাটা কাটা এসভিডি কম্পিউটিংয়ের জন্য কোন দ্রুত অ্যালগরিদম বিদ্যমান?
সম্ভবত এখানে বিষয়বস্তু বন্ধ, তবে ইতিমধ্যে ইতিমধ্যে বেশ কয়েকটি ( এক , দুটি ) সম্পর্কিত প্রশ্ন রয়েছে। সাহিত্যে (বা কাটা কাটা এসভিডি অ্যালগরিদমগুলির জন্য গুগল অনুসন্ধান) আশেপাশে প্রচুর পরিমাণে কাগজপত্রগুলি ছাঁটাইয়া এসভিডিগুলি বিভিন্ন উপায়ে ব্যবহার করে এবং দাবি করে (হতাশার সাথে, প্রায়শই উদ্ধৃতি ছাড়াই) যে এটির গণনা করার জন্য দ্রুত …

2
ডেটা ট্রান্সফর্মিং: সমস্ত ভেরিয়েবল না কেবল নরমাল?
এসপিএসএস ব্যবহার করে অ্যান্ডি ফিল্ডের আবিষ্কারক পরিসংখ্যানগুলিতে তিনি বলেছেন যে সমস্ত ভেরিয়েবলকে রূপান্তর করতে হবে। তবে প্রকাশনায়: "ভৌগোলিকভাবে ওজনযুক্ত রিগ্রেশন I: মডেল ডিজাইন এবং মূল্যায়ন ব্যবহার করে ভূমি ব্যবহার এবং জলের মানের মধ্যে স্থানিকভাবে পরিবর্তিত সম্পর্কের পরীক্ষা করা" তারা নির্দিষ্টভাবে বলেছে যে কেবলমাত্র নরমাল পরিবর্তনশীল রূপান্তরিত হয়েছিল। এই বিশ্লেষণ নির্দিষ্ট? …

2
পাইথনে ভন মাইজস-ফিশার বিতরণ থেকে নমুনা?
আমি পাইথনের মাল্টিভিয়ারেট ভন মাইজেস-ফিশার বিতরণ থেকে নমুনার একটি সহজ উপায় সন্ধান করছি । আমি স্কিপি এবং নম্পি মডিউলটিতে স্ট্যাটাস মডিউলটি দেখেছি তবে কেবল অদ্বিতীয় ভন মাইজেস বিতরণ পেয়েছি। কোন কোড উপলব্ধ আছে? আমি এখনও পাই না। স্পষ্টতই, উড (1994) এই লিঙ্কটি অনুসারে ভিএমএফ বিতরণ থেকে স্যাম্পলিংয়ের জন্য একটি অ্যালগরিদম …

3
আমি কীভাবে প্রোগ্রামিংয়ে ডেটা সিরিজের বিভিন্ন বিভাগগুলি বিভিন্ন বক্ররেখার সাথে ফিট করতে পারি?
প্রদত্ত ডেটাসেটের বিভাগগুলি আলাদাভাবে ফিট করার জন্য কোনও নথিভুক্ত অ্যালগরিদমগুলি কি সেরা ফিটের বিভিন্ন বক্ররেখাতে আছে? উদাহরণস্বরূপ, বেশিরভাগ মানব ডেটা এই চার্টের দিকে তাকাতে সহজেই এটিকে 3 ভাগে বিভক্ত করতে পারে: একটি সাইনোসয়েডাল বিভাগ, একটি লিনিয়ার অংশ এবং বিপরীত এক্সফোনেনশিয়াল বিভাগ। আসলে, আমি সাইন ওয়েভ, একটি লাইন এবং একটি সাধারণ …

3
কব্জি ক্ষতি বনাম লজিস্টিক ক্ষতির সুবিধা এবং অসুবিধা / সীমাবদ্ধতা
In ক্ষতি সংজ্ঞায়িত করা যায় এবং লগ ক্ষতি loss হিসাবে সংজ্ঞায়িত করা যায়সর্বোচ্চ ( 0 , 1 - y)আমিWটিএক্সআমি)সর্বোচ্চ(0,1-YআমিWটিএক্সআমি)\text{max}(0, 1-y_i\mathbf{w}^T\mathbf{x}_i)লগ ( 1 + এক্সপ্রেস( - y)আমিWটিএক্সআমি) )লগ(1+ +মেপুঃ⁡(-YআমিWটিএক্সআমি))\text{log}(1 + \exp(-y_i\mathbf{w}^T\mathbf{x}_i)) আমার নিম্নলিখিত প্রশ্নগুলি রয়েছে: কবজ ক্ষতির কোনও অসুবিধাগুলি রয়েছে (যেমন http://www.unc.edu/~yfliu/papers/rsvm.pdf এ উল্লিখিত outliers সম্পর্কে সংবেদনশীল )? অন্যটির তুলনায় একজনের …

3
ওএলএসের অনুমানকারীকে অনুমান করার জন্য অনুমান
কেউ কি আমার জন্য সংক্ষেপে ব্যাখ্যা করতে পারেন, কেন ওএলএসের অনুমানকারীকে গণনা করার জন্য ছয়টি অনুমানের প্রতিটি প্রয়োজন? আমি কেবল বহুবিধ লাইনারিটি সম্পর্কেই পেয়েছি it এটি উপস্থিত থাকলে আমরা ম্যাট্রিক্সকে (X'X) বিপরীত করতে পারি না এবং পরিবর্তে সামগ্রিক অনুমানকটি অনুমান করতে পারি। অন্যদের সম্পর্কে কী (যেমন, রৈখিকতা, শূন্যের অর্থ ত্রুটি …

4
নমুনার আকার যখন খুব বড় হয় তখন আত্মবিশ্বাসের ব্যবধানগুলি
আমার প্রশ্নটি "বড় ডেটা ব্যবহার করে কীভাবে নমুনা ত্রুটির মূল্যায়ন করবেন", বিশেষত একটি জার্নাল পাবলিকেশনের জন্য পুনরায় জবাব দেওয়া যেতে পারে। এখানে একটি চ্যালেঞ্জ বর্ণনা করার জন্য একটি উদাহরণ। খুব বড় একটি ডেটাসেট (> 100000 অনন্য রোগী এবং 100 টি হাসপাতাল থেকে তাদের নির্ধারিত ওষুধ) থেকে, আমি নির্দিষ্ট ওষুধ গ্রহণের …

1
মিশ্র প্রভাবগুলি মডেলগুলি নির্ভরতা সমাধান করে কেন?
বলুন যে আমরা কীভাবে শিক্ষার্থীদের পরীক্ষার গ্রেডগুলি ঘন্টার সংখ্যা দ্বারা প্রভাবিত হয় সে বিষয়ে আগ্রহী students এই সম্পর্কটি অন্বেষণ করতে, আমরা নিম্নলিখিত লিনিয়ার রিগ্রেশন চালাতে পারি: exam.gradesআমি= একটি + + β1× ঘন্টা.স্টুডেআমি+ ইআমিexam.gradesআমি=একটি+ +β1×hours.studiedআমি+ +ইআমি \text{exam.grades}_i = a + \beta_1 \times \text{hours.studied}_i + e_i তবে আমরা যদি শিক্ষার্থীদের বেশ কয়েকটি …

1
লেগ ইফেক্ট বাড়াতে কেন কোনও বায়েশিয়ার শ্রেণিবিন্যাসের মডেলটির বিচ্যুতি মানে?
পটভূমি: আমি বর্তমানে বিভিন্ন বায়েশিয়ান শ্রেণিবদ্ধ মডেলের তুলনা করে কিছু কাজ করছি। ডেটা অংশগ্রহনকারী i এবং সময় j এর জন্য মঙ্গলজনক সংখ্যার ব্যবস্থা । আমার প্রায় 1000 অংশগ্রহণকারী এবং প্রতি অংশগ্রহণকারী প্রতি 5 থেকে 10 টি পর্যবেক্ষণ রয়েছে।Yআমি জেYআমিঞy_{ij}আমিআমিiঞঞj বেশিরভাগ দ্রাঘিমাংশীয় ডেটাসেটের মতো, আমিও স্বতঃসম্পর্কতার এমন কিছু রূপ দেখতে প্রত্যাশা …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.