পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
লজিস্টিক রিগ্রেশন জন্য ম্যাট্রিক্স স্বরলিপি
লিনিয়ার রিগ্রেশন (স্কোয়ার লস) এ, ম্যাট্রিক্স ব্যবহার করে আমাদের উদ্দেশ্যটির জন্য খুব সংক্ষিপ্ত স্বরলিপি রয়েছে minimize ∥Ax−b∥2minimize ‖Ax−b‖2\text{minimize}~~ \|Ax-b\|^2 যেখানে AAA হ'ল ডেটা ম্যাট্রিক্স, xxx হ'ল সহগুণ, এবং bbb এর প্রতিক্রিয়া। লজিস্টিক রিগ্রেশন উদ্দেশ্য জন্য ম্যাট্রিক্স স্বরলিপি আছে কি? আমি যে সমস্ত নোটেশন দেখেছি সেগুলি সমস্ত ডেটা পয়েন্টের সমষ্টি থেকে …

1
কনভ্যুশনাল নেটওয়ার্কে কনভলশন ফিল্টারগুলির সংখ্যার তাত্পর্য কী?
একটি কনভ্যুশন লেয়ারে ফিল্টারগুলির সংখ্যাটি কী বোঝায়? এই সংখ্যাটি কীভাবে স্থাপত্যের কার্য সম্পাদন বা গুণমানকে প্রভাবিত করে? আমি বলতে চাই যে আমাদের কি সর্বদা উচ্চ সংখ্যক ফিল্টার বেছে নেওয়া উচিত? এগুলি কি ভাল? এবং লোকেরা বিভিন্ন স্তরের জন্য ফিল্টারগুলির বিবিধ সংখ্যাকে কীভাবে বরাদ্দ করে? আমি এই প্রশ্নটির দিকে তাকাতে চাইছি: …

2
এলোমেলো বনাঞ্চলের জন্য প্রশিক্ষণের ত্রুটির কোন পরিমাপ?
আমি বর্তমানে randomForestআর এ প্যাকেজটি ব্যবহার করে একটি শ্রেণিবদ্ধকরণ সমস্যার জন্য এলোমেলো বনগুলিতে ফিট করছি এবং এই মডেলগুলির প্রশিক্ষণের ত্রুটি কীভাবে রিপোর্ট করবেন সে সম্পর্কে আমি অনিশ্চিত । আমার প্রশিক্ষণের ত্রুটি 0% এর কাছাকাছি যখন আমি কমান্ডটি পেয়েছি এমন পূর্বাভাস ব্যবহার করে এটি গণনা করি: predict(model, data=X_train) X_trainপ্রশিক্ষণের ডেটা কোথায় …

2
আত্মবিশ্বাসের ব্যবধানের ব্যাখ্যা
দ্রষ্টব্য: যদি এটি সদৃশ হয় তবে অগ্রিম ক্ষমা চেয়েছি, আমার সন্ধানে আমি তেমন কিউ পাইনি বলুন আমরা একটি সত্য পরামিতি পি। আত্মবিশ্বাসের ব্যবধান সি (এক্স) এমন একটি আরভি যা পি থাকে, 95% সময় বলে say এখন ধরা যাক আমরা এক্স এবং গণনা সি (এক্স) পর্যবেক্ষণ করি। সাধারণ উত্তরটি মনে হয় …

2
কোন স্বরলিপি এবং কেন: , ,
এগুলি কি কেবল স্টাইলিস্টিক কনভেনশন (ইটালিকাইজড বা অ-ইটালিকাইজড) হোক না কেন, বা এই স্বরলিপিগুলির অর্থের মধ্যে যথেষ্ট পার্থক্য রয়েছে? এই প্রশ্নটিতে বিবেচনা করা উচিত " সম্ভাব্যতা " অর্থের অর্থের অন্যান্য স্বরলিপি রয়েছে কি?

3
অ-নেতিবাচক ম্যাট্রিক্স ফ্যাক্টেরাইজেশনে সুপ্ত কারণগুলির একটি অনুকূল সংখ্যা কীভাবে চয়ন করবেন?
একটি ম্যাট্রিক্স Give দেওয়া , অ-নেতিবাচক ম্যাট্রিক্স ফ্যাক্টরাইজেশন (এনএমএফ) দুটি নন-নেগেটিভ ম্যাট্রিকেস এবং finds ( অর্থাৎ সমস্ত উপাদান সহ with ) এর ফলে পচন মেট্রিক্স উপস্থাপন করুন:Vm×nVm×n\mathbf V^{m \times n}এইচ কে × এন ≥0Wm×kWm×k\mathbf W^{m \times k}Hk×nHk×n\mathbf H^{k \times n}≥0≥0\ge 0 V≈WH,V≈WH,\mathbf V \approx \mathbf W\mathbf H, উদাহরণস্বরূপ যে অ-নেতিবাচক …

3
আমরা কখন সহবাসের কথা বলতে পারি?
লিনিয়ার মডেলগুলিতে আমাদের ব্যাখ্যামূলক ভেরিয়েবলগুলির মধ্যে কোনও সম্পর্ক বিদ্যমান কিনা তা পরীক্ষা করা দরকার need যদি তারা খুব বেশি সম্পর্ক স্থাপন করে তবে কোলাইনারিটি আছে (অর্থাত্ ভেরিয়েবলগুলি একে অপরকে আংশিকভাবে ব্যাখ্যা করে)। আমি বর্তমানে প্রতিটি ব্যাখ্যামূলক ভেরিয়েবলের মধ্যে জুটিওয়ালা পারস্পরিক সম্পর্ক দেখছি। প্রশ্ন 1: খুব বেশি পারস্পরিক সম্পর্ক হিসাবে শ্রেণিবদ্ধ …

3
নেস্টেড ভের-কোভার মডেলগুলির মধ্যে বেছে নেওয়ার জন্য কেন কাউকে আরএমএল (এমএল পরিবর্তে) ব্যবহার করতে হবে?
লিনিয়ার মিশ্রিত মডেলগুলির এলোমেলো প্রভাব সম্পর্কে মডেল নির্বাচনের বিভিন্ন বিবরণগুলি আরএএমএল ব্যবহারের নির্দেশ দেয়। আমি কিছু স্তরে আরএমএল এবং এমএল এর মধ্যে পার্থক্য জানি, তবে কেন এমএল পক্ষপাতদুষ্ট তাই কেন আরএমএল ব্যবহার করা উচিত তা আমি বুঝতে পারি না। উদাহরণস্বরূপ, এমএল ব্যবহার করে একটি সাধারণ বিতরণ মডেলের ভেরিয়েন্স প্যারামিটারে এলআরটি …

1
বিশুদ্ধতা গণনা কিভাবে?
গুচ্ছ বিশ্লেষণে আমরা কীভাবে বিশুদ্ধতা গণনা করব? সমীকরণ কি? আমার জন্য এটি করার জন্য আমি কোনও কোড খুঁজছি না। আসুন ক্লাস্টার কে, এবং সি জে ক্লাস জে থাকুক।ωkωk\omega_kcjcjc_j তাহলে কি বিশুদ্ধতা কার্যত নির্ভুল হয়? দেখে মনে হচ্ছে নমুনা আকারের তুলনায় ক্লাস্টারে সত্যিকার অর্থে শ্রেণিবদ্ধ শ্রেণির পরিমাণের যোগফল দেওয়া হচ্ছে। সমীকরণ …
16 clustering 

2
স্বতঃসংশোধনের কাজ কী?
কেউ কি টাইম সিরিজের ডেটাতে স্বতঃসংশোধনের কাজটি ব্যাখ্যা করতে পারে? ডেটাতে এসিফ প্রয়োগ করা, অ্যাপ্লিকেশনটি কী হবে?

1
লিনিয়ার রিগ্রেশন এর জন্য পয়েন্টের সর্বনিম্ন সংখ্যা
একটি লিনিয়ার রিগ্রেশন সহ সময়ের সাথে একটি প্রবণতা সন্ধান করার জন্য "যুক্তিসঙ্গত" ন্যূনতম সংখ্যার পর্যবেক্ষণগুলি কী হবে? চতুর্ভুজ মডেল ফিটিং সম্পর্কে কি? আমি স্বাস্থ্যের অসমতার (এসআইআই, আরআইআই) সংমিশ্রিত সূচকগুলি নিয়ে কাজ করি এবং সমীক্ষার মাত্র 4 টি তরঙ্গ রয়েছে, সুতরাং 4 পয়েন্ট (1997,2001,2004,2008)। আমি পরিসংখ্যানবিদ নই, তবে আমার স্বজ্ঞাত ছাপ …
16 regression 

2
দুটি পারস্পরিক সম্পর্কযুক্ত এলোমেলো ভেরিয়েবল স্যাম্পল করার জন্য কিছু কৌশল কী কী?
দুটি পারস্পরিক সম্পর্কযুক্ত এলোমেলো ভেরিয়েবল নমুনা নেওয়ার জন্য কিছু কৌশল কী: যদি তাদের সম্ভাব্যতা বিতরণগুলি প্যারামিটারাইজড হয় (যেমন, লগ-সাধারণ) যদি তাদের অ-প্যারামেট্রিক বিতরণ থাকে। ডেটা হ'ল দুটি সময় সিরিজ যার জন্য আমরা অ-শূন্য সহসংস্কার সহগগুলি গণনা করতে পারি। Theতিহাসিক পারস্পরিক সম্পর্ক এবং সময় সিরিজ সিডিএফ ধ্রুবক ধরে ধরে আমরা ভবিষ্যতে …

2
কীভাবে লজিস্টিক রিগ্রেশন মডেলের জন্য আর-তে সিদ্ধান্তের সীমানা প্লট করবেন?
আমি আরএম তে গ্ল্যাম ব্যবহার করে একটি লজিস্টিক রিগ্রেশন মডেল তৈরি করেছি I আমার দুটি স্বতন্ত্র ভেরিয়েবল রয়েছে। আমি কীভাবে দুটি ভেরিয়েবলের স্ক্যাটার প্লটে আমার মডেলটির সিদ্ধান্তের সীমানা প্লট করতে পারি। উদাহরণস্বরূপ, আমি কীভাবে এই চিত্রটি প্লট করতে পারি: http : //onlinecourses.sज्ञान.psu.edu/stat557/node/55 ধন্যবাদ।
16 r  logistic 

2
CalibratedClassifierCV এর সাথে শ্রেণিবদ্ধকারীদের ক্যালিবিট করার সঠিক উপায় Sci
সাইকিটের ক্যালিব্রেটেড ক্লাসিফায়ারসিভি রয়েছে , যা আমাদের মডেলগুলিকে একটি নির্দিষ্ট এক্স, ওয়াই জুটিতে ক্যালিব্রেট করতে দেয়। এটি পরিষ্কারভাবে বলেছে যেdata for fitting the classifier and for calibrating it must be disjoint. যদি তাদের অবশ্যই বিভেদ হয়, তবে নিম্নলিখিতগুলির সাথে শ্রেণিবদ্ধকে প্রশিক্ষণ দেওয়া কি বৈধ? model = CalibratedClassifierCV(my_classifier) model.fit(X_train, y_train) আমি …

3
কীভাবে `predict.randomForest` শ্রেণীর সম্ভাবনাগুলি অনুমান করে?
randomForestআমি যখন ব্যবহার করি তখন প্যাকেজটি ক্লাসের সম্ভাবনাগুলি কীভাবে অনুমান করে predict(model, data, type = "prob")? সম্ভাব্যতার পূর্বাভাস rangerদেওয়ার পক্ষে probability = Tযুক্তি ব্যবহার করে আমি এলোমেলো বন প্রশিক্ষণের জন্য ব্যবহার করছিলাম । rangerডকুমেন্টেশনে বলেছেন যে এটি: ম্যালি এট আল-এর মতো একটি সম্ভাব্য বন বর্ধন করুন। (2012)। আমি কিছু ডেটা …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.