পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

3
বিশ্লেষণের জন্য সিডিএফ এবং পিডিএফ পরিসংখ্যান কীভাবে ব্যবহার করবেন
এটি সাধারণ প্রশ্নের খুব বেশি হতে পারে তবে আমি আশা করি আমি এখানে সহায়তা পেতে পারি। আমি আমার বিশ্ববিদ্যালয়ে আরএ জব শুরু করছি এবং আমার বিষয় ইন্টারনেট ট্রাফিক বিশ্লেষণ সম্পর্কিত হবে। বিশ্লেষণের জগতে আমি মোটামুটি নতুন, তবে আমার ধারণা গবেষণার জগতে এটি আমাকে অনেক কিছু করতে হবে। আমি কয়েকটি কাগজপত্র …

3
প্রশ্নোত্তর বৈধকরণ
আমি আমার গবেষণামূলক প্রবন্ধের জন্য একটি প্রশ্নপত্র ডিজাইন করছি। আমি প্রশ্নাবলীর বৈধতা দেওয়ার প্রক্রিয়াধীন আমি প্রাথমিক নমুনা গোষ্ঠীতে ক্রোনবাচের আলফা পরীক্ষা প্রয়োগ করেছি। প্রশ্নাবলীর প্রতিক্রিয়াগুলি লিকার্ট স্কেলে রয়েছে; এর বৈধতা পরীক্ষা করতে সহায়তা করতে যে কেউ আবেদন করতে আরও কোনও পরীক্ষার পরামর্শ দিতে পারে আমি পরিসংখ্যানের বিশেষজ্ঞ নই তাই কোনও …

1
নতুন পর্যবেক্ষণের সাথে লাসো ফিট আপডেট করা
আমি একটি খুব বড় ডেটাসেটের সাথে একটি এল 1-নিয়মিত লিনিয়ার রিগ্রেশন ফিটিং করছি (এন >> পি সহ) ভেরিয়েবলগুলি আগে থেকেই জানা যায়, তবে পর্যবেক্ষণগুলি ছোট অংশে আসে। আমি প্রতিটি খণ্ড পরে lasso ফিট বজায় রাখতে চাই। প্রতিটি পর্যবেক্ষণের নতুন সেট দেখার পরে আমি অবশ্যই পুরো মডেলটিকে আবার ফিট করতে পারি। …
12 regression  lasso 

5
লজিস্টিক রিগ্রেশনে ডিফল্টর আরও ভাল শ্রেণিবদ্ধকরণ
সম্পূর্ণ প্রকাশ: এটি হোমওয়ার্ক। আমি ডেটাসেটের লিঙ্কটি অন্তর্ভুক্ত করেছি ( http://www.bertelsen.ca/R/logistic-regression.sav ) আমার লক্ষ্য এই ডেটা সেটে loanণ খেলাপিদের পূর্বাভাস সর্বাধিক করা। আমি এখনও অবধি প্রতিটি মডেল নিয়ে এসেছি, 90% নন-খেলাপিদের পূর্বাভাস দেওয়া হয়, তবে <40% ডিফল্টরা শ্রেণিবিন্যাস দক্ষতা সামগ্রিকভাবে ~ 80% করে তোলে। সুতরাং, আমি ভাবছি যদি ভেরিয়েবলগুলির মধ্যে …
12 r  logistic  spss  self-study 

2
একটি আর নবজাতকের আইটেম বিশ্লেষণ
আমি একটি 20-আইটেমের মাল্টলিপল পছন্দ পরীক্ষাটি মূল্যায়ন করার চেষ্টা করছি। আমি একটি আইটেম বিশ্লেষণ করতে চাই যেমন এই উদাহরণটিতে পাওয়া যেতে পারে । সুতরাং প্রতিটি প্রশ্নের জন্য আমি পি-মান এবং মোটের সাথে পারস্পরিক সম্পর্ক চাই এবং নির্বাচিত বিকল্পগুলির বিতরণ চাই। আমি এখানে বিভিন্ন পরিসংখ্যান সংক্রান্ত সফ্টওয়্যার প্যাকেজ সম্পর্কে কিছু জানি …

3
অভিযোজিত কার্নেল ঘনত্বের অনুমানকারী?
অভিযোজিত কার্নেল ঘনত্বের প্রাক্কলনকারী দিয়ে কেউ কি তাদের অভিজ্ঞতার বিষয়ে রিপোর্ট করতে পারেন? (অনেকগুলি প্রতিশব্দ রয়েছে: অভিযোজক | পরিবর্তনশীল | ভেরিয়েবল-প্রস্থ, কে। ডি। হিস্টোগ্রাম | ইন্টারপোলটার ...) পরিবর্তনশীল কার্নেলের ঘনত্বের অনুমান অনুসারে "আমরা নমুনা ব্যবস্থার বিভিন্ন অঞ্চলে কার্নেলের প্রস্থকে পৃথক করি There দুটি পদ্ধতি রয়েছে ..." আসলে আরও বেশি: কিছু …

2
দুটি সাধারণত বিতরণ করা ভেরিয়েবলের অনুপাতকে কীভাবে প্যারামিটারাইজ করা যায়?
সমস্যা: আমি একজন বায়সিয়ান মেটা-বিশ্লেষণে প্রিয়ার এবং ডেটা হিসাবে ব্যবহারের জন্য বিতরণগুলি প্যারামিটারাইজ করছি। সাহিত্যে ডেটা সংক্ষিপ্ত পরিসংখ্যান হিসাবে সরবরাহ করা হয়, প্রায় একচেটিয়াভাবে সাধারণত বিতরণ করা হয় বলে ধরে নেওয়া হয় (যদিও কোনও ভেরিয়েবল <0 হতে পারে না, কিছু অনুপাত, কিছু ভর এবং ইত্যাদি)। আমি দুটি ক্ষেত্রে এসেছি যার …

2
প্যারামেট্রিকের নমুনা আকারের গণনা এবং অ-প্যারাম্যাট্রিক বিশ্লেষণ
আমি জানতে আগ্রহী যে প্যারাম্যাট্রিক পদ্ধতিগুলি (যেমন একটি সাধারণ বন্টন এবং পরিমাপের একটি নির্দিষ্ট বৈকল্পিকতা অনুমান) ব্যবহার করে নমুনা আকার গণনা সম্পাদনের চিকিত্সা সাহিত্যে সাধারণ অনুশীলনকে সমর্থন করার জন্য কারও নির্দিষ্ট রেফারেন্স (পাঠ্য বা জার্নাল নিবন্ধ) আছে কিনা? যখন প্রাথমিক পরীক্ষার ফলাফলের বিশ্লেষণ অ-প্যারাম্যাট্রিক পদ্ধতি ব্যবহার করে করা হবে। একটি …

4
লাসো মডেলটিতে ইটারেটিভলি রিয়েইটেড লেস্ট স্কোয়ারস (আইআরএলএস) পদ্ধতিটি কীভাবে প্রয়োগ করবেন?
আমি IRLS অ্যালগরিদম ব্যবহার করে একটি লজিস্টিক রিগ্রেশন প্রোগ্রাম করেছি । সঠিক বৈশিষ্ট্যগুলি স্বয়ংক্রিয়ভাবে নির্বাচন করার জন্য আমি একটি লাসো শাস্তি প্রয়োগ করতে চাই । প্রতিটি পুনরাবৃত্তিতে নিম্নলিখিতগুলি সমাধান করা হয়: (XTWX)δβ^=XT(y−p)(XTWX)δβ^=XT(y−p)\mathbf{\left(X^TWX\right) \delta\hat\beta=X^T\left(y-p\right)} আসুন একটি অ-নেতিবাচক আসল সংখ্যা । দ্য এলিমেন্টস এর পরামর্শ অনুসারে আমি ইন্টারসেপ্টটিকে শাস্তি দিচ্ছি না । …

3
যখন স্ট্যাটিসটিকাল টাই নিষ্ক্রিয়ভাবে প্রত্যাখ্যান করা হয় না তা আপনি ব্যাখ্যা করতে পারেন?
আমার পরিসংখ্যানের মূল পাঠ্য, কাগজপত্র বা অন্যান্য রেফারেন্সগুলি ব্যাখ্যা করতে এবং উদ্ধৃত করার দরকার আছে কেন সাধারণভাবে একটি পরিসংখ্যানগত টাই ঘোষণা করতে ভোটের ক্ষেত্রে রিপোর্ট করা ত্রুটির মার্জিন (এমওই) পরিসংখ্যান ব্যবহার করা কেন ভুল হয়? একটি উদাহরণ: প্রার্থী এ একটি জরিপে প্রার্থী বি নেতৃত্ব দেয়, শতাংশ, 500 জরিপ প্রাপ্ত ভোটারদের …
12 polling 

6
ক্লাস্টার বিশ্লেষণের ভূমিকা হিসাবে প্রস্তাবিত বই বা নিবন্ধগুলি?
আমি পাঠ্যের একটি ছোট (200M) কর্পাসে কাজ করছি, যা আমি কিছু ক্লাস্টার বিশ্লেষণের সাথে অন্বেষণ করতে চাই। আপনি এই বিষয়ে কোন বই বা নিবন্ধগুলি সুপারিশ করবেন?

5
শাস্ত্রীয় গাণিতিক পরিসংখ্যানের জন্য স্ট্যান্ডার্ড রেফারেন্স?
শাস্ত্রীয় (ঘনঘনবাদী) পরিসংখ্যানের জন্য যে কেউ স্ট্যান্ডার্ড রেফারেন্স হিসাবে বিবেচিত হয় এমন কোনও বই সুপারিশ করতে পারেন? IE, মোটামুটি বিস্তৃত এবং এছাড়াও কিছুক্ষণের জন্য ছিল যাতে সূত্রগুলিতে টাইপস এবং ভুলগুলি পরীক্ষা করে সংশোধন করার সুযোগ হয়

1
ওজনযুক্ত ডেটা সহ দ্বি-নমুনা টি-পরীক্ষা
দুটি স্বতন্ত্র নমুনার মধ্যে পার্থক্যের জন্য পরীক্ষার জন্য আমি একটি দ্বি-নমুনা টি-পরীক্ষা করতে চাই যা প্রতিটি নমুনা টি-টেস্টের অনুমান অনুসারে মেনে চলে (প্রতিটি বন্টনকে স্বতন্ত্র এবং সমান বৈচিত্র্যের সাথে সাধারণ হিসাবে বিতরণ হিসাবে ধরে নেওয়া যেতে পারে) । বেসিক দুটি-নমুনা টি-পরীক্ষা থেকে একমাত্র জটিলতা হ'ল ডেটা ওজন করা is আমি …
12 t-test 

3
অসম্পূর্ণ / নিখোঁজ ডেটা পরিচালনা করার কৌশলগুলি iques
আমার প্রশ্নটি ক্লাসিফায়ার / মডেল প্রশিক্ষণ / ফিটিংয়ের সময় অসম্পূর্ণ ডেটা নিয়ে কাজ করার কৌশলগুলিতে পরিচালিত । উদাহরণস্বরূপ, একটি ডেটাসেটে ডাব্লু / কয়েক শ সারি, প্রতিটি সারিতে শেষ আইটেম হিসাবে পাঁচটি মাত্রা এবং একটি শ্রেণির লেবেল বলা উচিত, বেশিরভাগ ডেটা পয়েন্টগুলি এর মতো দেখাবে: [0.74, 0.39, 0.14, 0.33, 0.34, 0] …

5
আরওসি বক্ররেখাগুলি আপনাকে কী বলে যে traditionalতিহ্যগত অনুক্রমটি না?
ফলাফলের উপর কিছু পরিমাপের পূর্বাভাসযোগ্য ক্ষমতা নির্ধারণ করতে আপনি কখন অন্য কিছু পরীক্ষার চেয়ে আরওসি বক্ররেখা ব্যবহার করবেন? বিচ্ছিন্ন ফলাফল (জীবিত / মৃত, উপস্থিত / অনুপস্থিত) নিয়ে কাজ করার সময়, আরওসি বক্ররেখাকে চি-স্কোয়ারের মতো কিছুর চেয়ে কম বা কম শক্তিশালী করে তোলে?
12 regression  roc 

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.