পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

3
লজিস্টিক রিগ্রেশন: সর্বাধিক ধনাত্মক - মিথ্যা ধনাত্মক
আমার একটি লজিস্টিক রিগ্রেশন মডেল রয়েছে (ইলাস্টিক নেট নিয়মিতকরণের সাথে আর গ্ল্যামনেটের মাধ্যমে ফিট) এবং আমি সত্য ধনাত্মক এবং মিথ্যা ধনাত্মকগুলির মধ্যে পার্থক্য সর্বাধিকতর করতে চাই। এটি করার জন্য, নিম্নলিখিত পদ্ধতিটি মাথায় এলো: মানসম্পন্ন লজিস্টিক রিগ্রেশন মডেল ফিট করুন পূর্বাভাস প্রান্তিকতা 0.5 হিসাবে ব্যবহার করে সমস্ত ধনাত্মক পূর্বাভাস শনাক্ত করুন …

6
প্যানেল ডেটা সহ ভেক্টর অটোরগ্রেশন এবং ইমপ্লস রেসপন্স ফাংশন কীভাবে অনুমান করা যায়
আমি ভেক্টর অটো-রিগ্রেশন (ভিএআরএস) এবং ইমপালস রেসপন্স ফাংশন (আইআরএফ) এর উপর ভিত্তি করে 77 77 কোয়ার্টারেরও বেশি 33 জন ব্যক্তির সাথে প্যানেল ডেটার উপর ভিত্তি করে কাজ করছি। এই ধরণের পরিস্থিতি কীভাবে বিশ্লেষণ করা উচিত? এই উদ্দেশ্যে কোন অ্যালগরিদমের অস্তিত্ব রয়েছে? আমি আর এ এই বিশ্লেষণগুলি পরিচালনা করতে পছন্দ করব, …

4
সকার স্কোর জন্য মডেলিং
ডিকসন, কোলস ( ১৯৯ )) এ, তারা সকারের স্কোরগুলি মডেল করতে (৪.৩) দুটি পরিবর্তিত স্বতন্ত্র পোইসন মডেলের সর্বাধিক সম্ভাবনার অনুমান ব্যবহার করেছেন। আমি আলফা এবং বিটা পাশাপাশি হোম এফেক্ট প্যারামিটারগুলি (পৃষ্ঠা 274, সারণি 4) "পুনঃ উত্পাদন" করতে আর ব্যবহার করার চেষ্টা করছি কোনও প্যাকেজ ব্যবহার না করে (সাধারণ স্বতন্ত্র পোইসন …

2
একটি মধ্যস্থতা মডেল ফিট করতে ডেটা সিমুলেটিং
আমি নির্দিষ্ট মধ্যস্থতা মডেলের সাথে সামঞ্জস্যপূর্ণ ডেটা সিমুলেট করার পদ্ধতি খুঁজে পেতে আগ্রহী। ব্যারন এবং কেনি (1986) দ্বারা প্রথম রূপরেখার মধ্যস্থতার মডেলগুলির পরীক্ষার জন্য সাধারণ লিনিয়ার স্ট্রাকচারাল সমীকরণ মডেল কাঠামো অনুসারে এবং অন্য কোথাও যেমন জড, ইজারবিট, এবং মুলার (2013) এর বর্ণনা দেওয়া হয়েছে , ফলাফল জন্য মধ্যস্থতা মডেল , …

3
বায়েশিয়ান ভবিষ্যদ্বাণীপূর্ণ বিতরণগুলি বোঝা
আমি বয়েস কোর্সে একটি ইন্ট্রো নিচ্ছি এবং ভবিষ্যদ্বাণীপূর্ণ বিতরণ বুঝতে আমার কিছুটা সমস্যা হচ্ছে। আমি বুঝতে পারি যে সেগুলি কেন কার্যকর এবং আমি সংজ্ঞাটির সাথে পরিচিত, তবে এমন কিছু জিনিস রয়েছে যা আমি বেশ বুঝতে পারি না। 1) কীভাবে নতুন পর্যবেক্ষণের ভেক্টরের সঠিক অনুমানমূলক বিতরণ পাবেন মনে করুন যে আমরা …

1
সাধারণীকরণযোগ্য মডেল: আর এর আউটপুটে ref.df কী?
হাই, আমি আর-এ আউটপুট স্ক্রিনে রেফ.ডিএফ বোঝার জন্য সংগ্রাম করছি: Approximate significance of smooth terms: edf Ref.df F p-value s(meangrain) 1.779 2.209 3.193 0.0451 * s(depth) 2.108 2.697 3.538 0.0254 * এর অর্থ কী এবং কোনও কাগজে জিএএম এর ফলাফল উপস্থাপনের জন্য এই শব্দটি অন্তর্ভুক্ত করা প্রয়োজন? এটি আমাদের পূর্বাভাসের …

1
সময় সিরিজের ভবিষ্যদ্বাণী পারফরম্যান্স মূল্যায়ন
আমার একটি ডায়নামিক নাইভ বেইস মডেল বেশ কয়েকটি টেম্পোরাল ভেরিয়েবলের উপর প্রশিক্ষিত। মডেলটির আউটপুটটি P(Event) @ t+1প্রতিটি অনুমানের পূর্বাভাস t। চক্রান্ত P(Event)বনাম timeযেমন নীচের চিত্রে দেওয়া হয়। এই চিত্রে, কালো রেখাটিP(Event) আমার মডেল দ্বারা পূর্বাভাস হিসাবে উপস্থাপিত ; অনুভূমিক লাল রেখা ঘটনা ঘটছে পূর্ব সম্ভাব্যতা প্রতিনিধিত্ব করে; এবং বিন্দুযুক্ত উল্লম্ব …

3
বায়েসের উপপাদ্য চিত্রটি কেন কাজ করে?
গাণিতিক দৃষ্টিকোণ থেকে বেয়েসের উপপাদ্যটি আমার কাছে নিখুঁতভাবে অনুধাবন করে (অর্থাত্ উদ্ভূত ও প্রমাণিত), তবে যা আমি জানি না তা হল কোনও ভাল জ্যামিতিক বা গ্রাফিক্যাল যুক্তি আছে যা বায়েসের উপপাদ্যকে ব্যাখ্যা করার জন্য দেখানো যেতে পারে। আমি এর উত্তরের জন্য গুগলিংয়ের চেষ্টা করেছিলাম এবং আশ্চর্যরকমভাবে আমি এটিতে কিছুই খুঁজে …

1
র‌্যান্ডমফোরেস্টগ্রিজারের জন্য ব্যাগ ত্রুটির অনুমানের অর্থ ব্যাখ্যা করা
আমি আমার ডেটাতে র‌্যান্ডমফোরেস্ট রেজিস্টার ব্যবহার করছি এবং আমি দেখতে পাচ্ছি যে আউব স্কোরটি 0.83 হয়ে গেছে। আমি নিশ্চিত নই যে এটি কীভাবে এমনভাবে এল। আমি বলতে চাইছি আমার টার্গেটগুলি 10 ^ 7 এর সীমাতে উচ্চতর মান। সুতরাং এটি যদি এমএসই হয় তবে এটি আরও অনেক বেশি হওয়া উচিত ছিল। …

1
3 টি নমুনা সহ অনুপাতের সমতার জন্য হাইপোথিসিস পরীক্ষা করা
আমার কাছে টলোকলম সহ সেল ফোন গ্রাহকের তথ্য উপাত্তের একটি ডেটা সেট রয়েছে। প্রথম কলামটিতে একটি নির্দিষ্ট বিভাগ রয়েছে যা কোনও অ্যাকাউন্টে পড়ে (এ, বি বা সি হয়) এবং দ্বিতীয় কলামে রয়েছে সেই অ্যাকাউন্টটি বাতিল হয়েছে কিনা তার দ্বিপদী মূল্যবান। যেমন A | cancelled C | active B | active …

1
চিঠিপত্র বিশ্লেষণ বনাম মূল উপাদান বিশ্লেষণ ব্যবহার করে
আমি অন্তর্বর্তী সম্প্রদায়ের সম্পর্কিত একটি ডেটা সেট বিশ্লেষণ করছি। চতুষ্কোণগুলিতে ডেটা শতাংশ কভার (সামুদ্রিক শ্যাওলা, বার্নক্লেস, ঝিনুক ইত্যাদি)। প্রজাতির গণনাগুলির ক্ষেত্রে আমি চিঠিপত্র বিশ্লেষণ (সিএ) এবং রৈখিক পরিবেশগত (প্রজাতি নয়) প্রবণতাগুলির জন্য আরও কার্যকর কিছু হিসাবে নীতিগত উপাদান বিশ্লেষণ (পিসিএ) সম্পর্কে ভাবতে অভ্যস্ত। শতভাগ কভারের জন্য যদি পিসিএ বা সিএ …

3
পরিসংখ্যান বাস্তুবিদ্যার উপর বই?
আমি জানি এই প্রশ্নটি আগে জিজ্ঞাসা করা হয়েছিল: বাস্তুশাস্ত্র অধ্যয়নের জন্য রেফারেন্স বই তবে এটি যা আমি খুঁজছি তা নয়। আমি যা খুঁজছি তা হ'ল যদি কেউ পরিসংখ্যান বাস্তুবিদ্যার উপর কোনও ভাল বইয়ের (বা একটি প্রচলিত রেফারেন্স) সুপারিশ করতে পারে? আমার কাছে পরিসংখ্যান সম্পর্কে খুব ভাল বোঝা আছে তাই বইটি …

6
হ্যাডোপ / ম্যাপ-হ্রাস ব্যবহার করে কোন মেশিন লার্নিং অ্যালগরিদমগুলি মাপা যায়
স্কেলেবল মেশিন লার্নিং অ্যালগরিদমগুলি আজকাল গুঞ্জনের মতো মনে হচ্ছে। প্রতিটি সংস্থা বড় ডেটার সংক্ষিপ্ত কিছুই পরিচালনা করে না । ম্যাপ-রিডুজের মতো সমান্তরাল আর্কিটেকচার ব্যবহার করে কোন মেশিন লার্নিং অ্যালগরিদমকে ছোট করা যেতে পারে এবং কোনটি অ্যালগরিদমগুলি করতে পারে না তা নিয়ে কোনও পাঠ্যপুস্তক রয়েছে কিনা তা আলোচনা করে? নাকি কিছু …

4
অবিচ্ছিন্ন নির্ভরশীল চলকটির জন্য লজিস্টিক রিগ্রেশন ব্যবহার করা
আমি সম্প্রতি আমার গবেষণামূলক গবেষণাপত্রের জন্য একটি সংশোধন পেয়েছি এবং নিম্নলিখিতটি আমার কাগজে পর্যালোচকদের মন্তব্য: একটি মডেল থেকে প্রাপ্ত ফলাফলগুলি বেশ দৃinc়প্রত্যয়ী নয় বিশেষত রৈখিক প্রতিরোধের সাধারণত বহিরাগতদের সাথে আচরণ করার ক্ষেত্রে ঘাটতি রয়েছে। আমি পরামর্শ দিচ্ছি যে লেখকরাও লজিস্টিক রিগ্রেশন চেষ্টা করে এবং বর্তমান ফলাফলের সাথে সম্পর্কিত ফলাফলগুলি তুলনা …

2
প্রেডিকশন ইন্টারভাল গণনা করা হচ্ছে
আমার এখানে নিম্নলিখিত ডেটা রয়েছে । হাইড্রোকার্বন শতাংশের হার 1.0 হয় যখন আমি গড় বিশুদ্ধতার উপর 95% আত্মবিশ্বাসের ব্যবধান গণনা করার চেষ্টা করছি। আর এ, আমি নিম্নলিখিত লিখুন। > predict(purity.lm, newdata=list(hydro=1.0), interval="confidence", level=.95) fit lwr upr 1 89.66431 87.51017 91.81845 যাইহোক, আমি কীভাবে এই ফলাফলটি নিজেই অর্জন করতে পারি? আমি …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.