পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
বেয়েসিয়ান বিশ্লেষণের জন্য সর্বোত্তম সফ্টওয়্যার প্যাকেজ
আমি ভাবছিলাম যে আপনি কী সফটওয়্যার স্ট্যাটিস্টিকাল প্যাকেজটি বায়েসিয়ান অনুমান সম্পাদন করার জন্য প্রস্তাব দিচ্ছেন? উদাহরণস্বরূপ, আমি জানি যে আপনি ওপেনবিগস বা উইনবইউএসএস স্ট্যান্ডেলোন হিসাবে চালাতে পারেন বা আপনি তাদের আর থেকেও কল করতে পারেন R তবে আর এর নিজস্ব কয়েকটি প্যাকেজ (এমসিএমসিপ্যাক, বিএসিসিও) রয়েছে যা বেয়েসিয়ান বিশ্লেষণ করতে পারে। …

1
নিউরাল নেটওয়ার্কগুলিতে বাইনারি এবং অবিচ্ছিন্ন ইনপুটগুলির মিশ্রণটি কীভাবে মোকাবেলা করবেন?
কনডোর (ব্যক্তিগত প্রকল্প) রিয়েল এস্টেটের দামের পূর্বাভাস দেওয়ার জন্য একটি এএনএন তৈরির চেষ্টা করার জন্য আমি আর-তে নেট প্যাকেজটি ব্যবহার করছি। আমি এটিতে নতুন এবং কোনও গণিতের পটভূমি নেই তাই দয়া করে আমার সাথে বেয়ার করুন। আমার ইনপুট ভেরিয়েবলগুলি বাইনারি এবং অবিচ্ছিন্ন উভয়ই রয়েছে। উদাহরণস্বরূপ কিছু বাইনারি ভেরিয়েবল যা মূলত …

3
এই উদ্ধৃতিটি কেন বলে যে স্ট্যান্ডার্ড বিচ্যুতি সম্পর্কে নিরপেক্ষ অনুমানটি সাধারণত প্রাসঙ্গিক নয়?
আমি স্ট্যান্ডার্ড বিচ্যুতির নিরপেক্ষ অনুমান এবং আমি যে উত্সটি পড়েছি তার বিবরণ গণনাতে পড়ছিলাম (...) কিছু গুরুত্বপূর্ণ পরিস্থিতি ব্যতীত, কার্যটির পরিসংখ্যান প্রয়োগের সাথে সামান্য প্রাসঙ্গিকতা রয়েছে যেহেতু স্ট্যান্ডার্ড পদ্ধতিগুলি যেমন তাত্পর্য পরীক্ষা ও আত্মবিশ্বাসের ব্যবধানগুলি ব্যবহার করে বা বায়সীয় বিশ্লেষণ ব্যবহার করে এর প্রয়োজনীয়তা এড়ানো যায়। আমি ভাবছিলাম যে এই …

2
কমপক্ষে স্কোয়ারের গুণনক্ষেত্রগুলি বাদ দিয়ে স্পারসিটি
ধরুন আমি প্রত্যাবর্তন করতে ইচ্ছুক একটি সাধারণ বিরুদ্ধে , কিন্তু আমি একটি বিক্ষিপ্ত সমাধান চাই। রিগ্রেশন হওয়ার পরে, কেন ক্ষুদ্রতম মাত্রার সহগকে বাতিল করা হচ্ছে না?YYYXXX রেকর্ডের জন্য, আমি LARS এবং লাসো পদ্ধতিগুলি শুনেছি এবং প্রায়শই ব্যবহার করি। আমি কেবল কৌতূহল বোধ করি কেন উপরের পদ্ধতিটি প্রযোজ্য নয়।

1
শূন্য-স্ফীত পোইসন রিগ্রেশন
ধরুন স্বাধীন এবংY=(Y1,…,Yn)′Y=(Y1,…,Yn)′ \textbf{Y} = (Y_1, \dots, Y_n)' Yi=0Yi=kwith probability pi+(1−pi)e−λiwith probability (1−pi)e−λiλki/k!Yi=0with probability pi+(1−pi)e−λiYi=kwith probability (1−pi)e−λiλik/k!\eqalign{ Y_i = 0 & \text{with probability} \ p_i+(1-p_i)e^{-\lambda_i}\\ Y_i = k & \text{with probability} \ (1-p_i)e^{-\lambda_i} \lambda_{i}^{k}/k! } এছাড়াও ধরুন এবং সন্তুষ্টλ=(λ1,…,λn)′λ=(λ1,…,λn)′\mathbf{\lambda} = (\lambda_1, \dots, \lambda_n)'p=(p1,…,pn)p=(p1,…,pn)\textbf{p} = (p_1, \dots, p_n) log(λ)logit(p)=Bβ=log(p/(1−p))=Gλ.log⁡(λ)=Bβlogit(p)=log⁡(p/(1−p))=Gλ.\eqalign{ \log(\mathbf{\lambda}) &= …

2
আপনি যখন অনুমানকারী ভেরিয়েবলগুলি করতে পারেন তবে বিভিন্ন নমুনা আকারের সাথে গ্রুপ গড়ের ভিত্তিতে আপনি কী করতে পারেন?
একটি শাস্ত্রীয় তথ্য বিশ্লেষণ সমস্যা বিবেচনা করুন যেখানে আপনি একটি ফলাফল আছে YiYiY_{i} এবং কিভাবে এটা ভবিষ্যতবক্তা একটি নম্বর সঙ্গে সম্পর্কযুক্ত Xi1,...,XipXi1,...,XipX_{i1}, ..., X_{ip} । এখানে মূল ধরণের প্রয়োগের বিষয়টি মনে রাখবেন YiYiY_{i} কিছু গ্রুপ পর্যায়ের ফলাফল যেমন শহরে অপরাধের হারiii । ভবিষ্যদ্বাণীকারীরা গ্রুপের স্তরের বৈশিষ্ট্যগুলি যেমন শহর এর ডেমোগ্রাফিক …

1
ফরোয়ার্ড স্টেজওয়াইজ রিগ্রেশন অ্যালগরিদম কী?
সম্ভবত এটি কেবল ক্লান্ত হয়ে পড়েছি তবে ফরোয়ার্ড স্টেজওয়াইজ রিগ্রেশন অ্যালগরিদম বোঝার চেষ্টা করতে আমার সমস্যা হচ্ছে। থেকে "পরিসংখ্যানগত শিক্ষণ উপাদানসমূহ" পৃষ্ঠা 60: ফরোয়ার্ড-স্টেজওয়্যার রিগ্রেশন (এফএস) ফরোয়ার্ড-স্টেপওয়াইজ রিগ্রেশন-এর চেয়েও বেশি বাধা। এটি শুরু হয় ধাপে ধাপে ধাপে ধাপে ধাপে ধাপে ধাপে ধাপে ধাপে ধাপে ধাপে ধাপে ধাপে ধাপে ধাপে ধাপে …

1
ক্ষতিকারক ফিটের স্কোয়ারের অবশিষ্টাংশগুলি কীভাবে হ্রাস করা যায়?
আমার কাছে নিম্নলিখিত তথ্য রয়েছে এবং এটিতে নেতিবাচক এক্সফোনেনশিয়াল গ্রোথ মডেলটি ফিট করতে চাই: Days <- c( 1,5,12,16,22,27,36,43) Emissions <- c( 936.76, 1458.68, 1787.23, 1840.04, 1928.97, 1963.63, 1965.37, 1985.71) plot(Days, Emissions) fit <- nls(Emissions ~ a* (1-exp(-b*Days)), start = list(a = 2000, b = 0.55)) curve((y = 1882 * (1 …

1
আর.আর ব্যবহার করে দ্বিধাত্ত্বিক তথ্য (বাইনারি ভেরিয়েবল) সম্পর্কিত একটি ফ্যাক্টর বিশ্লেষণের উদাহরণের মাধ্যমে একটি পদক্ষেপের সন্ধান করছেন
আমার কাছে কিছু দ্বিগুণ তথ্য রয়েছে, কেবলমাত্র বাইনারি ভেরিয়েবলগুলি, এবং আমার বস আমাকে টেট্রাকোরিক সম্পর্কিত সম্পর্কিত ম্যাট্রিক্স ব্যবহার করে একটি ফ্যাক্টর বিশ্লেষণ করতে বলেছিলেন। আমি পূর্বে এখানে এবং ইউসিএলএর স্ট্যাট সাইট এবং এর মতো অন্যান্য সাইটে উদাহরণের উপর ভিত্তি করে কীভাবে বিভিন্ন বিশ্লেষণ চালাতে পারি তা শিখতে পেরেছি, তবে দ্বিধাত্বক …

2
একটি গণনার মানক ত্রুটি
বিরল রোগের মরসুমে আমার কাছে ঘটনার মামলার একটি ডেটাসেট রয়েছে। উদাহরণস্বরূপ, বলুন যে বসন্তে 180 টি ছিল, গ্রীষ্মে 90, শরত্কালে 45 এবং শীতে 210 টি ঘটনা ঘটে। আমি এই সংখ্যার সাথে স্ট্যান্ডার্ড ত্রুটিগুলি সংযুক্ত করা উপযুক্ত কিনা তা নিয়ে আমি লড়াই করছি। গবেষণার লক্ষ্যগুলি এই অর্থে নির্ধারিত যে আমরা ভবিষ্যতে …

1
অরথোগোনাল পলিনোমিয়াল রিগ্রেশন থেকে কাঁচা সহগ এবং বৈচিত্রগুলি পুনরুদ্ধার করা
দেখে মনে হচ্ছে আমার কাছে যদি রিগ্রেশন মডেল থাকে যেমন yi∼β0+β1xi+β2x2i+β3x3iyi∼β0+β1xi+β2xi2+β3xi3y_i \sim \beta_0 + \beta_1 x_i+\beta_2 x_i^2 +\beta_3 x_i^3আমি হয় একটি কাঁচা বহুপুত্র ফিট করতে পারি এবং অবিশ্বাস্য ফলাফল পেতে পারি বা একটি অর্থোগোনাল বহুবর্ষের সাথে ফিট করতে পারি এবং সহগগুলি পাই যাগুলির সরাসরি শারীরিক ব্যাখ্যা নেই (যেমন আমি এগুলিকে …

1
এলোমেলো প্রভাবগুলির সাথে মডেলগুলির জন্য লেমারের সাথে বৈকল্পিক উপাদানগুলি কীভাবে অনুমান করা যায় এবং সেগুলি lme ফলাফলের সাথে তুলনা করে
আমি একটি পরীক্ষা করেছি যেখানে আমি দুটি ভিন্ন উত্স জনসংখ্যা থেকে বিভিন্ন পরিবারকে উত্থাপন করেছি। প্রতিটি পরিবারকে দুটি চিকিত্সার মধ্যে একটির দায়িত্ব দেওয়া হয়েছিল। পরীক্ষার পরে আমি প্রতিটি ব্যক্তির বেশ কয়েকটি বৈশিষ্ট্য পরিমাপ করেছিলাম। চিকিত্সা বা উত্স পাশাপাশি তাদের মিথস্ক্রিয়াগুলির একটি প্রভাবের জন্য পরীক্ষার জন্য, আমি পরিবারের সাথে র্যান্ডম ফ্যাক্টর …
14 r  anova  variance  lme4-nlme 

4
বিদ্যমান এসভিএম মডেলগুলিতে প্রশিক্ষণ ডেটা যুক্ত করা কি সম্ভব?
আমি libsvm ব্যবহার করছি এবং আমি লক্ষ্য করেছি যে আমি যখনই svmtrain () কল করি তখন আমি একটি নতুন মডেল তৈরি করি এবং মনে হয় যে কোনও বিদ্যমান মডেলটিতে ডেটা রাখার কোনও বিকল্প নেই। এটি কি তবে সম্ভব? আমি কি শুধু লিবসভিমে এই দিকটি দেখছি না?
14 svm  libsvm 

3
লুকানো মার্কভ মডেল থ্রেশহোল্ডিং
আমি এমএফসিসি এবং লুকানো মার্কভ মডেলগুলি ব্যবহার করে শব্দ স্বীকৃতির জন্য কনসেপ্ট সিস্টেমের একটি প্রমাণ তৈরি করেছি। আমি যখন পরিচিত শব্দগুলিতে সিস্টেমটি পরীক্ষা করি তখন এটি আশাব্যঞ্জক ফলাফল দেয়। যদিও সিস্টেমটি, যখন কোনও অজানা শব্দটি ইনপুট করা হয় তখন নিকটতম ম্যাচের সাথে ফলাফলটি দেয় এবং স্কোরটি এটি নির্ধারণের জন্য আলাদা …

1
বাইনারি ডেটার সাথে সম্পর্কের ক্ষেত্রে পার্থক্য বিভাজন এবং দ্রাঘিমাংশীয় পরিবর্তন
আমি লজিস্টিক লিনিয়ার মিশ্র প্রভাবগুলির মডেল (এলোমেলো ইন্টারসেপ্ট) সহ ১ 300৫ টি বিদ্যালয়ে ৩০০,০০০ শিক্ষার্থীর উপর ডেটা বিশ্লেষণ করছি। প্রতিটি ছাত্র ঠিক একবার হয় এবং তথ্য 6 বছর বিস্তৃত। অবিচ্ছিন্ন ফলাফলের জন্য কীভাবে আমি ভিপিসি / আইসিসির অনুরূপভাবে স্কুল এবং শিক্ষার্থীদের স্তরের মধ্যে পার্থক্য ভাগ করব? আমি এই নিবন্ধটি দেখেছি …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.