পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
কোন বর্ণনামূলক পরিসংখ্যানগুলি প্রভাব আকারগুলি নয়?
উইকিপিডিয়া বলেছেন প্রভাবের আকারটি কোনও ঘটনার শক্তির পরিমাপ বা সেই পরিমাণের একটি নমুনা-ভিত্তিক অনুমান। ডেটা থেকে গণনা করা একটি প্রভাব আকার হ'ল বর্ণনামূলক পরিসংখ্যান যা উপাত্তগুলিতে আপাত সম্পর্ক জনসংখ্যার মধ্যে একটি সত্য সম্পর্কের প্রতিফলন ঘটায় কিনা সে সম্পর্কে কোনও বক্তব্য না দিয়েই সম্পর্কের আনুমানিক প্রগা .়তা জানায়। এটি আরও ভালভাবে …

2
যখন ডেটাতে গাউসীয় বিতরণ থাকে, তখন এটির কতগুলি নমুনা চিহ্নিত করা যায়?
একক মাত্রায় বিতরণ করা গাউসিয়ান ডেটাগুলিকে এটি চিহ্নিত করার জন্য দুটি পরামিতি (মানে, বৈচিত্র) প্রয়োজন হয় এবং গুজবটিতে বলা হয় যে প্রায় 30 টি এলোমেলোভাবে নির্বাচিত নমুনা যথাযথভাবে উচ্চ আত্মবিশ্বাসের সাথে এই পরামিতিগুলি অনুমান করার জন্য যথেষ্ট। তবে মাত্রার সংখ্যা বাড়ার সাথে সাথে কী ঘটে? দুটি মাত্রায় (যেমন উচ্চতা, ওজন) …

2
সাধারণ ঘনকের যোগফলের যোগফলের অনুপাত
নিম্নলিখিতগুলির সীমাবদ্ধ বিতরণ ( হিসাবে ) : যেখানে IID হয় ।U n = এক্স 1 + এক্স 2 + … + এক্স এনn→∞n→∞n \rightarrow \inftyএক্সআইএন(0,1)ইউএন= এক্স1+ এক্স2+ … + এক্সএনএক্স31+ এক্স32+ … এক্স3এন,Un=X1+X2+…+XnX13+X23+…Xn3, U_n = \frac{X_1 + X_2 + \ldots + X_n}{X_1^3 + X_2^3 + \ldots X_n^3},এক্সআমিXiX_iএন( 0 , 1 …

2
গেলম্যান রিপোর্ট করেছেন "প্যারাডক্স" এর নাম
অ্যান্ড্রু গ্যালম্যানের "রেড স্টেট, ব্লু স্টেট" বইটিতে তিনি এই বিশ্লেষণ করেছেন যে নির্দিষ্ট রাজ্যের ধনী লোকেরা গরিব মানুষের চেয়ে বেশি রিপাবলিকানকে ভোট দেয়, কিন্তু ধনী রাষ্ট্রগুলি গরিব রাজ্যের চেয়ে বেশি গণতান্ত্রিক ভোট দেয়। এই প্যারাডক্সের কোনও নাম আছে? এটি আমার কাছে বাস্তুতান্ত্রিক প্যারাডক্সের সাথে সম্পর্কিত তবে অভিন্ন নয় বলে মনে …
12 paradox 

2
আরে lmer () দিয়ে পোইসন জিএলএমএম-এ ওভারডিস্পার্সন পরীক্ষা কিভাবে করবেন?
আমার কাছে নিম্নলিখিত মডেল রয়েছে: > model1<-lmer(aph.remain~sMFS1+sAG1+sSHDI1+sbare+season+crop +(1|landscape),family=poisson) ... এবং এটি সারাংশ আউটপুট। > summary(model1) Generalized linear mixed model fit by the Laplace approximation Formula: aph.remain ~ sMFS1 + sAG1 + sSHDI1 + sbare + season + crop + (1 | landscape) AIC BIC logLik deviance 4057 4088 -2019 4039 …

2
একটি সাধারণীকরণীয় রৈখিক মডেলের অবশিষ্টাংশের প্রত্যাশিত বিতরণ কী?
আমি একটি জেনারেলাইজড লিনিয়ার মডেল সম্পাদন করছি, যেখানে আমাকে সাধারণের চেয়ে আলাদা একটি পরিবার নির্দিষ্ট করতে হবে। অবশিষ্টাংশের প্রত্যাশিত বিতরণ কী? উদাহরণস্বরূপ, অবশিষ্টাংশগুলি কি সাধারণত বিতরণ করা উচিত?

3
নাইভ বয়েস বৈশিষ্ট্যগুলির বৈশিষ্ট্য: আমি কি শব্দগুলিকে দ্বিগুণ করব?
আমি আমার নিজস্ব নাইভ বয়েস ব্যাগ ও ওয়ার্ডস মডেলের প্রোটোটাইপ করছি এবং বৈশিষ্ট্যের সম্ভাব্যতা গণনা করার বিষয়ে আমার একটি প্রশ্ন ছিল। ধরা যাক আমার দুটি ক্লাস হয়েছে, আমি কেবল স্প্যাম এবং নন-স্প্যাম ব্যবহার করব যেহেতু সবাই এটি ব্যবহার করে। এবং এর উদাহরণ হিসাবে "ভায়াগ্রা" শব্দটি নেওয়া যাক। আমার প্রশিক্ষণ সেটে …

5
আর এর মধ্যে বৈশিষ্ট্য নির্বাচন প্যাকেজগুলি, যা উভয়ই রিগ্রেশন এবং শ্রেণিবিন্যাস করে
লক । এই প্রশ্নটি এবং এর উত্তরগুলি লক করা আছে কারণ প্রশ্নটি অফ-টপিক তবে historicalতিহাসিক তাত্পর্যপূর্ণ। এটি বর্তমানে নতুন উত্তর বা মিথস্ক্রিয়া গ্রহণ করছে না। আমি আর এর সাথে খুব নতুন I আমি এখনই মেশিন লার্নিং শিখছি। খুব দুঃখিত, যদি এই প্রশ্নটি খুব প্রাথমিক মনে হয়। আমি আর-তে একটি ভাল …

2
আরএম মধ্যে lm এবং aov এর মধ্যে রিপোর্ট করা পি-মানগুলির মধ্যে পার্থক্য
নিম্নলিখিত aovএবং lmকলগুলিতে পি-মানগুলির পার্থক্য কী ব্যাখ্যা করে ? পার্থক্যটি কি কেবলমাত্র বিভিন্ন ধরণের স্কোম-অফ-বর্গ গণনার কারণে? set.seed(10) data=rnorm(12) f1=rep(c(1,2),6) f2=c(rep(1,6),rep(2,6)) summary(aov(data~f1*f2)) summary(lm(data~f1*f2))$coeff

5
20 নম্বর কি যাদু?
আমার কাছে উল্লেখ রয়েছে যা ডেটা ফিটিং বিতরণের জন্য সর্বনিম্ন 20 এর একটি নমুনা আকার বিবেচনা করার পরামর্শ দেয়। এর মধ্যে কি কোনও ধারণা আছে? ধন্যবাদ

3
মুন্ডলাক স্থির প্রতিক্রিয়া পদ্ধতি ডামিগুলির সাথে লজিস্টিক রিগ্রেশনের জন্য প্রযোজ্য?
আমার কাছে 8000 ক্লাস্টার এবং 4 মিলিয়ন পর্যবেক্ষণ সহ একটি ডেটাসেট রয়েছে। দুর্ভাগ্যক্রমে আমার পরিসংখ্যান সংক্রান্ত সফটওয়্যার, স্টাটা লজিস্টিক রিগ্রেশনের জন্য এর প্যানেল ডেটা ফাংশনটি ব্যবহার করার পরিবর্তে ধীরে ধীরে চালিত হয়: xtlogitএমনকি 10% সাবমেল সহ। তবে ননপ্যানেল ব্যবহার করার সময় logitফলাফলগুলি খুব শীঘ্রই উপস্থিত হয়। সুতরাং আমি logitসংশোধিত ডেটা …

3
আরওসি বক্ররেখাটি তির্যকটি অতিক্রম করে
আমি এই মুহুর্তে বাইনারি ক্লাসিফায়ার চালাচ্ছি। আমি যখন আরওসি বক্ররেখার প্লট করি আমি শুরুতে একটি ভাল লিফট পাই তখন এটি দিক পরিবর্তন করে এবং তির্যকটি অতিক্রম করে অবশ্যই ব্যাক আপ করুন, বক্ররেখাটিকে আকৃতির মতো কাত করে দেওয়া making এই প্রভাবটির ব্যাখ্যা / ব্যাখ্যা কী হতে পারে? ধন্যবাদ
12 roc 

2
কিউকিউ প্লট হিস্টগ্রামের সাথে মেলে না
আমার কাছে হিস্টোগ্রাম, কার্নেল ঘনত্ব এবং আর্থিক লগ রিটার্নগুলির একটি উপযুক্ত সাধারণ বিতরণ রয়েছে, যা ক্ষতির মধ্যে রূপান্তরিত হয় (লক্ষণগুলি পরিবর্তিত হয়), এবং এই ডেটার একটি সাধারণ কিউকিউ প্লট রয়েছে: কিউকিউ প্লটটি পরিষ্কারভাবে দেখায় যে লেজগুলি সঠিকভাবে লাগানো হয়নি। তবে আমার যদি হিস্টোগ্রাম এবং লাগানো সাধারণ বিতরণ (নীল) দিকে নজর …

3
এলোমেলো বন হিসাবে গণনা ডেটা পূর্বাভাস
একটি এলোমেলো অরণ্য গণনা তথ্য যথাযথভাবে পূর্বাভাস প্রশিক্ষণ দেওয়া যেতে পারে? এটি কীভাবে এগিয়ে যাবে? আমার কাছে মানগুলির বিস্তৃত পরিসর রয়েছে সুতরাং শ্রেণিবিন্যাসটি সত্যিকার অর্থে আসে না। আমি যদি রিগ্রেশন ব্যবহার করতাম তবে আমি কী ফলাফলগুলি ছাঁটাই করব? আমি এখানে বেশ হারিয়ে গেছি। কোন ধারনা?

3
অত্যন্ত অ-লিনিয়ার ফাংশন ফিটিংয়ের কৌশল
একটি বায়োফিজিক পরীক্ষা থেকে ডেটা বিশ্লেষণের জন্য, আমি বর্তমানে একটি উচ্চ অ-রৈখিক মডেলের সাথে কার্ভ ফিটিং করার চেষ্টা করছি। মডেল ফাংশনটি মূলত: y=ax+bx−1/2y=ax+bx−1/2y = ax + bx^{-1/2} এখানে, বিশেষত এর মান খুব আগ্রহের।bbb এই ফাংশনটির জন্য একটি প্লট: (নোট করুন যে মডেল ফাংশনটি সিস্টেমের গাণিতিক বিবরণের উপর ভিত্তি করে তৈরি …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.