পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

1
স্ট্যান্ডার্ড ত্রুটিটিকে স্ট্যান্ডার্ড বিচ্যুতিতে রূপান্তর করা হচ্ছে?
স্ট্যান্ডার্ড ত্রুটিটিকে স্ট্যান্ডার্ড বিচ্যুতিতে রূপান্তর করা কি বুদ্ধিমান? এবং যদি তা হয় তবে এই সূত্রটি কি উপযুক্ত? SE=SDN−−√SE=SDNSE = \frac{SD}{\sqrt{N}}

6
লজিস্টিক রিগ্রেশন জন্য নমুনা আকার?
আমি আমার জরিপের তথ্য থেকে একটি লজিস্টিক মডেল তৈরি করতে চাই। এটি চারটি আবাসিক উপনিবেশের একটি ছোট সমীক্ষা যেখানে 154 জন উত্তরদাতাকে সাক্ষাত্কার দেওয়া হয়েছিল। আমার নির্ভরশীল পরিবর্তনশীল হ'ল "কার্যক্রমে সন্তোষজনক রূপান্তর"। আমি খুঁজে পেয়েছি যে 154 জন উত্তরদাতাদের মধ্যে 73 জন বলেছিলেন যে তারা সন্তোষজনকভাবে কাজটিতে স্থানান্তরিত হয়েছে, বাকিরা …

3
মানোভা এবং পুনরাবৃত্তি ব্যবস্থা আনোভা মধ্যে পার্থক্য?
কিছু ফ্যাক্টর (পরীক্ষামূলক শর্তটি বলুন) এবং একটি মনোভা সম্পর্কে বারবার ব্যবস্থা আনোভা মধ্যে পার্থক্য কী? বিশেষ করে একটি ওয়েবসাইটে আমি হোঁচট খেয়েছি বলে পরামর্শ দিয়েছিল যে মানোভা গোলকত্বের একই ধারণা গ্রহণ করে না যে বারবার এনোভা যে ব্যবস্থা গ্রহণ করে, তা কি সত্য? যদি তা হয় তবে কেন একজন সর্বদা …

2
সিনথেটিক ডেটা সেট তৈরি করার জন্য কিছু মানক অনুশীলনগুলি কী কী?
প্রসঙ্গ হিসাবে: খুব বড় ডেটা সেট নিয়ে কাজ করার সময়, আমাকে মাঝে মাঝে জিজ্ঞাসা করা হয় যে আমরা কোন সিনথেটিক ডেটা সেট তৈরি করতে পারি যেখানে আমরা ভবিষ্যদ্বাণীকারীদের সাথে প্রতিক্রিয়াশীল পরিবর্তনশীল এবং ভবিষ্যদ্বাণীকের মধ্যে সম্পর্ক "জানি"। বছরের পর বছরগুলিতে, আমি উভয়ই এক-অফ সিন্থেটিক ডেটা সেটগুলির মুখোমুখি হব বলে মনে হচ্ছে, …

4
গ্রিডলাইন এবং ধূসর পটভূমি চার্টজঙ্ক এবং সেগুলি কেবল ব্যতিক্রমের ভিত্তিতে ব্যবহার করা উচিত?
দেখে মনে হচ্ছে বেশিরভাগ কর্তৃপক্ষ সম্মত হন যে প্লটগুলিতে অন্ধকার বা অন্যথায় বিশিষ্ট গ্রিডলাইনগুলি কোনও যুক্তিসঙ্গত সংজ্ঞা দ্বারা "চার্টজঙ্ক" এবং চার্টের মূল অংশের বার্তা থেকে দর্শকের মন খারাপ করে দেয়। সুতরাং আমি point দফায় রেফারেন্স দেওয়ার জন্য বিরক্ত করব না। সমানভাবে, আমরা সব সম্মত করতে পারেন থাকবে যে সময়ের যে …

2
বিতরণটির কি কোনও নাম আছে?
আমি অন্য দিন এই ঘনত্ব পেরিয়ে। কেউ এই নাম দিয়েছে? f(x)=log(1+x−2)/2πf(x)=log⁡(1+x−2)/2πf(x) = \log(1 + x^{-2}) / 2\pi ঘনত্বের সূচনাটি অসীম এবং এটিতে ফ্যাট লেজ রয়েছে। আমি এটিকে প্রাসঙ্গিক বিতরণ হিসাবে দেখেছি যেখানে অনেকগুলি পর্যবেক্ষণ ছোট হওয়ার আশা করা হয়েছিল, যদিও বড় মানগুলিও প্রত্যাশিত ছিল।

3
খুব সামান্য নমুনার আকারের (যেমন, এন = 6) দিয়ে স্বাভাবিকতার জন্য পরীক্ষা করা কি অর্থবহ?
আমার একটি নমুনা আকার 6.. এরকম ক্ষেত্রে কোলমোগোরভ-স্মারনভ পরীক্ষাটি ব্যবহার করে স্বাভাবিকতার জন্য পরীক্ষা করা কি বোধগম্য? আমি এসপিএস ব্যবহার করেছি। আমার একটি খুব ছোট নমুনা আকার রয়েছে কারণ এটি প্রতিটি পেতে সময় লাগে। যদি এটি বোধগম্য হয় না, তবে কতটি নমুনা সর্বনিম্ন সংখ্যা যা পরীক্ষার জন্য বোঝায়? দ্রষ্টব্য: উত্স …

6
আমি সম্ভবত 1300 সালে জন্মগ্রহণকারী কোনও নির্দিষ্ট ব্যক্তির বংশোদ্ভূত হতে পারি?
অন্য কথায়, নীচের উপর ভিত্তি করে, পি কি? এটিকে নৃবিজ্ঞান বা সামাজিক বিজ্ঞানের চেয়ে গণিতের সমস্যা তৈরি করার জন্য এবং সমস্যাটি সহজ করার জন্য, ধরে নেওয়া উচিত যে ভাইবোন এবং প্রথম চাচাত ভাইরা কখনও সঙ্গী হন না, এবং সঙ্গী সর্বদা একই থেকে নির্বাচিত হয়, জনগণের জুড়ে সমান সম্ভাবনার সাথে বাছাই …

4
ইয়াহু ফিনান্স থেকে স্টক মূল্য আমদানি করবেন?
লক । এই প্রশ্নটি এবং এর উত্তরগুলি লক করা আছে কারণ প্রশ্নটি অফ-টপিক তবে historicalতিহাসিক তাত্পর্যপূর্ণ। এটি বর্তমানে নতুন উত্তর বা মিথস্ক্রিয়া গ্রহণ করছে না। আমি ইয়াহু ফিনান্স থেকে "সর্বশেষ বাণিজ্য" শেয়ারের দামটি আরয়েতে আমদানি করতে চাই The উদ্দেশ্যটি হল (প্রায়) রিয়েল টাইম ডেটার সাথে কাজ করা। কোন সমাধান আছে? …
26 r 

3
আর এর সাথে লাগানো নেতিবাচক দ্বিপদী রেজিস্ট্রেশনে থায়া কী?
নেতিবাচক দ্বিপদী রিগ্রেশন সম্পর্কে আমার একটি প্রশ্ন এসেছে: মনে করুন যে আপনার নিম্নলিখিত আদেশগুলি রয়েছে: require(MASS) attach(cars) mod.NB<-glm.nb(dist~speed) summary(mod.NB) detach(cars) (দ্রষ্টব্য যে গাড়িগুলি একটি ডেটাসেট যা আর এ উপলভ্য, আমি যা জানতে চাই তা হল: আমি কীভাবে চলকটি ব্যাখ্যা করতে পারি theta(কলটির নীচে ফিরে আসার পরে summary)। এটি কি নেগবিন …

9
একটি লজিস্টিক রিগ্রেশন-ভিত্তিক মডেলের নির্ভুলতা পরিমাপ করা
আমার কাছে একটি প্রশিক্ষিত লজিস্টিক রিগ্রেশন মডেল রয়েছে যা আমি পরীক্ষার ডেটা সেটটিতে প্রয়োগ করছি। নির্ভরশীল পরিবর্তনশীল বাইনারি (বুলিয়ান)। পরীক্ষার ডেটা সেটে প্রতিটি নমুনার জন্য, আমি লজিস্টিক রিগ্রেশন মডেলটি প্রয়োগ করে এমন একটি% সম্ভাবনা তৈরি করে যে নির্ভরশীল পরিবর্তনশীলটি সত্য হবে। তারপরে আমি রেকর্ড করি যে একিউটাল মানটি সত্য ছিল …

1
কীভাবে আর-এ অনুগ্রহ করে দেখাতে পারেন যে ক্রস-বৈধকরণের পদ্ধতিগুলি এআইসি এবং বিআইসির সমতুল্য?
এই সাইটের অন্য কোথাও একটি প্রশ্নের মধ্যে বেশ কয়েকটি উত্তরে উল্লেখ করা হয়েছে যে এআইসি লেভ-ওয়ান-আউট (এলইউ) ক্রস-বৈধকরণের সমতুল্য এবং বিআইসির কে-ফোল্ড ক্রস বৈধতার সমতুল্য। এটি কি আর-তে অভিজ্ঞতার সাথে দেখানোর কোনও উপায় আছে যে এলইউ এবং কে-ফোল্ডের সাথে জড়িত কৌশলগুলি এআইসি এবং বিআইসির মানগুলির সমতুল্য হিসাবে পরিষ্কার এবং প্রদর্শিত …
26 r  aic  cross-validation  bic 

4
র্যানস্যাক পরিসংখ্যানগুলিতে কেন বহুল ব্যবহৃত হয় না?
কম্পিউটার দর্শনের ক্ষেত্র থেকে আগত, আমি প্রায়শই প্রচুর বিদেশিদের সাথে ডেটাতে মডেলগুলি ফিটিংয়ের জন্য রানস্যাক (র্যান্ডম নমুনা সম্মতি) পদ্ধতিটি ব্যবহার করেছি। যাইহোক, আমি এটি পরিসংখ্যানবিদদের দ্বারা ব্যবহৃত কখনও দেখিনি, এবং আমি সর্বদা এই ধারণাটির মধ্যে ছিলাম যে এটি একটি "পরিসংখ্যানগতভাবে কার্যকর" পদ্ধতি হিসাবে বিবেচিত হয় না। কেন যে এত? এটি …

3
আর এর পোল ফাংশন (আদেশযুক্ত লজিস্টিক রিগ্রেশন) থেকে আউটপুট কীভাবে বোঝা যায়?
আমি আর-তে নতুন, আদেশ দিয়েছি লজিস্টিক রিগ্রেশন এবং polr। পলারের জন্য সহায়তা পৃষ্ঠার নীচে "উদাহরণস্বরূপ" বিভাগ (এটি একটি অর্ডারযুক্ত ফ্যাক্টরের প্রতিক্রিয়াতে লজিস্টিক বা প্রবিট রিগ্রেশন মডেল ফিট করে) দেখায় options(contrasts = c("contr.treatment", "contr.poly")) house.plr <- polr(Sat ~ Infl + Type + Cont, weights = Freq, data = housing) pr <- …
26 r  logistic 

11
বহুবিশ্লেষ বিশ্লেষণের জন্য বইয়ের সুপারিশ
আমি মাল্টিভারিয়েট বিশ্লেষণ সম্পর্কে কিছু বই পেতে আগ্রহী এবং আপনার প্রস্তাবনাগুলি দরকার। নিখরচায় বই সর্বদা স্বাগত, তবে আপনি যদি কিছু দুর্দান্ত-বিহীন এমভিএ বইয়ের বিষয়ে জানেন তবে দয়া করে তা জানান।

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.