পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

1
কেন গাউসীয় রৈখিক মডেলগুলির এফ-টেস্ট সবচেয়ে শক্তিশালী?
একটি গসিয়ান রৈখিক মডেল জন্য যেখানে কিছু ভেক্টর স্থান মিথ্যা বলে ধরা হয় এবং উপর আদর্শ সাধারন বন্টনের হয়েছে , এর পরিসংখ্যাত জন্য -test যেখানে একটি ভেক্টর স্থান, একটি বৃদ্ধি একের সাথে এক ফাংশন বক্রতা পরিসংখ্যাত: আমরা কীভাবে জানতে পারি যে এই পরিসংখ্যানটি এইচটি 00 এর জন্য সবচেয়ে শক্তিশালী পরীক্ষা …

2
কেন স্বাধীনতা পরীক্ষা চি-স্কোয়ার বিতরণ ব্যবহার করে?
ধার্মিকতা অফ হইয়া পরীক্ষা নিম্নলিখিত ব্যবহার পরিসংখ্যাত : পরীক্ষা ইন, দেওয়া যে শর্তগুলি পূরণ করা হয়, কেউ ব্যবহার করে - পি-মান গণনা করার জন্য বিতরণ যে টি সত্য তা একই আকারের প্রতিনিধি নমুনায় এই জাতীয় মানটি পর্যবেক্ষণ করতে পারে।χ 2 0 = n ∑ i = 1 ( O i …

2
বিটা বিতরণের গড়ের জন্য আত্মবিশ্বাসের ব্যবধান গণনা করুন
[0,1] এ প্রদত্ত রেটিংয়ের একটি সেট জন্য বিটা বিতরণ বিবেচনা করুন। গড় গণনা করার পরে: μ = αα + βμ=αα+ +β \mu = \frac{\alpha}{\alpha+\beta} এর অর্থের চারদিকে কোনও আস্থা অন্তর দেওয়ার কোনও উপায় আছে কি?

2
বনাম -test 2 দলে দলে একটি ঠান্ডা ধরার মতভেদ তুলনা জন্য -test
আমি একটি আকর্ষণীয় পরীক্ষার (একটি উত্স ছাড়া, দুর্ভাগ্যক্রমে) সম্পর্কে একটি বরং সম্মানিত (জনপ্রিয়) বিজ্ঞান ম্যাগাজিনে (জার্মান প্রধানমন্ত্রী, 02/2013, p.36) পড়েছি। এটি আমার দৃষ্টি আকর্ষণ করেছে কারণ স্বজ্ঞাতভাবে আমি ফলাফলটির তাত্পর্য নিয়ে সন্দেহ করেছি, তবে প্রদত্ত তথ্যটি পরিসংখ্যান পরীক্ষার পুনরুত্পাদন করার জন্য যথেষ্ট ছিল। গবেষকরা ভেবেছিলেন যে ঠান্ডা আবহাওয়ায় শীত পড়লে …

4
দুটি অধিক নমুনার মধ্যে মধ্যমদের মধ্যে পার্থক্যের জন্য হাইপোথিসিস পরীক্ষা
প্রশ্ন তিন গ্রুপের পরীক্ষার স্কোরগুলি আর-তে পৃথক ভেক্টর হিসাবে সংরক্ষণ করা হয়েছে set.seed(1) group1 <- rnorm(100, mean = 75, sd = 10) group2 <- rnorm(100, mean = 85, sd = 10) group3 <- rnorm(100, mean = 95, sd = 10) আমি জানতে চাই যে এই গ্রুপগুলির মধ্যে মধ্যমদের মধ্যে কোনও …

5
পুনরাবৃত্ত (অনলাইন) সর্বনিম্ন স্কোয়ার অ্যালগরিদমকে নিয়মিত করে
টিখনভ নিয়মিতকরণ (ন্যূনতম স্কোয়ারগুলি নিয়মিত করা) এর জন্য কোনও অনলাইন (পুনরাবৃত্ত হওয়া) অ্যালগরিদমের দিকে আমাকে কী নির্দেশ করতে পারে? একটি অফলাইন সেটিং, আমি নিরূপণ করবে আমার মূল ডেটা সেট যেখানে ব্যবহার λ ক্রস বৈধতা এন-ভাঁজ ব্যবহার পাওয়া যায়। Y = x ^ T \ hat \ বিটা ব্যবহার করে প্রদত্ত …

1
পিডিএফ এর অনুপাত বনাম অনুপাতের অনুপাত
আমি একটি ক্লাস্টারিং সমস্যা সমাধানের জন্য বেয়েস ব্যবহার করছি। কিছু গণনা করার পরে আমি দুটি সম্ভাবনার অনুপাত পাওয়ার প্রয়োজনীয়তাটি শেষ করি: P(A)/P(B)P(A)/P(B)P(A)/P(B) প্রাপ্ত পাবে P(H|D)P(H|D)P(H|D) । এই সম্ভাবনাগুলি এই উত্তরে বর্ণিত হিসাবে দুটি পৃথক 2 ডি মাল্টিভারিয়েট কে-ডি-ই সংহত করে প্রাপ্ত করা হয়েছে : পি ( বি ) = ∬ …

3
বাইনোমিয়ালের ফিশার তথ্য বি এর বিপরীতভাবে সমানুপাতিক হওয়ায় স্বজ্ঞাত কারণে
এটি আমার মনকে বিভ্রান্ত করে / উড়িয়ে দেয় যে বাইনোমিয়ালের আনুপাতিক পরিমাণ রয়েছে । সমতুল্যভাবে, ফিশার তথ্য সমানুপাতিক । এটার কারণ কি? ফিশার তথ্য এ কেন হ্রাস করা হয় ? অর্থাত্, তে অনুমান কেন সবচেয়ে কঠিন ?p(1−p)p(1−p)p(1-p)1p(1−p)1p(1−p)\frac{1}{p(1-p)}p=0.5p=0.5p=0.5p=0.5p=0.5p=0.5 প্রসঙ্গ: আমি একটি নমুনা আকারের ক্যালকুলেটর নিয়ে কাজ করছি, এবং এর সূত্রটি , …

10
সাধারণ শব্দ যা নির্দিষ্ট পরিসংখ্যানগত অর্থ রয়েছে
আমি কোনও পরিসংখ্যানবিদ নই তবে আমার গবেষণা কাজে পরিসংখ্যান (তথ্য বিশ্লেষণ, সাহিত্য পড়া ইত্যাদি) জড়িত। আমাকে এখানে পোস্ট করা আমার একটি প্রশ্নের একটি মন্তব্য থেকে আবার স্মরণ করিয়ে দেওয়া হয়েছিল যে কয়েকটি সাধারণ শব্দ রয়েছে যাঁদের বিশেষত নির্দিষ্ট অর্থ বা অর্থের ক্ষেত্রের ক্ষেত্রে ভাল অনুশীলনকারীদের অর্থ রয়েছে। এই জাতীয় শব্দের …

2
এমএলই এর অর্থ কি সর্বদা আমরা আমাদের ডেটাগুলির অন্তর্নিহিত পিডিএফ জানি এবং ইএম এর অর্থ আমরা কী না?
আমার কিছু সাধারণ ধারণাগত প্রশ্ন রয়েছে যা আমি এমএলই (সর্বাধিক সম্ভাবনার প্রাক্কলন) সম্পর্কিত এবং ইএম (প্রত্যাশা সর্বাধিকতা) এর সাথে কোনও যোগসূত্র আছে কিনা তা স্পষ্ট করতে চাই। আমি এটি যেমন বুঝতে পেরেছি, যদি কেউ "আমরা এমএলই ব্যবহার করি" বলে থাকে তবে তার অর্থ কি স্বয়ংক্রিয়ভাবে তাদের ডেটার পিডিএফের একটি স্পষ্ট …

2
টি-বিতরণ ঘনত্ব ফাংশনের পিছনে অন্তর্দৃষ্টি
আমি স্টুডেন্টের টি-ডিস্ট্রিবিউশন সম্পর্কে অধ্যয়ন করছি এবং আমি ভাবতে শুরু করেছিলাম, কীভাবে কেউ টি-ডিস্ট্রিবিউশন ডেনসিটি ফাংশন (উইকিপিডিয়া, http://en.wikedia.org/wiki/Student%27s_t-distribration থেকে ) পাবেন? f(t)=Γ(v+12)vπ−−√Γ(v2)(1+t2v)−v+12f(t)=Γ(v+12)vπΓ(v2)(1+t2v)−v+12f(t) = \frac{\Gamma(\frac{v+1}{2})}{\sqrt{v\pi}\:\Gamma(\frac{v}{2})}\left(1+\frac{t^2}{v} \right)^{-\frac{v+1}{2}} যেখানে হ'ল স্বাধীনতার ডিগ্রি এবং Γ হ'ল গামা ফাংশন। এই ফাংশনটির অন্তর্দৃষ্টি কী? আমি বলতে চাইছি, আমি যদি দ্বিপদী বিতরণের সম্ভাব্যতা গণ ফাংশনটি দেখি তবে …

2
কিছু লোক কেন তাদের কাঁচা ডেটাতে রিগ্রেশন-জাতীয় মডেল অনুমানগুলি পরীক্ষা করে এবং অন্যান্য লোকেরা তাদের অবশিষ্টাংশে পরীক্ষা করে?
আমি পরীক্ষামূলক মনোবিজ্ঞানের পিএইচডি শিক্ষার্থী এবং আমার ডেটা কীভাবে বিশ্লেষণ করতে হয় তা সম্পর্কে আমার দক্ষতা এবং জ্ঞানের উন্নতি করার জন্য আমি কঠোর চেষ্টা করি। মনোবিজ্ঞানে আমার 5 ম বছর অবধি, আমি ভেবেছিলাম যে রিগ্রেশন-জাতীয় মডেলগুলি (যেমন, আনোভা) নিম্নলিখিত জিনিসগুলি ধরে নিয়েছে: তথ্য স্বাভাবিকতা ডেটা এবং এর জন্য বৈকল্পিক একজাতীয়তা …

2
আমি কীভাবে একাধিক সংখ্যাযুক্ত ডেটা সেট জুড়ে বুটস্ট্র্যাপযুক্ত পি-মানগুলিকে পুল করতে পারি?
আমি যে সমস্যার সাথে আমি পি-ভ্যালুটি মাল্টিপল ইম্পিউটেড (এমআই) ডেটা থেকে অনুমানের জন্য বুটস্ট্র্যাপ করতে চাই তা নিয়ে উদ্বিগ্ন , তবে এমআই সেটগুলিতে কীভাবে পি-মানগুলি একত্রিত করা যায় তা আমার কাছে অস্পষ্ট।θθ\theta এমআই ডেটা সেটগুলির জন্য, অনুমানের মোট বৈকল্পিকতা পেতে স্ট্যান্ডার্ড পদ্ধতিটি রুবিনের নিয়ম ব্যবহার করে। পুলিং এমআই ডেটা সেটগুলির …

5
টার্ম ফ্রিকোয়েন্সি / বিপরীত নথির ফ্রিকোয়েন্সি (টিএফ / আইডিএফ): ওজন
আমার কাছে একটি ডেটাসেট রয়েছে যা 1000 টি নথি এবং এতে উপস্থিত সমস্ত শব্দকে উপস্থাপন করে। সুতরাং সারিগুলি নথির প্রতিনিধিত্ব করে এবং কলামগুলি শব্দের প্রতিনিধিত্ব করে। সুতরাং উদাহরণস্বরূপ, কক্ষে মান বার শব্দ ঘোরা নথিতে দেখা দেয় । এখন, tf / idf পদ্ধতি ব্যবহার করে শব্দের 'ওজন' খুঁজে বের করতে হবে, …

5
জন কেরিক মুদ্রা-ফ্লিপ ডেটা
ডাব্লুডব্লিউআই-এর সময় জন কেরিচের দ্বারা সম্পাদিত 10,000 কয়েনের ফ্লিপগুলি (যেমন, সমস্ত 10,000 মাথা এবং লেজ) এর ফলাফল কোথায় পাবেন সে বিষয়ে কেউ পরামর্শ দিতে পারেন?

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.