পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
সমর্থন ভেক্টর মেশিন ভারসাম্যহীন ডেটাসেট পরিচালনা করে?
এসভিএম ভারসাম্যহীন ডেটাসেট পরিচালনা করে? ভারসাম্যহীন ডেটাসেট পরিচালনা করে এমন কোনও প্যারামিটার (যেমন সি, বা ভুল সংশোধনী ব্যয়)?

1
প্রথম অর্ডার ডেরিভেটিভ শূন্যের সময় ডেল্টা পদ্ধতিটি কীভাবে ব্যবহার করবেন?
http://en.wikipedia.org/wiki/Delta_method উইকিপিডিয়া নিবন্ধে, এটা যে যা হওয়ার তাই হল থাকা আবশ্যক এবং যে ছ ' ( θ ) হয় নন-জিরো মূল্যবান। √ এর জন্য কী অসম্পূর্ণ বিতরণ পাওয়া সম্ভব?g′(θ)g′(θ)g'(\theta)g′(θ)g′(θ)g'(\theta) প্রদত্তছ'(θ)শূন্য এবং হতে পারে √n−−√(g(Xn)−g(θ))n(g(Xn)−g(θ))\sqrt{n}(g(X_n)-g(\theta)) g′(θ)g′(θ)g'(\theta)?n−−√(Xn−θ)→dN(0,σ2)n(Xn−θ)→dN(0,σ2)\sqrt{n}(X_n-\theta) \stackrel{d}{\rightarrow} N(0,\sigma^2)

5
ছড়িয়ে যাওয়ার 'সমতা' কি আছে?
আমি ওয়েবে সন্ধান করেছি, কিন্তু সহায়ক কিছু খুঁজে পেল না। আমি মূলত একটি মূল্য কীভাবে 'সমানভাবে' বিতরণ করা হয় তা পরিমাপ করার উপায় খুঁজছি। যেমনটি, এক্সের মতো একটি 'সমান' বিতরণ বিতরণ : এবং প্রায় একই গড় এবং স্ট্যান্ডার্ড বিচ্যুতির একটি 'অসম' বিতরণ বিতরণ ওয়াই : তবে এম (এক্স)> মি (ওয়াই) …

3
আইটেম রেসপন্স থিওরি বনাম কনফার্ম্যাটরি ফ্যাক্টর বিশ্লেষণ
আমি ভাবছিলাম আইটেম রেসপন্স তত্ত্ব এবং কনফার্ম্যাটরি ফ্যাক্টর বিশ্লেষণের মধ্যে মূল, অর্থপূর্ণ পার্থক্যগুলি কী। আমি বুঝতে পারি যে গণনাগুলির মধ্যে পার্থক্য রয়েছে (আইটেম বনাম কোভেরিয়েন্সগুলিতে আরও ফোকাস করা; লগ-লিনিয়ার বনাম লিনিয়ার)। তবে, উচ্চ-স্তরের দৃষ্টিকোণ থেকে এর অর্থ কী তা আমার কোনও ধারণা নেই - এর অর্থ কী এই আইআরটি কিছু …

5
সেন্সর করা ডেটা ঠিক কী?
আমি সেন্সর করা ডেটার বিভিন্ন বিবরণ পড়েছি: ক) এই থ্রেডে বর্ণিত হিসাবে, নির্দিষ্ট থ্রেশহোল্ডের নীচে বা তার উপরে অপ্রমাণিত ডেটা সেন্সর করা হয়েছে। অপ্রমাণিত মানে ডেটা নির্দিষ্ট স্রোতের চেয়ে উপরে বা নীচে তবে আমরা সঠিক মানটি জানি না। এরপরে রিগ্রেশন মডেলটিতে ডেটা কম বা উচ্চ প্রান্তিক মান হিসাবে চিহ্নিত করা …

3
বুটস্ট্র্যাপ: ওভারফিটিংয়ের বিষয়টি
অঙ্কন করার মাধ্যমে এক সঞ্চালিত তথাকথিত অ স্থিতিমাপ বুটস্ট্র্যাপ ধরুন BBB আকার নমুনা nnn মূল থেকে প্রতিটিnnn প্রতিস্থাপন সঙ্গে পর্যবেক্ষণ। আমি বিশ্বাস করি যে এই পদ্ধতিটি সমকালীন সিডিএফ দ্বারা संचयी বিতরণ ফাংশনটি অনুমান করার সমান: http://en.wikipedia.org/wiki/Empirical_distribution_function এবং তারপরে অনুমান করা সিডিএফ বি থেকে nnn পর্যবেক্ষণ অনুকরণ করে বুটস্ট্র্যাপ নমুনা প্রাপ্ত …

2
কে-মানে বনাম কে-মিডিয়ান?
আমি জানি যে কে-মানে ক্লাস্টারিং অ্যালগরিদম এবং কে-মিডিয়ান রয়েছে। একটি ক্লাস্টারের কেন্দ্র হিসাবে গড় ব্যবহার করে এবং অন্যটি মিডিয়ান ব্যবহার করে। আমার প্রশ্ন: কখন / কোথায় কোনটি ব্যবহার করবেন?

1
কিউকিউ লাইনের জন্য আত্মবিশ্বাস ব্যান্ড
এই প্রশ্নটি বিশেষভাবে সম্পর্কিত নয় R, তবে আমি Rএটি চিত্রিত করার জন্য ব্যবহার করতে পছন্দ করেছি। একটি (সাধারণ) কিউকি-লাইনের চারপাশে আত্মবিশ্বাস ব্যান্ড উত্পাদন করার কোডটি বিবেচনা করুন: library(car) library(MASS) b0<-lm(deaths~.,data=road) qqPlot(b0$resid,pch=16,line="robust") আমি কীভাবে এই আত্মবিশ্বাস ব্যান্ডগুলি তৈরি করা হয় (বা আরক্সের ফাইলগুলিতে ফক্স 2002 এর একটি রেফারেন্স দেখেছি তবে দুঃখের …

4
জুরি নির্বাচনের পক্ষপাতিত্ব?
কোনও বন্ধু একটি ফৌজদারী বিচারের পরে আপিলের উপরে ক্লায়েন্টের প্রতিনিধিত্ব করছে, যেখানে দেখা যাচ্ছে যে জুরি নির্বাচনটি জাতিগতভাবে পক্ষপাতদুষ্ট ছিল। জুরি পুলটিতে ৪ টি জাতিগত গোষ্ঠীতে ৩০ জন লোক ছিল। প্রসিকিউশন এই 10 জনকে পুল থেকে নির্মূল করার জন্য চূড়ান্ত চ্যালেঞ্জ ব্যবহার করেছিল। প্রতিটি জাতিগত গোষ্ঠীর লোক সংখ্যা এবং প্রকৃত …

3
লজিস্টিক রিগ্রেশন এর সহগগুলির কোনও অর্থ আছে?
আমার বেশ কয়েকটি বৈশিষ্ট্য থেকে বাইনারি শ্রেণিবদ্ধার সমস্যা আছে। একটি (নিয়মিত) লজিস্টিক রিগ্রেশন এর সহগগুলির কি ব্যাখ্যাযোগ্য অর্থ আছে? আমি ভেবেছিলাম তারা প্রভাবগুলির আকার নির্দেশ করতে পারে, বৈশিষ্ট্যগুলি আগেই স্বাভাবিক করা হয়। তবে, আমার সমস্যায় সহগগুলি আমার নির্বাচন করা বৈশিষ্ট্যগুলির উপর সংবেদনশীলভাবে নির্ভর করে বলে মনে হচ্ছে। এমনকি গুণফলগুলির চিহ্নটি …

2
ফ্রিকোয়েন্সিস্ট স্ট্যাটিস্টিকসে সাবজেক্টিভিটি
আমি প্রায়শই দাবিটি শুনি যে বায়েশিয়ান পরিসংখ্যানগুলি অত্যন্ত বিষয়গত হতে পারে। মূল যুক্তিটি হ'ল অনুমানটি পূর্বের নির্বাচনের উপর নির্ভর করে (যদিও কেউ উদাসীনতার নীতিটি ব্যবহার করতে পারে o একটি অগ্রাধিকারটি বেছে নিতে সর্বাধিক এনট্রপি)। তুলনায়, দাবি যায়, ঘন ঘনসংখ্যক পরিসংখ্যান সাধারণত আরও উদ্দেশ্যমূলক হয়। এই বিবৃতিতে কতটা সত্যতা আছে? এছাড়াও, …

1
গেলম্যান এবং রুবিন কনভার্জেনশন ডায়াগোনস্টিক, কীভাবে ভেক্টরগুলির সাথে কাজ করার জন্য সাধারণীকরণ করবেন?
সমান্তরালভাবে চলমান একাধিক এমএমসিসি চেইনের রূপান্তর পরীক্ষা করতে গেলম্যান এবং রুবিন ডায়াগনস্টিক ব্যবহার করা হয়। এটি আন্তঃ-চেইন বৈকল্পিককে মধ্যবর্তী-চেইনের বৈচিত্রের সাথে তুলনা করে, প্রকাশটি নীচে রয়েছে: পদক্ষেপ (প্রতিটি প্যারামিটারের জন্য): অতিমাত্রায় প্রারম্ভিক মানগুলি থেকে 2 length দৈর্ঘ্যের মি ≥ 2 চেইনগুলি চালান। প্রতিটি চেইনে প্রথম এন অঙ্কন ত্যাগ করুন। চেনের …

1
কীভাবে কার্ল পিয়ারসন চি-স্কোয়ার পরিসংখ্যান নিয়ে এসেছেন?
পিয়ারসন কীভাবে নীচের পিয়ারসন চি-স্কোয়ার পরিসংখ্যান নিয়ে 1900 সালে এসেছিলেন? যে K∼χ2K=∑(Oij−Eij)2EijK=∑(Oij−Eij)2Eij K = \sum \frac{(O_{ij} -E_{ij})^2}{E_{ij}} K∼χ2K∼χ2 K \sim \chi^2 তিনি কি মনে মনে চি-স্কোয়ার রেখেছিলেন এবং মেট্রিক (নীচে-আপ পদ্ধতির) তৈরি করেছিলেন, নাকি তিনি পরিসংখ্যানটি তৈরি করেছিলেন এবং পরে প্রমাণ করেছেন যে এটি চি-স্কোয়ার বিতরণ (শীর্ষ-ডাউন) অনুসরণ করে?KKK আমি …

4
"পারস্পরিক সম্পর্ক" এর অর্থ কি রিগ্রেশন বিশ্লেষণের meanাল?
আমি একটি কাগজ পড়ছি এবং লেখক লিখেছেন: Y, A, B, C এর প্রভাব একাধিক রিগ্রেশন বিশ্লেষণের মাধ্যমে অধ্যয়ন করা হয়েছিল। A, B, C নির্ভরশীল পরিবর্তনশীল হিসাবে Y এর সাথে রিগ্রেশন সমীকরণে প্রবেশ করেছিল। বৈকল্পিক বিশ্লেষণটি সারণি 3 এ উপস্থাপন করা হয়েছে, বি এর সাথে Y এর প্রভাব তাৎপর্যপূর্ণ ছিল, বি …

1
মেশিন লার্নিং ক্লাসিফায়ারগুলি বিগ-ও বা জটিলতা
পারফরম্যান্সটি একটি নতুন শ্রেণিবদ্ধ অ্যালগরিদম মূল্যায়ন করতে, আমি নির্ভুলতা এবং জটিলতা (প্রশিক্ষণ এবং শ্রেণিবদ্ধকরণে বিগ-ও) তুলনা করার চেষ্টা করছি। থেকে মেশিন লার্নিং: একটি পর্যালোচনা আমি একটি সম্পূর্ণ তত্ত্বাবধানে থাকা ক্লাসিফায়ার তালিকা একটি সঠিকতা টেবিল আলগোরিদিম মধ্যে থেকে 44 টি টেস্ট সমস্যার পেতে, এবং UCI তথ্য repositoy । তবে সাধারণ শ্রেণিবদ্ধের …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.