পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

3
কোনও ইভেন্টের সম্ভাবনা যা পরিমাপযোগ্য নয়
আমরা পরিমাপ তত্ত্ব থেকে জানি যে এমন কিছু ইভেন্ট রয়েছে যা পরিমাপ করা যায় না, অর্থাৎ সেগুলি লেবেসগু পরিমাপযোগ্য নয়। সম্ভাব্যতার পরিমাপটি সংজ্ঞায়িত নয় এমন সম্ভাব্যতা সহ আমরা কোন ইভেন্টটিকে কী বলি? এই জাতীয় ঘটনা সম্পর্কে আমরা কী ধরণের বক্তব্য দেব?

6
দুটি ভিন্ন র্যান্ডম ফরেস্ট মডেল থেকে আর-স্কোয়ারের তুলনা করুন
আমি আর এ র্যান্ডমফোরস্ট প্যাকেজটি ব্যবহার করছি র্যান্ডম ফরেস্ট মডেল বিকাশের জন্য, একটি "প্রশস্ত" ডেটাসেটে অবিচ্ছিন্ন ফলাফলকে নমুনার চেয়ে আরও বেশি ভবিষ্যদ্বাণীকারী ব্যাখ্যা করার চেষ্টা করার জন্য। বিশেষত, আমি একটি আরএফ মডেল ফিটিং করছি ~ 75 পূর্বাভাসকারী ভেরিয়েবলগুলির সেটটি যেটি আমার কাছে গুরুত্বপূর্ণ বলে মনে হয় সেট থেকে প্রক্রিয়াটি নির্বাচন …

3
পারস্পরিক সম্পর্ক মেট্রিক্সের মধ্যে একটি সম্পর্কের পরিসংখ্যানগত তাত্পর্য নির্দেশ করতে পারস্পরিক সম্পর্কের সহগের জন্য থ্রেশহোল্ড
আমি একটি ডেটা সেটের একটি সম্পর্কিত ম্যাট্রিক্স গণনা করেছি যার মধ্যে 455 ডেটা পয়েন্ট রয়েছে, প্রতিটি ডাটা পয়েন্ট 14 টি বৈশিষ্ট্যযুক্ত। সুতরাং পারস্পরিক সম্পর্ক মেট্রিক্সের মাত্রা 14 x 14 is আমি ভাবছিলাম যে পারস্পরিক সম্পর্ক সহগের মানটির জন্য একটি প্রান্ত রয়েছে কিনা যা উল্লেখ করে যে সেই দুটি বৈশিষ্ট্যের মধ্যে …

3
ডেটা পয়েন্টগুলির গড় হিসাবে দুটি সময়-সিরিজের সংমিশ্রণ
আমি গড় স্কোয়ারড প্রেডিকশন ত্রুটিটি হ্রাস করে একটি টাইম-সিরিজ ডেটা সেট করে এমন টাইম-সিরিজ ডেটার পূর্বাভাসিত এবং ব্যাককাস্টেড (অর্থাত্ পূর্বাভাসিত অতীত মানগুলি) একত্রিত করতে চাই। বলুন যে ২০০২-২০১০ এর সময়কালের জন্য আমার ২০০ series-২০১০ সময়কাল রয়েছে । আমি ২০০১-২০০7 ডেটা (লাল রেখাকে - এটি ) ব্যবহার করে ২০০ fore এর …

1
পরিসংখ্যান মডেলদের প্রশিক্ষণের জন্য কি "পর্যাপ্ত" ডেটার ধারণা রয়েছে?
আমি হিট মার্কোভ মডেলস এবং গাউসিয়ান মিশ্রণ মডেলগুলির মতো বেশ কয়েকটি পরিসংখ্যানের মডেলিংয়ে কাজ করি। আমি দেখতে পাচ্ছি যে প্রতিটি ক্ষেত্রে ভাল মডেলদের প্রশিক্ষণ দেওয়ার জন্য চূড়ান্ত ব্যবহারের মতো একই পরিবেশ থেকে নেওয়া একটি বৃহত (> 20000 বাক্য এইচএমএমদের জন্য বাক্য) প্রয়োজন। আমার প্রশ্নটি হ'ল: সাহিত্যে "পর্যাপ্ত" প্রশিক্ষণের ডেটা ধারণা …

2
এখানে কি এমন কোনও মডেল ফিট ফিট স্ট্যাটিস্টিক রয়েছে (যেমন এআইসি বা বিআইসির মতো) যা কেবলমাত্র তুলনামূলক তুলনার পরিবর্তে পরম জন্য ব্যবহার করা যেতে পারে?
আমি এই সাহিত্যের সাথে তেমন পরিচিত নই, সুতরাং যদি এটি একটি সুস্পষ্ট প্রশ্ন হয় তবে দয়া করে আমাকে ক্ষমা করুন। যেহেতু এআইসি এবং বিআইসি সম্ভাব্যতা সর্বাধিকের উপর নির্ভর করে, তাই মনে হয় যে কেবলমাত্র একটি নির্দিষ্ট ডেটা-সেট ফিট করার চেষ্টা করে এমন একটি মডেলের সেটগুলির মধ্যে তুলনামূলক তুলনা তৈরি করতে …

5
2-বর্ণের সংমিশ্রণগুলি ভিজ্যুয়ালাইজ করা
এসও-তে এই প্রশ্নের উত্তরগুলি প্রায় 125 এক-থেকে দ্বি-বর্ণের নামের একটি সেট ফেরত দিয়েছে: /programming/6979630/ কি -1-2-letter-object-names-conflict-with- existing -r-বস্তু [1] "Ad" "am" "ar" "as" "bc" "bd" "bp" "br" "BR" "bs" "by" "c" "C" [14] "cc" "cd" "ch" "ci" "CJ" "ck" "Cl" "cm" "cn" "cq" "cs" "Cs" "cv" [27] "d" "D" "dc" …

2
এম-এসিমেটরের শর্তগুলি প্রকৃত গড়তে রূপান্তরিত করতে
গাউসীয় ডিস্ট্রিবিউশন এবং এম-অনুমানকারী, , , কী বৈশিষ্ট্য গ্যারান্টি যথেষ্ট হয় সম্ভবত? কি কঠোরভাবে উত্তল এবং কঠোরভাবে বৃদ্ধি পাচ্ছে?X1,...,Xn∼N(μ,σ)X1,...,Xn∼N(μ,σ)X_1,...,X_n \sim N(\mu,\sigma) μm=argmina∑ρ(|Xi−a|)μm=argmina∑ρ(|Xi−a|)\mu_m = \underset{a}{\operatorname{argmin}} \sum\rho(|X_i-a|)ρρ\rhoμm→μμm→μ\mu_m \rightarrow \muρρ\rho
10 estimation 

1
ফাংশনের আকৃতি বজায় রেখে কীভাবে কোনও ফাংশনটিকে সম্ভাব্যতার ঘনত্বে পরিণত করতে হয়?
আমার কয়েকটি ক্রিয়াকলাপ রয়েছে, প্রত্যেকে এজেন্ট জুড়ে এলোমেলো পরিবর্তনশীলের ঘনত্বের প্রতিনিধিত্ব করে। প্রতিটি ফাংশনের একটি ডোমেনও রয়েছে যা র্যান্ডম ভেরিয়েবলের মানগুলি বৈধ কিনা তা বর্ণনা করে। এখন, আমি যদি আমার পরিসংখ্যানের ক্লাসগুলি সঠিকভাবে মনে রাখি, আমি যদি ফাংশনের ডোমেন দ্বারা বর্ণিত মানগুলিতে ক্রিয়াকলাপগুলির একটিতে ইন্টিগ্রাল গ্রহণ করি তবে আমার 1.0 …

4
অনলাইন আউটিলার সনাক্তকরণ
হাই-থ্রুপুট ইমেজিং পাইপলাইনের অংশ হিসাবে ত্রুটিযুক্ত চিত্রগুলি এবং / অথবা ত্রুটিযুক্ত বিভাগগুলি সনাক্ত করতে আমি স্বয়ংক্রিয়ভাবে বিভাগিত মাইক্রোস্কোপি চিত্রগুলি প্রক্রিয়া করতে চাই। প্রতিটি কাঁচা চিত্র এবং বিভাগকরণের জন্য গণনা করা যেতে পারে এমন অনেকগুলি প্যারামিটার রয়েছে এবং যখন চিত্রটি ত্রুটিযুক্ত হয় তখন এটি "চরম" হয় " উদাহরণস্বরূপ, চিত্রের একটি বুদবুদ …
10 outliers  online 

1
এটি কি মিশ্র মডেলগুলিতে ভবিষ্যদ্বাণী হিসাবে সময় অন্তর্ভুক্ত করার অনুমতি রয়েছে?
আমি সর্বদা বিশ্বাস করি যে সময়গুলি পূর্বেকার হিসাবে ভবিষ্যদ্বাণী হিসাবে ব্যবহার করা উচিত নয় (ইনক্ল্যাম। গামের) কারণ, তখন কেবল প্রবণতাটিই কেবল "বর্ণিত" হবে। যদি কোনও গবেষণার লক্ষ্য হ'ল তাপমাত্রা ইত্যাদির মতো পরিবেশগত প্যারামিটারগুলি খুঁজে পাওয়া যায় যা কোনও প্রাণীর ক্রিয়াকলাপের বিস্তৃতি ব্যাখ্যা করে, তবে আমি ভাবছি যে সময় কীভাবে কার্যকর …

2
সময় সিরিজের সেটগুলির তুলনা
আমি তুলনা করতে চাইছি সময়-সিরিজের ডেটা তিন সেট আছে। এগুলি প্রায় 12 দিনের 3 টি পৃথক সময়কালে নেওয়া হয়েছে। ফাইনালের সপ্তাহগুলিতে এগুলি কলেজের লাইব্রেরিতে নেওয়া সর্বনিম্ন, সর্বোচ্চ এবং সর্বনিম্ন প্রধান সংখ্যা। আমার গড়, সর্বোচ্চ এবং সর্বনিম্ন কারণটি ছিল কারণ প্রতি ঘন্টার মাথার সংখ্যাগুলি অবিচ্ছিন্ন ছিল না ( একটি সময়ের সিরিজের …

3
এল-ইনফিনিটি আদর্শ লিনিয়ার রিগ্রেশন সমাধান করার জন্য সফ্টওয়্যার প্যাকেজ
এল-ইনফিনিটি আদর্শকে হ্রাস করার লক্ষ্যে লিনিয়ার রিগ্রেশন সমাধান করার জন্য কোনও সফ্টওয়্যার প্যাকেজ রয়েছে কি?
10 regression 

2
দুটি ডেটাসেটের জন্য ফিট টেস্টের কোনও অ্যান্ডারসন-ডার্লিং ভালতা আছে কি?
আমি জানি অ্যাড.টেস্ট () সাধারণতা পরীক্ষা করার জন্য ব্যবহার করা যেতে পারে। দুটি ডেটা নমুনা থেকে বিতরণকে তুলনা করার জন্য কি অ্যাড.টেস্ট পাওয়া সম্ভব? x <- rnorm(1000) y <- rgev(2000) ad.test(x,y) আমি কীভাবে 2 টি নমুনায় অ্যান্ডারসন-ডার্লিং পরীক্ষা করতে পারি?

4
কেন ডেমোগ্রাফাররা প্রতি 100,000 লোককে হার দেয়?
এটি সর্বজনীন বলে মনে হয় যে প্রতিবছর ১০,০০০ জনসংখ্যার ভিত্তিতে জনসংখ্যার পরিসংখ্যান দেওয়া হয়। উদাহরণস্বরূপ, আত্মহত্যার হার, হত্যার হার, প্রতিবন্ধীতা-সমন্বিত জীবন বছর, তালিকাটি এগিয়ে যায়। কেন? যদি আমরা রসায়নের কথা বলি তবে প্রতি মিলিয়ন (পিপিএম) অংশগুলি সাধারণ common লোক গণনা করার কাজটি কেন মৌলিকভাবে আলাদাভাবে দেখা হয়। ১০,০০,০০০ সংখ্যার এসআই …
10 demography  units 

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.