পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

4
স্নায়বিক নেটওয়ার্ক, অটো.রিমা এবং ইএসএস সহ আর সময়-সিরিজের পূর্বাভাস
সময় সিরিজের পূর্বাভাস দেওয়ার জন্য আমি নিউরাল নেটওয়ার্কগুলি ব্যবহার করার বিষয়ে কিছুটা শুনেছি। আমি কীভাবে তুলনা করতে পারি, আমার টাইম-সিরিজ (দৈনিক খুচরা ডেটা) পূর্বাভাস দেওয়ার জন্য কোন পদ্ধতিটি আরও ভাল: অটো.রিমা (এক্স), এটস (এক্স) বা নেটনেটার (এক্স)। আমি অটো.আরিয়ামার সাথে এআইসি বা বিআইসির মাধ্যমে ইটের সাথে তুলনা করতে পারি। তবে …

1
লিনিয়ার বৈষম্যমূলক বিশ্লেষণের জন্য বায়সিয়ান এবং ফিশারের পদ্ধতির
আমি এলডিএ করার 2 টি পদ্ধতি, বায়সিয়ান পদ্ধতির এবং ফিশারের পদ্ধতির জানি । ধরা যাক আমাদের কাছে ডেটা , যেখানে হল মাত্রিক পূর্বাভাসকারী এবং হ'ল শ্রেণীর নির্ভরশীল পরিবর্তনশীল ।( x , y))(x,y)(x,y)এক্সxxপিppYyyকেKK বায়েশিয়ান পদ্ধতির দ্বারা আমরা পশ্চাদপদ , এবং হিসাবে বইগুলিতে বলেছে গাউসিয়ান, আমাদের এখন th হিসাবে ক্লাসের জন্য বৈষম্যমূলক …

2
কেন হোল্ম-বনফেরোনির উপরে বনফেরনি ব্যবহার করবেন?
আমি দেখতে পাচ্ছি আপনি বোনফেরোনি সংশোধন করার পরে কেন আরও শক্তিশালী পদ্ধতি, যেমন হচবার্গ পদ্ধতি ব্যবহার করতে পারবেন না, কারণ তাদের অতিরিক্ত ধারনা থাকতে পারে, যেমন এই ক্ষেত্রে অনুমানের স্বাধীনতার মতো, তবে কেন আপনি তা করবেন তা আমি বুঝতে পারি না পরবর্তীতে আরও শক্তিশালী এবং বনফেরনির চেয়ে অনুমান আর নেই …

1
কেন
একটি সমস্যায় সেট করে আমি এই "লেমা" প্রমাণ করেছি, যার ফলাফল আমার কাছে স্বজ্ঞাত নয়। ZZZ হ'ল একটি সেন্সর করা মডেলের একটি সাধারণ বন্টন। আনুষ্ঠানিকভাবে, Z∗∼Norm(0,σ2)Z∗∼Norm(0,σ2)Z^* \sim Norm(0, \sigma^2) , এবং Z=max(Z∗,c)Z=max(Z∗,c)Z = max(Z^*, c) । তারপরে, E[Z|Z>c]=∫∞cziϕ(zi)dzi=12π−−√∫∞cziexp(−12z2i)dzi=12π−−√exp(−12c2) (Integration by substitution)=ϕ(c)E[Z|Z>c]=∫c∞ziϕ(zi)dzi=12π∫c∞ziexp(−12zi2)dzi=12πexp(−12c2) (Integration by substitution)=ϕ(c)\begin{align} E[Z|Z>c] &= \int_c^\infty z_i \phi({z_i})\mathrm{d}z_i \\ …

2
হায়ারারিকাল বায়েসিয়ান মডেলগুলির শক্তি চিত্রিত করার জন্য একটি ভাল উপমা কী?
আমি বায়সিয়ান পরিসংখ্যান তুলনায় তুলনামূলকভাবে নতুন এবং সম্প্রতি বিভিন্ন ডাটাসেটে বায়বীয় মডেল তৈরি করতে জাগস ব্যবহার করছি AG যদিও আমি ফলাফলগুলি (স্ট্যান্ডার্ড গ্ল্যাম মডেলের তুলনায়) থেকে খুব সন্তুষ্ট, আমাকে স্ট্যাটিস্টিকাল মডেলগুলির সাথে পার্থক্য কী তা অ-পরিসংখ্যানবিদদের বোঝাতে হবে। বিশেষত, এইচবিএমগুলি কেন এবং কখন সহজ মডেলের চেয়ে ভাল পারফরম্যান্স করে তা …

3
'পরিসংখ্যানগতভাবে প্রমাণিত' ধারণা
যখন বিষয়গুলি সম্পর্কিত সংবাদগুলি 'পরিসংখ্যানগতভাবে প্রমাণিত' হয়ে থাকে তখন তারা কি পরিসংখ্যানের একটি সঠিকভাবে সংজ্ঞায়িত ধারণাটি সঠিকভাবে ব্যবহার করে, এটি ভুল ব্যবহার করে, বা কেবল একটি অক্সিমোরন ব্যবহার করে? আমি ধারণা করি যে একটি 'পরিসংখ্যানগত প্রমাণ' আসলে অনুমান বা প্রমাণের জন্য কোনও গাণিতিক প্রমাণ নয়, বরং এটি একটি 'পরিসংখ্যান পরীক্ষা' …
10 inference  proof 

1
স্থানিক ডেটা ফিটিং বিতরণ
কিছু পরিসংখ্যান সুনির্দিষ্ট সহায়তা সন্ধানের জন্য গণিত থেকে আমার প্রশ্ন পোস্ট করা ক্রস করুন । আমি একটি শারীরিক প্রক্রিয়া ডেটা তৈরির অধ্যয়ন করছি যা অ-নেতিবাচক মানগুলির সাথে দুটি মাত্রায় দুর্দান্তভাবে প্রজেক্ট করে। প্রতিটি প্রক্রিয়াতে - পয়েন্টগুলির একটি (প্রস্তাবিত) ট্র্যাক থাকে - নীচের চিত্রটি দেখুন।এক্সএক্সxYYy নমুনা ট্র্যাকগুলি নীল, একটি ঝামেলার ধরণের …

2
একটি নমুনা টি-টেস্টে, ভেরিয়েন্স অনুমানকারীতে যদি নমুনাটির অর্থ
একটি এক নমুনা t-test এর, যেখানে নাল হাইপোথিসিস অনুমান । পরিসংখ্যানটি তখন t = ¯ x - μ 0 হয়μ = μ0μ=μ0\mu=\mu_0 নমুনা স্ট্যানডার্ড ডেভিয়েশন ব্যবহারগুলি। প্রাক্কলনেগুলি, এক নমুনা পর্যবেক্ষণ তুলনা গড়¯এক্স:t = x¯¯¯- μ0এস / এন√t=x¯−μ0s/nt=\frac{\overline{x}-\mu_0}{s/\sqrt{n}}গুলিssগুলিssএক্স¯¯¯x¯\overline{x} ।s = 1n - 1Σএনi = 1( এক্সআমি- এক্স¯¯¯)2---------------√s=1n−1∑i=1n(xi−x¯)2s=\sqrt{\frac{1}{n-1}\sum_{i=1}^n (x_i-\overline{x})^2} যাইহোক, যদি আমরা …

1
এই দুটি রিগ্রেশন মডেলের মধ্যে মৌলিক পার্থক্য কী?
ধরা যাক, উল্লেখযোগ্য পারস্পরিক সম্পর্কের সাথে আমার দ্বিভাগীয় প্রতিক্রিয়া রয়েছে। আমি এই ফলাফলগুলি মডেল করার জন্য দুটি উপায়ের সাথে তুলনা করার চেষ্টা করছি। একটি উপায় হ'ল দুটি ফলাফলের মধ্যে পার্থক্যকে মডেল করা: অন্য ব্যবহার বা মডেল করা: (yi2−yi1=β0+X′β)(yi2−yi1=β0+X′β)(y_{i2}-y_{i1}=\beta_0+X'\beta)glsgee(yij=β0+time+X′β)(yij=β0+time+X′β)(y_{ij}=\beta_0+\text{time}+X'\beta) এখানে একটি নিখুঁত উদাহরণ: #create foo data frame require(mvtnorm) require(reshape) set.seed(123456) sigma …

1
টোটাল এসএস এবং এসএস এর মধ্যে কে-ক্লাস্টারিংয়ের অর্থ কী?
গুচ্ছ বিশ্লেষণে আমি খুব নতুন। আমি কে-মানে ক্লাস্টারিংয়ের জন্য আর ব্যবহার করছি এবং আমি আশ্চর্য হই যে এই জিনিসগুলি কী। এবং যদি তাদের অনুপাতটি ছোট বা বড় হয় তবে এর চেয়ে ভাল আর কী হতে পারে?
10 clustering 

1
কোন বিতরণটি কোনও পরিচিত অর্থ নিরঙ্কুশ বিচ্যুতির জন্য সর্বাধিক এনট্রপি রয়েছে?
আমি হ্যাকার নিউজ-এ অন্যান্য পরিমাপ যেমন গড় নিখুঁত বিচ্যুতির বিপরীতে স্ট্যান্ডার্ড বিচ্যুতি ব্যবহার সম্পর্কে আলোচনাটি পড়ছিলাম । সুতরাং, যদি আমরা সর্বাধিক এনট্রপির নীতি অনুসরণ করি, তবে আমরা যদি বিতরণটির অর্থ এবং এর অর্থ নিরঙ্কুশ বিচ্যুতি জানতাম তবে আমরা কোন ধরণের বিতরণ ব্যবহার করব? বা মিডিয়ান এবং মধ্যমা থেকে নিখুঁত বিচ্যুতিটি …

1
বেঁচে থাকার বিশ্লেষণের জন্য সিপিএইচ, ত্বরণী ব্যর্থতার সময় মডেল বা নিউরাল নেটওয়ার্কগুলির তুলনা
আমি বেঁচে থাকার বিশ্লেষণে নতুন এবং আমি সম্প্রতি শিখেছি যে এটির একটি নির্দিষ্ট লক্ষ্য দেওয়ার বিভিন্ন উপায় রয়েছে। আমি এই পদ্ধতির প্রকৃত বাস্তবায়ন এবং যথাযথতায় আগ্রহী। আমাকে time তিহ্যবাহী কক্স প্রপোরশনাল-হ্যাজার্ডস , এক্সিলারেটেড ব্যর্থতার সময় মডেল এবং নিউরাল নেটওয়ার্কগুলি (মাল্টিলেয়ার পার্সেপট্রন) উপস্থাপিত হয়ে রোগীর বেঁচে থাকার জন্য সময়, স্থিতি এবং …

2
কোনও অন্বেষণকারী ফ্যাক্টর বিশ্লেষণ সমাধানটি অবিরত রেখে দেওয়ার কোনও কারণ আছে কি?
সেখানে কোনো কারণ আছে না একটি অনুসন্ধানমূলক ফ্যাক্টর বিশ্লেষণ সমাধান ঘোরান? তির্যক সমাধানগুলির সাথে অर्थোগোনাল সমাধানগুলির তুলনা করে আলোচনাগুলি খুঁজে পাওয়া সহজ এবং আমি মনে করি যে আমি সমস্ত জিনিস পুরোপুরি বুঝতে পেরেছি। এছাড়াও, আমি পাঠ্যপুস্তকগুলিতে যা সন্ধান করতে পেরেছি সেখান থেকে লেখকরা সাধারণত ঘূর্ণন কীভাবে কাজ করে এবং কী …

2
লামার টেস্টে স্বাধীনতার ডিগ্রি :: আনোভা সঠিক? তারা আরএম-আনোভা থেকে খুব আলাদা
আমি আর তে একটি প্রতিক্রিয়া সময় পরীক্ষার ফলাফল বিশ্লেষণ করছি। আমি একটি পুনরাবৃত্তি ব্যবস্থা এনাওভা চালিয়েছি (2 টি স্তরের সাথে 1-সাবজেক্ট ফ্যাক্টর এবং 2 এর সাথে সাবজেক্ট ফ্যাক্টর 2 স্তর)। আমি একটি অনুরূপ লিনিয়ার মিশ্র মডেল চালিয়েছিলাম এবং আমি ব্যবহার করে আনোভা টেবিলের আকারে লিরার ফলাফলগুলি সংক্ষেপ করতে চাইlmerTest::anova । …

3
আমেরিকান কমিউনিটি জরিপ বৈচিত্র্যের ডেটাগুলিকে পুনরায় ওজন কীভাবে ত্রুটির প্রান্তিকতায় প্রভাবিত করবে?
পটভূমি: বর্তমানে আমার সংস্থাটি তার কর্মশক্তি বৈচিত্র্যের পরিসংখ্যান (উদাহরণস্বরূপ% প্রতিবন্ধী ব্যক্তি,% মহিলা,% অভিজ্ঞ) আমেরিকান কমিউনিটি জরিপ (মার্কিন আদমশুমারি ব্যুরোর একটি জরিপ প্রকল্প) এর ভিত্তিতে groups গোষ্ঠীগুলির জন্য মোট শ্রমশক্তি প্রাপ্যতার সাথে তুলনা করে। এটি একটি ত্রুটিযুক্ত বেঞ্চমার্ক, কারণ আমাদের কাছে একটি খুব নির্দিষ্ট চাকরির সেট রয়েছে যা সামগ্রিক শ্রমশক্তির চেয়ে …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.