পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

1
সর্বাধিক সম্ভাবনা অনুমানের আনুমানিক স্বাভাবিক বন্টন কীভাবে হয়?
লাগানো বিতরণ উত্পন্ন করার পদ্ধতি হিসাবে আমি এমএলই সম্পর্কে পড়ছি। আমি একটি বিবৃতি পেলাম যে সর্বাধিক সম্ভাবনা অনুমান "আনুমানিক স্বাভাবিক বন্টন আছে।" এর অর্থ কি এই যে আমি যদি আমার ডেটা এবং আমি যে ডিস্ট্রিবিউশনগুলির সাথে ফিট করার চেষ্টা করছি তার উপর বারবার এমএলই প্রয়োগ করি তবে আমি যে মডেলগুলি …

2
0.05 <p <0.95 ফলাফলকে মিথ্যা ধনাত্মক বলা হয় কেন?
সম্পাদনা করুন: আমার প্রশ্নের ভিত্তি ত্রুটিযুক্ত এবং এটিকে বোঝার জন্য এমনকি তৈরি করা যেতে পারে কিনা তা জানতে আমার কিছুটা সময় ব্যয় করা দরকার। সম্পাদনা 2: স্পষ্ট করে যে আমি স্বীকার করেছি যে একটি পি-মান কোনও নাল অনুমানের সম্ভাবনার সরাসরি পরিমাপ নয়, তবে আমি ধরে নিয়েছি যে পি-মানটি 1 এর …

1
আমার কি আত্মবিশ্বাসের ব্যবধানের পরিবর্তে বিশ্বাসযোগ্য ব্যবধানগুলি প্রতিবেদন করা উচিত?
একটি পরিসংখ্যান পাঠ্যপুস্তকে ধারণাকে হোঁচট দেওয়ার পরে আমি এ সম্পর্কে আমার মাথা গুটিয়ে দেওয়ার চেষ্টা করেছি এবং শেষ পর্যন্ত এমন একটি সিদ্ধান্তে পৌঁছেছি যা মনে হয়েছে যে আমি এখনও পর্যন্ত যা কিছু ব্যাখ্যা পেয়েছি তা ফিট করে: একটি বিশ্বাসযোগ্য ব্যবস্থাই অ-পরিসংখ্যানবিদদের একটি আত্মবিশ্বাস বলে মনে করে বিরতি হয়। আমার মতো …

2
সময়ের সাথে আরও বিস্তারিত ব্যাখ্যামূলক ভেরিয়েবলগুলি অন্তর্ভুক্ত করা
আমি বুঝতে চেষ্টা করছি যে আমি কীভাবে একটি পরিবর্তনশীল মডেল করতে পারি যেখানে সময়ের সাথে সাথে ক্রমবর্ধমান বিস্তারিত ভবিষ্যদ্বাণী পেয়েছি। উদাহরণস্বরূপ, খেলাপি loansণগুলিতে মডেলিং পুনরুদ্ধার হারগুলি বিবেচনা করুন। ধরুন আমাদের 20 বছরের ডেটা সহ একটি ডেটাসেট রয়েছে, এবং সেই বছরের 15 বছরের মধ্যে আমরা কেবল জানি যে colণটি জামানত হয়েছিল …

1
এক্সেল বনাম আর-তে চি-স্কোয়ার গণনার অদ্ভুত উপায়
আমি একটি এক্সেল শীট খুঁজছি যা দাবি করে যে গণনা করা হচ্ছে χ2χ2\chi^2, তবে আমি এটি করার এই পদ্ধতিটি চিনতে পারি না এবং আমি ভাবছিলাম যে আমি কিছু অনুপস্থিত। এটি বিশ্লেষণ করছে এমন ডেটা এখানে: +------------------+----------+----------+ | Total Population | Observed | Expected | +------------------+----------+----------+ | 2000 | 42 | …
9 r  chi-squared  excel 

1
একটি সমীকরণের একটি অননুমোদিত সিস্টেমের জন্য রিজ রিগ্রেশন প্রয়োগ করছেন?
যখন , সর্বনিম্ন স্কোয়ার সমস্যা যা sp মানের উপরে একটি গোলাকার বিধিনিষেধ আরোপ করে হিসাবে an একটি অতি-নির্ধারিত সিস্টেমের জন্য। \ |। সিডট \ | _2 হ'ল ভেক্টরের ইউক্লিডিয়ান আদর্শ।y=Xβ+ey=Xβ+ey = X\beta + eδδ\deltaββ\betamin ∥y−Xβ∥22s.t. ∥β∥22≤δ2min⁡ ‖y−Xβ‖22s.t.⁡ ‖β‖22≤δ2\begin{equation} \begin{array} &\operatorname{min}\ \| y - X\beta \|^2_2 \\ \operatorname{s.t.}\ \ \|\beta\|^2_2 \le …

1
কোনও ডেটাসেটের বৈকল্পিকতার জন্য আস্থার ব্যবধান গণনা করতে বুটস্ট্র্যাপ পুনরায় মডেলিং ব্যবহার করা যেতে পারে?
আমি জানি যে আপনি যদি অনেকবার ডেটা সেট থেকে পুনরায় নমুনা নেন এবং প্রতিবার গড় গণনা করেন তবে এই উপায়গুলি একটি সাধারণ বিতরণ (সিএলটি দ্বারা) অনুসরণ করবে। সুতরাং, আপনি ডেটা সেটটির সম্ভাব্যতা বিতরণ সম্পর্কে কোনও অনুমান না করে ডেটা সেটের গড়ের উপর একটি আত্মবিশ্বাসের ব্যবধান গণনা করতে পারেন। আমি ভাবছিলাম …

3
কেন লিনিয়ার রিগ্রেশন সাধারণ ডিস্ট্রিমেন্টিক ক্রমের ফলাফলটি ভবিষ্যদ্বাণী করতে সক্ষম হয় না?
আমার একজন সহকর্মী আমাকে এই সমস্যাটি স্পষ্টতই ইন্টারনেটে ঘুরিয়ে পাঠিয়েছে: If $3 = 18, 4 = 32, 5 = 50, 6 = 72, 7 = 98$, Then, $10 =$ ? উত্তর 200 বলে মনে হচ্ছে। 3*6 4*8 5*10 6*12 7*14 8*16 9*18 10*20=200 যখন আমি আর তে লিনিয়ার রিগ্রেশন করি: …
9 r  regression  lm 

2
আপনি কীভাবে একটি ফ্যাক্টর এবং একটি ক্রমাগত কোভারিয়েটের মধ্যে একটি মিথস্ক্রিয়া পরিকল্পনা করেন?
আমি আমার অবিচ্ছিন্ন ভবিষ্যদ্বাণী এবং আমার শ্রেণিবদ্ধ মডারেটরের মধ্যে মিথস্ক্রিয়াটিকে একই গ্রাফে প্লট করতে চাই। উভয় শ্রেণিবদ্ধ ( ফ্যাক্টর ইন্টারঅ্যাকশন ) করার সময় আমি এটি কীভাবে করব তা জানি তবে যখন কেউ একটানা এবং একটি শ্রেণিবদ্ধ হয় তখন কীভাবে এটি করতে হয় তা সত্যিই আমি জানি না।

2
সিমপ্লেক্সকে ডিরিচলেট বিতরণে ত্রিভুজ পৃষ্ঠ হিসাবে উপস্থাপনের অর্থ?
আমি এমন একটি বই থেকে পড়ছি যা ডারচিলিট বিতরণ প্রবর্তন করে এবং তারপরে এটি পরিসংখ্যান উপস্থাপন করে। তবে আমি সেই পরিসংখ্যানগুলি বুঝতে পারি না। আমি চিত্রটি এখানে নীচে সংযুক্ত করেছি। আমি যা বুঝতে পারি না তা হ'ল ত্রিভুজগুলির অর্থ। সাধারণত যখন কেউ 2 টি ভেরিয়েবলের ফাংশন প্লট করতে চায়, আপনি …

1
পার্থক্য-মধ্যে-পার্থক্যের জন্য ডেটা সেটআপ
পার্থক্য রিগ্রেশন মডেল ব্যবহার করে পার্থক্যের জন্য কোন সেটআপটি সঠিক ওয়াইআমি গুলি টি= α +γগুলি। টি+ + λঘটি+ + δ∗ ( টি*ঘটি) +εআমি গুলি টিওয়াইআমিগুলিটি=α+ +γগুলি*টি+ +λঘটি+ +δ*(টি*ঘটি)+ +εআমিগুলিটিY_{ist} = \alpha +\gamma_s*T + \lambda d_t + \delta*(T*d_t)+ \epsilon_{ist} যেখানে টি হ'ল ডামি যা সমান 1 এবং পর্যবেক্ষণ যদি চিকিত্সা গোষ্ঠী …

1
প্রতিস্থাপন ছাড়াই কে সংখ্যাগুলির যোগফলের প্রত্যাশা
প্রদত্ত এনএনnসংখ্যা, যেখানে প্রতিটি সংখ্যার মান পৃথক, হিসাবে চিহ্নিত করা হয় এবং প্রতিটি সংখ্যা নির্বাচনের সম্ভাবনা যথাক্রমে হয়।বনাম1,বনাম2, । । । ,বনামএনবনাম1,বনাম2,।।।,বনামএনv_1, v_2, ..., v_nপি1,পি2, । । । ,পিএনপি1,পি2,।।।,পিএনp_1, p_2, ..., p_n এখন যদি আমি প্রদত্ত সম্ভাবনার উপর ভিত্তি করে নম্বর নির্বাচন করি , যেখানে , সেই সংখ্যার যোগফলের প্রত্যাশা …

2
একাধিক স্থানিক রেজোলিউশন / আইশের সাহায্যে উত্স থেকে সংযুক্ত সময় সিরিজের তথ্য
আমার কাছে বিভিন্ন সেন্সর থেকে পাওয়া অনেক উপগ্রহ রাস্টার চিত্র রয়েছে। এগুলি থেকে, মোটাগুলিগুলির একটি প্রচুর পরিমাণে টেম্পোরাল রেজোলিউশন রয়েছে। মাঝারি রেজোলিউশন রাস্টারদের অধিগ্রহণের তারিখ কম থাকে তবে এখনও কিছুটা তথ্য পাওয়া যায়। জরিমানা রেজোলিউশনগুলি খুব কম অস্থায়ী রেজোলিউশন রাখে, যা 2 বছরের কম বয়সী 2 থেকে 6 টি পর্যবেক্ষণ …

4
সম্ভাব্য পরিসংখ্যান পিএইচডি শিক্ষার্থীর জন্য গুরুত্বপূর্ণ খাঁটি গণিত কোর্সগুলি কী কী?
আমি জানি যে লিনিয়ার বীজগণিত এবং বিশ্লেষণ (বিশেষত পরিমাপ তত্ত্ব) গুরুত্বপূর্ণ। বাস্তব এবং জটিল বিশ্লেষণে স্নাতক স্তরের কোর্সগুলি নেওয়া কী সহায়ক? আমি কি সূচনা বীজগণিতের কোর্সগুলি প্রবর্তনীয় কোর্সগুলি, যেমন, পরিবহণ বীজগণিত এবং বীজগণিতের জ্যামিতির বাইরে রেখেছি?

1
দ্বিপদী বিতরণের দুটি নমুনা একই পি এর সাথে সম্মতি দেয় কিনা তা পরীক্ষা করুন
মনে করুন, আমি এটি করেছি: এন1এন1n_1 একটি অজানা সাফল্যের হার সঙ্গে স্বাধীন বিচারের এবং পর্যবেক্ষিত সফলতা।পি1পি1p_1ট1ট1k_1 এন2এন2n_2 একটি অজানা সাফল্যের হার সঙ্গে স্বাধীন বিচারের এবং পর্যবেক্ষিত সফলতা।পি2পি2p_2ট2ট2k_2 তাহলে এখনই কিন্তু এখনও অজানা, সম্ভাব্যতা পালন করা একটি প্রদত্ত জন্য (বা তদ্বিপরীত) সমানুপাতিক হয় , সুতরাং আমি যদি p_1 \ neq p_2 …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.