পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
চলক গুরুত্ব এলোমেলোভাবে নেতিবাচক মান
আমি নিজেকে জিজ্ঞাসা করছি যে কোনও রিগ্রেশন প্রসঙ্গে negativeণাত্মক ভেরিয়েবল গুরুত্ব মান ("% IncMSE") সহ সেই ভেরিয়েবলগুলি সরিয়ে ফেলা ভাল ধারণা কিনা। এবং যদি এটি আমাকে আরও ভাল ভবিষ্যদ্বাণী দেয়? আপনি কি মনে করেন?

1
আর-তে বারবার ব্যবস্থা নেওয়া ত্রুটি () শব্দটি নির্দিষ্ট করে
আনোভা আর-তে দ্বিপাক্ষিক পুনরুদ্ধার ব্যবস্থার জন্য ত্রুটি শর্তগুলি সংজ্ঞায়িত করতে আমার সমস্যা হচ্ছে My এখানে মোট 20 টি প্রজাতি রয়েছে, প্রতিটি প্রজাতির 6 জন ব্যক্তি এবং প্রতিটি গাছ থেকে দুটি কোর রয়েছে। কাঠের ঘনত্বের উপর রেডিয়াল অবস্থানের প্রভাব পরীক্ষা করার জন্য, আমি ত্রুটি শব্দটির সাথে নিম্নলিখিত দুটি উপায় আনোভা মডেলটি …

2
অ প্যারাম্যাট্রিক পরিসংখ্যান জন্য বুক
অ-প্যারাম্যাট্রিক পরিসংখ্যানগুলির জন্য কী ভাল বই হবে। শুধু পরিচয় নয় উন্নত স্তর। এছাড়াও আমি এমন কিছু সন্ধান করছি যা আমি শেখার জন্য ব্যবহার করতে পারি এবং রেফারেন্সের জন্য নয়। বিশেষত আমি এমন একটি বইয়ের সন্ধান করছি যা প্যারামিমেটিকবিহীন পদ্ধতি, নন-প্যারাম্যাট্রিক অনুমিতি, নন প্যারাম্যাট্রিকগুলি মূল্যায়নের পদ্ধতিগুলি, যেমন, কেএস পরীক্ষা, পরীক্ষা ইত্যাদি, …


3
র‌্যাঙ্কিংয়ের জন্য মেশিন লার্নিং অ্যালগরিদম
আমি উপাদানগুলির একটি সেট পেয়েছি যা আমি বৈশিষ্ট্য অনুসারে বর্ণনা করতে পারি । এভাবে:XXXnnn xi:{ci1,ci2,…,cin}∣xi∈Xxi:{ci1,ci2,…,cin}∣xi∈Xx_i: \{c_{i1}, c_{i2}, \ldots, c_{in}\} \mid x_i \in X যেখানে উপাদানের জন্য (সংখ্যাসূচক) মূল্যায়ন হয় বৈশিষ্ট্য অনুযায়ী । সুতরাং আমার উপাদানগুলি একটি মাত্রা স্পেসে পয়েন্ট হিসাবে দেখা যেতে পারে ।cijcijc_{ij}iiijjjnnn আমার পঠন অনুসারে, "বেইস ক্লাসিফায়ার" এর …

2
দুটি গ্রুপের জন্য ছোট এবং ভারসাম্যহীন নমুনার আকার - কী করব?
আমি দুটি গ্রুপের জন্য ডেটা পেয়েছি (যেমন নমুনা) আমি তুলনা করতে চাই তবে মোট নমুনার আকারটি ছোট (n = 29) এবং দৃ strongly়ভাবে ভারসাম্যহীন (n = 22 বনাম এন = 7)। এই ডেটাগুলি যৌক্তিকভাবে সংগ্রহ করা কঠিন এবং ব্যয়বহুল, সুতরাং 'আরও ডেটা সংগ্রহ করা' যখন একটি সুস্পষ্ট সমাধান হিসাবে এই …

1
ওয়েইবুল বিতরণের বহুবিধ সংস্করণ আছে কি?
আমি আশা করি এটি স্ব-বর্ণনামূলক, তবে কিছু অস্পষ্ট কিনা তা আমাকে জানাবেন: ওয়েবুল বিতরণের কোনও মাল্টিভারিয়েট সংস্করণ রয়েছে কি?

1
বিন্দু অনুসারে বৈকল্পিকতা কী?
স্ট্যাটিস্টিকাল লার্নিংয়ের উপাদানগুলি পড়ার সময় , আমি "পয়েন্ট-ওয়াইস ভেরিয়েন্স" শব্দটি বেশ কয়েকবার সম্মুখীন হয়েছি। যদিও এর সম্ভাব্য অর্থটি সম্পর্কে আমার অস্পষ্ট ধারণা রয়েছে তবে আমি তা জানতে পেরে কৃতজ্ঞ হব এটি কীভাবে সংজ্ঞায়িত করা হয়? এটি কীভাবে প্রাপ্ত?
10 variance 

3
কোনও হিস্টোগ্রামে অন্তরগুলির সংখ্যার উপরের সীমা কি রয়েছে?
আমি বইয়ের বেশ কয়েকটি নিবন্ধ এবং অংশগুলি পড়েছি যা কোনও ডেটা সেটের হিস্টোগ্রামের জন্য কীভাবে ভাল সংখ্যক অন্তর (বিন) নির্বাচন করতে হয় তা ব্যাখ্যা করে , তবে আমি ভাবছি যে পয়েন্টের সংখ্যার উপর ভিত্তি করে একটি কঠিন সর্বোচ্চ সংখ্যার অন্তর রয়েছে কিনা? একটি ডেটা সেট, বা অন্য কিছু মানদণ্ড। পটভূমি: …

2
আরএমএল বনাম এমএল স্টেপএইসি
আমার মিশ্র মডেল বিশ্লেষণকে এটি অনুসরণ করে কীভাবে সেরা মডেল বা মডেলগুলি নির্বাচন করতে এআইসি ব্যবহার করে চালানো যায় সে সম্পর্কে সাহিত্যের খনন করার চেষ্টা করার পরে আমি অভিভূত বোধ করি। আমি মনে করি না যে আমার ডেটাটি জটিল, তবে আমি যা করেছি তা নিশ্চিত হওয়ার জন্য সন্ধান করছি এবং …

1
শ্রেণিবদ্ধ এবং অবিচ্ছিন্ন পরিবর্তনশীল মধ্যে একটি মিথস্ক্রিয়া এর সহগ ব্যাখ্যার
অবিচ্ছিন্ন এবং শ্রেণিবদ্ধ ভেরিয়েবলের মধ্যে একটি মিথস্ক্রিয়াটির সহগগুলির ব্যাখ্যা সম্পর্কে আমার একটি প্রশ্ন আছে। এখানে আমার মডেল: model_glm3=glm(cog~lg_hag+race+pdg+sex+as.factor(educa)+(lg_hag:as.factor(educa)), data=base_708) Coefficients: Estimate Std. Error t value Pr(>|t|) (Intercept) 21.4836 2.0698 10.380 < 2e-16 *** lg_hag 8.5691 3.7688 2.274 0.02334 * raceblack -8.4715 1.7482 -4.846 1.61e-06 *** racemexican -3.0483 1.7073 -1.785 0.07469 …

3
পূর্ব বিতরণের জন্য তথ্য ব্যতীত উইনব্যাগস এবং অন্যান্য এমসিমিসি
প্যারামিটারগুলি বিতরণের কোনও ধারণা না থাকলে কী হয়? আমাদের কোন পদ্ধতির ব্যবহার করা উচিত? বেশিরভাগ সময় আমরা লক্ষ্য করি যে কোনও নির্দিষ্ট ভেরিয়েবলের কোনও নির্দিষ্ট প্রজাতির উপস্থিতি / অনুপস্থিতির উপর যদি প্রভাব থাকে এবং চলকটি পরিবর্তনশীল গুরুত্ব অনুসারে গ্রহণযোগ্য হয় বা না হয় তবে তার প্রভাব কম থাকে। এর অর্থ …
10 r  bayesian  mcmc  bugs  winbugs 

5
প্রথমে কোনও বায়েশিয়ান মডেল ফিট করা ঠিক আছে, তারপরে প্রবীণদের দুর্বল করা শুরু করবেন?
ঘনঘটিত পরিসংখ্যানগুলি করার সময়, আরও বেশি নম্বর সংগ্রহের সিদ্ধান্ত নেওয়ার আগে পরিসংখ্যান পরীক্ষার ফলাফলগুলি দেখার মতো বড় সংখ্যাগুলির একটি দীর্ঘ তালিকা রয়েছে is আমি সাধারণভাবে ভাবছি যে বায়েশিয়ান পরিসংখ্যানের সাথে জড়িত পদ্ধতিগুলির জন্য এবং না বিশেষত নিম্নলিখিতগুলির মধ্যে একটি কিনা সেই জন্য যদি অনুরূপ একটি তালিকা থাকে। আমি সম্প্রতি উপলব্ধি …

2
ভবিষ্যদ্বাণী ত্রুটি পরীক্ষা করতে GAM ক্রস-বৈধতা
আমার প্রশ্নগুলি জিজিএসের সাথে এমজিসিভি আর প্যাকেজটিতে ডিল করে । একটি ছোট নমুনা আকারের কারণে আমি ছুটি-ওয়ান-আউট ক্রস-বৈধতা ব্যবহার করে পূর্বাভাস ত্রুটিটি নির্ধারণ করতে চাই। এটা কি যুক্তিসঙ্গত? আমি কীভাবে এটি করতে পারি এমন কোনও প্যাকেজ বা কোড রয়েছে? errorest()ফাংশন ipred প্যাকেজ কাজ করে না। একটি সাধারণ পরীক্ষার ডেটাসেট হ'ল: …
10 r  cross-validation  gam  mgcv 

1
ক্রস বৈধতা ব্যবহার করার সময় পূর্বাভাস অন্তরগুলি গণনা করা
এর মাধ্যমে স্ট্যান্ডার্ড বিচ্যুতি অনুমানগুলি গণনা করা হয়: sN=1N∑Ni=1(xi−x¯¯¯)2−−−−−−−−−−−−−√.sN=1N∑i=1N(xi−x¯)2. s_N = \sqrt{\frac{1}{N} \sum_{i=1}^N (x_i - \overline{x})^2}. ( http://en.wikedia.org/wiki/S স্ট্যান্ডার্ড_ডিভিয়েশন# নমুনা_ স্ট্যান্ডার্ড_ডিয়েশন ) পূর্বাভাস নির্ভুলতার জন্য 10-গুণ ক্রস বৈধতা থেকে নমুনা? আমি উদ্বিগ্ন যে প্রতিটি ভাঁজগুলির মধ্যে গণনা করা পূর্বাভাসের নির্ভুলতা নির্ভরশীল কারণ প্রশিক্ষণের সেটগুলির মধ্যে যথেষ্ট পরিমাণে ওভারল্যাপের (যদিও পূর্বাভাসের …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.