পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
স্মুথিংয়ের জন্য স্মুথ স্প্লাইস বনাম লোইসের তুলনা করছেন?
আমি কোনও বক্ররেখার মসৃণকরণের জন্য লোস বা একটি স্মুথ স্প্লাইজগুলি ব্যবহার করার পক্ষে ভাল / কৌশলগুলি আরও ভালভাবে বুঝতে চাই। আমার প্রশ্নের অন্য একটি পরিবর্তন হ'ল যদি এমন কোনও উপায়ে মসৃণ স্প্লাইন তৈরির উপায় থাকে যা লোয়েস ব্যবহারের মতো একই ফলাফল দেয় yield কোন রেফারেন্স বা অন্তর্দৃষ্টি স্বাগত জানানো হয়।

6
আর এর সাথে পরিসংখ্যানগুলির জন্য রেফারেন্স বই - এটি বিদ্যমান এবং এটিতে কী থাকা উচিত?
পটভূমি এটিকে নিয়ে অনেক আলোচনা রয়েছে, তাই আমি ভেবেছিলাম যে স্ট্যাকএক্সচেঞ্জের পূর্ববর্তী পদক্ষেপগুলি থেকে এবং জোর করে গুগল করে আমার উত্তরটি খুঁজে পেতে পারি। আর এর সাথে (বায়ো) পরিসংখ্যানের জন্য একটি মাত্র রেফারেন্স বইয়ের চেষ্টা করার জন্য অর্ধ দিন ব্যবহার করার পরে, আমি একেবারে বিভ্রান্ত হয়ে পড়েছিলাম এবং ছেড়ে দিতে …
25 r  references 

2
কলম্যান ফিল্টার এবং চলন্ত গড়ের মধ্যে পার্থক্য কী?
আমি একটি খুব সাধারণ কলম্যান ফিল্টার (এলোমেলো হাঁটা + শোর মডেল) গণনা করছি। আমি দেখতে পাই যে ফিল্টারটির আউটপুট একটি চলমান গড়ের সাথে খুব মিল। দুজনের মধ্যে কি সমতা আছে? তা না হলে পার্থক্য কী?

4
জিলিয়াক (২০১১) পি-মান ব্যবহারের বিরোধিতা করে এবং কিছু বিকল্পের কথা উল্লেখ করে; তারা কি?
"ম্যাট্রিক্স বনাম সিরাকুসানো এবং শিক্ষার্থী বনাম ফিশারের পরিসংখ্যান সম্পর্কিত তাত্পর্যপূর্ণ তাত্পর্য" (ডিওআই: 10.1111 / জে .740-9713.2011.00511.x) নামে পরিসংখ্যানগত অনুমানের জন্য পি-মানের উপর নির্ভর করার শপথ নিয়ে আলোচনা করা সাম্প্রতিক একটি নিবন্ধে , স্টিফেন টি। জিলিয়াক পি-মান ব্যবহারের বিরোধিতা করেছেন। সমাপনী অনুচ্ছেদে তিনি বলেছেন: ডেটা হ'ল এক জিনিস যা আমরা ইতিমধ্যে …

3
পোইসন রিগ্রেশন থেকে ফিটেড মানসমূহের অবশিষ্টাংশের প্লটকে ব্যাখ্যা করা
আমি আর-তে একটি জিএলএম (পোয়েসন রিগ্রেশন) দিয়ে ডেটা ফিট করার চেষ্টা করছি When এটার মানে কি? library(faraway) modl <- glm(doctorco ~ sex + age + agesq + income + levyplus + freepoor + freerepa + illness + actdays + hscore + chcond1 + chcond2, family=poisson, data=dvisits) plot(modl)

3
বৈকল্পিকের জন্য আত্মবিশ্বাসের ব্যবধানে একটি পর্যবেক্ষণ দেওয়া হয়েছে
এটি "প্রব্যাবিলিটি থিওরিতে সপ্তম কোলমোগোরভ স্টুডেন্ট অলিম্পিয়াড" থেকে একটি সমস্যা: উভয় প্যারামিটারের বিতরণ থেকে একটি পর্যবেক্ষণ দেওয়া হয়েছে, কমপক্ষে 99% এর আত্মবিশ্বাসের স্তরের সাথে জন্য একটি আত্মবিশ্বাসের ব্যবধান দিন ।এক্সএক্সXসাধারণ( μ , σ)2)সাধারণ⁡(μ,σ2)\operatorname{Normal}(\mu,\sigma^2)σ2σ2\sigma^2 আমার কাছে মনে হচ্ছে এটি অসম্ভব হওয়া উচিত। আমার কাছে সমাধান আছে তবে এটি এখনও পড়েনি। কোন …

5
সাধারণ গ্রিডের পরিবর্তে কেন মন্টি কার্লো পদ্ধতি ব্যবহার করবেন?
কোনও ফাংশনকে সংহত করার সময় বা জটিল সিমুলেশনে, আমি দেখেছি মন্টে কার্লো পদ্ধতিটি ব্যাপকভাবে ব্যবহৃত হয়। আমি নিজেকে জিজ্ঞাসা করছি কেন কেউ এলোমেলো পয়েন্ট আঁকার পরিবর্তে কোনও ফাংশন সংহত করার জন্য পয়েন্টগুলির একটি গ্রিড তৈরি করে না। এটি কি আরও সঠিক ফলাফল আনবে না?

7
উদাহরণস্বরূপ, কেন লিঙ্গ সাধারণত 1/2 এর পরিবর্তে 0/1 কোড করে?
আমি ডেটা বিশ্লেষণের কোডিংয়ের যুক্তি বুঝতে পারি। নীচে আমার প্রশ্নটি একটি নির্দিষ্ট কোড ব্যবহারের বিষয়ে। লিঙ্গ প্রায়শই মহিলা হিসাবে 0 এবং পুরুষের জন্য 1 হিসাবে কোডড হওয়ার কোনও কারণ আছে কি? কেন এই কোডিংটিকে 'স্ট্যান্ডার্ড' হিসাবে বিবেচনা করা হয়? মহিলা = 1 এবং পুরুষ = 2 এর সাথে এটি তুলনা …

2
পিসিএ কি বহুবিধ লাইনের অধীনে অস্থির?
আমি জানি যে একটি রিগ্রেশন পরিস্থিতিতে, যদি আপনার অত্যন্ত সংযোগযুক্ত ভেরিয়েবলগুলির একটি সেট থাকে তবে এটি সাধারণত "খারাপ" কারণ অনুমান সহগের অস্থিরতার কারণে (নির্ধারক শূন্যের দিকে চলে যাওয়ার কারণে বৈকল্পিকতা অনন্তের দিকে যায়)। আমার প্রশ্ন হ'ল এই "খারাপ" পিসিএ পরিস্থিতিতে স্থায়ী কিনা। কোভারিয়েন্স ম্যাট্রিক্স একক হয়ে যাওয়ার সাথে সাথে কোনও …


2
আমি কখন এমএলই এর জন্য আর এর এনএলএম ফাংশন ব্যবহার করব না?
আমি বেশ কয়েকটি সম্ভাব্য অনুমানের জন্য আর এর এনএলএম ব্যবহার করার পরামর্শ দিয়ে কয়েকজন গাইড জুড়েছি। তবে এগুলির কোনওটিই ( আর এর ডকুমেন্টেশন সহ ) কখন ফাংশনটি ব্যবহার করবেন বা ব্যবহার করবেন না সে সম্পর্কিত তাত্ত্বিক দিকনির্দেশনা দেয়। যতদূর আমি বলতে পারি, এনএলএম নিউটনের পদ্ধতির লাইন ধরে কেবল গ্রেডিয়েন্ট বংশোদ্ভূত …

1
প্রোফাইল সম্ভাবনার উপর ভিত্তি করে আত্মবিশ্বাসের ব্যবধানগুলি তৈরি করা
আমার প্রাথমিক পরিসংখ্যান কোর্সে, শিখেছি কীভাবে 95% আত্মবিশ্বাস ব্যবধান যেমন জনসংখ্যার গড়, μμ\mu , "বড়" নমুনা আকারের অ্যাসিপটোটিক স্বাভাবিকতার উপর ভিত্তি করে তৈরি করা যায় । পুনরায় মডেলিং পদ্ধতিগুলি (যেমন বুটস্ট্র্যাপ) বাদে "প্রোফাইল সম্ভাবনা" এর উপর ভিত্তি করে আরও একটি পদ্ধতি রয়েছে । কেউ এই পদ্ধতির ব্যাখ্যা করতে পারে? কোন …

4
মডেল অনিশ্চয়তা সম্বোধন
আমি ভাবছিলাম যে ক্রসভিলেটেড সম্প্রদায়ের বায়েশিয়ানরা মডেল অনিশ্চয়তার সমস্যাটিকে কীভাবে দেখে এবং তারা কীভাবে এটি মোকাবেলা করতে পছন্দ করে? আমি আমার প্রশ্নটি দুটি অংশে বলার চেষ্টা করব: মডেল অনিশ্চয়তার সাথে আপনার অভিজ্ঞতা (মতামত) কতটা গুরুত্বপূর্ণ? আমি এই সমস্যাটি নিয়ে মেশিন লার্নিং সম্প্রদায়টিতে কোনও কাগজপত্র পাইনি, সুতরাং আমি কেন ভাবছি। মডেল …

2
জেনারেল লিনিয়ার মডেল বনাম জেনারালাইজড লিনিয়ার মডেল (একটি পরিচয় লিঙ্ক ফাংশন সহ?)
এটি আমার প্রথম পোস্ট, তাই আমি যদি কিছু মান অনুসরণ না করি তবে দয়া করে এটি আমার উপরে সহজ করে নিন! আমি আমার প্রশ্নের জন্য একটি অনুসন্ধান করেছি এবং কিছুই আসেনি। আমার প্রশ্নটি সাধারণত রৈখিক মডেলিং (জিএলএম) এবং জেনারেলাইজড লিনিয়ার মডেলিং (জিজেডএলএম) এর মধ্যে ব্যবহারিক পার্থক্যের আশেপাশে সম্পর্কিত। আমার ক্ষেত্রে …

3
প্রথম চেষ্টা করার জন্য শীর্ষ পাঁচটি শ্রেণিবদ্ধী
মত স্পষ্ট শ্রেণিবদ্ধ বৈশিষ্ট্য ছাড়াও গণনা ব্যয়, বৈশিষ্ট্য / লেবেলগুলির প্রত্যাশিত ডেটা এবং নির্দিষ্ট আকারের এবং ডেটা সেটগুলির মাত্রার জন্য উপযুক্ততা, শীর্ষে থাকা পাঁচটি (বা 10, 20?) শ্রেণিবদ্ধকারীরা কোন নতুন ডেটা সেট করতে প্রথমে চেষ্টা করার জন্য এখনও কোনওটি জানেন না (যেমন শব্দার্থক এবং স্বতন্ত্র বৈশিষ্ট্যের পারস্পরিক সম্পর্ক)? সাধারণত আমি …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.