পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

4
কিউকিউ প্লটের পরিমাণ নির্ধারণ করা হচ্ছে
কিউকিউ প্লট দুটি বিতরণ কীভাবে সমান হয় তা ভিজ্যুয়ালাইজ করতে ব্যবহার করা যেতে পারে (উদাহরণস্বরূপ একটি সাধারণ বিতরণে কোনও বিতরণের মিলের দৃশ্যায়ন, তবে দুটি আর্টিব্রারি ডেটা বিতরণের তুলনা করার জন্য)। এমন কোনও পরিসংখ্যান রয়েছে যা আরও উদ্দেশ্যমূলক, সংখ্যাগত পরিমাপ উত্পন্ন করে যা তাদের মিলের প্রতিনিধিত্ব করে (পছন্দমত একটি সাধারণীকরণ (0 …

6
ভবিষ্যদ্বাণীমূলক বিশ্লেষণে প্রবেশের জন্য কয়েকটি বই / নিবন্ধ / গাইডের পরামর্শ দিন?
ভবিষ্যদ্বাণীমূলক বিশ্লেষণে প্রবেশের জন্য আপনি কোনও সিএস ব্যক্তি / নবাগত পরিসংখ্যানবিদ / নবাগত গণিতবিদদের জন্য কোন শিক্ষণ সামগ্রীর পরামর্শ দেবেন?

2
কার্নেল ঘনত্বের অনুমানের মধ্যে কার্নেল ব্যান্ডউইথ
আমি ওজনযুক্ত পয়েন্টগুলি সেট করে (উদাহরণস্বরূপ, প্রতিটি নমুনার একটি ওজন রয়েছে যা প্রয়োজনীয় নয়) এন পরিমিতিতে কিছু কর্নেল ঘনত্বের অনুমান করছি। এছাড়াও, এই নমুনাগুলি কেবলমাত্র একটি মেট্রিক জায়গাতে (যেমন, আমরা তাদের মধ্যে একটি দূরত্ব নির্ধারণ করতে পারি) তবে অন্য কিছুই নয়। উদাহরণস্বরূপ, আমরা নমুনা পয়েন্টগুলির গড়টি নির্ধারণ করতে পারি না, …

4
গ্রাফের উপত্যকাগুলি কীভাবে সন্ধান করবেন?
আমি কিছু জিনোমিক কভারেজ ডেটা পরীক্ষা করছি যা মূলত পূর্ণসংখ্যার দীর্ঘ তালিকা (কয়েক মিলিয়ন মান), প্রতিটি জিনোমে এই অবস্থানটি কতটা ভাল (বা "গভীর") আচ্ছাদিত তা বলেছে। আমি এই ডেটাতে "উপত্যকাগুলি" সন্ধান করতে চাই, অর্থাত্ যে অঞ্চলগুলি আশেপাশের পরিবেশের তুলনায় উল্লেখযোগ্যভাবে "নিম্ন"। দ্রষ্টব্য যে আমি যে উপত্যকাগুলি খুঁজছি তার আকার 50 …


4
বহুজাতিকের Asyptotic বিতরণ
আমি ডি ফলাফলের উপর বহুজাতিক বিতরণ সীমাবদ্ধ বিতরণ সন্ধান করছি। IE, নিম্নলিখিত বিতরণ লিমn → ∞এন- 12এক্সএনlimn→∞n−12Xn\lim_{n\to \infty} n^{-\frac{1}{2}} \mathbf{X_n} কোথায় ঘনত্ব একটি ভেক্টর মান র্যান্ডম পরিবর্তনশীল f_n (\ mathbf {x এর}) জন্য \ mathbf {x এর} যেমন যে \ sum_i x_i = ঢ , x_i \ এ \ mathbb …

11
গত 50 বছর ধরে পরিসংখ্যানগুলিতে বিপ্লবগুলি? [বন্ধ]
যেমনটি বর্তমানে দাঁড়িয়ে আছে, এই প্রশ্নটি আমাদের প্রশ্নোত্তর বিন্যাসের জন্য উপযুক্ত নয়। আমরা উত্তরগুলি তথ্য, তথ্যসূত্র বা দক্ষতার দ্বারা সমর্থন করা আশা করি তবে এই প্রশ্নটি সম্ভবত বিতর্ক, যুক্তি, পোলিং বা বর্ধিত আলোচনার জন্য অনুরোধ করবে। আপনি যদি মনে করেন যে এই প্রশ্নটি উন্নত হতে পারে এবং সম্ভবত পুনরায় খোলা …
10 history 

5
বর্গমূল, লগ ইত্যাদির মতো সাধারণগুলির বাইরে অন্য কোন সাধারণকরণের রূপান্তরগুলি সাধারণত ব্যবহৃত হয়?
পরীক্ষার স্কোরগুলির বিশ্লেষণে (যেমন, শিক্ষা বা মনোবিজ্ঞানের ক্ষেত্রে) সাধারণ বিশ্লেষণ কৌশলগুলি প্রায়শই ধরে নেয় যে ডেটা সাধারণত বিতরণ করা হয়। তবে, সম্ভবত প্রায়শই বেশি না, স্কোরগুলি কখনও কখনও স্বাভাবিক থেকে বন্যভাবে বিচ্যুত হয়। আমি কিছু বেসিক নরমালাইজিং ট্রান্সফর্মেশনগুলির সাথে পরিচিত, যেমন: স্কোয়ার শিকড়, লোগারিদম, ইতিবাচক স্কিউ হ্রাস করার জন্য পারস্পরিক …

1
আপনি কীসের অবশিষ্টাংশগুলির পোস্ট-ফিট বিশ্লেষণ ব্যবহার করেন?
ওএলএস একাধিক লিনিয়ার রিগ্রেশন বহন করার সময়, লাগানো মানগুলির বিরুদ্ধে অবশিষ্টাংশ প্লট করার পরিবর্তে আমি (অভ্যন্তরীণ) স্টাটেডাইজড রেসিডুয়ালগুলিকে লাগানো মানগুলির (কোভেরিয়েটগুলির জন্য ডাইটো) বিরুদ্ধে প্লট করি। এই অবশিষ্টাংশগুলি হিসাবে সংজ্ঞায়িত করা হয়: ই*আমি= ইআমিগুলি2( 1 - এইচi i)---------√ei∗=eis2(1−hii)\begin{equation} e^*_i = \frac{e_i}{\sqrt{s^2 (1-h_{ii})}} \end{equation} যেখানে হল অবশিষ্ট এবং the হ্যাট ম্যাট্রিক্সের …

2
বিভাগীয় ডেটা হিসাবে সরাসরি সিএসভি কলামগুলি পড়া কি সম্ভব?
আমাকে একটি সিএসভিতে আসা একটি মেডিকেল জরিপ (100+ কোডযুক্ত কলাম সহ) থেকে ডেটা বিশ্লেষণ করতে হবে। আমি কিছু প্রাথমিক বিশ্লেষণের জন্য রটল ব্যবহার করব তবে পর্দার আড়ালে এটি এখনও আর। আমি যদি ফাইলটি সিএসভি () পড়ে থাকি তবে সংখ্যাসূচক কোড সহ কলামগুলি সংখ্যাসূচক ডেটা হিসাবে গণ্য হবে। আমি সচেতন আমি …

1
এমন কোনও প্রক্রিয়ার উদাহরণ যা ২ য় অর্ডার স্থির তবে কঠোরভাবে স্থির নয়
কারও কাছে কি স্টোকাস্টিক প্রক্রিয়াটির দুর্দান্ত উদাহরণ রয়েছে যা 2 য়-অর্ডারের স্থায়ী, তবে কঠোরভাবে স্থির নয়?

1
সময়ের সাথে সাথে পরিবর্তনশীলতার অনুমান করা
আমার কাছে একটি ডেটাসেট রয়েছে যাতে ~ 2,500 ব্যক্তির কাছ থেকে ~ 7,500 রক্ত ​​পরীক্ষা রয়েছে। আমি দুটি পরীক্ষার মধ্যবর্তী সময়ের সাথে রক্তের পরীক্ষার পরিবর্তনশীলতা বৃদ্ধি বা হ্রাস পায় কিনা তা জানার চেষ্টা করছি। উদাহরণস্বরূপ - বেসলাইন পরীক্ষার জন্য আমি আপনার রক্ত ​​আঁকছি, তারপরে তাত্ক্ষণিকভাবে দ্বিতীয় নমুনা আঁকুন। ছয় মাস …

2
শ্রেণিবদ্ধ তথ্য থেকে বুটস্ট্র্যাপযুক্ত আত্মবিশ্বাসের অন্তরগুলি অর্জন এবং ব্যাখ্যা করা
আমি পরিমাণে এক্স এর উপর একটি বুটস্ট্র্যাপড আত্মবিশ্বাসের ব্যবধান পেতে আগ্রহী, যখন এই পরিমাণটি 10 ​​ব্যক্তির প্রত্যেকটিতে 10 বার পরিমাপ করা হয়। একটি পদ্ধতি হ'ল পৃথক প্রতি গড় অর্জন করা, তারপরে উপায়গুলি বুটস্ট্র্যাপ করুন (উদাহরণস্বরূপ প্রতিস্থাপনের সাথে পুনরায় নমুনা করুন)। বুটস্ট্র্যাপিং পদ্ধতির প্রতিটি পুনরাবৃত্তির জন্য আরেকটি পদ্ধতি নিম্নলিখিতটি করা: প্রতিটি …

2
ক্রিয়ামূলক ডেটা বিশ্লেষণ এবং উচ্চ মাত্রিক ডেটা বিশ্লেষণের মধ্যে পার্থক্য কী
পরিসংখ্যান সাহিত্যে " ক্রিয়ামূলক ডেটা " (অর্থাত্ তথ্যগুলি যে বক্ররেখা হয়) এবং সমান্তরালে " উচ্চ মাত্রিক ডেটা " (অর্থাৎ যখন ডেটা উচ্চ মাত্রিক ভেক্টর থাকে) সম্পর্কিত প্রচুর উল্লেখ রয়েছে। আমার প্রশ্নটি দুই ধরণের ডেটার মধ্যে পার্থক্য সম্পর্কে। যখন প্রয়োগ করা পরিসংখ্যান পদ্ধতিগুলির ক্ষেত্রে কথা বলা হয় যা ক্ষেত্রে 1 এর …

3
এটি আরও অর্থবহ দেখানোর জন্য কোনও টাইম সিরিজকে একত্রিত করার জন্য বৈধ?
আমার কাছ থেকে টাইম সিরিজ সম্পর্কে আরও একটি প্রশ্ন। আমার কাছে একটি ডেটাসেট রয়েছে যা মানসিক রোগের হাসপাতালে তিন বছরেরও বেশি সময় ধরে হিংসাত্মক ঘটনাগুলির নথিভুক্ত করে। আমার আগের প্রশ্নটির সাহায্যে আমি এটির সাথে ফেটে যাচ্ছি এবং এটি সম্পর্কে এখন কিছুটা খুশি। আমার কাছে এখন জিনিসটি হ'ল দৈনিক সিরিজটি খুব …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.