পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

4
আরিমা মডেলিংয়ের জন্য প্যারামিটারগুলি নির্ধারণ (পি, ডি, কিউ)
আমি পরিসংখ্যানগুলিতে মোটামুটি নতুন এবং আর। আমি আমার ডেটাসেটের জন্য আরিমা পরামিতিগুলি নির্ধারণ করার প্রক্রিয়াটি জানতে চাই। আপনি কি আমাকে আর তাত্ত্বিকভাবে (যদি সম্ভব হয়) ব্যবহার করে এটি নির্ণয় করতে সহায়তা করতে পারেন? ডেটাটি জানুয়ারি -12 থেকে মার্চ -14 পর্যন্ত রয়েছে এবং মাসিক বিক্রয়কে চিত্রিত করে। এখানে ডেটা সেট করা …
10 r  arima  box-jenkins 

1
মুহুর্ত তৈরির কাজ এবং ফুরিয়ার ট্রান্সফর্ম?
একটি মুহূর্ত উত্পন্ন ফাংশন একটি সম্ভাব্য ঘনত্ব ফাংশন একটি ফুরিয়ার রূপান্তর ? অন্য কথায়, একটি মুহূর্ত উত্পন্ন ফাংশন কি কেবল একটি এলোমেলো ভেরিয়েবলের সম্ভাব্যতা ঘনত্ব বিতরণের বর্ণালী রেজোলিউশন, অর্থাত্ কোনও প্যারামিটারের পরিবর্তে এর প্রশস্ততা, পর্ব এবং ফ্রিকোয়েন্সি অনুসারে কোনও ফাংশনকে বৈশিষ্ট্যযুক্ত করার সমতুল্য উপায় ? যদি তা হয় তবে আমরা …
10 moments  mgf  cumulants 

1
পিআর বক্ররেখা অধীনে অঞ্চল ব্যাখ্যা
আমি বর্তমানে তিনটি পদ্ধতির তুলনা করছি এবং আমার যথাযথতা, অরোক এবং অউপিআরটি মেট্রিক হিসাবে রয়েছে। এবং আমি নিম্নলিখিত ফলাফল আছে: পদ্ধতি এ - acc: 0.75, auROC: 0.75, auPR: 0.45 পদ্ধতি বি - acc: 0.65, অরোক: 0.55, ইউপিআর: 0.40 পদ্ধতি সি - acc: 0.55, auROC: 0.70, auPR: 0.65 আমার যথাযথতা এবং …

2
উপাদানগুলির সংখ্যা বাছাই করার জন্য, পিসিএ ফিটের মান নির্ধারণ করার জন্য ভাল মেট্রিকগুলি কী কী?
প্রধান উপাদান বিশ্লেষণের (পিসিএ) গুণমান নির্ধারণের জন্য একটি ভাল মেট্রিক কী? আমি একটি ডেটাসেটে এই অ্যালগরিদম সম্পাদন করেছি। আমার উদ্দেশ্যটি ছিল বৈশিষ্ট্যগুলির সংখ্যা হ্রাস করা (তথ্যটি খুব অপ্রয়োজনীয় ছিল)। আমি জানি যে শতাংশের বৈকল্পিকতা আমরা কতটা তথ্য রাখি তার একটি ভাল সূচক, আমি অপ্রয়োজনীয় তথ্য সরিয়েছি এবং এই জাতীয় তথ্য …

2
গাউসীয় বিতরণের নমুনা কুর্তোসিস বিতরণের জন্য ফর্ম এক্সপ্রেশন বন্ধ
গাউসীয় বিতরণ থেকে প্রাপ্ত নমুনা কুর্তোসিসের ডেটা বন্টনের জন্য কি কোনও বদ্ধ-রূপের অভিব্যক্তি রয়েছে? অর্থাত, P(K^&lt;a)P(K^&lt;a)P(\hat{K}<a) যেখানে the নমুনা কুরটোসিস।K^K^\hat{K}

2
এনবিএ শুটিংয়ের ধারাবাহিকতা গণনা করা হচ্ছে
কোনও এনবিএ প্লেয়ারের 3-পয়েন্টের শুটিং ধারাবাহিকতা মূল্যায়ন / নির্ধারণ করার উপযুক্ত উপায় কী হবে? উদাহরণস্বরূপ, আমার কাছে এমন একজন খেলোয়াড় রয়েছে যা 3-পয়েন্টের পরিসীমা থেকে 37% অঙ্কুর করে এবং সারা বছর 200 টি প্রচেষ্টা নেয়। আমি শটগুলির একটি নির্বিচার সংখ্যার রোলিং গড় 3-পয়েন্ট% নেওয়ার কথা বিবেচনা করছি (20 বলুন)। তারপরে …

3
দুটি ডিভাইসের যথার্থতার তুলনা করতে পরিসংখ্যান পরীক্ষা
আমি এনেস্থেসেটিসযুক্ত রোগীদের শরীরের তাপমাত্রা ঠিক 37 ডিগ্রি বজায় রাখতে দু'টি তাপমাত্রা নিয়ন্ত্রণ ডিভাইসের তুলনা করছি। ডিভাইসগুলি দুটি গ্রুপ গঠনকারী 500 রোগীর জন্য লাগানো হয়েছিল। গ্রুপ এ (৪০০ রোগী) - ডিভাইস ১, গ্রুপ বি (১০০ জন রোগী) - ডিভাইস ২. প্রতিটি রোগীর প্রতি ঘন্টা তার তাপমাত্রা প্রতি ঘন্টা for hours …

1
এমন কোনও উপপাদ্য রয়েছে যা বলে যে distribution অনন্ততায় যাওয়ার সাথে সাথে বিতরণে রূপান্তরিত হয় ?
যাক হতে কোনো সংজ্ঞায়িত গড় সঙ্গে বন্টন এবং স্ট্যানডার্ড ডেভিয়েশন । কেন্দ্রীয় সীমাবদ্ধতা উপপাদ্যটি বলে যে distribution বিতরণকে একটি আদর্শ সাধারণ বিতরণে রূপান্তর করে। যদি আমরা sample নমুনা স্ট্যান্ডার্ড বিচ্যুতি দ্বারা প্রতিস্থাপন করি তবে এমন কোনও উপপাদ রয়েছে যা distribution বিতরণে টি-বিতরণে রূপান্তর করে? যেহেতু বড়XXXμμ\muσσ\sigman−−√X¯−μσnX¯−μσ \sqrt{n}\frac{\bar{X} - \mu}{\sigma} σσ\sigmaSSSn−−√X¯−μSnX¯−μS …

2
সাধারণ লিনিয়ার রিগ্রেশন জন্য নমুনা পারস্পরিক সম্পর্ক এবং আর পরিসংখ্যানের সমতুল্য
এটা প্রায়ই বর্ণিত আছে যে নমুনা পারস্পরিক সম্পর্কের বর্গ r2R2r^2 সমতূল্য R2আর2R^2 সহজ রৈখিক রিগ্রেশনের জন্য সংকল্প সহগ। আমি নিজেই এটি প্রদর্শন করতে অক্ষম হয়েছি এবং এই সত্যতার একটি সম্পূর্ণ প্রমাণের প্রশংসা করব।

2
আমার কি ক্লাস্টার স্তরে বা পৃথক স্তরে বুটস্ট্র্যাপ করা উচিত?
হাসপাতালে নেস্টেড রোগীদের সাথে আমার বেঁচে থাকার মডেল রয়েছে যা হাসপাতালের জন্য এলোমেলো-প্রভাব অন্তর্ভুক্ত করে। এলোমেলো প্রভাব গামা-বিতরণযোগ্য এবং আমি সহজেই বোঝা যায় এমন স্কেলটিতে এই শব্দটির 'প্রাসঙ্গিকতা' প্রতিবেদন করার চেষ্টা করছি। আমি নিম্নলিখিত রেফারেন্সগুলি পেয়েছি যা মিডিয়ান হ্যাজার্ড অনুপাত (কিছুটা মিডিয়ান ওডস অনুপাতের মতো) ব্যবহার করে এবং এটি গণনা …

2
অ্যানোমালি সনাক্তকরণ: কোন অ্যালগরিদম ব্যবহার করবেন?
প্রসঙ্গ: আমি এমন একটি সিস্টেম বিকাশ করছি যা টাইপস হতে পারে এমন অনর্থক ডেটা ফিল্টার করার জন্য ক্লিনিকাল ডেটা বিশ্লেষণ করে। আমি এ পর্যন্ত কি করেছি: প্রশংসনীয়তা প্রমাণের জন্য, আমার এ পর্যন্ত প্রচেষ্টাটি ছিল ডেটা স্বাভাবিক করার এবং তারপরে সেট ডি (= প্রশিক্ষণের সেট) এর ज्ञিত ডেটা পয়েন্টগুলির দূরত্বের ভিত্তিতে …

3
কেন বারবার পদক্ষেপগুলি আনোভা গোলকত্ব গ্রহণ করে?
কেন বারবার পদক্ষেপগুলি আনোভা গোলকত্ব গ্রহণ করে? গোলাকৃতির দ্বারা আমি এই ধারণাটি বোঝাতে চাইছি যে গ্রুপগুলির মধ্যে সমস্ত জুটিযুক্ত পার্থক্যের বৈচিত্র একই হওয়া উচিত। বিশেষত, আমি কেন বুঝতে পারি না কেন এটি অনুমান করা উচিত এবং না যে পর্যবেক্ষণ করা গোষ্ঠীর স্কোরগুলির ভেরিয়েন্সগুলি সেগুলি একই হয়।

1
মন্টি কার্লো বিশ্লেষণের জন্য প্রয়োজনীয় সংখ্যার অনুকরণ
আমার প্রশ্ন মন্টি কার্লো বিশ্লেষণ পদ্ধতির জন্য প্রয়োজনীয় সংখ্যার সিমুলেশন সম্পর্কে। যতদূর আমি দেখতে পাচ্ছি যে কোনও অনুমোদিত শতাংশ ত্রুটির জন্য প্রয়োজনীয় সংখ্যার নম্বর (যেমন, 5) হ'ল ইইEn = { 100 ⋅ zগD স্ট্যান্ড ( এক্স )ই⋅ গড় ( এক্স )}2,এন={100⋅z- রগ⋅এসটিডি(এক্স)ই⋅গড়(এক্স)}2, n = \left\{\frac{100 \cdot z_c \cdot \text{std}(x)}{E \cdot …

1
আমি জিএপি পরিসংখ্যান কীভাবে ব্যাখ্যা করব?
আমি আর এ কে ক্লাস্টারগুলি অনুমান করার জন্য জিএপি পরিসংখ্যান ব্যবহার করেছি However তবে আমি এটির ভাল ব্যাখ্যা করি কিনা তা নিশ্চিত নই। উপরের প্লট থেকে আমি ধরে নিচ্ছি যে আমার 3 টি ক্লাস্টার ব্যবহার করা উচিত। দ্বিতীয় প্লট থেকে আমার 6 টি ক্লাস্টার বেছে নেওয়া উচিত। এটি জিএপি পরিসংখ্যানের …
10 clustering 

1
কেন সাধারণভাবে বিতরণ করা ত্রুটিগুলি আমাদের তাত্পর্যপূর্ণ বিবৃতিগুলির বৈধতার সাথে আপস করে?
ওএলএস মডেলগুলি বিবেচনা করার ক্ষেত্রে একটি স্বাভাবিকতা অনুমান হয় এবং ত্রুটিগুলি সাধারণত বিতরণ করা হয়। আমি ক্রস যাচাইকরণের মাধ্যমে ব্রাউজ করে চলেছি এবং মনে হচ্ছে ত্রুটিগুলি স্বাভাবিক হওয়ার জন্য ওয়াই এবং এক্স এর স্বাভাবিক ক্রম হওয়া উচিত নয়। আমার প্রশ্ন হ'ল যখন আমাদের অ-সাধারণভাবে বিতরণ করা ত্রুটিগুলি থাকে তখন আমাদের …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.