পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
শব্দগুলির অবিচ্ছিন্ন ব্যাগ সম্পর্কে প্রশ্ন
এই বাক্যটি বুঝতে আমার সমস্যা হচ্ছে: প্রথম প্রস্তাবিত আর্কিটেকচারটি ফিডফোর্ড এনএনএলএম এর অনুরূপ, যেখানে অ-রৈখিক লুকানো স্তর সরানো হয় এবং প্রজেকশন স্তরটি সমস্ত শব্দের জন্য ভাগ করা হয় (কেবলমাত্র প্রক্ষেপণ ম্যাট্রিক্স নয়); সুতরাং, সমস্ত শব্দ একই অবস্থানে প্রজেক্ট হয় (তাদের ভেক্টরগুলির গড় হয়)। প্রোজেকশন স্তর বনাম প্রজেকশন ম্যাট্রিক্স কী? সমস্ত …

3
সামঞ্জস্যযোগ্য নির্ভুলতা বনাম স্মরণ সহ শ্রেণিবদ্ধকারী
আমি বাইনারি শ্রেণিবদ্ধকরণ সমস্যা নিয়ে কাজ করছি যেখানে মিথ্যা ধনাত্মকতা না থাকা আরও গুরুত্বপূর্ণ; বেশ কিছু মিথ্যা নেগেটিভ ঠিক আছে। উদাহরণস্বরূপ আমি স্ক্লার্নে একগুচ্ছ ক্লাসিফায়ার ব্যবহার করেছি, তবে আমি মনে করি তাদের মধ্যে কারও স্পষ্টরূপে নির্ভুলতা-রিক্যাল ট্রেডঅফ সামঞ্জস্য করার ক্ষমতা নেই (তারা বেশ ভাল ফলাফল দেয় তবে সামঞ্জস্যযোগ্য নয়)। কোন …

2
কেন আমরা একটি সময় সিরিজ থেকে মৌসুমী অপসারণ করা উচিত?
সময় সিরিজের সাথে কাজ করার সময় আমরা মাঝে মাঝে বর্ণালি বিশ্লেষণ ব্যবহার করে মৌসুমতাকে সনাক্ত এবং সরিয়ে ফেলি। আমি সময় সিরিজের সত্যিকারের শিক্ষানবিস এবং আমি বিভ্রান্ত হয়ে পড়েছি কেন কেউ আসল সময়ের সিরিজ থেকে মৌসুমীতা সরিয়ে নিতে চাইবে? মৌসুমীতা সরানো কি মূল ডেটাটি বিকৃত করে না? মৌসুমীতা সরিয়ে একটি টাইম …

2
ফিশারের সঠিক পরীক্ষাটি কোন বিতরণ অনুমান করে?
আমার কাজে আমি ফিশারের সঠিক পরীক্ষার বেশ কয়েকটি ব্যবহার দেখেছি এবং আমি ভাবছিলাম যে এটি আমার ডেটার সাথে কতটা ফিট করে। বেশ কয়েকটি উত্সের দিকে তাকিয়ে আমি বুঝতে পারি যে কীভাবে পরিসংখ্যানগুলি গণনা করতে হবে তবে অনুমান নাল অনুমানের কোনও পরিষ্কার এবং আনুষ্ঠানিক ব্যাখ্যা দেখিনি। অনুগ্রহ করে বিতরণ সম্পর্কে কোনও …

2
সিদ্ধান্ত গাছের সাথে অ্যাডাবোস্ট কেন?
আমি শ্রেণিবিন্যাসের কাজের জন্য এবং বিশেষত অ্যাডাবুস্টের জন্য অ্যালগরিদমগুলি বাড়িয়ে দেওয়ার বিষয়ে কিছুটা পড়ছি। আমি বুঝতে পারি যে অ্যাডাবোস্টের উদ্দেশ্য হ'ল বেশ কয়েকটি "দুর্বল শিখর" নেওয়া এবং প্রশিক্ষণের ডেটা নিয়ে পুনরাবৃত্তির একটি সেটের মাধ্যমে, শ্রেণিবদ্ধদের ধাক্কা দিয়ে ক্লাসগুলি পূর্বাভাস দিতে শিখুন যা মডেল (গুলি) বার বার ভুল করে। তবে আমি …

2
সমঝোতা কাজ করে কেন?
সুতরাং আমি জানি যে আমরা যদি কোনও পরিমাণে स्वतंत्र র্যান্ডম ভেরিয়েবল এক্স+ ওয়াইX+YX + Y সম্ভাব্যতা বন্টন সন্ধান করতে চাই, তবে আমরা এক্সXX এবং এর সম্ভাব্যতা বিতরণ থেকে এটি গণনা করতে পারি ওয়াইYY, চএক্স+ ওয়াই( একটি ) = ∫∞x = - ∞চএক্স, Y( এক্স= এক্স , ওয়াই= a - x …

1
সিউডো-র্যান্ডম নম্বর জেনারেশনে বীজ স্থাপনের জন্য উল্লেখ এবং সেরা অনুশীলন
ইন এই দস্তাবেজটি , যে উদ্বেগ "সেট বীজ" কমান্ড, Stata মানুষ বীজ যখন সিউডো-রেণ্ডম সংখ্যার উৎপাদিত সেটিং এর সাথে সম্পর্কিত বিষয় নিয়ে আলোচনা। একটি উল্লেখযোগ্য "না" হ'ল প্রাকৃতিক সংখ্যার ক্রমটি বীজ হিসাবে ক্রমবর্ধমানভাবে ব্যবহার করবেন না, কারণ এটির একটি প্যাটার্ন রয়েছে এবং সিউডো-র্যান্ডমনেসকে বিপন্ন করে "। একটি মাত্র এক-চতুর্থাংশ-রসিকতার সাথে …

2
লগ-প্রতিক্রিয়া বিতরণ কি?
আমি মেশিন লার্নিংয়ের পাঠ্যপুস্তকটি পড়ছি (উইটেন দ্বারা ডেটা মাইনিং, এট আল।, ২০১১) এবং এই উত্তরণটি পেরিয়ে এসেছি: ... তদুপরি, বিভিন্ন বিতরণ ব্যবহার করা যেতে পারে। যদিও সাধারণ বিতরণ সাধারণত সংখ্যাযুক্ত গুণাবলীর জন্য ভাল পছন্দ, তবে এটি এমন বৈশিষ্ট্যের জন্য উপযুক্ত নয় যা পূর্বনির্ধারিত ন্যূনতম তবে উপরের কোন আবদ্ধ নয়; এই …

2
যদি কোনও টাইম সিরিজ দ্বিতীয় ক্রম স্থিতিশীল হয় তবে এটি কি বোঝায় যে এটি কঠোরভাবে স্থিতিশীল?
এক্স টি 1 , এক্স টি 2 , এর যৌথ বিতরণ করা হলে একটি প্রক্রিয়া কঠোরভাবে স্থির । । । , এক্স টি এম এক্স টি 1 + কে , এক্স টি 2 + কে , এর যৌথ বিতরণ হিসাবে সমান । । । , এক্স টি এম + কে …

2
লিনিয়ার রিগ্রেশন মধ্যে বাইনারি / ডিকোটমাস স্বাধীন প্রেডিক্টরদের জন্য কীভাবে অবশিষ্ট বিশ্লেষণ করবেন?
পরিচালিত তহবিলের রিটার্নের পূর্বাভাস দিতে আমি নীচে একাধিক লিনিয়ার রিগ্রেশন করছি। reg <- lm(formula=RET~GRI+SAT+MBA+AGE+TEN, data=rawdata) এখানে কেবল জিআরআই এবং এমবিএই বাইনারি / ডিকোটমাস প্রেডিক্টর; বাকী ভবিষ্যদ্বাণীকারী অবিচ্ছিন্ন। বাইনারি ভেরিয়েবলের জন্য অবশিষ্ট প্লট তৈরি করতে আমি এই কোডটি ব্যবহার করছি। plot(rawdata$GRI, reg$residuals) abline(lm(reg$residuals~rawdata$GRI, data=rawdata), col="red") # regression line (y~x) plot(rawdata$MBA, reg$residuals) …

3
নির্ভুলতা-পুনর্বিবেচনা বক্ররেখার জন্য ভাল এউসি কী?
যেহেতু আমার খুব ভারসাম্যহীন ডেটাসেট রয়েছে (9% ইতিবাচক ফলাফল), তাই আমি সিদ্ধান্ত নিয়েছি যে একটি স্পষ্টতা-রিক্যাল রেখাঙ্কনটি কোনও আরওসি বক্ররের চেয়ে বেশি উপযুক্ত। আমি পিআর বক্ররেখা (.49, যদি আপনি আগ্রহী হন) এর অধীনে ক্ষেত্রের আনুষাঙ্গিক সংক্ষিপ্তসার পরিমাপটি পেয়েছি তবে কীভাবে এটি ব্যাখ্যা করবেন তা সম্পর্কে আমি নিশ্চিত নই। আমি শুনেছি …

2
বিকল্প অনুমানটি গ্রহণ করা কি সম্ভব?
আমি এখানে বেশ কয়েকটি সম্পর্কিত প্রশ্ন সম্পর্কে অবহিত (উদাঃ, নোপকে ঘিরে হাইপোথিসিস পরীক্ষার পরিভাষা , নাল হাইপোথিসিস প্রমাণ করা কি সম্ভব? ) তবে নীচে আমার প্রশ্নের সুনির্দিষ্ট উত্তর আমি জানি না। ধরুন একটি হাইপোথিসিস পরীক্ষা যেখানে আমরা মুদ্রাটি সুষ্ঠু কিনা তা পরীক্ষা করতে চাই। আমাদের দুটি অনুমান আছে: H0:p(head)=0.5H0:p(head)=0.5H_0: p(head)=0.5 …

2
এমসিমিসিতে স্বতঃসম্পর্কতা কম হওয়া বাঞ্ছনীয় কেন?
আমি এমসিমিসিতে স্বতঃসংশোধনের জন্য পরীক্ষা করার প্রয়োজনীয়তা সম্পর্কে পড়তে থাকি। স্বতঃসংশ্লিষ্টতা কম কেন এটি গুরুত্বপূর্ণ? এটি এমসিমিসির প্রসঙ্গে কী পরিমাপ করে?

1
কৌণিক / বিজ্ঞপ্তি তথ্য জন্য রিগ্রেশন
টার্গেটগুলি কোণ রয়েছে এমন শিক্ষণ সমস্যাটি আমি তদারকি করেছি। যদি আমি সাধারণ রিগ্রেশন করতাম তবে 360 এবং 1 নম্বরগুলি আমার মডেলের পক্ষে অনেক দূরে থাকবে, তবে প্রকৃতপক্ষে তারা নিকটবর্তী এবং ভবিষ্যদ্বাণী করছে x এবং y স্থানাঙ্কগুলি সঠিক মনে হয় না, যেহেতু আমি এখানে কেবল একটি সংখ্যার পূর্বাভাস দেওয়ার চেষ্টা করছি। …

2
গড় এবং বৈকল্পিক যখন জানা যায় তখন দ্বিগুণ স্বাভাবিক তথ্যগুলির সমাহারের সর্বাধিক সম্ভাবনার অনুমান কত?
মনে করুন আমাদের কাছে একটি দ্বিবির্ভর সাধারণ বিতরণ থেকে এলোমেলো নমুনা রয়েছে যার অর্থ হিসাবে শূন্য রয়েছে এবং বৈচিত্র হিসাবে এটি রয়েছে, সুতরাং একমাত্র অজানা প্যারামিটারটি হল কোভেরিয়েন্স। সমবায় এর MLE কি? আমি জানি এটি মতো কিছু হওয়া উচিত তবে আমরা কীভাবে এটি জানি?1n∑nj=1xjyj1n∑j=1nxjyj\frac{1}{n} \sum_{j=1}^{n}x_j y_j

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.