পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

8
প্রতিটি পরিসংখ্যানবিদদের কী তত্ত্বগুলি জানা উচিত?
আমি এটি একটি খুব বেসিক, ন্যূনতম প্রয়োজনীয়তার দৃষ্টিকোণ থেকে ভাবছি। একটি শিল্প (একাডেমিক নয়) স্ট্যাটিস্টিস্টিয়ানদের নিয়মিত ভিত্তিতে জানতে, বুঝতে এবং ব্যবহার করা উচিত এমন মূল তত্ত্বগুলি কী কী? মনে মনে আসে একটি বড় একটি হ'ল বিপুল সংখ্যার আইন । ডেটা বিশ্লেষণে স্ট্যাটিস্টিকাল তত্ত্ব প্রয়োগের জন্য সবচেয়ে প্রয়োজনীয় কী কী?

3
কোনও টাইম সিরিজ স্থির বা অ-স্টেশনারি হয় কীভাবে তা জানবেন?
আমি আর ব্যবহার করছি, আমি Google এ অনুসন্ধান এবং যে শিখেছি kpss.test(), PP.test()এবং adf.test()সময় সিরিজের stationarity সম্পর্কে জানতে ব্যবহার করা হয়। তবে আমি কোনও পরিসংখ্যানবিদ নই, যারা তাদের ফলাফলগুলি ব্যাখ্যা করতে পারে > PP.test(x) Phillips-Perron Unit Root Test data: x Dickey-Fuller = -30.649, Truncation lag parameter = 7, p-value = …

1
জিএএমএস (আরগুজে এমজিসিভি প্যাকেজ) তে টেনসর পণ্যের ইন্টারঅ্যাকশনগুলির পিছনে অন্তর্দৃষ্টি
সাধারণকরণযোগ্য মডেলগুলি উদাহরণস্বরূপ । ফাংশনগুলি মসৃণ এবং অনুমান করা যায়। সাধারণত দণ্ডিত স্প্লাই দ্বারা। এমজিসিভি হ'ল একটি প্যাকেজ যা আর এটি করে এবং লেখক (সাইমন উড) আর এর উদাহরণ সহ তাঁর প্যাকেজ সম্পর্কে একটি বই লিখেছেন। রুপার্ট, ইত্যাদি। (2003) একই জিনিসটির আরও সহজ সংস্করণ সম্পর্কে আরও বেশি অ্যাক্সেসযোগ্য বই লিখুন। …

4
শ্রেণি ভারসাম্যহীন অধীনে যথার্থ-পুনর্বিবেচনা বক্ররেখার জন্য অনুকূলকরণ
আমার একটি শ্রেণিবিন্যাস টাস্ক রয়েছে যেখানে আমার কাছে অনেকগুলি ভবিষ্যদ্বাণী রয়েছে (যার মধ্যে একটি সর্বাধিক তথ্যপূর্ণ), এবং আমি আমার শ্রেণিবদ্ধ নির্মানের জন্য মার্স মডেলটি ব্যবহার করছি (আমি কোনও সাধারণ মডেলের প্রতি আগ্রহী, এবং উদাহরণস্বরূপ গ্ল্যাম ব্যবহার করা হবে) ঠিক আছে)। প্রশিক্ষণ ডেটাতে এখন আমার কাছে বিশাল শ্রেণির ভারসাম্যহীনতা রয়েছে (প্রতিটি …

6
লাইন গ্রাফের অনেকগুলি লাইন রয়েছে, এর থেকে আরও ভাল সমাধান কি আছে?
আমি সময়ের সাথে সাথে ব্যবহারকারীদের দ্বারা ক্রিয়া সংখ্যা (এই ক্ষেত্রে, "পছন্দগুলি") লেখার চেষ্টা করছি। সুতরাং আমার y- অক্ষ হিসাবে আমার "ক্রমের সংখ্যা" রয়েছে, আমার এক্স-অক্ষের সময় (সপ্তাহ) এবং প্রতিটি লাইনই একজন ব্যবহারকারীকে উপস্থাপন করে। আমার সমস্যাটি হ'ল আমি প্রায় 100 ব্যবহারকারীর সেট এর জন্য এই ডেটাটি দেখতে চাই। একটি লাইন …

3
পাঠ্য শ্রেণিবদ্ধকরণের কার্যগুলিতে আর স্কেল কতটা ভাল হয়? [বন্ধ]
আমি আর এর সাথে গতি অর্জনের চেষ্টা করছি eventually আমি শেষ পর্যন্ত পাঠ্য শ্রেণিবদ্ধকরণের জন্য আর লাইব্রেরিটি ব্যবহার করতে চাই। আমি যখন কেবল পাঠ্য শ্রেণিবদ্ধকরণ করার কথা বলি তখন আর এর স্কেল্যাবিলিটি সম্পর্কিত লোকদের অভিজ্ঞতাগুলি কী তা আমি ভাবছিলাম। আমি উচ্চ মাত্রিক ডেটা (k 300k মাত্রা) চালানোর সম্ভবত। আমি বিশেষত …

4
দুটি পোইসন নমুনার একইরকম আছে কিনা তা পরীক্ষা করা হচ্ছে
এটি একটি প্রাথমিক প্রশ্ন, তবে আমি উত্তরটি খুঁজে পাইনি। আমার দুটি পরিমাপ রয়েছে: টাইম টি 1 এ এন 1 ইভেন্ট এবং টি টি 2-তে এন 2 ইভেন্ট, উভয়ই পয়েসন প্রসেস দ্বারা উত্পাদিত (বলুন) সম্ভবত বিভিন্ন-ল্যাম্বডা মান সহ। এটি আসলে একটি সংবাদ নিবন্ধ থেকে এসেছে, যা মূলত দাবি করে যে যেহেতু …

6
আত্মবিশ্বাসের অন্তর কখন কার্যকর হয়?
যদি আমি সঠিকভাবে বুঝতে পারি তবে প্যারামিটারের একটি আত্মবিশ্বাসের ব্যবধান হ'ল একটি পদ্ধতি দ্বারা নির্মিত একটি বিরতি যা নমুনার নির্দিষ্ট অনুপাতে সত্যিকারের মান সহ অন্তরগুলি দেয়। সুতরাং 'আত্মবিশ্বাস' কোনও নির্দিষ্ট নমুনা থেকে আমি বিরতি গণনা করে ব্যবধানের চেয়ে পদ্ধতিটি সম্পর্কে। পরিসংখ্যানের ব্যবহারকারী হিসাবে আমি সবসময়ই এর দ্বারা প্রতারণাপূর্ণ বোধ করেছি …

6
দ্বি দ্বিবিশ্বের আত্মবিশ্বাসের ব্যবধানের অনুমান - কেন এটি প্রতিসম নয়?
বাইনোমিয়াল অনুপাতের আস্থা অন্তরগুলি অনুমান করার জন্য আমি নীচের আর কোডটি ব্যবহার করেছি কারণ আমি বুঝতে পারি যে কোনও জনসংখ্যার রোগ সনাক্তকরণের দিকে তাকিয়ে রিসিভার অপারেটিং বৈশিষ্ট্যযুক্ত কার্ভ ডিজাইনের ডিজাইনের সময় একটি "পাওয়ার গণনা" এর বিকল্প হয়। n 150, এবং আমাদের বিশ্বাস, রোগটি 25% জনসংখ্যার মধ্যে রয়েছে। আমি 75% সংবেদনশীলতা …

2
প্রধান উপাদান বিশ্লেষণে বাইপলটসের ব্যাখ্যা
আমি এই সুন্দর টিউটোরিয়ালটি পেরিয়ে এসেছি: আর। ব্যবহার করে পরিসংখ্যান বিশ্লেষণের একটি হ্যান্ডবুক Chapter অধ্যায় 13. অধ্যক্ষ উপাদান উপাদান বিশ্লেষণ: কীভাবে আর ভাষায় পিসিএ করবেন সে বিষয়ে অলিম্পিক হেপটাথলন । আমি চিত্র 13.3 এর ব্যাখ্যা বুঝতে পারি না: তাই আমি প্রথম ইগেনভেક્ટર বনাম দ্বিতীয় ইগেনভেেক্টর ষড়যন্ত্র করছি। ওটার মানে কি? …

5
নমুনা বিতরণ শেখানোর কৌশল
টিএল; ডাঃ সংস্করণ সূচনা স্নাতক স্তরের নমুনা বিতরণ (উদাহরণস্বরূপ, উদাহরণস্বরূপ) শেখানোর জন্য আপনি কোন সফল কৌশল ব্যবহার করেন? পটভূমি সেপ্টেম্বরে আমি দ্বিতীয় বর্ষের সামাজিক বিজ্ঞানের (প্রাথমিকভাবে রাষ্ট্রবিজ্ঞান এবং সমাজবিজ্ঞান) শিক্ষার্থীদের ডেভিড মুরের বুনিয়াদি অনুশীলন ব্যবহার করে শিক্ষার্থীদের জন্য একটি সূচনা পরিসংখ্যান কোর্স শিখিয়ে দেব । এটি এই পঞ্চমবারের মতো হবে …

3
অনেকগুলি সেটের ছেদগুলি ভিজ্যুয়ালাইজ করা
এমন কোনও ভিজ্যুয়ালাইজেশন মডেল রয়েছে যা অনেকগুলি সংখ্যার ছেদকে ছেদ করার জন্য ভাল? আমি ভেন ডায়াগ্রামের মতো কিছু ভাবছি তবে এটি কোনওরকম 10 বা তার বেশি সংখ্যক সেটের কাছে নিজেকে আরও ভাল ধার দিতে পারে। উইকিপিডিয়ায় কিছু উচ্চতর সেট ভেন ডায়াগ্রাম দেখাতে পারে তবে 4 সেট চিত্রটিও গ্রহণ করার মতো। …

2
স্বাভাবিকতার শাপিরো-উইলক পরীক্ষা এবং কোলমোগোরভ-স্মারনভ পরীক্ষার মধ্যে পার্থক্য কী?
স্বাভাবিকতার শাপিরো-উইলক পরীক্ষা এবং কোলমোগোরভ-স্মারনভ পরীক্ষার মধ্যে পার্থক্য কী? এই দুটি পদ্ধতির ফলাফলগুলি কখন পৃথক হবে?

1
কেন কেন্দ্রিং পিসিএ (এসভিডি এবং ইগেন পচানোর জন্য) মধ্যে পার্থক্য আনতে পারে?
আপনার ডেটা পিসিএর জন্য কেন্দ্রীভূত করে (বা ডি-অর্থ)? আমি শুনেছি এটি গণিতকে সহজ করে তোলে বা এটি প্রথম পিসিকে ভেরিয়েবলগুলির মাধ্যম দ্বারা প্রভাবিত হতে বাধা দেয় তবে আমার মনে হয় আমি এখনও দৃ feel়ভাবে ধারণাটি উপলব্ধি করতে সক্ষম হইনি। উদাহরণস্বরূপ, শীর্ষস্থানীয় উত্তর এখানে ডেটা কেন্দ্রীকরণ কীভাবে রিগ্রেশন এবং পিসিএর বিরতি …
30 r  pca  svd  eigenvalues  centering 

6
লজিস্টিক রিগ্রেশন এবং পারসেপ্ট্রনের মধ্যে পার্থক্য কী?
আমি মেশিন লার্নিংয়ের বিষয়ে অ্যান্ড্রু এনজি'র বক্তৃতার নোটগুলি দিয়ে যাচ্ছি । নোটগুলি আমাদের লজিস্টিক রিগ্রেশন এবং তারপরে পারসেপ্ট্রনের সাথে পরিচয় করিয়ে দেয়। পারসেপ্ট্রন বর্ণনা করার সময়, নোটগুলি বলে যে আমরা কেবল লজিস্টিক রিগ্রেশন জন্য ব্যবহৃত থ্রেশহোল্ড ফাংশনটির সংজ্ঞা পরিবর্তন করেছি। এটি করার পরে, আমরা শ্রেণিবিন্যাসের জন্য পার্সেপট্রন মডেলটি ব্যবহার করতে …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.