পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
Ggplot2 এ রিগ্রেশন লাইনের পূর্বাভাস বা প্রসারিত কীভাবে?
আমার কাছে একটি ডেটা ফ্রেম রয়েছে যাতে দুটি সময়ের সিরিজ থাকে: তারিখ এবং সংস্করণ নম্বর Emacs এবং ফায়ারফক্স প্রকাশের। একটি ggplot2 কমান্ড ব্যবহার করে বিন্দুগুলিকে লাইনে পরিণত করার জন্য একটি চার্ট তৈরি করা সহজ যা লোয়েস (এমনভাবে দেখায় যে কিছুটা মজাদার মনে হয়) uses কীভাবে আমি ভবিষ্যতে লাইনগুলি প্রসারিত করতে …

1
কেন কেএল ডাইভারজেন্স অ-নেতিবাচক?
কেএল ডাইভারজেন অ-নেতিবাচক কেন? তথ্য তত্ত্বের দৃষ্টিকোণ থেকে আমার এমন স্বজ্ঞাত জ্ঞান রয়েছে: দুই ensembles আছে বলুন AAA এবং BBB যার দ্বারা লেবেল উপাদানের একই সেট দ্বারা গঠিত xxx । p(x)p(x)p(x) এবং q(x)q(x)q(x) হ'ল যথাক্রমে AAA এবং জুড়ে বিভিন্ন সম্ভাবনা বিতরণ BBB। তথ্য তত্ত্বের দৃষ্টিকোণ থেকে, log2(P(x))log2⁡(P(x))\log_{2}(P(x)) হ'ল বিটগুলির ন্যূনতম …

3
পাইথনে কীভাবে পদ্ধতিতে কলিনারি ভেরিয়েবলগুলি মুছবেন? [বন্ধ]
বন্ধ থাকে। এই প্রশ্নটি অফ-টপিক । এটি বর্তমানে উত্তর গ্রহণ করছে না। এই প্রশ্নটি উন্নত করতে চান? প্রশ্নটি আপডেট করুন যাতে এটি ক্রস ভ্যালিডেটের জন্য অন-বিষয় । 2 বছর আগে বন্ধ । এখনও অবধি, আমি প্রাসঙ্গিক টেবিলগুলি দেখে এবং নির্দিষ্ট থ্রেশোল্ডের উপরে যে ভেরিয়েবলগুলি অপসারণ করে ডেটা প্রস্তুতি প্রক্রিয়ার অংশ …

1
স্ট্যান্ডার্ড পিসিএর তুলনায় কার্নেল পিসিএর সুবিধা কী কী?
আমি একটি কাগজে একটি অ্যালগরিদম বাস্তবায়ন করতে চাই যা ডেটা ম্যাট্রিক্স পচে যাওয়ার জন্য কার্নেল এসভিডি ব্যবহার করে। সুতরাং আমি কার্নেল পদ্ধতি এবং কার্নেল পিসিএ ইত্যাদি সম্পর্কিত সামগ্রীগুলি পড়ছি তবে এটি এখনও আমার কাছে খুব অস্পষ্ট, বিশেষত যখন এটি গাণিতিক বিবরণে আসে এবং আমার কয়েকটি প্রশ্ন থাকে। কার্নেল পদ্ধতি কেন? …
18 pca  svd  kernel-trick 

3
ভারসাম্যহীন ডেটাসেটে আরওসি বনাম যথার্থ-পুনরুদ্ধার বক্ররেখা
আমি এই আলোচনাটি পড়ে শেষ করেছি । তাদের যুক্তি রয়েছে যে ভারসাম্যহীন ডেটাসেটের ক্ষেত্রে আরওসি এউসি থেকে পিআর এউসি ভাল। উদাহরণস্বরূপ, আমাদের পরীক্ষার ডেটাসেটে 10 টি নমুনা রয়েছে। 9 টি নমুনা ধনাত্মক এবং 1 টি নেতিবাচক। আমাদের কাছে একটি ভয়াবহ মডেল রয়েছে যা সবকিছুকে ইতিবাচক বলে পূর্বাভাস দেয়। সুতরাং, আমাদের …

2
নিউরাল নেটওয়ার্ক প্রশিক্ষণ দেওয়ার সময় প্রশিক্ষণ / পরীক্ষার ত্রুটিগুলিতে হঠাৎ হ্রাস হওয়ার কারণ কী?
নিউরাল নেটওয়ার্ক প্রশিক্ষণ চলাকালীন আমি পরীক্ষার / প্রশিক্ষণের ত্রুটির প্লটগুলি হঠাৎ কয়েকবার কিছু সময় নেমে এসেছি এবং আমি আশ্চর্য হয়েছি যে কী কারণে এই পারফরম্যান্স লাফিয়ে উঠেছে: এই চিত্রটি কাইমিং হি গিথুব থেকে নেওয়া হয়েছে, তবে একই রকম প্লটগুলি অনেকগুলি কাগজপত্রে প্রদর্শিত হয়।

3
এর উদ্দেশ্যযুক্ত বিতরণের বিরুদ্ধে এলোমেলোভাবে উত্পন্ন ডেটা পরীক্ষা করা
আমি একটি প্রোগ্রাম লিখেছি যা এলোমেলো ডেটা উত্পন্ন করে। যদি প্রোগ্রামটি সঠিকভাবে কাজ করে, তবে সেই ডেটাটির একটি নির্দিষ্ট, জ্ঞাত সম্ভাবনা বন্টন অনুসরণ করা উচিত। আমি প্রোগ্রামটি চালাতে চাই, ফলাফলটি সম্পর্কে কিছু গণনা করব এবং একটি পি-মান নিয়ে এসেছি। অন্য কেউ এটির আগে বলার আগে: আমি বুঝতে পারি যে প্রোগ্রামটি …

2
একটি ভেরিয়েবলকে শ্রেণিবদ্ধকরণ এটিকে তুচ্ছ থেকে তাৎপর্যপূর্ণ করে তোলে
আমার কাছে একটি সাংখ্যিক পরিবর্তনশীল রয়েছে যা মাল্টিভারিয়েট লজিস্টিক রিগ্রেশন মডেলটিতে তাত্পর্যপূর্ণ নয় turns যাইহোক, যখন আমি এটিকে দলগুলিতে শ্রেণিবদ্ধ করি, হঠাৎ এটি তাৎপর্যপূর্ণ হয়ে ওঠে। এটি আমার কাছে অত্যন্ত স্ব-স্বজ্ঞাত: যখন কোনও ভেরিয়েবলকে শ্রেণিবদ্ধকরণ করা হয়, তখন আমরা কিছু তথ্য ছেড়ে দেই। এটা কিভাবে হতে পারে?

1
গেলম্যানের 8 টি স্কুলের উদাহরণে, পৃথক অনুমানের স্ট্যান্ডার্ড ত্রুটি কেন ধরা হয়?
প্রসঙ্গ: গেলম্যানের ৮-স্কুলের উদাহরণে (বায়েসিয়ান ডেটা অ্যানালাইসিস, তৃতীয় সংস্করণ, সিএফ 5.5) কোচিংয়ের প্রভাব পরীক্ষা করে 8 টি স্কুলে আটটি সমান্তরাল পরীক্ষা-নিরীক্ষা রয়েছে। প্রতিটি পরীক্ষায় কোচিংয়ের কার্যকারিতা এবং সংশ্লিষ্ট মানক ত্রুটির জন্য একটি অনুমান পাওয়া যায়। এরপরে লেখকরা কোচিংয়ের প্রভাবের 8 ডেটা পয়েন্টগুলির জন্য একটি শ্রেণিবদ্ধ মডেল তৈরি করেন: yi∼N(θi,sei)θi∼N(μ,τ)yi∼N(θi,sei)θi∼N(μ,τ) y_i …

1
ধাপে ধাপে এআইসি - এই বিষয়টিকে ঘিরে কি বিতর্ক আছে?
আমি এই সাইটে অগণিত পোস্ট পড়েছি যা পি-ভ্যালু ভিত্তিক, এআইসিসি, বিআইসি ইত্যাদির কোনও ধরণের মানদণ্ড ব্যবহার করে ভেরিয়েবলের ধাপে ধাপে ব্যবহারের বিপরীতে অবিশ্বাস্যরূপে are আমি বুঝতে পারি কেন এই পদ্ধতিগুলি সাধারণ হয়, ভেরিয়েবল নির্বাচনের জন্য যথেষ্ট দুর্বল। gung এর সম্ভবত বিখ্যাত পোস্টে এখানে পরিষ্কারভাবে কেন প্রকাশ করে; শেষ পর্যন্ত আমরা …

2
প্রশ্নপত্রটি কি-লার্নিংয়ে কেন বেছে নেওয়া হয়েছিল?
প্রশ্নপত্রটি কি-লার্নিংয়ের নামে কেন বেছে নেওয়া হয়েছিল? সর্বাধিক অক্ষর যেমন একটি সমাহার হিসেবে নির্বাচিত করা হয় নীতি এবং জন্য স্থায়ী বনাম মান জন্য দাঁড়িয়েছে। তবে আমি মনে করি না যে প্রশ্নটি কোনও শব্দের সংক্ষেপণ।ππ\pivvv

3
যখন আউটপুট এবং ভবিষ্যদ্বাণীকারীদের মধ্যে কোনও উল্লেখযোগ্য সম্পর্ক নেই তখন কীভাবে একটি ভাল লিনিয়ার রিগ্রেশন মডেল পাওয়া সম্ভব?
আমি ভেরিয়েবল / বৈশিষ্ট্যগুলির সেট ব্যবহার করে একটি লিনিয়ার রিগ্রেশন মডেলকে প্রশিক্ষণ দিয়েছি। এবং মডেল একটি ভাল অভিনয় আছে। যাইহোক, আমি বুঝতে পেরেছি যে পূর্বাভাসযুক্ত ভেরিয়েবলের সাথে ভাল সম্পর্কযুক্ত কোনও ভেরিয়েবল নেই। কিভাবে এটা সম্ভব?

2
বায়েশীয় দৃষ্টিকোণ থেকে লাসো এবং রিজ: টিউনিং প্যারামিটারের কী হবে?
লাসো এবং রিজের মতো দণ্ডিত রিগ্রেশন অনুমানকারীরা নির্দিষ্ট কিছু প্রিয়ারের সাথে বায়েশিয়ান অনুমানের সাথে সঙ্গতিপূর্ণ বলে মনে হয়। আমার ধারণা (যেহেতু বায়েশিয়ান পরিসংখ্যান সম্পর্কে আমি যথেষ্ট পরিমাণে জানি না) একটি নির্দিষ্ট টিউনিং প্যারামিটারের জন্য পূর্বের সাথে একটি কংক্রিট উপস্থিত রয়েছে। এখন একটি ঘনত্ববাদী ক্রস বৈধতা দ্বারা সুরক্ষা পরামিতি অনুকূল করতে …

11
আপনি কি স্বৈরশাসক গেমের এই উদাহরণে পারস্পরিক সম্পর্ক থেকে কার্যকারিতা অনুমান করতে পারেন?
আমি সবেমাত্র পরীক্ষা দিয়েছি যেখানে আমাদের দুটি ভেরিয়েবল উপস্থিত হয়েছিল। একটি স্বৈরশাসকের খেলায় যেখানে কোনও স্বৈরশাসককে ১০০ ডলার দেওয়া হয় এবং নিজের জন্য কতটা প্রেরণ বা রাখার তা চয়ন করতে পারেন, বয়সের মধ্যে অংশগ্রহণকারীরা কতটা টাকা রাখার সিদ্ধান্ত নিয়েছিল তার মধ্যে একটি ইতিবাচক সম্পর্ক ছিল। আমার ধারণা হ'ল আপনি এ …

3
একটি "পরিসংখ্যান পরীক্ষা" এবং "পরিসংখ্যানের মডেল" এর মধ্যে পার্থক্য কী?
আমি অ্যাডাব্লু ভ্যান ডার ভার্ট, অ্যাসেম্পটোটিক পরিসংখ্যান (1998) অনুসরণ করছি। তিনি পরিসংখ্যানমূলক পরীক্ষা-নিরীক্ষার কথা বলে দাবি করেছেন যে সেগুলি একটি পরিসংখ্যানের মডেল থেকে আলাদা, তবে তিনি কোনওটিই সংজ্ঞায়িত করেননি। আমার প্রশ্ন: (1) একটি পরিসংখ্যান পরীক্ষা, (2) একটি পরিসংখ্যানগত মডেল এবং (3) মূল উপাদানটি কী যা সর্বদা পরিসংখ্যানগত পরীক্ষাকে কোনও পরিসংখ্যানের …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.