পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

3
প্রতিরোধের জন্য বল্টজম্যান মেশিনগুলি সীমাবদ্ধ?
আমি আরবিএমগুলিতে আগে জিজ্ঞাসা করা প্রশ্নটি অনুসরণ করছি । আমি তাদের প্রচুর সাহিত্যের বিবরণ দেখতে পাচ্ছি কিন্তু বাস্তবে রিগ্রেশন নিয়ে কথা বলে না এমন কোনও কিছুই নেই (এমনকি লেবেলযুক্ত ডেটা সহ শ্রেণিবদ্ধকরণও নয়)। আমি একটি অনুভূতি পেয়েছি যে এটি কেবল লেবেলযুক্ত ডেটার জন্য ব্যবহৃত হয়। রিগ্রেশন পরিচালনা করার জন্য কি …

3
আর তে নেতিবাচক লাসো বাস্তবায়ন নয়
আমি কিছু ওপেন সোর্স বা একটি বিদ্যমান লাইব্রেরি খুঁজছি যা আমি ব্যবহার করতে পারি। আমি যতদূর জানি গ্ল্যামনেট প্যাকেজটি অ নেতিবাচক ক্ষেত্রে coverাকতে খুব সহজেই বর্ধিত নয়। আমি ভুল হতে পারি, যে কোনও ধারণা সহ যিনি অনেক প্রশংসা করেছেন। অ-নেতিবাচক দ্বারা আমি বোঝাতে চাইছি যে সমস্ত সহগুণ ইতিবাচক (> 0) …
13 r  lasso 

4
আরিমার আগে বা আরিমার মধ্যে পার্থক্য সময় সিরিজ
আরিমা ব্যবহার করার আগে একটি সিরিজ (এটির এটির প্রয়োজন অনুমান) পার্থক্য করা ভাল কি আরিমার মধ্যে ডি প্যারামিটারটি ব্যবহার করা ভাল? আমি অবাক হয়েছিলাম একই মডেল এবং ডেটা সহ কোন রুট নেওয়া হয় তার উপর নির্ভর করে ফিটযুক্ত মানগুলি কতটা আলাদা। নাকি আমি ভুলভাবে কিছু করছি? install.packages("forecast") library(forecast) wineindT<-window(wineind, start=c(1987,1), …
13 r  time-series  arima 

3
ভেরিয়েবলগুলি ছড়িয়ে না দিয়ে আপনি কীভাবে অস্থির
উচ্চ মাল্টি-কোলাইনারিটির সাথে লিনিয়ার রিগ্রেশনে বিটা স্থিতিশীলতা? আসুন একটি লিনিয়ার রিগ্রেশন বলি, ভ্যারিয়েবল এবং এর উচ্চ মাল্টি-কোলাইনারিটি রয়েছে (পারস্পরিক সম্পর্ক 0.9 এর কাছাকাছি)।x 2এক্স1x1x_1এক্স2x2x_2 আমরা সহগ স্থিতিশীলতার জন্য উদ্বিগ্ন তাই আমাদের বহু-প্রান্তিকের চিকিত্সা করতে হবে।ββ\beta পাঠ্যপুস্তকের সমাধানটি কেবলমাত্র একটি ভেরিয়েবলকে ফেলে দেওয়া হবে। তবে আমরা কেবল ভেরিয়েবলগুলি ফেলে দিয়ে দরকারী …

2
দুটি অন্তর্নিহিত বিতরণ একই অন্তর্নিহিত জনসংখ্যা থেকে নমুনা দেওয়া আছে কিনা তা কীভাবে পরীক্ষা করবেন?
বলুন আপনাকে দুটি মাল্টিভিয়ারেট ডেটা সেট দেওয়া হয়েছে, একটি পুরানো এবং একটি নতুন বলুন এবং সেগুলি একই প্রক্রিয়াটি দ্বারা উত্পাদিত হয়েছিল বলে মনে করা হচ্ছে (যার জন্য আপনার কোনও মডেল নেই) তবে সম্ভবত, সংগ্রহ / তৈরির রেখা বরাবর কোথাও ডেটা, কিছু খারাপ লাগল went আপনি পুরানো ডেটা বা পুরানো ডেটা …

4
যখন দুটি নমুনার মাধ্যমগুলি উল্লেখযোগ্যভাবে পৃথক হয় তবে কী করতে হবে তবে তাত্পর্যটি খুব কম মনে হচ্ছে
আমার দুটি নমুনা রয়েছে ( উভয় ক্ষেত্রেই )। উপায় প্রায় দ্বিগুণ পুলের দ্বারা পৃথক হয় দেব। ফলাফলের মানটি প্রায় 10। যদিও আমি এটা অবাক করে জেনেছি যে আমি নির্ধারিতভাবে দেখিয়েছি যে উপায়গুলি এক নয়, এটি আমার কাছে বড় এন দ্বারা চালিত বলে মনে হয়। ডেটাগুলির হিস্টোগ্রামগুলি দেখে আমি অবশ্যই অনুভব …

2
ল্যাসো কখন সম্পর্কিত সম্পর্কযুক্ত ভবিষ্যদ্বাণী নির্বাচন করে?
আমি নিম্নলিখিত কোড সহ আর-তে প্যাকেজ 'লারস' ব্যবহার করছি: > library(lars) > set.seed(3) > n <- 1000 > x1 <- rnorm(n) > x2 <- x1+rnorm(n)*0.5 > x3 <- rnorm(n) > x4 <- rnorm(n) > x5 <- rexp(n) > y <- 5*x1 + 4*x2 + 2*x3 + 7*x4 + rnorm(n) > …

2
মিথস্ক্রিয়া মডেলগুলিতে সেরা বৈশিষ্ট্য সন্ধান করা
আমি তাদের বৈশিষ্ট্য মান সহ প্রোটিনের তালিকা আছে। একটি নমুনা সারণী দেখতে দেখতে: ...............Feature1...Feature2...Feature3...Feature4 Protein1 Protein2 Protein3 Protein4 সারিগুলি হ'ল প্রোটিন এবং কলামগুলি বৈশিষ্ট্য। আমার পাশাপাশি প্রোটিনগুলির একটি তালিকা রয়েছে যা ইন্টারঅ্যাক্ট করে; উদাহরণ স্বরূপ Protein3, Protein4 Protein1, Protein2 Protein4, Protein1 সমস্যা : প্রাথমিক বিশ্লেষণের জন্য আমি জানতে চাই কোন …

2
শ্রেণিবদ্ধ লজিস্টিক রিগ্রেশন জন্য বার্নোল্লি প্যারামিটারে বিটা বিতরণ কেন ব্যবহার করবেন?
আমি বর্তমানে ক্রুশকের দুর্দান্ত "ডুয়িং বায়েসিয়ান ডেটা অ্যানালাইসিস" বইটি পড়ছি। তবে, শ্রেণিবিন্যাসিক লজিস্টিক রিগ্রেশন (অধ্যায় 20) এর অধ্যায়টি কিছুটা বিভ্রান্তিকর। চিত্র 20.2 একটি শ্রেণিবিন্যাসিক লজিস্টিক রিগ্রেশন বর্ণনা করে যেখানে বার্নোল্লি প্যারামিটারকে সিগময়েড ফাংশনের মাধ্যমে রূপান্তরিত সহগের উপর একটি রৈখিক ফাংশন হিসাবে সংজ্ঞায়িত করা হয়েছে। অনলাইনে অন্যান্য উত্সগুলিতেও আমি দেখেছি এমন …

2
E1071 libsvm নিয়ে সমস্যা?
আমার কাছে দুটি ওভারল্যাপিং ক্লাস সহ একটি ডেটাসেট রয়েছে, প্রতিটি শ্রেণিতে সাতটি পয়েন্ট, পয়েন্টগুলি দ্বিমাত্রিক জায়গায় space আর এ, এবং আমি এই ক্লাসগুলির জন্য পৃথকীকরণের হাইপারপ্লেন তৈরি svmকরতে e1071প্যাকেজটি থেকে চালাচ্ছি । আমি নিম্নলিখিত কমান্ডটি ব্যবহার করছি: svm(x, y, scale = FALSE, type = 'C-classification', kernel = 'linear', cost = …

1
হালটোন সিকোয়েন্স বনাম সোবোল 'সিক্যুয়েন্স?
পূর্ববর্তী প্রশ্নের উত্তর থেকে , আমাকে হাল্টোন ক্রমের দিকে পরিচালিত করা হয়েছিল, ভেক্টরগুলির একটি সেট তৈরি করার জন্য যা একটি অভিন্ন নমুনা স্থান মোটামুটি সমানভাবে আচ্ছাদন করেছিল। তবে উইকিপিডিয়া পৃষ্ঠায় উল্লেখ করা হয়েছে যে উচ্চতর প্রাইমগুলি বিশেষত সিরিজের শুরুর দিকে প্রায়শই অত্যন্ত সংযুক্ত থাকে। এটি তুলনামূলকভাবে সংক্ষিপ্ত নমুনা আকারের সাথে …

2
নিউরাল নেটওয়ার্কগুলিতে কেন উদ্ভূত বৈশিষ্ট্য ব্যবহার করা হয়?
উদাহরণস্বরূপ, কেউ বাড়ির দামের পূর্বাভাস দিতে চায় এবং বাড়ির দৈর্ঘ্য এবং প্রস্থের দুটি ইনপুট রয়েছে। কখনও কখনও, একটির মধ্যে 'উত্পন্ন' বহুপদী ইনপুট বৈশিষ্ট্যও অন্তর্ভুক্ত থাকে, যেমন ক্ষেত্রফল, দৈর্ঘ্য * প্রস্থ। 1) উদ্ভূত বৈশিষ্ট্যগুলি অন্তর্ভুক্ত করার বিষয়টি কী? একটি নিউরাল নেটওয়ার্ক প্রশিক্ষণের সময় দৈর্ঘ্য, প্রস্থ এবং দামের মধ্যে সংযোগ শিখতে হবে …

1
কীটেক্ট কীভাবে এলোমেলো বন ব্যবহার করে?
আমি এই সাইটে পড়েছিলাম যে স্পষ্টতই কিনেক্ট কোনওভাবে মেশিন শেখার জন্য এলোমেলো বন অ্যালগরিদম ব্যবহার করে। কেউ কি এটিকে এলোমেলো বন ব্যবহার করে এবং কীভাবে তাদের পদ্ধতির কাজ করে তা ব্যাখ্যা করতে পারে?

2
কোয়ান্টাইল রিগ্রেশন পূর্বাভাস
আমি আমার কয়েকটি মডেলের জন্য কোয়ান্টাইল রিগ্রেশন ব্যবহার করতে আগ্রহী, তবে এই পদ্ধতিটি ব্যবহার করে আমি কী অর্জন করতে পারি সে সম্পর্কে কিছু স্পষ্টতা থাকতে চাই। আমি বুঝতে পারি আমি চতুর্থ / ডিভি সম্পর্কের আরও শক্তিশালী বিশ্লেষণ পেতে পারি , বিশেষত যখন বিদেশী এবং ভিন্ন ভিন্নতার মুখোমুখি হয় তবে আমার …

5
কেন দাবি করা হয় যে একটি নমুনা প্রায় শুমারির চেয়ে বেশি সঠিক?
স্যাম্পলিংয়ের কোর্স শিখার সময় আমি নিম্নলিখিত দুটি বিবৃতি পূরণ করি: 1) স্যাম্পলিং ত্রুটি বেশিরভাগ পরিবর্তনের দিকে নিয়ে যায়, ননস্যাম্পলিং ত্রুটি পক্ষপাতিত্বের দিকে পরিচালিত করে। 2) ননসম্পলিং ত্রুটির কারণে, একটি নমুনা প্রায়শই সেনসাসের চেয়ে বেশি সঠিক accurate এই দুটি বিবৃতি কীভাবে বুঝতে হবে তা আমি জানি না। এই দুটি বিবৃতি পেতে …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.