পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

3
স্কিউড ডেটা সহ রিগ্রেশন
ডেমোগ্রাফিক এবং পরিষেবা থেকে ভিজিট গণনা গণনা করার চেষ্টা করা। তথ্য খুব skew হয়। Histograms: কিউকি প্লট (বাম লগ হয়): m <- lm(d$Visits~d$Age+d$Gender+city+service) m <- lm(log(d$Visits)~d$Age+d$Gender+city+service) cityএবং serviceফ্যাক্টর ভেরিয়েবল হয়। আমি সমস্ত ভেরিয়েবলের জন্য একটি কম পি মান পাই *** তবে আমি .05 এর একটি কম আর-স্কোয়ারও পাই। আমার কি …

1
বাম-স্কিউডকে কেন নেতিবাচকভাবে স্কিউড এবং ডান-স্কিউকে পজিটিভলি স্কিউ বলা হয়?
নামটি সম্পর্কে আমি কৌতূহল: বাম-স্কিউডকে নেতিবাচকভাবে স্কিউড এবং ডান-স্কিউডকে কেন ইতিবাচক স্কিউ বলা হয়?

1
নেটওয়ার্ক মেটা-বিশ্লেষণের জন্য সেরা পদ্ধতি কোনটি?
নেটওয়ার্ক মেটা-বিশ্লেষণ বা মিশ্রিত চিকিত্সার তুলনা সম্পাদনের জন্য এখন বেশ কয়েকটি ভিন্ন পদ্ধতি রয়েছে। সর্বাধিক ব্যবহৃত এবং অ্যাক্সেসযোগ্য সম্ভবত নিম্নলিখিত: বায়েশিয়ান কাঠামোর মধ্যে : WinBUGS- এ ডিজাইন দ্বারা চিকিত্সা ইন্টারঅ্যাকশন পদ্ধতির (যেমন জ্যাকসন এট আল ); উইনবিইউজিএসে হায়ারার্কিকাল আর্ম-ভিত্তিক বায়েশিয়ান মডেলিং (উদাঃ ঝাও এট আল ); হায়ারারিকিকাল কনট্রাস্ট-ভিত্তিক (অর্থাত্ নোড-বিভক্তকরণ) …

3
নিউরাল নেটওয়ার্কগুলির জন্য এনকোডিংয়ের তারিখ / সময় (চক্রীয় তথ্য)
নিউরাল নেটওয়ার্কের জন্য কোনও ইভেন্টের তারিখ এবং সময় কীভাবে এনকোড করা যায়? আমার একটি অবিচ্ছিন্ন সময় সিরিজ নেই, তবে তারিখ এবং সময় সহ কিছু ইভেন্ট এবং আমি একরকমের আগ্রহ বিশ্লেষণ করি। এই আগ্রহটি সকাল এবং সন্ধ্যার মধ্যে পৃথক এবং সপ্তাহের দিনগুলির মধ্যে এবং গ্রীষ্ম এবং শীতের মধ্যে এবং ক্রিসমাস এবং …

2
বেয়েসিয়ান পদ্ধতিগুলি কি অন্তর্নিহিতভাবে অনুক্রমিক?
অর্থাৎ ক্রমান্বয়ে বিশ্লেষণ করতে (আপনি ঠিক কতটা তথ্য সংগ্রহ করবেন তা সময়ের আগে জানেন না) ঘন ঘন পদ্ধতিগুলির বিশেষ যত্ন প্রয়োজন; পি-মান পর্যাপ্ত পরিমাণে কম না হওয়া বা আত্মবিশ্বাসের ব্যবধান পর্যাপ্ত সংক্ষিপ্ত না হওয়া পর্যন্ত আপনি কেবল ডেটা সংগ্রহ করতে পারবেন না। কিন্তু বায়েসিয়ান বিশ্লেষণ করার সময়, এটি কি উদ্বেগজনক? …

5
অ পর্যায়ক্রমিক সময় সিরিজের প্রবণতা কীভাবে বিশ্লেষণ করা যায়
ধরা যাক আমি অ পর্যায়ক্রমিক সময় সিরিজ অনুসরণ করছি। অবশ্যই প্রবণতা হ্রাস পাচ্ছে এবং আমি এটি কিছু পরীক্ষার মাধ্যমে প্রমাণ করতে চাই ( পি-মান সহ )। শক্তিশালী টেম্পোরাল (সিরিয়াল) মানগুলির মধ্যে স্ব-সম্পর্কের কারণে আমি ক্লাসিক লিনিয়ার রিগ্রেশন ব্যবহার করতে অক্ষম use library(forecast) my.ts <- ts(c(10,11,11.5,10,10.1,9,11,10,8,9,9, 6,5,5,4,3,3,2,1,2,4,4,2,1,1,0.5,1), start = 1, end …
12 r  time-series 

2
কীভাবে 'কনভলিউশনগুলির সাথে আরও গভীরতর হয়' কাজ করে ডেপথকনক্যাট অপারেশন?
সমঝোতার সাথে আরও গভীরতর পড়া আমি একটি ডিপথ কনক্যাট স্তর জুড়ে এসেছি , প্রস্তাবিত ইনসেপশন মডিউলগুলির একটি বিল্ডিং ব্লক , যা বিভিন্ন আকারের একাধিক টেনসারের আউটপুটকে একত্রিত করে। লেখকরা এটিকে "ফিল্টার কনক্যাটেনশন" বলে থাকেন। টর্চের জন্য একটি বাস্তবায়ন বলে মনে হচ্ছে , তবে আমি আসলে বুঝতে পারি না, এটি কী …

4
আর-তে একটি এনএলএস মডেলের জন্য সঠিক প্রারম্ভিক মানগুলি পাওয়া
আমি নিম্নলিখিত হিসাবে একটি ডেটা সেট একটি সাধারণ শক্তি আইন মডেল ফিট করার চেষ্টা করছি: mydf: rev weeks 17906.4 1 5303.72 2 2700.58 3 1696.77 4 947.53 5 362.03 6 লক্ষ্যটি হ'ল পাওয়ার লাইনটি পেরিয়ে যাওয়া এবং এটি ব্যবহার করা revভবিষ্যতের সপ্তাহের জন্য ভ্যাল্যগুলি পূর্বাভাস দেওয়ার জন্য। একগুচ্ছ গবেষণা আমাকে …

1
Scikit পূর্বাভাস_প্রবাহ আউটপুট ব্যাখ্যা
আমি পাইথনে সাইকিট-লার্ন লাইব্রেরির সাথে কাজ করছি। নীচের কোডটিতে, আমি সম্ভাবনার পূর্বাভাস দিচ্ছি তবে আউটপুট কীভাবে পড়তে হয় তা আমি জানি না। তথ্য পরীক্ষা করা হচ্ছে from sklearn.ensemble import RandomForestClassifier as RF from sklearn import cross_validation X = np.array([[5,5,5,5],[10,10,10,10],[1,1,1,1],[6,6,6,6],[13,13,13,13],[2,2,2,2]]) y = np.array([0,1,1,0,1,2]) ডেটাসেট বিভক্ত করুন X_train, X_test, y_train, y_test = …

2
কেন রিজ রিগ্রেশন লাসোর চেয়ে আরও ভাল ব্যাখ্যা প্রদান করতে পারে না?
রিজ রিগ্রেশন এবং লাসো সম্পর্কে আমার ইতিমধ্যে একটি ধারণা রয়েছে। লাসোর জন্য, এল 1 পেনাল্টি শব্দটি একটি বিচ্ছিন্ন সহগ ভেক্টর এনে দেবে, যা বৈশিষ্ট্য নির্বাচন পদ্ধতি হিসাবে দেখা যেতে পারে। তবে লাসোর জন্য কিছু সীমাবদ্ধতা রয়েছে। যদি বৈশিষ্ট্যগুলির উচ্চ সম্পর্ক থাকে তবে লাসো কেবল তাদের মধ্যে একটি নির্বাচন করবে। তদ্ব্যতীত, …

1
লাসোতে নিয়মিতকরণ প্যারামিটারের জন্য পরিসর এবং গ্রিড ঘনত্ব নির্বাচন করা
আমি ইতিমধ্যে লাসো (কমপক্ষে পরম সংকোচন এবং নির্বাচন অপারেটর) অধ্যয়ন করছি । আমি দেখতে পাচ্ছি যে নিয়মিতকরণ পরামিতিগুলির সর্বোত্তম মান ক্রস বৈধকরণের মাধ্যমে চয়ন করা যেতে পারে। আমি রিজ রিগ্রেশন এবং নিয়মিতকরণ প্রয়োগ করে এমন অনেকগুলি পদ্ধতিতেও দেখতে পাই, আমরা সর্বোচ্চ নিয়মিতকরণ পরামিতি (পেনাল্টি বলার) জন্য সিভি ব্যবহার করতে পারি। …

2
একটি সাধারণ বিতরণে এক্স এর প্রত্যাশিত মান, এটি নির্দিষ্ট মানের নীচে থেকে দিন IV
কেবলমাত্র একটি নির্দিষ্ট মানের নীচে (উদাহরণস্বরূপ, গড় মানের নীচে) দেওয়া সত্ত্বেও যদি এটি সাধারণত বিতরণ করা হয় তবে এক্স এর প্রত্যাশিত মানটি পাওয়া সম্ভব কিনা তা কেবল ভাবছেন।

1
কেন সময় সিরিজ বিশ্লেষণকে কোনও মেশিন লার্নিং অ্যালগরিদম হিসাবে বিবেচনা করা হয় না
কেন সময় সিরিজ বিশ্লেষণকে কোনও মেশিন লার্নিং অ্যালগরিদম হিসাবে বিবেচনা করা হয় না (লিনিয়ার প্রতিরোধের বিপরীতে)। রিগ্রেশন এবং সময় সিরিজ বিশ্লেষণ উভয়ই পূর্বাভাসের পদ্ধতি। তাহলে কেন তাদের একজনকে শেখার অ্যালগরিদম বিবেচনা করা হয় তবে অন্যটি নয়?

1
ফিশারের সঠিক পরীক্ষাটি অ-ইউনিফর্মের পি-মান দেয়
আমি সিমুলেটেড জেনেটিক্স সমস্যায় ফিশারের সঠিক পরীক্ষাটি প্রয়োগ করার চেষ্টা করছি, তবে পি-মানগুলি ডানদিকে স্কুড বলে মনে হচ্ছে। জীববিজ্ঞানী হওয়ার কারণে, আমি অনুমান করি যে আমি প্রতিটি পরিসংখ্যানবিদদের কাছে স্পষ্ট কিছু মিস করছি, তাই আমি আপনার সহায়তার প্রশংসা করব। আমার সেটআপটি হ'ল: (সেটআপ 1, প্রান্তিক স্থির নয়) 0 এবং 1 …

1
আংশিক উচিত
নিম্নলিখিতটি mtcarsডেটাসেট থেকে তৈরি একটি মডেল : > ols(mpg~wt+am+qsec, mtcars) Linear Regression Model ols(formula = mpg ~ wt + am + qsec, data = mtcars) Model Likelihood Discrimination Ratio Test Indexes Obs 32 LR chi2 60.64 R2 0.850 sigma 2.4588 d.f. 3 R2 adj 0.834 d.f. 28 Pr(> chi2) 0.0000 …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.