পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

4
আর এর মধ্যে পরিসংখ্যান বিশ্লেষণের জন্য সহজেই ডেটা সঞ্চয় করার সর্বোত্তম উপায় [বন্ধ]
বন্ধ থাকে। এই প্রশ্নটি অফ-টপিক । এটি বর্তমানে উত্তর গ্রহণ করছে না। এই প্রশ্নটি উন্নত করতে চান? প্রশ্নটি আপডেট করুন যাতে এটি ক্রস ভ্যালিডেটের জন্য অন-বিষয় । 6 বছর আগে বন্ধ ছিল । আমি কিছু সময়ের জন্য কোনও সমস্যা ছাড়াই আমার ডেটা সংরক্ষণ করতে টেক্সট ফাইলগুলি ব্যবহার করছি। তবে সাম্প্রতিক …
12 r  dataset 

1
একটি লুকানো মার্কভ মডেলটিতে "সেরা" মডেল নির্বাচন করার মানদণ্ড
আমার একটি টাইম সিরিজের ডেটা সেট রয়েছে যাতে আমি কোনও লুকানো মার্কভ মডেল (এইচএমএম) ফিট করার চেষ্টা করছি যাতে তথ্যগুলিতে সুপ্ত রাষ্ট্রের সংখ্যা অনুমান করা যায়। এটি করার জন্য আমার সিউডো কোডটি নিম্নলিখিত: for( i in 2 : max_number_of_states ){ ... calculate HMM with i states ... optimal_number_of_states = "model …

2
লোগারিদমিক অফসেট সহ বাইনারি মডেল (প্রবিট এবং লগিট)
প্রবিট এবং লগাইটের মতো বাইনারি মডেলগুলিতে কোনও অফসেট কীভাবে কাজ করে তার কোনও বিকাশ আছে? আমার সমস্যাটিতে, ফলো-আপ উইন্ডো দৈর্ঘ্যে পরিবর্তিত হতে পারে। ধরা যাক রোগীরা চিকিত্সা হিসাবে প্রফিল্যাকটিক শট পান। শটটি বিভিন্ন সময়ে ঘটে থাকে, সুতরাং যদি ফলাফলটি কোনও বাইনারি সূচক হয় তবে কোনও অসুবিধাগুলি ঘটেছিল কিনা আপনার এই …

2
প্রতিটি স্তরে 1 পর্যবেক্ষণের সাথে মিশ্রিত মডেল
আমি glmerকিছু ব্যবসায়িক ডেটার সাথে একটি এলোমেলো প্রভাব মডেল ফিট করছি । লক্ষ্যটি হ'ল আঞ্চলিক বৈকল্পিকতা বিবেচনায় নিয়ে বিতরণকারী দ্বারা বিক্রয় কার্যকারিতা বিশ্লেষণ করা। আমার নিম্নলিখিত ভেরিয়েবলগুলি রয়েছে: distcode: প্রায় 800 স্তর সহ বিতরণকারী আইডি region: শীর্ষ স্তরের ভৌগলিক আইডি (উত্তর, দক্ষিণ, পূর্ব, পশ্চিম) zone: মাঝারি স্তরের ভূগোলের মধ্যে regionপ্রায় …

2
সময় সিরিজ এবং রিগ্রেশন মধ্যে সম্পর্ক এবং পার্থক্য?
টাইম সিরিজ এবং রিগ্রেশন এর মধ্যে সম্পর্ক এবং পার্থক্য কী? জন্য মডেল এবং অনুমানের , এটি ঠিক যে রিগ্রেশন মডেল ইনপুট ভেরিয়েবলের বিভিন্ন মানের জন্য আউটপুট ভেরিয়েবল মধ্যে স্বাধীনতা অনুমান, যখন সময় সিরিজের মডেল না? অন্যান্য কিছু পার্থক্য কি? জন্য পদ্ধতি থেকে ডার্লিংটন দ্বারা একটি ওয়েবসাইট টাইম সিরিজ বিশ্লেষণের জন্য …

2
লগ স্পেসে আমি কীভাবে পৃথক (শ্রেণিবদ্ধ) বন্টন থেকে নমুনা করব?
ধরুন আমার কাছে ভেক্টর মতো বিভাগ সম্ভাব্যতার সাথে অঙ্কিত হবে এবং আরও কিছু দ্বারা নির্ধারিত একটি স্বতন্ত্র বিতরণ রয়েছে। আমি তখন আবিষ্কার করেছি যে বিতরণের কিছু মানগুলি এত ছোট যে তারা আমার কম্পিউটারের ভাসমান পয়েন্ট সংখ্যা উপস্থাপনের তলদেশে প্রবাহিত করে, তাই ক্ষতিপূরণ দেওয়ার জন্য, আমি আমার সমস্ত গণনা লগ-স্পেসে করি। …

1
টাইম-সিরিজ ডেটা রিয়েল-টাইম নরমালাইজের জন্য অ্যালগরিদম?
আমি এমন একটি অ্যালগরিদম নিয়ে কাজ করছি যা বেশ কয়েকটি সেন্সর প্রবাহ থেকে অতি সাম্প্রতিক ডেটা পয়েন্টের ভেক্টর গ্রহণ করে এবং ইউক্লিডিয়ান দূরত্বকে পূর্ববর্তী ভেক্টরগুলির সাথে তুলনা করে। সমস্যাটি হ'ল বিভিন্ন ডেটা স্ট্রিমগুলি সম্পূর্ণ আলাদা সেন্সর থেকে আসে, তাই একটি সাধারণ ইউক্লিডিয়ান দূরত্ব নেওয়া নাটকীয়ভাবে কিছু মানকে ছাড়িয়ে যায়। স্পষ্টতই, …

1
কিছু বৈপরীত্য পরীক্ষা করা: এটি সম্ভবত একটি কঠিন সমস্যা, না?
আমি এটি গণিতের প্রবাহে পোস্ট করেছি এবং কারও উত্তর নেই: পরিসংখ্যানগতভাবে গুরুত্বপূর্ণ বৈপরীত্য সনাক্ত করার জন্য শেফের পদ্ধতিটি বহুল পরিচিত। একটি বৈসাদৃশ্য উপায়ে মধ্যে , এর জনগোষ্ঠী একটি রৈখিক সমন্বয় যা , এবং একটি বিপরীতে একটি স্কেলার একাধিক হ'ল মূলত একই বিপরীতে, সুতরাং কেউ বলতে পারেন যে বিপরীতে সেটটি একটি …

3
কখন একটি স্থির প্রভাব কার্যকর হয়?
প্রকারের রৈখিক প্রভাবগুলির মডেলটি বিবেচনা করুন: যেখানে একটি তবে সময়-আক্রমণকারী বৈশিষ্ট্য এবং একটি ত্রুটি, এবং সূচক পৃথক পর্যবেক্ষণ এবং সময়, যথাক্রমে। একটি নির্দিষ্ট প্রভাব (এফই) রিগ্রেশন-এর সাধারণ পদ্ধতির স্বতন্ত্র ডমিগুলি (এলএসডিভি) / ডি-অর্থের মাধ্যমে বা প্রথম পৃথক করে remove অপসারণ করা হবে ।Yআমি টি= এক্সআমি টিβ+ গআমি+ ইআমি টিYআমিটি=এক্সআমিটিβ+ +গআমি+ …

2
2D তে কার্নেল ঘনত্বের প্রাক্কলনকারীকে সংহত করে
কেউ এই পদক্ষেপটি অনুসরণ করতে চাইলে আমি এই প্রশ্ন থেকে আসছি । মূলত আমার কাছে একটি ডেটা সেট রয়েছে বস্তুর সমন্বয়ে গঠিত যেখানে প্রতিটি বস্তুর সাথে একটি সংখ্যক পরিমাপ করা মান সংযুক্ত থাকে (এই ক্ষেত্রে দুটি):এনΩΩ\OmegaNNN Ω=o1[x1,y1],o2[x2,y2],...,oN[xN,yN]Ω=o1[x1,y1],o2[x2,y2],...,oN[xN,yN]\Omega = o_1[x_1, y_1], o_2[x_2, y_2], ..., o_N[x_N, y_N] আমি একটি সম্ভাবনা নির্ধারণ করতে …

1
পিএমসি ব্যবহার করে বেয়েসিয়ান নেটওয়ার্ক ইনফারেন্সেশন (শুরুর বিভ্রান্তি)
আমি বর্তমানে কফেসেরায় ডাফনে কলার দ্বারা পিজিএম কোর্স নিচ্ছি। এটিতে, আমরা সাধারণত একটি বায়সিয়ান নেটওয়ার্ককে কারণ এবং প্রভাব পরিচালিত গ্রাফ হিসাবে পরিবর্তনশীলগুলির পর্যবেক্ষণ করা তথ্যের অংশ হিসাবে মডেল করি। তবে পাইএমসি টিউটোরিয়াল এবং উদাহরণগুলিতে আমি সাধারণত দেখতে পাই যে এটি পিজিএম বা ন্যূনতম আমি বিভ্রান্ত হয়ে পড়ে ঠিক তেমনভাবে মডেলিং …

2
পিয়ারসনের পারস্পরিক সম্পর্ক পরীক্ষার জন্য পি-মানগুলি কি কেবলমাত্র সহসংস্থান সহগ এবং নমুনার আকার থেকে গণনা করা যেতে পারে?
পটভূমি: আমি একটি নিবন্ধ পড়েছি যেখানে লেখকরা পিয়ারসন পারস্পরিক সম্পর্কের নমুনা আকার 878 থেকে 0.754 প্রতিবেদন করেছেন corre পারস্পরিক সম্পর্কের পরীক্ষার জন্য পি-মানটির ফলাফল "দুই তারকা" উল্লেখযোগ্য (অর্থাত্ পি <0.01) is তবে আমি মনে করি যে এত বড় আকারের নমুনা আকারের সাথে সংশ্লিষ্ট পি-মানটি 0.001 এর চেয়ে কম হওয়া উচিত …

4
আমি কোনও অঙ্কন, 2, 3 এবং আরও কিছু না পাওয়া পর্যন্ত কার্ড আঁকার পরে প্রত্যাশিত নম্বরটি করব
নিম্নলিখিতগুলি সমাধান করতে আমার কিছুটা সমস্যা হচ্ছে। আপনি কোনও টেক্কা না পাওয়া পর্যন্ত প্রতিস্থাপন ছাড়াই একটি স্ট্যান্ডার্ড 52-কার্ড ডেক থেকে কার্ডগুলি আঁকুন। আপনি যা পান না হওয়া অবধি আপনি যা আঁকেন ২ থেকে টানুন You. আপনি চালিয়ে যান ৩. পুরো ডেকটি ফুরিয়ে যাওয়ার পরে আপনি যে প্রত্যাশিত সংখ্যাটি করবেন তা …


1
মেশিন লার্নিং ব্যবহার করে আর্থিক টাইমরিজগুলি পূর্বাভাস দেওয়ার জন্য প্রথম পদক্ষেপগুলি
ভবিষ্যতে আর্থিক টাইমসারিগুলি 1 বা আরও বেশি পদক্ষেপের পূর্বাভাস দেওয়ার জন্য মেশিন লার্নিং কীভাবে ব্যবহার করতে হয় সে সম্পর্কে আমি উপলব্ধি করার চেষ্টা করছি। আমার কিছু বর্ণনামূলক ডেটা সহ একটি আর্থিক টাইমরিজ রয়েছে এবং আমি একটি মডেল তৈরি করতে চাই এবং তারপরে মডেলটি n-steps এর পূর্বে ভবিষ্যদ্বাণী করতে ব্যবহার করতে …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.