পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

4
"সংযম" বনাম "মিথস্ক্রিয়া"?
আমি এই দুটি পদ জুড়ে এসেছি যা বিভিন্ন প্রসঙ্গে পরিবর্তে পরিবর্তিতভাবে ব্যবহৃত হয়। মূলত, মডারেটর (এম) এমন একটি উপাদান যা এক্স এবং ওয়াইয়ের মধ্যে সম্পর্কের উপর প্রভাব ফেলে Mode সংযম বিশ্লেষণ সাধারণত একটি রিগ্রেশন মডেল ব্যবহার করে করা হয়। উদাহরণস্বরূপ, লিঙ্গ (এম) "পণ্য গবেষণা" (এক্স) এবং "পণ্য ক্রয়" (ওয়াই) এর …

2
এআরএমএ / এআরআইএমএ কীভাবে মিশ্র প্রভাবগুলির মডেলিংয়ের সাথে সম্পর্কিত?
প্যানেল ডেটা বিশ্লেষণে, অটো-রিলেশন সম্পর্কিত সমস্যাগুলি (যেমন, পর্যবেক্ষণগুলি সময়ের সাথে সাথে ব্যক্তিদের মধ্যে ক্লাস্টার করা হয়) সাথে সময় এবং আগ্রহের ঝাঁকুনির কিছু নির্দিষ্টকরণের জন্য সামঞ্জস্য করার জন্য আমি এলোমেলো / মিশ্র প্রভাব সহ বহু স্তরের মডেলগুলি ব্যবহার করেছি । এআরএমএ / এআরআইএমএ অনুরূপ সমস্যাগুলি সমাধান করার জন্য ডিজাইন করা মনে …

3
কাটা বিতরণ বলতে কী বোঝায়?
গতিশীল সিস্টেমের একটি সাধারণ ডিফারেনশিয়াল সমীকরণ মডেলের সংবেদনশীলতা বিশ্লেষণ সম্পর্কে গবেষণা নিবন্ধে, লেখক একটি সাধারণ মডেল প্যারামিটারকে সাধারণ বিতরণ হিসাবে অর্থ প্রদান করে (যার অর্থ = 1e-4, std = 3e-5) এই পরিসীমাটি কেটে দেওয়া হয়েছে [0.5e -4 1.5e-4]। তারপরে তিনি মডেলটির সিমুলেশনের জন্য এই কাটা বিতরণ থেকে নমুনা ব্যবহার করেন। …

4
কীভাবে পরিসংখ্যানিক প্রসঙ্গে হজম করবেন?
প্রথমত, আমি অনুমান যে না এই আকর্ষণীয় সাইটের সব সক্রিয় সদস্য তাদের কাজ যেমন স্ট্যাটিসটিসিয়ান হয়। নইলে নীচে যে প্রশ্ন করা হচ্ছে তাতে কোন লাভ হয় না! আমি অবশ্যই তাদের শ্রদ্ধা করি, তবে আমার এমন একটি ব্যাখ্যা দরকার যা ধারণার চেয়ে কিছুটা বেশি ব্যবহারিক। আমি উইকিপিডিয়া থেকে সংজ্ঞা দিতে একটি …

1
ভারসাম্যহীন ক্লাসের ওপরে / আন্ডার-স্যাম্পলিং করার সময়, সর্বাধিককরণের সঠিকতা কী ভুল সংশোধন ব্যয় হ্রাস করার থেকে পৃথক হয়?
প্রথমত, আমি কিছু সাধারণ বিন্যাস বর্ণনা করতে চাই যা ডেটা মাইনিং বইগুলি ভারসাম্যহীন ডেটাসেটগুলি কীভাবে মোকাবেলা করতে হবে তা ব্যাখ্যা করে ব্যবহার করে । সাধারণত মূল বিভাগটির নাম ভারসাম্যহীন ডেটাসেটস রাখা হয় এবং এগুলি এই দুটি সাব-সেকশনগুলি কভার করে: ব্যয়-সংবেদনশীল শ্রেণিবিন্যাস এবং নমুনা কৌশল। দেখে মনে হচ্ছে যে বিরল শ্রেণীর …

8
মেশিন লার্নিংয়ের জন্য "হট অ্যালগরিদম" কী কী?
মেশিন লার্নিং শিখতে শুরু করা কারও কাছ থেকে এটি একটি নির্লজ্জ প্রশ্ন। আমি আজকাল মার্সল্যান্ডের "মেশিন লার্নিং: একটি অ্যালগোরিদমিক দৃষ্টিভঙ্গি" বইটি পড়ছি। আমি এটি একটি প্রবর্তনাকারী বই হিসাবে দরকারী মনে করি তবে এখন আমি উন্নত অ্যালগরিদমে যেতে চাই, যেগুলি বর্তমানে সেরা ফলাফল দিচ্ছে। আমি বেশিরভাগ বায়োইনফরম্যাটিক্সে আগ্রহী: জৈবিক নেটওয়ার্কগুলির গুচ্ছবৃত্তি …


2
ইডিএ-তে বাইয়েশিয়ান এবং ঘন ঘন পদ্ধতির মধ্যে পার্থক্য রয়েছে কি?
খুব সহজ ভাষায়: এক্সপ্লোরার ডেটা বিশ্লেষণে বায়েশিয়ান এবং ফ্রিকোয়ালিস্ট পদ্ধতির মধ্যে কোনও পার্থক্য রয়েছে কি? আমি জানি যে ইডিএ পদ্ধতিতে কোনও হিস্টোগ্রাম হিস্টোগ্রাম, একটি স্কিটারপ্লট একটি স্ক্র্যাটারপ্লট ইত্যাদি, বা ইডিএ কীভাবে শেখানো হয় বা উপস্থাপন করা হয় তার মধ্যে পার্থক্যের উদাহরণ আমি খুঁজে পাইনি (এ। জেলম্যানের একটি বিশেষতাত্ত্বিক কাগজ উপেক্ষা …

1
এসভিএমের হাইপারপ্লেন থেকে দূরত্বের ব্যাখ্যা করা
এসভিএমগুলি স্বজ্ঞাতভাবে বুঝতে আমার কিছু সন্দেহ আছে। ধরে নিই আমরা কিছু মানক সরঞ্জাম যেমন SVMLight বা LibSVM ব্যবহার করে শ্রেণিবিন্যাসের জন্য একটি এসভিএম মডেলকে প্রশিক্ষণ দিয়েছি। আমরা যখন পরীক্ষার ডেটা সম্পর্কে ভবিষ্যদ্বাণী করার জন্য এই মডেলটি ব্যবহার করি, তখন মডেল প্রতিটি পরীক্ষার পয়েন্টের জন্য "আলফা" মানযুক্ত একটি ফাইল উত্পন্ন করে। …

3
আর-তে লেভেন টেস্ট ফাংশনটি কীভাবে ব্যবহার করবেন?
আমি পরিসংখ্যানের এক নবাগত এবং আর লেভেন ফাংশনটি ব্যবহার করতে আমার সমস্যা হয় (আমি দুটি নমুনার বৈচিত্রের সাম্যতা পরীক্ষা করতে চাই)। ডকুমেন্টেশন বলে যে আমার চালানো উচিত: levene.test (y, গ্রুপ) তবে y এবং গ্রুপ হিসাবে আমার কী রাখা উচিত তা আমার কোনও ধারণা নেই? আমার দুটি পৃথক নমুনা রয়েছে যেগুলির …

1
মাল্টিভারিয়েট গাউসীয় বিতরণ থেকে মান উত্পন্ন করা হচ্ছে
আমি বর্তমানে NNN ডাইমেনশনাল এলোমেলো ভেরিয়েবল এক্স এর মানগুলি অনুকরণ করার চেষ্টা করছি XXXযা গড় ভেক্টর μ=(μ1,...,μN)Tμ=(μ1,...,μN)T\mu = (\mu_1,...,\mu_N)^T এবং কোভেরিয়েন্স ম্যাট্রিক্স এস এর সাথে একটি মাল্টিভারিয়েট স্বাভাবিক বিতরণ রয়েছে SSS। আমি বিপরীতমুখী সিডিএফ পদ্ধতির অনুরূপ একটি পদ্ধতি ব্যবহার করার প্রত্যাশা করছি, যার অর্থ আমি প্রথমে একটি NNN ডাইমেনশনাল ইউনিফর্ম …

3
তুলনা করার জন্য বেহালা প্লট কীভাবে স্কেল করবেন?
আমি বেহালার প্লট আঁকার চেষ্টা করছি এবং ভাবছি যে তাদের গ্রুপে স্কেলিংয়ের জন্য কোনও গৃহীত সেরা অনুশীলন আছে কি না। এখানে আর তিনটি বিকল্প রয়েছে যা আমি আর mtcarsডেটা সেট ব্যবহার করার চেষ্টা করেছি (1973 সালের মোটর ট্রেন্ড গাড়ি, এখানে পাওয়া গেছে )। সমান প্রস্থ হতে কি মনে হয় মূল …

2
বক্স-জেনকিন্স মডেল নির্বাচন
টাইম সিরিজ বিশ্লেষণে বক্স-জেনকিন্স মডেল নির্বাচন পদ্ধতিটি সিরিজের স্বতঃসংশ্লিষ্টতা এবং আংশিক স্বতঃসংশোধনের কাজগুলি দেখে শুরু হয়। এই প্লটগুলি একটি এআরএমএ ( পি , কিউ ) মডেলের উপযুক্ত এবং কিউ প্রস্তাব করতে পারে । পদ্ধতিটি শ্বেত শব্দের ত্রুটি শর্তযুক্ত একটি মডেল উত্পাদনকারীদের মধ্যে সবচেয়ে পার্সামোনিয়াস মডেল বাছাই করতে এআইসি / বিআইসির …

3
Uniformক্যের সমতুল্য বিতরণ করা ওজন উত্পন্ন করে?
মিশ্রণ মডেলিংয়ের মতো অ্যাপ্লিকেশনগুলিতে ওজন ব্যবহার করা এবং বেসিক ফাংশনগুলিকে রৈখিকভাবে একত্রিত করা সাধারণ is ওজন wiwiw_i প্রায়ই মেনে চলবে wi≥wi≥w_i ≥ 0 এবং ∑iwi=1∑iwi=1\sum_{i} w_i=1 । আমি এ জাতীয় ভেক্টরগুলির অভিন্ন বিতরণ থেকে এলোমেলোভাবে ওয়েট ভেক্টর w=(w1,w2,…)w=(w1,w2,…)\mathbf{w} = (w_1, w_2, …) নিতে চাই। এটা ব্যবহার করা প্রলুব্ধকর যেতে পারে …

2
আর (টিএম প্যাকেজ) সহ পাঠ্য খনির উদাহরণ
আমি তিন দিনের সাথে tmএক বন্ধুর একটি খসড়া কাগজ পড়ার সাথে সাথে কাটালাম যেখানে তিনি ইউসিআইএনইটি দিয়ে একটি টেক্সট কর্পাস অন্বেষণ করেছিলেন, যেখানে টেক্সট ক্লাউড, টু-মোড নেটওয়ার্ক গ্রাফ এবং একক মান পচন (স্টাটা ব্যবহার করে গ্রাফিক্স সহ) দেখিয়েছিলেন। আমি প্রচুর সমস্যার মুখোমুখি হয়েছি: ম্যাক ওএস এক্সে, স্নোবল (স্টেমিং) বা আরগ্রাভিজ …
14 r  text-mining 

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.