পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

5
রিগ্রেশনে পক্ষপাত (ইন্টারসেপ্ট) শব্দটি সঙ্কুচিত না করার কারণ
একটি রৈখিক মডেল জন্য , সংকোচন শব্দটি সর্বদা ।পি ( β )y=β0+xβ+εy=β0+xβ+εy=\beta_0+x\beta+\varepsilonP(β)P(β)P(\beta) কী কারণে আমরা বায়াস (ইন্টারসেপ্ট) শব্দটি সঙ্কুচিত করি না ? নিউরাল নেটওয়ার্ক মডেলগুলিতে কি আমাদের পক্ষপাতের শব্দটি সঙ্কুচিত করা উচিত?β0β0\beta_0

3
টি-টেস্ট করার জন্য এক্সেল ব্যবহার করে কীভাবে সাধারণ বিতরণ পরীক্ষা করা যায়?
আমি জানতে চাইছি কীভাবে এক্সেলের স্বাভাবিকতার জন্য কোনও ডেটা সেট চেক করবেন, কেবল তা পরীক্ষা করতে যে কোনও টি-টেস্ট ব্যবহারের প্রয়োজনীয়তা পূরণ করা হচ্ছে । ডান লেজের জন্য, কেবলমাত্র একটি গড় এবং স্ট্যান্ডার্ড বিচ্যুতি গণনা করা, একটি পরিসীমা তৈরি করতে গড় থেকে 1, 2 এবং 3 স্ট্যান্ডার্ড বিচ্যুতি যুক্ত করে …

1
খুব সামান্য সম্ভাবনার মানগুলিকে সম্ভাবনার দিকে রূপান্তর (সাধারণকরণ)
আমি একটি অ্যালগরিদম লিখছি যেখানে, একটি মডেল দেওয়া, আমি ডেটাসেটের তালিকার জন্য সম্ভাবনাগুলি গণনা করি এবং তারপরে সম্ভাবনার প্রতিটিটির স্বাভাবিককরণের (সম্ভাবনার দিকে) প্রয়োজন। সুতরাং [0.00043, 0.00004, 0.00321] এর মতো কোনও কিছু [0.2, 0.03, 0.77] এর মতো হতে পারে। আমার সমস্যাটি হ'ল লগের সম্ভাবনাগুলি, আমি নিয়ে কাজ করছি, খুব ছোট (উদাহরণস্বরূপ, …

6
বর্ণনামূলক এবং অনুমানমূলক পরিসংখ্যানের মধ্যে পার্থক্য কী?
আমার বোধগম্যতা ছিল যে বর্ণনামূলক পরিসংখ্যানগুলি উপাত্তের নমুনার পরিমাণগতভাবে বর্ণিত বৈশিষ্ট্যগুলি বর্ণনা করে, যখন অনুমানমূলক পরিসংখ্যানগুলি যে জনসংখ্যা থেকে নমুনা আঁকা হয়েছিল সেগুলি সম্পর্কে সূচনা করে। তবে, পরিসংখ্যান অনুমানের জন্য উইকিপিডিয়া পৃষ্ঠাতে বলা হয়েছে: বেশিরভাগ ক্ষেত্রে, পরিসংখ্যানগত অনুমান জনসংখ্যা সম্পর্কে প্রস্তাবনা তৈরি করে, কিছু লোককে এলোমেলো নমুনার মাধ্যমে আগ্রহের জনসংখ্যা …

6
পূর্ববর্তী এবং সম্ভাবনার চেয়ে পূর্ববর্তীটি খুব আলাদা
যদি পূর্ব এবং সম্ভাবনা একে অপরের থেকে খুব আলাদা হয়, তবে কখনও কখনও এমন পরিস্থিতি দেখা দেয় যেখানে উত্তরোত্তর উভয়ের সাথে মিল নেই। উদাহরণস্বরূপ দেখুন এই ছবিটি, যা সাধারণ বিতরণ ব্যবহার করে। যদিও এটি গাণিতিকভাবে সঠিক, এটি আমার অন্তর্নিহিতের সাথে একমত বলে মনে হচ্ছে না - যদি ডেটা আমার দৃ …

3
কিভাবে এবং কখন Bonferroni সমন্বয় ব্যবহার করবেন
বোনফেরনির সামঞ্জস্য কখন ব্যবহার করবেন সে সম্পর্কে আমার দুটি প্রশ্ন রয়েছে: একাধিক পরীক্ষার সমস্ত ক্ষেত্রে কোনও Bonferroni সমন্বয় ব্যবহার করা কি উপযুক্ত? যদি কেউ একটি ডেটা সেটে একটি পরীক্ষা করে, তবে একটি সেই ডেটাটিকে আরও ভাল স্তরে বিভক্ত করে (উদাহরণস্বরূপ লিঙ্গ দ্বারা ডেটা বিভক্ত করে) এবং একই পরীক্ষা করে, এটি …

5
এলোমেলো বন বনাম রিগ্রেশন
আমি 5 টি স্বাধীন ভেরিয়েবল সহ ডেটা সেটে একটি ওএলএস রিগ্রেশন মডেল চালিয়েছিলাম। স্বতন্ত্র ভেরিয়েবল এবং নির্ভরশীল ভেরিয়েবল উভয়ই অবিচ্ছিন্ন এবং রৈখিকভাবে সম্পর্কিত। আর স্কয়ারটি প্রায় 99.3%। কিন্তু যখন আমি আর এলোমেলো বন ব্যবহার করে একই চালনা করি তখন আমার ফলাফলটি '% ভার ব্যাখ্যা করেছে: 88.42'। কেন এলোমেলোভাবে বনজ ফলাফল …

1
গণনার ডেটাতে আউটলিয়ারগুলি সনাক্ত করা
আমার কাছে নির্দ্বিধায় একটি মোটামুটি সোজা ফরোয়ার্ড সমস্যা বলে মনে হয়েছিল যা গণনা উপাত্তের অনেকগুলি সেটের জন্য আউটলেট সনাক্তকরণের সাথে জড়িত। বিশেষত, আমি নির্ধারণ করতে চাই যে গণনা উপক্রমের একটি সিরিজের এক বা একাধিক মান বিতরণের বাকি গণনাগুলির তুলনায় প্রত্যাশার চেয়ে বেশি বা কম if বিস্ময়কর কারণটি হ'ল আমার ৩,৫০০ …

1
পাঠ্যপুস্তকের MCMC অ্যালগরিদমগুলির তুলনায় কিছু বর্ধিত উন্নতি কী কী যা লোকেদের অনুমানের জন্য ব্যবহার করে?
যখন আমি কোনও সমস্যার জন্য একটি মন্টি কার্লো সিমুলেশন কোডিং করছি এবং মডেলটি যথেষ্ট সহজ, আমি একটি খুব বেসিক পাঠ্যপুস্তক গীবস নমুনা ব্যবহার করি। গীবস স্যাম্পলিং ব্যবহার করা যখন সম্ভব না হয়, তখন আমি বহু বছর আগে শিখেছি মেট্রোপলিস-হেস্টিংস পাঠ্যপুস্তকটি কোড করি। আমি কেবল এটিই দিচ্ছি যে জাম্পিং বিতরণ বা …

3
পূর্বে সংঘবদ্ধ হওয়া: গভীর সম্পত্তি বা গাণিতিক দুর্ঘটনা?
কিছু ডিস্ট্রিবিউশনে কনজিগেট প্রিয়ার থাকে এবং কিছু থাকে না। এই পার্থক্য কি শুধুই দুর্ঘটনা? এটি হল, আপনি গণিত করেন, এবং এটি একরকম বা অন্যভাবে কাজ করে তবে সত্যটি ব্যতীত এটি আপনাকে বিতরণ সম্পর্কে গুরুত্বপূর্ণ কিছু বলে না? বা সংঘবদ্ধতার উপস্থিতি বা অনুপস্থিতি কোনও বিতরণের কিছু গভীর সম্পত্তি প্রতিফলিত করে? কনজুগেট …

4
একাধিক অনুশাসন এবং মডেল নির্বাচন
আপনি অনুমান করতে চান এমন একটি প্রাইমারী লিনিয়ার মডেল থাকলে একাধিক অনুমানের বিষয়টি মোটামুটি সোজা । যাইহোক, জিনিসগুলি কিছুটা জটিল বলে মনে হচ্ছে যখন আপনি আসলে কিছু মডেল নির্বাচন করতে চান (উদাহরণস্বরূপ প্রার্থীর ভেরিয়েবলগুলির একটি বৃহত্তর সেট থেকে প্রেডিকটর ভেরিয়েবলগুলির "সেরা" সেটটি আবিষ্কার করুন - আমি বিশেষত ল্যাসো এবং আর …

5
আরের মাধ্যমে পরিসংখ্যান / গণিত শেখার (কেবল চলমান নয়) উত্স
আমি সূত্রের উদাহরণগুলিতে আগ্রহী (আর কোড, আর প্যাকেজ, বই, বই অধ্যায়, নিবন্ধ, লিঙ্ক ইত্যাদি) আর এর মাধ্যমে পরিসংখ্যান এবং গাণিতিক ধারণা শেখার জন্য (এটি অন্যান্য ভাষার মাধ্যমেও হতে পারে তবে আর আমার প্রিয় স্বাদ)। চ্যালেঞ্জটি হ'ল উপাদানটি শেখা আলগোরিদিম সম্পাদন করে এমন একটি কোড কীভাবে চালানো যায় তা নয়, প্রোগ্রামিংয়ের …

4
ন্যূনতম বর্গক্ষেত্র সমাধান কেন এই ক্ষেত্রে খারাপ ফলাফল দেয়?
বিশপের "প্যাটার্ন স্বীকৃতি এবং মেশিন লার্নিং" এর অধ্যায় 4 পৃষ্ঠায় 204 নম্বরে একটি চিত্র রয়েছে যেখানে আমি বুঝতে পারি না কেন ন্যূনতম বর্গক্ষেত্র সমাধান এখানে খারাপ ফলাফল দেয়: পূর্ববর্তী অনুচ্ছেদে এই বিষয়টি ছিল যে ন্যূনতম স্কোয়ারের সমাধানগুলির মধ্যে নীচের চিত্রটিতে আপনি যেমন দেখেন ততক্ষণে বিদেশিদের কাছে দৃust়তার ঘাটতি নেই, তবে …

5
এলোমেলো বনগুলিতে ভুল শ্রেণিবদ্ধকরণের ব্যয় কীভাবে নিয়ন্ত্রণ করবেন?
আর প্যাকেজটি এলোমেলোভাবে পোস্ট করাতে ভুল সংশোধনের ব্যয়টি নিয়ন্ত্রণ করা কি সম্ভব ? আমার নিজের কাজে মিথ্যা নেতিবাচক (যেমন, কোনও ব্যক্তির কোনও রোগ হতে পারে এমন ভুলের মধ্যে অনুপস্থিত) মিথ্যা ধনাত্মক চেয়ে অনেক বেশি ব্যয়বহুল। প্যাকেজ rpart ব্যবহারকারীকে ভুলভাবে ওজনকে ভুল পদ্ধতিতে ভুলের জন্য ম্যাট্রিক্স নির্দিষ্ট করে ভুল সংশোধন ব্যয়গুলি …

2
বিজ্ঞপ্তি ডেটা দিয়ে বৈকল্পিকের সাম্য কীভাবে পরীক্ষা করা যায়
আমি 8 টি বিভিন্ন নমুনার (প্রতিটি আলাদা জনগোষ্ঠীর) মধ্যে পরিবর্তনের পরিমাণের সাথে তুলনা করতে আগ্রহী। আমি সচেতন যে অনুপাতের ডেটা সহ এটি বেশ কয়েকটি পদ্ধতি দ্বারা করা যেতে পারে: এফ-পরীক্ষার বৈচিত্রের সমতা, লেভেন পরীক্ষা ইত্যাদি তবে, আমার ডেটা বৃত্তাকার / দিকনির্দেশক (অর্থাত এমন তথ্য যা বায়ুর গতিপথ এবং সাধারণ কৌণিক …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.