পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
একটি "স্প্লিট প্লট" আনোভা যে দুটি ফ্যাক্টর সহ দ্বি-মুখী এনোভা একই ফ্যাক্টরটিতে বারবার ব্যবস্থা নিয়ে একই?
একটি "স্প্লিট প্লট" আনোভা যে দুটি কারণের সাথে দ্বি-মুখী ANOVA এর সাথে একই উপাদানগুলির সাথে পুনরাবৃত্তির ব্যবস্থাগুলি অভিন্ন? যদি না হয় তবে পার্থক্য কী?

3
প্রতিপত্তি জাদুকর প্যারাডক্স
দ্য প্রেস্টিজ মুভিটির কৌশলটি আপনি সম্ভবত জানেন : [মুভি স্পোলার] একজন যাদুকর একটি চিত্তাকর্ষক যাদু কৌশল পেয়েছেন: তিনি একটি মেশিনে যান, দরজাটি বন্ধ করেন এবং তারপরে অদৃশ্য হয়ে আবার ঘরের অন্যদিকে উপস্থিত হন। তবে মেশিনটি নিখুঁত নয়: কেবল তাকে টেলিপোর্ট করার পরিবর্তে এটি তাকে নকল করে। যাদুকর তিনি যেখানে আছেন …

1
বুটস্ট্র্যাপ টি পদ্ধতিতে বা কেবল বুটস্ট্র্যাপের মাধ্যমে গড়ের আত্মবিশ্বাসের বিরতি অনুমান করে?
গড়ের আত্মবিশ্বাসের ব্যবধানটি নির্ধারণ করার সময়, আমি মনে করি বুটস্ট্র্যাপ টি পদ্ধতি এবং ননপ্যারামেট্রিক বুটস্ট্র্যাপ পদ্ধতি উভয়ই প্রয়োগ করতে পারে তবে পূর্বেরটির আরও কিছুটা গণনা প্রয়োজন। আমি ভাবছি যে সাধারণ ননপ্যারমেট্রিক বুটস্ট্র্যাপের বুটস্ট্র্যাপ টির সুবিধাগুলি এবং অসুবিধাগুলি কী? কেন? এটি ব্যাখ্যা করার জন্য কিছু রেফারেন্স আছে?

5
পিয়ারসন পারস্পরিক সম্পর্কের বাইরে আমি কী করতে পারি?
দুটি ভেরিয়েবল পারস্পরিক সম্পর্কযুক্ত কিনা তা যাচাই করার সময়, আমি পর্যবেক্ষণ করেছি যে পিয়ারসন পারস্পরিক সম্পর্ক প্রয়োগের ফলে 0.1 এর চেয়ে কম সংখ্যক ফল পাওয়া গেছে যার সাথে কোনও সম্পর্ক নেই। এই দাবিটি জোরদার করতে আমি কি কিছু করতে পারি? ডেটাসেট (পোস্ট সীমাবদ্ধতার কারণে সাবসেট) আমি যা দেখছি তা হ'ল: …

3
অত্যন্ত ত্রুটি হারগুলি কীভাবে যাচাই করবেন
সেন্সরটির জন্য অত্যন্ত নিম্ন ত্রুটি হারের পরীক্ষার মাধ্যমে আমি প্রদর্শনের চেষ্টা করার মুখোমুখি হয়েছি (1,000,000 চেষ্টায় 1 টির বেশি নয়)। আমাদের কাছে পরীক্ষাটি পরিচালনা করার জন্য সীমিত সময় রয়েছে তাই আমরা প্রায় 4,000 টিরও বেশি প্রচেষ্টা অর্জনে সক্ষম না হতে পারব বলে আশা করি। সেন্সরটি প্রয়োজনীয়তা পূরণ করে না দেখানোর …

5
অনানুষ্ঠানিক / চাক্ষুষ "একাধিক তুলনা" জন্য একাধিক তুলনা সংশোধন প্রয়োজনীয়?
আমার যখন একাধিক তুলনা সংশোধন করা আবশ্যক সম্পর্কে এক ধরণের দার্শনিক প্রশ্ন রয়েছে। আমি একটি অবিচ্ছিন্ন সময় বিভিন্ন সংকেত পরিমাপ করছি (পৃথক সময় পয়েন্টে)। সময়ে সময়ে পৃথক পৃথক ঘটনা ঘটে এবং আমি যদি এই ইভেন্টগুলি পরিমাপক সংকেতের উপর উল্লেখযোগ্য প্রভাব ফেলে তবে তা প্রতিষ্ঠিত করতে চাই। সুতরাং আমি কোনও ঘটনা …

3
খুব বড় ডেটাসেট থেকে কীভাবে দ্রুত গুরুত্বপূর্ণ ভেরিয়েবলগুলি নির্বাচন করবেন?
আমার প্রায় 2000 বাইনারি ভেরিয়েবল / 200,000 সারি সহ একটি ডেটাসেট রয়েছে এবং আমি একক বাইনারি নির্ভরশীল ভেরিয়েবলের পূর্বাভাস দেওয়ার চেষ্টা করছি। আমার এই পর্যায়ে প্রধান লক্ষ্য পূর্বাভাসের সঠিকতা পাচ্ছে না, বরং এর মধ্যে কোনটি পরিবর্তনশীল গুরুত্বপূর্ণ ভবিষ্যদ্বাণীকারী তা সনাক্ত করার জন্য identify আমি আমার চূড়ান্ত মডেলটিতে ভেরিয়েবলের সংখ্যা প্রায় …

3
সরল ইংরেজিতে এপ্রোরি অ্যালগরিদম?
আমি এপ্রিওরি সম্পর্কে উইকি নিবন্ধটি পড়ি। ছাঁটাই এবং যোগদানের পদক্ষেপটি বুঝতে আমার সমস্যা হয়। কেউ কি আমাকে ব্যাখ্যা করতে পারেন যে কীভাবে এপরিওরি অ্যালগরিদম সহজ ভাষায় কাজ করে (যেমন আমার মতো নোভিস সহজেই বুঝতে পারে)? এটির সাথে যুক্ত কেউ যদি ধাপে ধাপে প্রক্রিয়াটি ব্যাখ্যা করে তবে ভাল হবে।

2
উপরের বাউন্ডের সাথে একটি ভেরিয়েবল বিবেচনা করে কোন ধরণের রিগ্রেশন ব্যবহার করতে হবে?
নীচে বর্ণিত পরীক্ষায় দুটি ভেরিয়েবল ( এবং ) এর মধ্যে সম্পর্কের মডেল করার জন্য কোন পদ্ধতিটি ব্যবহার করবেন তা আমি নিশ্চিত নই :xxxyYy এখানে 3 টি ভেরিয়েবল রয়েছে: , এবং ।xaimএক্সএকটিআমিমিx_{aim}xএক্সxyYy of এর মানটি পরীক্ষাটি পরিচালনা করার সময় সেট করা হয়। তবে, এবং always সবসময় সমান হয় না।xaimএক্সএকটিআমিমিx_{aim}xএক্সxxaimএক্সএকটিআমিমিx_{aim} এবং মধ্যে …

2
গ্রুপগুলির মধ্যে (কিছু) কোয়ান্টাইল-কিউয়ের পার্থক্য পরীক্ষা করে?
কিছু Y ভেরিয়েবলের জন্য, এটি 3 টি গ্রুপে (এক্স) বিভক্ত, আমি দলগুলির তুলনা করতে চাই এবং অনুমানের জন্য যে 90% কোয়ান্টাইলটি তিনটি দলের মধ্যেই সমান। আমি কোন পরীক্ষা ব্যবহার করতে পারি? আমি যে বিকল্পের কথা ভাবতে পারি তা হল কোয়ান্টাইল রিগ্রেশন ব্যবহার করা, অন্য বিকল্পগুলি / অ্যাপোচারগুলি কী আছে? আমি …

4
কেউ তাৎপর্যপূর্ণ নয় বলে গবেষণা থেকে ডেটা ছেড়ে দিতে পারে?
বিজ্ঞানম্যাগ.অর্গ.এর একটি নিবন্ধ পড়ার সময় আমি এই বাক্যটির মুখোমুখি হয়েছি । শেষ পর্যন্ত, 12 টি দেশের মাত্র 7600 গবেষকের প্রতিক্রিয়াগুলি অন্তর্ভুক্ত করা হয়েছিল কারণ বাকী ডেটাটি পরিসংখ্যানগতভাবে তাৎপর্যপূর্ণ বলে বিবেচিত হয়নি। এটি কি গবেষণা করার উপযুক্ত উপায়? ফলাফলগুলি ছেড়ে দেওয়ার জন্য কারণ তারা পরিসংখ্যানগতভাবে তাৎপর্যপূর্ণ বলে বিবেচিত হয়নি?

4
কেন আমাদের টি-টেস্টের জেড-পরীক্ষা দেওয়া দরকার?
টি-টেস্ট "কেন ঘটে" তার জন্য কেউ ব্যাখ্যা দিতে পারেন? আপনি যখন জনসংখ্যার মানক বিচ্যুতি জানেন না তখন আমাকে টি-টেস্ট ব্যবহার করতে শিখানো হয়েছিল (যেমন, আপনি কেবলমাত্র আপনার নমুনার মানক বিচ্যুতি জানেন) তবে কেন এটি জেড-টেস্ট থেকে আলাদা করবে তা আমি নিশ্চিত নই ।

2
ডেটাগুলিকে প্রিয়ারদের হুকুম দেওয়ার অনুমতি দেবে এবং তারপরে এই প্রিয়ারগুলি ব্যবহার করে মডেলটি চালাবে? (উদাহরণস্বরূপ, একই ডেটা সেট থেকে ডেটা-চালিত প্রিয়ার্স)
এটি আমার বোধগম্য যে আমাদের পূর্বের বন্টনগুলি কোনও বায়সিয়ান বিশ্লেষণে দেখতে কেমন তা নির্ধারণ করতে ড্রাইভ / সংজ্ঞা দেওয়ার জন্য আমরা একই ডেটা সেটটি মঞ্জুরি দেওয়া উচিত নয় allowing বিশেষত, আপনি একইভাবে মডেল ফিট করতে প্রিরিয়ারদের ব্যবহার করতে যাচ্ছেন সেই একই ডেটা সেট থেকে সংক্ষিপ্ত পরিসংখ্যানের ভিত্তিতে কোনও বয়েশীয় বিশ্লেষণের …
9 bayesian  prior 

3
সময় সিরিজের মোটর ডেটা শ্রেণিবদ্ধ করার জন্য সেরা অ্যালগরিদম
আমি একটি মেশিন নিয়ন্ত্রণ প্রকল্পে কাজ করছি। অপারেশন চলাকালীন আমরা মোটরের স্রোত পরিমাপ করতে পারি। সফলভাবে একটি অপারেশন করে দুটি মোটর থেকে প্রাপ্ত নমুনা তথ্য নীচে। লাল ট্রেসটি একটি মোটর থেকে স্রোত দেখায়, নীলটি অন্য থেকে কারেন্টটি সন্ধান করে। আমি চেষ্টা করতে চাই এবং মেশিনের আচরণের সমস্যাগুলি চিহ্নিত করার জন্য …

2
ভাঁজ করা সাধারণ বিতরণ থেকে নমুনা নেওয়া কি সাধারণ বন্টন থেকে নমুনার সমান 0 হয়?
আমি একটি সাধারণ ঘনত্ব থেকে অনুকরণ করতে চাই (মানে = 1, এসডি = 1) তবে কেবল ইতিবাচক মান চাই। একটি উপায় হ'ল একটি সাধারণ থেকে অনুকরণ এবং পরম মান গ্রহণ করা। আমি এটিকে ভাঁজ হওয়া স্বাভাবিক হিসাবে ভাবি। আমি আর এ দেখছি ছিন্ন করা এলোমেলো পরিবর্তনশীল জেনারেশনের জন্য বিভিন্ন কার্য …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.