পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

3
ম্যাকসেন্ট, এমএল, বেয়েস এবং অন্যান্য ধরণের স্ট্যাটিস্টিকাল ইনফারেন্স পদ্ধতির মধ্যে তুলনা
আমি কোনও উপায়েই কোনও পরিসংখ্যানবিদ নই (আমি গাণিতিক পরিসংখ্যানের কোর্স করেছি কিন্তু এর চেয়ে বেশি কিছুই নেই), এবং সম্প্রতি তথ্য তত্ত্ব এবং পরিসংখ্যানিক মেকানিক্স অধ্যয়নকালে আমি "অনিশ্চয়তা পরিমাপ" / "এনট্রপি" নামে এই জিনিসটির মুখোমুখি হয়েছি। আমি এটির খিনচিন ডেরাইভেশনটি অনিশ্চয়তার পরিমাপ হিসাবে পড়েছি এবং এটি আমার কাছে বোধগম্য হয়েছিল। আপনি …

4
স্কেল পরামিতিগুলির জন্য দুর্বলভাবে তথ্যবহুল পূর্ব বিতরণ
আমি স্কেল প্যারামিটারগুলির (সাধারণ বিতরণ, টি বিতরণ ইত্যাদির জন্য) পূর্বের বিতরণ হিসাবে লগের সাধারণ বিতরণগুলি ব্যবহার করছি যখন স্কেলটি কী হবে সে সম্পর্কে আমার কোনও ধারণা আছে তবে আমি জানি না বলে বলার দিক থেকে ভুল করতে চাই এটি সম্পর্কে অনেক। আমি এটি ব্যবহার করি কারণ সে ব্যবহারটি আমার কাছে …

2
নথি অনুরূপতা পরিমাপ
দলিলগুলিকে ক্লাস্টার করতে (পাঠ্য) দস্তাবেজের জোড়ার মধ্যে মিল খুঁজে পাওয়ার জন্য আপনার একটি উপায় প্রয়োজন। দুটি বিকল্প হ'ল: পদার্থের ভারসাম্য হিসাবে কোসিন সাদৃশ্য - এবং টিএফ / আইডিএফ ব্যবহার করে শব্দ ভেক্টর হিসাবে নথিগুলির তুলনা করুন । প্রতিটি ডকুমেন্টের সম্ভাব্যতা বিতরণের সাথে এফ-ডাইভারজেন্স যেমন কুলব্যাক-লেবেলার ডাইভারজেন্স ব্যবহার করে তুলনা করুন …

2
একটি পাওয়ার আইনে ট্রেন্ডলাইনের ফিটনের উপযোগিতা কীভাবে পরিমাপ / তর্ক করতে হবে?
আমার কাছে এমন কিছু ডেটা রয়েছে যা আমি ট্রেন্ডলাইনে ফিট করার চেষ্টা করছি। আমি বিশ্বাস করি যে ডেটা একটি পাওয়ার আইন অনুসরণ করে, এবং তাই লগ-লগ অক্ষের উপর একটি সরলরেখার জন্য ডেটা প্লট করে। এটি একটি (প্রায়) সরলরেখার ফলে তৈরি হয়েছে এবং তাই এক্সেলে আমি একটি পাওয়ার আইনের জন্য একটি …

3
নির্ণয়ের গুণফল (
আমি ভেরিয়েবলের মধ্যে পরিবর্তনের পরিমাণ বর্ণনা করে এর ধারণাটি পুরোপুরি উপলব্ধি করতে চাই । প্রতিটি ওয়েব ব্যাখ্যা কিছুটা যান্ত্রিক এবং অবসন্ন হয়। আমি ধারণাটি "পেতে" চাই, কেবল যান্ত্রিকভাবে সংখ্যাগুলি ব্যবহার করি না।R2R2r^2 যেমন: ঘন্টা স্কোর বনাম পরীক্ষার স্কোর = .8RRr = .64R2R2r^2 তাহলে এর অর্থ কি? পরীক্ষার স্কোরের 64৪% পরিবর্তনশীলতা …

5
সাইন ওয়েভের পূর্বাভাস দেওয়ার ক্ষেত্রে আমি কীভাবে আমার নিউরাল নেটওয়ার্ককে আরও উন্নত করতে পারি?
এখানে, একবার দেখুন: আপনি প্রশিক্ষণ ডেটা কোথায় শেষ হবে তা দেখতে পারবেন। প্রশিক্ষণ ডেটা যায় থেকে 1 ।−1−1-1111 আমি কেরাস এবং তান অ্যাক্টিভেশন সহ 1-100-100-2 ঘন নেটওয়ার্ক ব্যবহার করেছি। আমি ফলাফলটি দুটি মান, পি এবং কিউ হিসাবে পি / কিউ হিসাবে গণনা করি। এইভাবে আমি 1 টির চেয়ে কম মান …

1
পারস্পরিক সম্পর্কযুক্ত দ্বিপদী র্যান্ডম ভেরিয়েবল তৈরি করা
আমি ভাবছিলাম যে লিনিয়ার ট্রান্সফর্মেশন পদ্ধতির অনুসরণের পরে এলোমেলোভাবে এলোমেলো দ্বিপদী ভেরিয়েবলগুলি উত্পন্ন করা সম্ভব? নীচে, আমি আর তে কিছু সাধারণ চেষ্টা করেছি এবং এটি কিছুটা পারস্পরিক সম্পর্ক তৈরি করে। তবে আমি ভাবছিলাম যে এটি করার কোনও নীতিগত উপায় আছে কিনা? X1 = rbinom(1e4, 6, .5) ; X2 = rbinom(1e4, …

3
রুট গড় স্কোয়ার্ড ত্রুটি (আরএমএসই) বনাম মান বিচ্যুতি কীভাবে ব্যাখ্যা করবেন?
ধরা যাক আমার কাছে এমন একটি মডেল রয়েছে যা আমাকে অনুমানকৃত মান দেয়। আমি সেই মানগুলির আরএমএসই গণনা করি। এবং তারপরে প্রকৃত মানগুলির প্রমিত বিচ্যুতি। এই দুটি মান (রূপগুলি) তুলনা করার কি কোনও ধারণা আছে? আমি যা মনে করি তা হল, আরএমএসই এবং মানক বিচ্যুতি যদি একই / একই হয় …

4
একটি চিত্র এন্ট্রপি
কোনও চিত্রের এনট্রপি গণনা করার জন্য সর্বাধিক তথ্য / পদার্থবিজ্ঞান-তাত্ত্বিক সঠিক উপায় কী? আমি এখনই গণ্য দক্ষতার বিষয়ে চিন্তা করি না - আমি এটি তাত্ত্বিকভাবে যথাসম্ভব যথাযথভাবে চাই want ধূসর-স্কেল চিত্র দিয়ে শুরু করা যাক। এক স্বজ্ঞাত পদ্ধতির পিক্সেল ব্যাগ হিসাবে ইমেজ বিবেচনা করে এবং গনা হয় যেখানে কে ধূসর …

3
কে-ফোল্ড ক্রস-বৈধতা ব্যবহার করার সময় আমাদের কি একটি পরীক্ষার সেট দরকার?
আমি কে-ফোল্ড বৈধতা সম্পর্কে পড়ছি এবং আমি কীভাবে এটি কাজ করে তা আমি নিশ্চিত করতে চাই। আমি জানি যে হোল্ডআউট পদ্ধতির জন্য, ডেটাটি তিনটি সেটে বিভক্ত হয়, এবং পরীক্ষার সেটটি কেবলমাত্র মডেলের কর্মক্ষমতা নির্ধারণের জন্য একেবারে শেষে ব্যবহৃত হয়, যখন বৈধতা সেটটি হাইপারপ্যারামিটারগুলি সুরকরণ ইত্যাদির জন্য ব্যবহৃত হয় ইত্যাদি etc. …

5
ডেটা এলোমেলোভাবে অনুপস্থিত কিনা তা নির্ধারণের জন্য একটি পরিসংখ্যানিক পদ্ধতি approach
আমার কাছে ফিচার ভেক্টরগুলির একটি বিশাল সেট রয়েছে যা আমি বাইনারি শ্রেণিবদ্ধকরণ সমস্যাটিতে আক্রমণ করার জন্য ব্যবহার করব (পাইথনে সাইকিট শিখার ব্যবহার করে)। অনুমান সম্পর্কে ভাবতে শুরু করার আগে, আমি যদি অনুপস্থিত তথ্য 'এলোমেলোভাবে অনুপস্থিত' বা এলোমেলোভাবে অনুপস্থিত থাকে তবে ডেটার বাকী অংশগুলি থেকে তা নির্ধারণের চেষ্টা করতে আগ্রহী। এই …

2
চিকিত্সা দর্শকদের জন্য বিশ্বাসযোগ্য ব্যবধানগুলি কীভাবে সংক্ষিপ্ত করবেন
স্ট্যান এবং ফ্রন্টএন্ড প্যাকেজগুলির সাথে rstanarmবা brmsআমি মিশ্র-মডেলগুলির মতো আগে যেমন করেছি তেমন সহজেই বায়েশিয়ান পদ্ধতিতে ডেটা বিশ্লেষণ করতে পারি lme। আমার ডেস্কে ক্রুশকে-গেলম্যান-ওয়াগেনমেকারস-ইত্যাদির বেশিরভাগ বই এবং নিবন্ধগুলি থাকা সত্ত্বেও এগুলি আমাকে কীভাবে চিকিত্সা দর্শকদের জন্য ফলাফলগুলি সংক্ষিপ্ত করতে হবে তা জানায় না, বায়সিয়ানদের ক্রোধের স্কাইলা এবং চিকিত্সা পর্যালোচকদের চ্যারিবিডিসের …

2
বিপরীত রূপান্তর পদ্ধতি কীভাবে কাজ করে?
বিপরীতমুখী পদ্ধতি কীভাবে কাজ করে? আমি একটি র্যান্ডম নমুনা আছে বলুন সঙ্গে ঘনত্ব উপর 0 <এক্স <1 এবং সেইজন্য সঙ্গে সিডিএফ F_X (x) এর = এক্স ^ {1 / \ থেটা} উপর (0,1) । তারপরে বিবর্তন পদ্ধতিতে আমি এক্স এর বিতরণটি F_X ^ {- 1} (u) = u ^ \ …

3
দুটি সাধারণ বিতরণের মধ্যে পার্থক্য বিতরণ
আমার কাছে সাধারণ বিতরণের দুটি সম্ভাব্য ঘনত্বের কার্য রয়েছে: f1(x1|μ1,σ1)=1σ12π−−√e−(x−μ1)22σ21f1(x1|μ1,σ1)=1σ12πe−(x−μ1)22σ12f_1(x_1 \; | \; \mu_1, \sigma_1) = \frac{1}{\sigma_1\sqrt{2\pi} } \; e^{ -\frac{(x-\mu_1)^2}{2\sigma_1^2} } এবং f2(x2|μ2,σ2)=1σ22π−−√e−(x−μ2)22σ22f2(x2|μ2,σ2)=1σ22πe−(x−μ2)22σ22f_2(x_2 \; | \; \mu_2, \sigma_2) = \frac{1}{\sigma_2\sqrt{2\pi} } \; e^{ -\frac{(x-\mu_2)^2}{2\sigma_2^2} } আমি x1x1x_1 এবং মধ্যে বিচ্ছিন্নতার সম্ভাবনা ঘনত্ব ফাংশনটি সন্ধান করছি x2x2x_2। আমি মনে করি …

2
কেন একটি "নেতিবাচক দ্বিপদী" এলোমেলো পরিবর্তনশীল বলা হয়?
"নেতিবাচক দ্বিপদী" র্যান্ডম ভেরিয়েবলের কেন নাম আছে তা আমি বুঝতে পারি না। এটি সম্পর্কে নেতিবাচক কি? এটি সম্পর্কে দ্বিপদী কি? এটি সম্পর্কে নেতিবাচক-দ্বিপদী কী?

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.