পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

5
যখন কেন্দ্রীয় সীমাবদ্ধ তত্ত্ব এবং বৃহত সংখ্যার আইন একমত হয় না
এটি মূলত গণিতের উপরে আমি যে প্রশ্নের উত্তর পেয়েছি তারই একটি প্রতিলিপি , যা আমি প্রত্যাশিত উত্তর পাই নি। যাক { এক্স আমি } আমি ∈ এন{Xi}i∈N\{ X_i \}_{i \in \mathbb{N}} স্বাধীন, অভিন্নরুপে বিতরণ র্যান্ডম ভেরিয়েবল একটা ক্রম, সাথে থাকতে এবং ।ই [ এক্স আই ] = 1 E[Xi]=1\mathbb{E}[X_i] = …

2
সাইকিতে মাল্টিলেবল শ্রেণিবদ্ধকরণের মেট্রিক্স
আমি একাধিক-লেবেল শ্রেণিবদ্ধকারী তৈরি করার চেষ্টা করছি যাতে স্কাইকিট ব্যবহার করে বিদ্যমান নথিতে বিষয় নির্ধারণ করা যায় আমি আমার নথি মাধ্যমে তাদের পাশ প্রক্রিয়াকরণের করছি TfidfVectorizerমাধ্যমে লেবেল MultiLabelBinarizerএবং নির্মিত OneVsRestClassifierএকটি সঙ্গে SGDClassifierমূল্নির্ধারক হিসাবে। তবে আমার শ্রেণিবদ্ধার পরীক্ষা করার সময় আমি কেবল ২৯.২ পর্যন্ত স্কোর পাই যা যা পড়েছি তা থেকে …

3
একটি সিদ্ধান্ত স্ট্যাম্প একটি রৈখিক মডেল?
ডিসিশন স্টাম্প একটি সিদ্ধান্ত গাছ যা কেবল একটি বিভাজন। এটি পিসওয়াস ফাংশন হিসাবেও লেখা যেতে পারে। উদাহরণস্বরূপ, ধরুন একটি ভেক্টর, এবং প্রথম উপাদান , রিগ্রেশন সেটিংয়ে, কিছু সিদ্ধান্ত স্টাম্প হতে পারেxxxx1x1x_1xxx f(x)={35x1≤2x1>2f(x)={3x1≤25x1>2f(x)= \begin{cases} 3& x_1\leq 2 \\ 5 & x_1 > 2 \\ \end{cases} তবে এটি কি লিনিয়ার মডেল? হিসাবে …

5
একটি নামে কি: হাইপারপ্যারামিটার
সুতরাং একটি সাধারণ বিতরণে, আমাদের দুটি পরামিতি রয়েছে: গড় এবং বৈকল্পিক । প্যাটার্ন রিকগনিশন এবং মেশিন লার্নিং বইয়ে হঠাৎ ত্রুটি ফাংশনের নিয়মিতকরণের শর্তাবলীতে একটি হাইপারপ্যারামিটার ল্যাম্বদা উপস্থিত হয়।σ 2 λμμ\muσ2σ2\sigma^2λλ\lambda হাইপারপ্যারামিটার কি? কেন তাদের নামকরণ করা হয়েছে? এবং এগুলি সাধারণভাবে পরামিতিগুলির থেকে স্বজ্ঞাতভাবে কীভাবে আলাদা?

3
কেমন আছে
কার্টেসিয়ান x,yx,yx,y স্থানাংকগুলিকে এলোমেলো বিন্দুর (x,y)∼U(−10,10)×U(−10,10)(x,y)∼U(−10,10)×U(−10,10)(x,y) \sim U(-10,10) \times U(-10,10) । সুতরাং, ব্যাসার্ধ, ρ=x2+y2−−−−−−√ρ=x2+y2\rho = \sqrt{x^2 + y^2} ,এরপিডিএফদ্বারাহিসাবে অভিন্নভাবে বিতরণ করা হয়নি।ρρ\rho তবুও আমি আশা করব θ=arctanyxθ=arctan⁡yx\theta = \arctan{\frac{y}{x}} প্রায় অভিন্ন হতে, প্রান্তে 4 টি বাম ওভারের কারণে শিল্পকর্মগুলি বাদ দিয়ে: নীচে θ এবং ρ এর গ্রাফিকালি গণিত সম্ভাবনা …

3
প্রথমে কী শেখানো উচিত: সম্ভাবনা বা পরিসংখ্যান?
আমি নতুনভাবে একটি গণিত বিভাগে অনুষদ সদস্য হিসাবে যোগদান করেছি। একটি নামী প্রতিষ্ঠানের। আমি স্নাতক স্তরে সম্ভাব্যতা এবং পরিসংখ্যান কোর্স শিখিয়ে দেব। প্রতিষ্ঠানটির ইতিমধ্যে এই কোর্সের জন্য একটি সিলেবাস রয়েছে যা নিয়ে আমি খুব বেশি সন্তুষ্ট নই। সেই সিলেবাসে পরিসংখ্যানগুলি প্রথমে আচ্ছাদিত করা হয়, অনুমানের অংশটিও অনুপস্থিত। আমি সর্বদা ভাবতাম …
19 teaching 

1
ভিন্নতার প্রতিশব্দ
এমন কোনও শব্দ আছে যার অর্থ 'বিপরীত বিপরীত'? অর্থাৎ, যদি উচ্চতর বৈকল্পিকতা থাকে, তবে কম ? কাছের কোনও প্রতিশব্দে (যেমন 'চুক্তি' বা 'মিল') তে আগ্রহী নন তবে বিশেষত অর্থ ?XXXXXX……\dots1/σ21/σ21/\sigma^2

2
আমরা যদি কেবলমাত্র মডেলিংয়ে আগ্রহী, পূর্বাভাস না দিয়ে নিয়মিতকরণ কার্যকর হতে পারে?
আমরা যদি কেবলমাত্র পূর্বাভাস বা ভবিষ্যদ্বাণীতে না হয়ে মডেল প্যারামিটারগুলি অনুমান করতে (এবং ব্যাখ্যা করতে) আগ্রহী তবেই নিয়মিতকরণ কার্যকর হতে পারে? আমি লক্ষ্য করি যে যদি আপনার লক্ষ্যটি নতুন ডেটাতে ভাল পূর্বাভাস দেওয়া হয় তবে নিয়মিতকরণ / ক্রস-বৈধকরণ কীভাবে চূড়ান্ত কার্যকর। তবে আপনি যদি traditionalতিহ্যবাহী অর্থনীতি করছেন এবং আপনার যত্ন …

3
সিবিডাব্লু এর চেয়ে বিরল শব্দগুলির জন্য স্কিপ-গ্রাম কেন ভাল?
আমি অবাক হয়েছি কেন ওয়ার্ড টু ওয়েভের সিবিডাব্লু এর চেয়ে বিরল শব্দগুলির জন্য স্কিপ-গ্রাম ভাল। আমি https://code.google.com/p/word2vec/ এ দাবিটি পড়েছি ।

8
একে অপরের অনুসরণ করে প্রতিটি মানের মধ্যে পার্থক্য হিসাবে বৈকল্পিক সংজ্ঞা দেওয়া হয় না কেন?
এটি অনেকের কাছে একটি সাধারণ প্রশ্ন হতে পারে তবে এটি এখানে: মানগুলির গড়ের পার্থক্যের পরিবর্তে প্রতিটি মান একে অপরের অনুসরণ করে কেন পার্থক্যটিকে সংজ্ঞায়িত করা হয় না? এটি আমার কাছে আরও যুক্তিযুক্ত পছন্দ হবে, আমার ধারণা আমি অবশ্যই কিছু অসুবিধাগুলি পর্যবেক্ষণ করছি। ধন্যবাদ সম্পাদনা করুন: আমাকে যতটা সম্ভব পরিষ্কার করা …
19 variance 

5
বেসিক মেশিন লার্নিং অ্যালগরিদম শিখতে কিছু ভাল ডেটাসেট কী এবং কেন?
আমি মেশিন লার্নিংয়ে নতুন এবং এমন কিছু ডেটাসেট সন্ধান করছি যার মাধ্যমে আমি বিভিন্ন মেশিন লার্নিং অ্যালগরিদমের (ডিসিশন ট্রি, বুস্টিং, এসভিএম এবং নিউরাল নেটওয়ার্ক) মধ্যে পার্থক্য তুলনা করতে এবং তার বিপরীতে তুলনা করতে পারি আমি এই জাতীয় ডেটাসেটগুলি কোথায় পাব? ডেটাসেট বিবেচনা করার সময় আমার কী সন্ধান করা উচিত? আপনি …

2
সর্বাধিক সম্ভাবনার অনুমান কেন ঘন ঘন কৌশল হিসাবে বিবেচিত হয়?
আমার জন্য ক্রমবর্ধমান পরিসংখ্যানগুলি সিদ্ধান্ত নেওয়ার চেষ্টা করার সমার্থক যা সম্ভাব্য সমস্ত নমুনার জন্য ভাল। অর্থাত্, একটি ঘন ঘন সিদ্ধান্তের নিয়ম সর্বদা ঘন ঘন ঝুঁকি হ্রাস করার চেষ্টা করা উচিত, যা ক্ষতির ফাংশন এবং প্রকৃতির সত্য অবস্থার উপর নির্ভর করে :δδ\deltaএলএলLθ0θ0\theta_0 আরচR e q= ইθ0( এল ( θ0, δ( ওয়াই) …

2
বুস্টিং: শেখার হারকে নিয়মিতকরণের পরামিতি কেন বলা হয়?
গ্রেডিয়েন্ট বুস্টিং- এ লার্নিং রেট প্যারামিটার ( ) প্রতিটি নতুন বেস মডেলের অবদান সঙ্কুচিত করে - মূলত একটি অগভীর গাছ- যা সিরিজে যুক্ত করা হয়। এটি টেস্ট সেট যথার্থতা নাটকীয়ভাবে বৃদ্ধি করে দেখানো হয়েছিল, এটি ছোট পদক্ষেপের মতোই বোধগম্য, ক্ষতির ন্যূনতমতম কাজটি আরও সঠিকভাবে অর্জন করা যেতে পারে। ν∈ [ …

1
লিনিয়ার রিগ্রেশন মধ্যে বিজ্ঞপ্তি পূর্বাভাসকারী ব্যবহার
আমি বায়ু ডেটা (0, 359) এবং দিনের সময় (0, 23) ব্যবহার করে একটি মডেল ফিট করার চেষ্টা করছি, তবে আমি উদ্বিগ্ন যে তারা নিজেরাই লিনিয়ার পরামিতি নয় বলেই তারা একটি লিনিয়ার রিগ্রেশনে ফিট হবে। আমি পাইথন ব্যবহার করে তাদের রূপান্তর করতে চাই। আমি কমপক্ষে বাতাসের ক্ষেত্রে, ডিগ্রির পাপ এবং মহাকাশ …

3
টাইমসারি ভেক্টর (থিয়ানো) ভবিষ্যদ্বাণী করার জন্য আরএনএন (এলএসটিএম) ব্যবহার করে
আমার খুব সাধারণ সমস্যা আছে তবে আমি এটি সমাধান করার জন্য কোনও সঠিক সরঞ্জাম খুঁজে পাচ্ছি না। আমার একই দৈর্ঘ্যের ভেক্টরগুলির কিছু ক্রম রয়েছে। এখন আমি এই সিকোয়েন্সগুলির ট্রেনের নমুনায় এলএসটিএম আরএনএনকে প্রশিক্ষণ দিতে চাই এবং তারপরে এটি বেশ কয়েকটি প্রাইমিং ভেক্টরের উপর ভিত্তি করে দৈর্ঘ্যের এর ভেক্টরগুলির নতুন সিক্যুয়েন্সটির …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.