পরিসংখ্যান এবং বড় তথ্য

পরিসংখ্যান, মেশিন লার্নিং, ডেটা বিশ্লেষণ, ডেটা মাইনিং এবং ডেটা ভিজ্যুয়ালাইজেশনে আগ্রহী ব্যক্তিদের জন্য প্রশ্নোত্তর

2
প্রভাব কার্য এবং ওএলএস
আমি প্রভাবগুলি কীভাবে কাজ করে তা বোঝার চেষ্টা করছি। কোনও সাধারণ ওএলএস রিগ্রেশন প্রসঙ্গে ব্যাখ্যা করতে পারে yi=α+β⋅xi+εiyi=α+β⋅xi+εi\begin{equation} y_i = \alpha + \beta \cdot x_i + \varepsilon_i \end{equation} যেখানে আমি জন্য প্রভাব ফাংশন চাই ।ββ\beta

1
একটি মেশিন লার্নিং মডেলের "ক্ষমতা" কী?
আমি কার্ল ডোরস্চের ভেরিয়েশনাল অটোনকোডার্সের এই টিউটোরিয়ালটি অধ্যয়ন করছি । দ্বিতীয় পৃষ্ঠায় এটি উল্লেখ করেছে: এই জাতীয় ফ্রেমওয়ার্কগুলির মধ্যে অন্যতম জনপ্রিয় হ'ল ভেরিয়াল অটোইনকোডার [1, 3], এই টিউটোরিয়ালটির বিষয়। এই মডেলটির অনুমানগুলি দুর্বল, এবং ব্যাকপ্রেগেশন দ্বারা প্রশিক্ষণ দ্রুত fast ভিএইগুলি প্রায় অনুমান করে তবে এই আনুমানিক মাধ্যমে প্রবর্তিত ত্রুটিটি উচ্চ …

2
সর্বাধিক গড় তাত্পর্য (দূরত্ব বিতরণ)
আমার কাছে দুটি ডেটা সেট রয়েছে (উত্স এবং লক্ষ্য ডেটা) যা বিভিন্ন বিতরণ অনুসরণ করে। আমি এমএমডি ব্যবহার করছি - এটি উত্স এবং লক্ষ্য ডেটার মধ্যে প্রান্তিক বিতরণ গণনা করার জন্য একটি অ-প্যারাম্যাট্রিক দূরত্ব বিতরণ। উত্স তথ্য, এক্স লক্ষ্য তথ্য, এক্সটি অভিযোজন ম্যাট্রিক্স এ * অনুমিত ডেটা, যদ = একটি …

1
আরএনএনস: কখন বিপিটিটি এবং / অথবা ওজন আপডেট করবেন?
আমি ফোনমে ক্লাসিফিকেশনে গ্র্যাভস ২০০৫ এর কাগজের মাধ্যমে সিকোয়েন্স লেবেলিংয়ের জন্য আরএনএনগুলির উচ্চ-স্তরের অ্যাপ্লিকেশনটি বোঝার চেষ্টা করছি । সমস্যার সংক্ষিপ্তসার হিসাবে: আমাদের কাছে একক বাক্যগুলির (ইনপুট) অডিও ফাইল এবং (আউটপুট) বিশেষজ্ঞের লেবেলযুক্ত শুরুর সময়, স্টপ টাইম এবং পৃথক ফোনমেসগুলির জন্য লেবেল (কিছু "বিশেষ" ফোনমাস যেমন নীরবতা, যেমন প্রতিটি অডিও ফাইলের …
15 lstm  rnn 

2
পারসেন্টাইলের জন্য আস্থার ব্যবধান কীভাবে পাওয়া যায়?
আমার কাছে একগুচ্ছ কাঁচা ডেটা মান রয়েছে যা ডলারের পরিমাণের এবং আমি সেই ডেটার পারসেন্টাইলের জন্য একটি আত্মবিশ্বাসের ব্যবধান সন্ধান করতে চাই। এই ধরনের আত্মবিশ্বাসের ব্যবধানের কোনও সূত্র আছে কি?

2
কোনও ইনস্ট্রুমেন্ট ভেরিয়েবল সমীকরণটি কি নির্দেশিত অ্যাসাইক্লিক গ্রাফ (ডিএজি) হিসাবে লেখা যেতে পারে?
নির্দেশিত অ্যাসাইক্লিক গ্রাফ (ডিএজিএস) পরিসংখ্যানগত মডেলগুলিতে গুণগত কার্যকারণ অনুমানের দক্ষ ভিজ্যুয়াল উপস্থাপনা, তবে সেগুলি কি নিয়মিত উপকরণের পরিবর্তনশীল সমীকরণ (বা অন্যান্য সমীকরণ) উপস্থাপন করতে ব্যবহার করা যেতে পারে? যদি তাই হয়, কিভাবে? তা না হলে কেন?

1
এল-বিএফজিএস কীভাবে কাজ করে?
কাগজটির উদ্দেশ্য হ'ল নিয়মিত লগ-সম্ভাবনা সর্বাধিক করে কিছু পরামিতি অনুকূল করা। তারপরে তারা আংশিক ডেরিভেটিভস গণনা করে। এবং তারপরে লেখকরা উল্লেখ করেছেন যে তারা এল-বিএফজিএস ব্যবহার করে সমীকরণটি অপ্টিমাইজ করে, অনেকগুলি ভেরিয়েবলের মসৃণ ফাংশনগুলি অপ্টিমাইজ করার জন্য একটি প্রমিত নিউটোন প্রক্রিয়া (কোনও বিবরণ নেই)। এটা কিভাবে কাজ করে ?

4
বিনামূল্যে জনস্বার্থের ডেটা হোস্টিং? [বন্ধ]
বন্ধ থাকে। এই প্রশ্নটি অফ-টপিক । এটি বর্তমানে উত্তর গ্রহণ করছে না। এই প্রশ্নটি উন্নত করতে চান? প্রশ্নটি আপডেট করুন যাতে এটি ক্রস ভ্যালিডেটের জন্য অন-বিষয় । 4 বছর আগে বন্ধ ছিল । Http://data.barrycarter.info/ এ অনেক স্টেশনের জন্য আমার কাছে ঘন্টা এবং প্রতিদিনের তাপমাত্রার প্রতিবেদন রয়েছে আমি লোকেদের এটি ডাউনলোড …
14 dataset 

1
তারা কেন এখানে গামা বিতরণ বেছে নেবে?
আমার কোর্সের একটি অনুশীলনে আমরা একটি কেগল মেডিকেল ডেটাসেট ব্যবহার করছি । অনুশীলন বলে: আমরা স্বতন্ত্র চার্জের বিতরণকে মডেল করতে চাই এবং আমরা সত্যই সেই বিতরণ সম্পর্কে আমাদের অনিশ্চয়তা ক্যাপচার করতে সক্ষম হতে চাই যাতে আমরা দেখতে পেলাম মূল্যবোধের পরিধি আরও ভালভাবে ক্যাপচার করতে পারি। ডেটা লোড হচ্ছে এবং একটি …

3
দুটি ফ্রিকোয়েন্সি বিতরণের মধ্যে পরিসংখ্যানিক "দূরত্ব" কীভাবে পরিমাপ করবেন?
আমি একটি ডেটা বিশ্লেষণ প্রকল্প হাতে নিচ্ছি যা বছরের পর বছর ধরে ওয়েবসাইট ব্যবহারের সময়গুলি অনুসন্ধানের সাথে জড়িত। আমি যা করতে চাই তা ব্যবহারের ধরণগুলি কীভাবে "সামঞ্জস্যপূর্ণ", তুলনা করে বলুন, তারা এমন একটি প্যাটার্নের সাথে কতটা কাছাকাছি আছেন যা প্রতি সপ্তাহে একবার 1 ঘন্টা ব্যবহার করা জড়িত, বা একটি যা …

2
ওল্ফ্রাম ম্যাথওয়ার্ল্ড একটি সম্ভাব্যতা ঘনত্ব ফাংশন সহ একটি পৃথক সম্ভাব্যতা বন্টন বর্ণনা ভুল করে?
সাধারণত বিচ্ছিন্ন ভেরিয়েবলগুলির উপর সম্ভাব্যতা বন্টন একটি সম্ভাব্য ভর ফাংশন (পিএমএফ) ব্যবহার করে বর্ণনা করা হয়: অবিচ্ছিন্ন এলোমেলো ভেরিয়েবলগুলির সাথে কাজ করার সময় আমরা সম্ভাব্যতা গণ ফাংশনের পরিবর্তে সম্ভাব্যতা ঘনত্ব ফাংশন (পিডিএফ) ব্যবহার করে সম্ভাব্যতা বিতরণগুলি বর্ণনা করি। - গুডফেলো, বেনজিও এবং করভিলের কাছ থেকে ডিপ লার্নিং যাইহোক, ওল্ফ্রাম ম্যাথওয়ার্ল্ড …

1
প্রদত্ত ডেটা সেটে সবচেয়ে বড় এবং ক্ষুদ্রতম মানের গড়ের নাম কী?
আপনি কোনও পরিসংখ্যান বলতে কী বোঝেন যা কোনও প্রদত্ত ডেটাসেটের উপরের এবং নিম্ন চূড়া থেকে গণনা করা হয়? উদাহরণস্বরূপ, আপনার যদি একটি সেট থাকে: { -2, 0 , 8, 9, 1, 50, -2, 6} এই সেটটির উপরের চরমটি হ'ল 50এবং নিম্ন চরম -2। সুতরাং, চূড়ান্ত গড় হবে(-2 + 50 / …

3
আত্মবিশ্বাসের ব্যবধান কখন "বুদ্ধিমান" হয় তবে সংশ্লিষ্ট বিশ্বাসযোগ্য ব্যবধানটি কখন তা করে না?
এটি প্রায়শই ক্ষেত্রে ঘটে যে 95% কভারেজ সহ একটি আস্থার ব্যবধান একটি বিশ্বাসযোগ্য ব্যবধানের সাথে খুব সামঞ্জস্যপূর্ণ যা 95% উত্তরীয় ঘনত্ব ধারণ করে। পূর্ববর্তী ক্ষেত্রে ইউনিফর্ম বা ইউনিফর্মের নিকটবর্তী হলে এটি ঘটে। সুতরাং একটি আত্মবিশ্বাসের ব্যবধান প্রায়শই একটি বিশ্বাসযোগ্য ব্যবধান এবং বিপরীতভাবে প্রায় অনুমান করতে ব্যবহার করা যেতে পারে। গুরুত্বপূর্ণভাবে, …

2
ধারাবাহিক ডেটা থেকে শ্রেণীবদ্ধে যাওয়া কি সর্বদা ভুল?
আমি যখন আপনার ডেটা সেটআপ করব সে সম্পর্কে আমি যখন পড়ি তখন একটি বিষয় আমি প্রায়শই দেখতে পেলাম যে কয়েকটি ধারাবাহিক তথ্যকে শ্রেণিবদ্ধ ডেটাতে রূপান্তর করা ভাল ধারণা নয়, যেহেতু থ্রেশহোল্ডগুলি দুর্বলভাবে নির্ধারিত হয় তবে আপনি ভুল উপসংহারটি করতে পারেন। যাইহোক, আমার কাছে বর্তমানে কিছু তথ্য রয়েছে (প্রস্টেট ক্যান্সার রোগীদের …

2
একটি পরিসংখ্যানের উদাহরণ যা নমুনা বিতরণের স্বতন্ত্র নয়?
এটি উইকিপিডিয়ায় পরিসংখ্যানগুলির সংজ্ঞা আরও আনুষ্ঠানিকভাবে, পরিসংখ্যানগত তত্ত্ব একটি পরিসংখ্যানকে একটি নমুনার ফাংশন হিসাবে সংজ্ঞায়িত করে যেখানে ফাংশনটি নিজেই নমুনার বন্টন থেকে স্বতন্ত্র; অর্থাত, তথ্য উপলব্ধির আগে ফাংশনটি বলা যেতে পারে। পরিসংখ্যান শব্দটি ফাংশন এবং প্রদত্ত নমুনায় ফাংশনের মান উভয়ের জন্য ব্যবহৃত হয়। আমি মনে করি আমি এই সংজ্ঞাটির বেশিরভাগটি …

আমাদের সাইট ব্যবহার করে, আপনি স্বীকার করেছেন যে আপনি আমাদের কুকি নীতি এবং গোপনীয়তা নীতিটি পড়েছেন এবং বুঝতে পেরেছেন ।
Licensed under cc by-sa 3.0 with attribution required.