آموزش نرم‌افزار R برای علوم داده: مباحث مقدماتی

آموزش نرم‌افزار R برای علوم داده: مباحث مقدماتی

در این مقاله به موضوعات مقدماتی شامل نحوه تخصیص یک متغیر، کار با بردارها، ماتریس‌ها و قالب‌های داده و همچنین توابع پایه‌ای و پرکاربرد ریاضی و آماری بحث می‌پردازم. رویکرد من در آموزش برنامه‌نویسی R بیشتر مبتنی بر استفاده از مثال است تا خواننده با اجرای کدها بتواند این زبان را یاد بگیرد. اگر R […]

آشنایی با نرم‌افزار R

آشنایی با نرم‌افزار R

R (به فارسی “آر” تلفظ می‌شود) یک زبان برنامه‌نویسی و محیط نرم‌افزاری رایگان است که برای محاسبات آماری و نمایش گرافیکی داده‌ها از آن استفاده می‌شود. کسانی که در حوزه داده‌کاوی (Data Mining)، ماشین‌های یادگیرنده (Machine Learning) و روش‌های تحلیلی کسب‌وکار (Business Analytics) فعال هستند از این نرم‌افزار برای تحلیل‌ داده بهره می‌برند. زبان R برای […]

معنی‌داری آماری به زبان ساده

معنی‌داری آماری به زبان ساده

معنی‌داری آماری (Statistical Significance) یکی از مفاهیم مهمی است که در تحلیل‌های آماری استفاده می‌شود. با گسترش تصمیم‌گیری داده‌محور در عرصه‌های مختلف، امروزه چه محققان و چه مدیران بیشتر و بیشتر از مفهوم معنی‌داری آماری در تصمیم‌گیری استفاده می‌کنند. برای مثال شرکت دارویی که می‌خواهد بر مبنای نتایج آزمایش کنترل‌شده تصادفی (Randomized Controlled Experiment) تصمیم […]

رگرسیون به زبان ساده برای مدیران

رگرسیون به زبان ساده برای مدیران

یکی از مهم‌ترین روش‌های تحلیل داده در کسب‌وکار تحلیل رگرسیون (Regression Analysis) است. اگرچه در بیشتر موارد مدیران خود چنین تحلیل‌هایی را انجام نمی‌دهند، برای تصمیم‌گیری بر مبنای خروجی‌های تحلیل رگرسیون نیاز است تا با مفاهیم آن آشنا باشند. من در این مقاله به معرفی تحلیل رگرسیون می‌پردازم. تحلیل رگرسیون چیست؟ فرض کنید شما مدیر بازاریابی […]

شاخص‌های پراکندگی در آمار

شاخص‌های پراکندگی در آمار

اگرچه میانگین و سایر شاخص‌های مرکزی کمک می‌کنند تا مرکز داده‌ها را در جامعه یا نمونه آماری تشخیص دهیم، تنها اکتفا کردن به این شاخص‌ها می‌تواند تصویر نادرستی از مسئله پیش روی ما بگذارد. در بسیاری موارد فهمیدن این‌که داده‌ها چگونه حول میانگین پراکنده شده‌اند اهمیت پیدا می‌کند. اگر می‌خواهید بدانید در چه زمانی نباید […]

شاخص‌های مرکزی در آمار

شاخص‌های مرکزی در آمار

در این مقاله توضیح می‌دهم که اگر بخواهیم داده‌های موجود در جامعه آماری و یا نمونه را تنها با یک عدد نشان دهیم از چه شاخص‌هایی می‌توانیم استفاده کنیم. هدف استفاده از چنین شاخص‌هایی این است که اطلاعاتی را که در مجموعه داده‌ها وجود دارد در یک مقدار عددی خلاصه کند. شاخص‌هایی مانند میانگین (Mean)، […]

فرآیند اجرای پروژه‌های داده‌کاوی

فرآیند اجرای پروژه‌های داده‌کاوی

ممکن است برخی داده‌کاوی (Data Mining) را مجموعه‌ای از نرم‌افزارهای خودکار یا روش‌های ریاضی و آماری بدانند. درواقع داده‌کاوی یک فرآیند و متدولوژی است که به مدیران کمک می‌کند تا از داده‌های خام به اطلاعات ارزشمندی برسند که به بهبود تصمیم‌گیری‌های آنان منجر شود. یکی از متداول‌ترین فرآیندها برای انجام پروژه‌های داده‌کاوی، CRISP-DM (Cross-Industry Standard […]

ضریب همبستگی چیست و چه کاربردی دارد؟

ضریب همبستگی چیست و چه کاربردی دارد؟

در دنیای کسب‌وکار پیش می‌آید که تصمیم‌گیر به رابطه بین دو متغیر علاقه‌مند است. در آمار، از کوواریانس (Covariance) و همبستگی (Correlation) برای کمّی کردن رابطه بین متغیرها بهره می‌برند. در این مقاله به تعاریف ریاضی این مفاهیم می‌پردازم. علاوه بر این با یک مثال در حوزه مدیریت کیفیت و اجرای آن در نرم‌افزار R، […]