در حالی که این اصطلاح ارعاب کننده به نظر می رسد ، "تجزیه و تحلیل داده ها" چیزی غیر از ایجاد اطلاعات در یک جدول نیست. این شامل فیلتر ، مرتب سازی ، گروه بندی و دستکاری جداول داده با جبر اساسی و آمار است.
در واقع ، شما برای درک اصول اولیه نیازی به تجربه ندارید. شما قبلاً با داده های گسترده در زندگی خود کار کرده اید ، و "تجزیه و تحلیل" چیزی غیر از یک کلمه فانتزی برای حس خوب و منطق اساسی نیست.
با گذشت زمان ، مردم به طور شهودی بهترین روشهای منطقی را برای درمان داده ها طبقه بندی کرده اند. این دسته ها همان چیزی هستند که امروزه آنها را انواع ، روش ها و تکنیک ها می نامیم.
در این مقاله لیست کاملی از انواع ، روش ها و تکنیک ها ارائه شده و تفاوت بین آنها را توضیح می دهد.
برای یک مقدمه عملی به تجزیه و تحلیل داده ها (از جمله انواع ، روش ها و تکنیک ها) ، مقدمه ما را به کتاب الکترونیکی تجزیه و تحلیل داده ها به صورت رایگان بررسی کنید.
تجزیه و تحلیل توصیفی ، تشخیصی ، پیش بینی و تجویز
اگر شما "انواع تجزیه و تحلیل داده ها" را گوگل کنید ، چند نتایج اول تجزیه و تحلیل توصیفی ، تشخیصی ، پیش بینی کننده و تجویزی را بررسی می کنند. چرا؟از آنجا که این نام ها به راحتی قابل درک هستند و در "دنیای واقعی" بسیار مورد استفاده قرار می گیرند.
تجزیه و تحلیل توصیفی یک روش اطلاع رسانی است ، تجزیه و تحلیل تشخیصی توضیح می دهد "چرا" یک پدیده رخ می دهد ، تجزیه و تحلیل پیش بینی به دنبال پیش بینی نتیجه یک عمل است و تجزیه و تحلیل تجویز راه حل های یک مشکل خاص را مشخص می کند.
گفته می شود ، این تنها چهار شاخه از یک درخت تحلیلی بزرگتر است.
تحلیلگران خوب داده ها می دانند که چگونه این چهار نوع را در سایر روش ها و تاکتیک های تحلیلی قرار دهند ، به آنها امکان می دهد از نقاط قوت و ضعف در هر یک استفاده کنند تا با ارزش ترین بینش ها را از بین ببرند.
بیایید درخت تحلیلی کامل را کشف کنیم تا نحوه ارزیابی مناسب و استفاده از این چهار نوع سنتی را درک کنیم.
نمودار درخت انواع ، روش ها و تکنیک ها
در اینجا تصویری برای تجسم ساختار و سلسله مراتب انواع ، روش ها و تکنیک های تجزیه و تحلیل داده ها وجود دارد.
اگر خیلی کوچک است می توانید تصویر را در یک برگه جدید مشاهده کنید. آن را باز کنید تا در کنار هم باشید!
توجه: آمار توصیفی اساسی مانند میانگین ، متوسط و حالت و همچنین انحراف استاندارد نشان داده نشده است زیرا بیشتر افراد قبلاً با آنها آشنا هستند. در نمودار ، آنها تحت نوع تجزیه و تحلیل "توصیفی" قرار می گیرند.
نمودار درخت توضیح داد
طبقه بندی بالاترین سطح تجزیه و تحلیل داده ها کمی در مقابل کیفی است. کمی حاکی از اعداد است در حالی که کیفی اطلاعاتی غیر از اعداد را نشان می دهد.
تجزیه و تحلیل داده های کمی سپس به تجزیه و تحلیل ریاضی و تجزیه و تحلیل هوش مصنوعی (AI) تقسیم می شود. انواع ریاضی سپس به توصیفی ، تشخیصی ، پیش بینی کننده و تجربی می پردازند.
مواد و روشهای تحت تجزیه و تحلیل ریاضی شامل خوشه بندی ، طبقه بندی ، پیش بینی و بهینه سازی است. روشهای تجزیه و تحلیل داده های کیفی شامل تجزیه و تحلیل محتوا ، تجزیه و تحلیل روایت ، تجزیه و تحلیل گفتمان ، تجزیه و تحلیل چارچوب و/یا نظریه مبتنی بر.
علاوه بر این ، تکنیک های ریاضی شامل رگرسیون ، خلیج ها ، هموار سازی نمایی ساده ، گروه ها ، عوامل ، تبعیض های خطی و موارد دیگر است ، در حالی که تکنیک های موجود در زیر نوع AI شامل شبکه های عصبی مصنوعی ، درختان تصمیم گیری ، برنامه نویسی تکاملی و منطق فازی است. تکنیک های تحت تجزیه و تحلیل کیفی شامل تجزیه و تحلیل متن ، برنامه نویسی ، تجزیه و تحلیل الگوی ایده و فرکانس کلمه است.
یادآوری خیلی زیاد است! نگران نباشید ، هنگامی که رابطه و انگیزه پشت همه این شرایط را درک کردید ، مانند دوچرخه سواری خواهد بود.
ما از بالا به پایین لیست را پایین خواهیم آورد و من شما را تشویق می کنم که نمودار درخت را در بالا در یک برگه جدید باز کنید تا بتوانید دنبال کنید.
اما اول ، بیایید فقط به فیل موجود در اتاق بپردازیم: به هر حال تفاوت بین روش ها و تکنیک ها چیست؟
تفاوت بین روش ها و تکنیک ها
اگرچه اغلب به صورت متناوب مورد استفاده قرار می گیرد ، تکنیک های روش ها و روش ها یکسان نیستند. با تعریف ، روش ها فرایندی هستند که با استفاده از آن تکنیک ها اعمال می شود و تکنیک ها کاربرد عملی آن روش ها هستند.
به عنوان مثال ، رانندگی را در نظر بگیرید. روشها شامل ماندن در خط شما ، توقف در چراغ قرمز و پارکینگ در یک نقطه است. تکنیک ها شامل چرخاندن فرمان ، ترمز و فشار دادن پدال گاز است.
مجموعه داده ها: مشاهدات و زمینه ها
درک ساختار اساسی جداول داده برای درک بقیه مقاله مهم است. یک مجموعه داده شامل یک ستون چپ چپ است که حاوی مشاهدات است ، سپس یک سری ستون حاوی زمینه ها (با نام "ویژگی ها" یا "ویژگی ها") که هر مشاهدات را توصیف می کند. به عنوان مثال ، تصور کنید که ما یک جدول داده برای میوه می خواهیم. ممکن است اینگونه به نظر برسد:
روش طبقه بندی
توضیحات: روش طبقه بندی با هدف جدا کردن و گروه بندی نقاط داده بر اساس ویژگی های مشترک. این کار می تواند به صورت شهودی یا آماری انجام شود.
روش پیش بینی
توضیحات: روش پیش بینی از داده های سری گذشته برای پیش بینی آینده استفاده می کند.
اهمیت: بسیار بالا. پیش بینی تحت تجزیه و تحلیل پیش بینی کننده قرار می گیرد و مسلماً رایج ترین و مهمترین روش در دنیای شرکت ها است. در تحقیقات کمتر مفید است ، که ترجیح می دهد به جای گمانه زنی در مورد آینده ، شناخته شده را درک کند.
ماهیت داده ها: داده های مفید برای پیش بینی داده های سری زمانی است که همانطور که اشاره کردیم ، همیشه متغیر زمان را شامل می شود.
روش بهینه سازی
توضیحات: روش بهینه سازی مقادیر را در مجموعه ای از معیارها به حداکثر می رساند یا به حداقل می رساند. احتمالاً در تجزیه و تحلیل تجویز متداول است. از نظر ریاضی ، با توجه به محدودیت های خاص ، عملکردی را به حداکثر می رساند یا به حداقل می رساند.
اهمیت: بسیار بالا. ایده بهینه سازی در مورد انواع تجزیه و تحلیل بیشتر از هر روش دیگر اعمال می شود. در حقیقت ، برخی استدلال می کنند که این محرک اساسی تجزیه و تحلیل داده ها است. شما از آن در همه جای تحقیق و یک شرکت استفاده می کنید.
روش تجزیه و تحلیل محتوا
توضیحات: تجزیه و تحلیل محتوا روشی برای تجزیه و تحلیل کیفی است که داده های متنی را برای ردیابی مضامین در یک سند تعیین می کند. این امر در زمینه های دانشگاهی و علوم اجتماعی شایع ترین است ، جایی که محتوای کتبی موضوع تحقیق است.
روش تجزیه و تحلیل روایی
توضیحات: تجزیه و تحلیل روایت روشی برای تجزیه و تحلیل کیفی است که داستانها را برای ردیابی مضامین در آنها تعیین می کند. این با تجزیه و تحلیل محتوا متفاوت است زیرا به جای اسناد تحقیقاتی روی داستان ها متمرکز است ، و تکنیک های مورد استفاده کمی متفاوت از آن در تجزیه و تحلیل محتوا است (بسیار ظریف و خارج از محدوده این مقاله).
اهمیت: کم. مگر اینکه در کار با داستان ها بسیار تخصص داشته باشید ، تجزیه و تحلیل روایت نادر است.
ماهیت داده ها: ماهیت داده های مفید برای روش تحلیل روایت متن روایت است.
روش تجزیه و تحلیل گفتمان
توضیحات: روش تجزیه و تحلیل گفتمان تحت تجزیه و تحلیل کیفی قرار می گیرد و از برنامه نویسی موضوعی برای ردیابی الگوهای در گفتمان زندگی واقعی استفاده می کند. گفته می شود ، گفتمان زندگی واقعی شفاهی است ، بنابراین ابتدا باید به متن رونویسی شود.
اهمیت: کم. مگر اینکه شما در درک اشتراک ایده در دنیای واقعی در یک مجموعه تحقیق متمرکز شوید ، این نوع تجزیه و تحلیل کمتر از سایر موارد موجود در این لیست رایج است.
روش تجزیه و تحلیل چارچوب
توضیحات: روش تحلیل چارچوب تحت تجزیه و تحلیل کیفی قرار می گیرد و از تکنیک های کد نویسی موضوعی مشابه برای تجزیه و تحلیل محتوا استفاده می کند. با این حال ، در جایی که تجزیه و تحلیل محتوا با هدف کشف مضامین ، تجزیه و تحلیل چارچوب با یک چارچوب آغاز می شود و فقط عناصری را که در نتیجه آن قرار می گیرند ، در نظر می گیرد.
روش تئوری پایه
توضیحات: روش تئوری مبتنی بر تجزیه و تحلیل کیفی قرار می گیرد و از برنامه نویسی موضوعی برای ساختن تئوری ها در اطراف آن مضامین استفاده می کند.
اهمیت: کم. مانند سایر تکنیک های تجزیه و تحلیل کیفی ، نظریه پایه در دنیای شرکت ها کمتر متداول است. حتی در بین محققان ، شما برای پیدا کردن بسیاری از آنها تحت فشار قرار می گیرید. گرچه قدرتمند است ، صرف وقت یادگیری بسیار نادر است.
ماهیت داده ها: ماهیت داده های مفید در روش تئوری مبتنی بر متنی است.
تکنیک خوشه بندی: k-means
توضیحات: K-Means یک تکنیک خوشه بندی است که در آن نقاط داده در خوشه هایی که نزدیکترین وسیله را دارند گروه بندی می شوند. اگرچه AI یا ML در نظر گرفته نشده است ، اما ذاتاً به استفاده از یادگیری تحت نظارت برای ارزیابی مجدد خوشه ها با افزودن نقاط داده نیاز دارد. از تکنیک های خوشه بندی می توان در تجزیه و تحلیل داده های تشخیصی ، توصیفی و تجربی استفاده کرد.
اهمیت: بسیار مهم. اگر فقط 3 مورد از این مقاله بگیرید ، خوشه بندی K-Mean باید بخشی از آن باشد. در هر شرایطی مفید است که N مشاهدات دارای چندین ویژگی باشد و ما می خواهیم آنها را به صورت گروهی قرار دهیم.
تکنیک رگرسیون
توضیحات: رگرسیون ساده و چند متغیره از یک متغیر مستقل یا ترکیبی از متغیرهای مستقل متعدد برای محاسبه همبستگی با یک متغیر وابسته واحد با استفاده از ثابت استفاده می کند. رگرسیون امروز تقریباً مترادف با همبستگی است.
تکنیک N Nïave
توضیحات: Nïave Bayes یک روش طبقه بندی است که از احتمال ساده برای طبقه بندی موارد مبتنی بر طبقه بندی های قبلی استفاده می کند. به زبان انگلیسی ساده ، فرمول می تواند "فرصتی باشد که با ویژگی X متعلق به کلاس C باشد ، به (=) احتمال کلی صفت X متعلق به کلاس C بستگی دارد ، که با احتمال کلی کلاس C ، تقسیم بر شانس کلی است. از دریافت صفت x. "به عنوان یک فرمول ، P (C | X) = P (X | C) * P (C) / P (X) است.
اهمیت: بالاNïave Bayes یک تکنیک طبقه بندی بسیار متداول و ساده است زیرا با مجموعه داده های بزرگ مؤثر است و می تواند برای هر لحظه که در آن کلاس وجود داشته باشد ، اعمال شود. به عنوان مثال ، Google ممکن است از آن برای گروه بندی صفحات وب به گروه هایی برای نمایش های خاص موتور جستجو استفاده کند.
ماهیت داده ها: ماهیت داده ها برای Bayes nïave حداقل یک کلاس و حداقل دو صفت در یک مجموعه داده است.
تکنیک گروه
توضیحات: تکنیک گروهها نوعی روش خوشه بندی است که در علوم رفتاری برای جدا کردن کاربران توسط صفات مشترک استفاده می شود. مانند خوشه بندی ، می توان آن را به صورت شهودی یا ریاضی انجام داد ، که دومی آن به سادگی K-Means خواهد بود.
اهمیت: بسیار بالا. با توجه به شباهت به K-Means ، تکنیک کوهورت بیشتر از یک همتای سطح بالا است. در حقیقت ، بیشتر افراد به عنوان بخشی از Google Analytics با آن آشنا هستند. این بیشتر در بخش های بازاریابی در شرکت ها و نه در تحقیقات رایج است.
تکنیک عامل
توضیحات: تکنیک تحلیل عاملی راهی برای گروه بندی بسیاری از صفات به یک عامل واحد برای تسریع تجزیه و تحلیل است. به عنوان مثال ، از عوامل می توان به عنوان صفات برای طبقه بندی N Nïave به جای زمینه های عمومی تر استفاده کرد.
تکنیک تبعیض های خطی
توضیحات: تکنیک های تجزیه و تحلیل تبعیض آمیز خطی شبیه به رگرسیون هستند زیرا از یک یا چند متغیر مستقل برای تعیین یک متغیر وابسته استفاده می کنند. با این حال ، تکنیک تبعیض آمیز خطی تحت یک روش طبقه بندی کننده قرار می گیرد زیرا از صفات به عنوان متغیرهای مستقل و کلاس به عنوان یک متغیر وابسته استفاده می کند. به این ترتیب ، به یک روش طبقه بندی و یک روش پیش بینی کننده تبدیل می شود.
اهمیت: بالااگرچه دنیای تحلیلگر از تبعیض های خطی کمتر صحبت می کند و از آن استفاده می کند ، اما این یک تکنیک بسیار با ارزش است که می توانید در هنگام پیشرفت در تجزیه و تحلیل داده ها به خاطر داشته باشید.
ماهیت داده ها: ماهیت داده های مفید برای تکنیک تبعیض آمیز خطی مجموعه داده ها با بسیاری از زمینه ها است.
تکنیک هموار سازی نمایی
توضیحات: هموار سازی نمایی تکنیکی است که تحت روش پیش بینی قرار می گیرد که به منظور پیش بینی مقادیر آینده از یک عامل هموار سازی در داده های قبلی استفاده می کند. این می تواند خطی باشد یا برای فصلی تنظیم شود. اصل اساسی هموار سازی نمایی استفاده از وزن درصد (مقدار بین 0 تا 1 به نام آلفا) در مقادیر جدیدتر در یک سری و وزن درصد کمتری در مقادیر کمتر اخیر است. فرمول f (x) = مقدار دوره فعلی * alpha + مقدار دوره قبلی * 1-alpha است.
اهمیت: بالااکثر تحلیلگران هنوز هم از تکنیک متوسط در حال حرکت (تحت پوشش بعدی) برای پیش بینی استفاده می کنند ، اگرچه از حرکت نمایی کارآمدتر است ، زیرا درک آن آسان است. با این حال ، تحلیلگران خوب برای افزایش ارزش پیش بینی های خود ، تکنیک های هموار سازی نمایی را در جیب خود خواهند داشت.
تکنیک متوسط حرکت
توضیحات: تکنیک میانگین متحرک تحت روش پیش بینی قرار می گیرد و از میانگین مقادیر اخیر برای پیش بینی مقادیر آینده استفاده می کند. به عنوان مثال، برای پیش بینی بارندگی در ماه آوریل، میانگین بارندگی از ژانویه تا مارس را در نظر بگیرید. این ساده و در عین حال بسیار موثر است.
تکنیک شبکه های عصبی
توضیحات: شبکه های عصبی یک تکنیک هوش مصنوعی بسیار پیچیده هستند که تحلیل عصبی انسان را از طریق یک سری محاسبات و مقایسه های فوق سریع که در زمان واقعی تکامل می یابند، تکرار می کند. این تکنیک آنقدر پیچیده است که یک تحلیلگر باید از برنامه های کامپیوتری برای اجرای آن استفاده کند.
اهمیت: متوسطدر حالی که پتانسیل شبکه های عصبی از نظر تئوری نامحدود است، هنوز کمی درک شده و بنابراین غیر معمول است. برای اینکه یک تحلیلگر داده باشید به هیچ وجه نیازی به دانستن آن ندارید.
ماهیت داده ها: ماهیت داده های مفید برای شبکه های عصبی مجموعه داده هایی با اندازه های نجومی است، به این معنی که دارای 100 از 1000 فیلد و حداقل تعداد ردیف های مشابه است.
تکنیک درخت تصمیم
توضیحات: تکنیک درخت تصمیم از الگوریتم های هوش مصنوعی برای محاسبه سریع مسیرهای تصمیم گیری احتمالی و نتایج آن ها بر اساس زمان واقعی استفاده می کند. آنقدر پیچیده است که برای اجرای آن به برنامه های کامپیوتری نیاز است.
اهمیت: متوسطهمانند شبکه های عصبی، درخت های تصمیم با هوش مصنوعی بسیار کم شناخته شده اند و بنابراین در محیط های سازمانی و تحقیقاتی به طور یکسان غیرمعمول هستند.
تکنیک برنامه نویسی تکاملی
توضیحات: تکنیک برنامه نویسی تکاملی از یک سری شبکه های عصبی استفاده می کند، می بیند که هر کدام چقدر با یک نتیجه دلخواه مطابقت دارند، و تنها بهترین ها را برای آزمایش و آزمایش مجدد انتخاب می کند. آن را تکاملی می نامند زیرا شبیه فرآیند انتخاب طبیعی با حذف گزینه های ضعیف تر است.
تکنیک منطق فازی
توضیحات: منطق فازی نوعی محاسبات است که بر اساس "حقایق تقریبی" به جای حقایق ساده مانند "درست" و "نادرست" است. اساساً دو سطح طبقه بندی است. به عنوان مثال، برای گفتن اینکه آیا سیب ها خوب هستند یا خیر، ابتدا باید طبقه بندی کنید که «خوب x، y، z است». فقط در این صورت می توانید بگویید سیب خوب است. راه دیگری برای کمک به رایانه برای دیدن حقیقت مانند انسان ها: «قطعاً درست، احتمالاً درست، شاید درست، احتمالاً نادرست، قطعاً نادرست».
اهمیت: متوسطمانند سایر تکنیک های هوش مصنوعی، منطق فازی هم در محیط های تحقیقاتی و هم در محیط های شرکتی غیرمعمول است، به این معنی که در دنیای امروز اهمیت کمتری دارد.
تکنیک تحلیل متن
توضیحات: تکنیک های تجزیه و تحلیل متن تحت نوع تجزیه و تحلیل داده های کیفی قرار می گیرند و از متن برای استخراج بینش استفاده می کنند.
تکنیک برنامه نویسی
توضیحات: از تکنیک برنامه نویسی در تجزیه و تحلیل متنی استفاده می شود تا ایده ها به عبارات یکنواخت تبدیل شود و تعداد زمان ها و روش های ظاهر شدن این ایده ها را تجزیه و تحلیل کند. به همین دلیل ، برخی آن را یک روش کمی نیز می دانند. در اینجا می توانید در مورد برنامه نویسی و سایر تکنیک های کیفی اطلاعات بیشتری کسب کنید.
اهمیت: بسیار بالا. اگر یک محقق هستید که در علوم اجتماعی کار می کنید ، برنامه نویسی تکنیک های تحلیل و به دلایل خوبی است. این یک روش عالی برای افزودن سخت گیری به تجزیه و تحلیل است. گفته می شود ، در تنظیمات شرکت ها کمتر رایج است.
ماهیت داده ها: ماهیت داده های مفید برای برنامه نویسی اسناد متنی طولانی است.
روش الگوی ایده
توضیحات: تکنیک تجزیه و تحلیل الگوی ایده به عنوان مرحله دوم فرآیند در کدگذاری قرار می گیرد. هنگامی که مضامین و ایده ها کدگذاری شوند ، ممکن است تست های تجزیه و تحلیل توصیفی ساده انجام شود. برخی از افراد حتی ایده ها را خوشه می کنند!
اهمیت: بسیار بالا. اگر یک محقق هستید ، تجزیه و تحلیل الگوی ایده به اندازه خود کدگذاری مهم است.
ماهیت داده ها: ماهیت داده های مفید برای تجزیه و تحلیل الگوی ایده در حال حاضر مضامین رمزگذاری شده است.
انگیزه: انگیزه تکنیک الگوی ایده ، ردیابی ایده ها در اسناد غیرقانونی غیرقانونی است.
تکنیک فرکانس کلمه
توضیحات: فرکانس کلمه یک تکنیک کیفی است که در تقابل با برنامه نویسی است و از یک رویکرد استقرایی برای یافتن کلمات خاص در یک سند استفاده می کند تا ارتباط آن را درک کند. فرکانس کلمه در اصل تجزیه و تحلیل توصیفی از داده های کیفی است زیرا از آماری مانند میانگین ، میانه و حالت برای جمع آوری بینش استفاده می کند.
اهمیت: بالامانند سایر رویکردهای کیفی ، فرکانس کلمه در تحقیقات علوم اجتماعی بسیار مهم است ، اما در تنظیمات شرکت ها کمتر است.
ماهیت داده ها: ماهیت داده های مفید برای فرکانس کلمه اسناد طولانی و آموزنده است.
انگیزه: انگیزه فرکانس کلمه ، یافتن کلمات هدف برای تعیین ارتباط یک سند مورد نظر است.
انواع تجزیه و تحلیل داده ها در تحقیقات
انواع تجزیه و تحلیل داده ها در روش تحقیق شامل هر موردی است که در این مقاله مورد بحث قرار گرفته است. به عنوان یک لیست ، آنها:
مقداری
کیفی
ریاضی
یادگیری ماشین و هوش مصنوعی
توصیفی
تشخیص
پیش بینی کننده
تجویز شده
خوشه
طبقه بندی
پیش بینی
بهينه سازي
محتوا
روایت
گفتار
چارچوب
نظریه مبانی
شبکه های عصبی مصنوعی
درختان تصمیم گیری
برنامه نویسی تکاملی
منطق فازی
تجزیه و تحلیل متن
برنامه نویسی
تحلیل الگوی ایده
تجزیه و تحلیل کلمه
پسرفت
N Nïave Bayes
هموارسازی نمایی
میانگین متحرک
گروه
عامل
تبعیض آمیز خطی
انواع تجزیه و تحلیل داده ها در تحقیقات کیفی
به عنوان یک لیست ، انواع تجزیه و تحلیل داده ها در تحقیقات کیفی روشهای زیر است: