داده کاوی داده های حجم زیاد با روش بسط یافته برای مدل نکاشت کاهش

Publish Year: 1399
نوع سند: مقاله کنفرانسی
زبان: Persian
View: 444

This Paper With 8 Page And PDF and WORD Format Ready To Download

  • Certificate
  • من نویسنده این مقاله هستم

این Paper در بخشهای موضوعی زیر دسته بندی شده است:

استخراج به نرم افزارهای پژوهشی:

لینک ثابت به این Paper:

شناسه ملی سند علمی:

RSETCONF04_008

تاریخ نمایه سازی: 10 دی 1399

Abstract:

پردازش داده های حجم زیاد وابسته به برنامه نویسی موازی است. تاکنون نگاشت کاهش که یکی از روش های تکراری داده کاوی در الگوریتم خوشه بندی بدون نظارت است در الگوریتم K-means استفاده شده است. اما بهبود مقیاس پذیری و کارایی این الگوریتم همواره یکی از اهداف برای داده کاوی در داده های حجم زیاد است. در اینجا یک الگوریتم بسط افته از مدل K-means پیشنهاد شده است که موجب افزایش کارایی عامل مقیاس پذیری در زمان افزایش حجم داده ها می شود. بطوری که در الگوریتم پیشنهادی، وابستگی مستقیم هر رکورد ساختار با رکورهای وضعیت موجود اعمال می شود. با ایجاد این وابستگی، هزینه های نگاشت کاهش و عملیات آغاز نگاشت تاحد زیادی کاهش می یابد. با توجه به بهبود صورت یافته در الگوریتم K-means و استفاده از روش نگاشت کاهش تکراری، میزان کارایی و مقیاس پذیری تاحد مطلوبی افزایش می یابد و آزمایشات ما این بهبودی نتایج را تایید می کنند.

Authors

مراد درخشان

استادیار، گروه مهندسی کامپیوتر و فناوری اطلاعات، دانشگاه پیام نور، تهران، ایران

جاسم قاسمی نژاد

دانشجوی کارشناسی ارشد رشته نرم افزار ،گروه مهندسی کامپیوتروفناوری اطلاعات، دانشگاه پیام نور، تهران، ایران