مراحل اجرای الگوریتم ECLAT
مرحله اول: تبدیل دادهها به فرم عمودی
در ابتدا پایگاه داده تراکنشی خوانده میشود.
سپس برای هر قلم، لیست شناسه تراکنشهای مربوط به آن استخراج میشود.
در پایان این مرحله، پایگاه داده به مجموعهای از TID Listها تبدیل میشود.
مرحله دوم: محاسبه حمایت اقلام منفرد
برای هر قلم، تعداد عناصر موجود در TID List محاسبه میشود.
این مقدار همان حمایت آن قلم است.
اقلامی که حمایت آنها کمتر از حداقل حمایت تعیینشده باشد حذف میشوند.
مرحله سوم: تشکیل کلاسهای همارز
پس از شناسایی اقلام پرتکرار اولیه، الگوریتم آنها را در ساختارهایی به نام کلاس همارز (Equivalence Class) سازماندهی میکند.
هدف از این کار کاهش فضای جستجو و جلوگیری از تولید ترکیبهای غیرضروری است.
هر کلاس شامل مجموعهای از اقلامی است که دارای پیشوند مشترک هستند.
مرحله چهارم: تولید مجموعه اقلام جدید
الگوریتم مجموعههای بزرگتر را از روی مجموعههای قبلی تولید میکند.
برای محاسبه حمایت مجموعه جدید، به جای مراجعه به پایگاه داده، اشتراک TID Listهای مربوطه محاسبه میشود.
تعداد عناصر موجود در اشتراک، حمایت مجموعه جدید را مشخص میکند.