الفريق العربي للبرمجةأرشيف المنتديات · 2000 – 2023
نسخة أرشيفية للقراءة فقط — التسجيل والمشاركة مغلقان، والمحتوى محفوظ كما كان.

تصنيف المجموعات و العلاقات

بدأه الزنتاني الليبي في 2 يونيو 2011 · 4 رد · 909 مشاهدة · في الذكاء الاصطناعي وتطبيقاته
مشاركة: واتساب X فيسبوك تيليجرام
#1 صاحب الموضوع

السلام عليكم و رحمة الله و بركاته

لدي سؤال يتعلق بتحليل بيانات المواقع الاجتماعية و للعلم فلقد درست الطرق العديدة و الخوارزميات الكثيرة من تصنيف و تجميع في عقد و استخدام الاحصاء سؤالي كيف لي ان اربط ما درسته مع بحثي

على سبيل المثال

لدينا شركة معينة و بها عدد من الموظفين في اقسام مختلفة كيف لي ان اصنف العمال حسب تخصصهم ( مدير قسم , مهندس , سكرتير , إلخ )

هده الخطوة هي المهمة و هي التي لم اتحصل على إجابة عليها إلى الان

أفيدوني أفادكم الله و جزاكم الله خيرا

#2

لايضاح السؤال اكثر فرضا انه لدي الداتاست للمنتدى هدا و اريد ان اصنفها الى مشرف الموقع, مدير عام, عضو مميز, عضو شرف, أعضاء جدد. كيف لي أن احصل على training set هل اقوم انا بتدريب الداتا يدويا ام كيف

#3

قبل ان اجيبك قليل من التوضيح لضمان انك معاي:

* الخطوة صفر zero: تحتاج منبع للبيانات.

* اولا تحتاج dataset... مجموعة بيانات.

* وثانيا تحتاج آلية لإستخراج features من تلك البيانات، وبعض الكتب تسميه attribute

ثالثا تحتاج feature subset selection method لتصغيير dimensionality للخواص المستخرجة والتي تؤدي الى زيادة السرعة والاهم من هذا زيادة كفاءة النظام.

* رابعا تحتاج آلية للتصنيف والباب مفتوح جدا (العديد من الخوارزميات)

* وبعدها آلية للevaluation، وهذه تقوم بتقسيم training/testing set splits بطريقة أو بؤخرى.

* اذا كنت في خطوة 0: الباب مفتوح جدا... اذا تريد تسحب بيانات من المنتدى، هناك مكتبات وبرامج عديدة تعطيك امكانية ارسال http request وثم تخزين الresponse عندك في الكمبيوتر..

* اذا كنت في خطوة 1: تحتاج pre-processing بسيطة على البيانات التي قمت بتخزينها في الخطوة رقم 0.

* اذا كنت في خطوة 2: الباب مفتوح جدا جدا جدا (ثلاث مرات)... تستخرج اي بيانات بأي طريقة تريد كما تحب من الdataset التي حصلت عليها في خطوة 1.

* اذا كنت في خطوة 3: هناك عدة طرق ايضا، مثل IG / consistency test/ correlation eval / wrapper /etc

* اذا كنت في خطوة 4: هناك عدة طرق ايضا، SVM / C4.5 / RF / ANN / K-NN / NB / LR

* اذا كنت في خطوة 5: هناك عدة طرق. اقترح تمشي على المتعارف عليه. cross-validation و 33% training 66% testing شائعة جدا في التصنيف

ابحث في المنتدى ستحد مواضيع شبيهة

ابحث في جوجل ستجد مواضيع شبيهة

2

ملاحظة: يوجد

أعضاء في قائمة تجاهلي. لذا عدم ردي عليهم لا يدل على موافقتي الضمية لمحتويات مشاركاتهم.

sigsubway.png

#4

السلام عليكم

شكرا اخي باسوورد و اعدرني على التاخير قي الرد لاني بصراحة فقدت الامل انه احد حيرد علي

أنا معاك الى الخطوة الثانية لانها هي العائق الاساسي امامي كيف احصل على attributes هل اقوم بــــ كلسترنق و من تم ب كلاسفيكايشن او كيف لانه العائق الاساسي امامي هي هده الخطوة

و جزاك الله خيرا

#5

لا توجد طريقة محددة لاستخراج الattributes او الfeatures

غالبا الناس تالف طرق خاصة بها ولذا الاسلوب الشائع انك تبرمج برامج خاصة بك لاستخراج الattribute هذه

يعني ممكن تكتب مجموعة اسكربتات وتستخرج هذه الattributes او الfeatures

مثلا... احد الattributes ربما تكون سنة التسجيل بالمنتدى

attribute اخرى هي عدد المشاركات

attribute اخرى هي النقاط الخضراء

attribute اخرى هي القسم الذي يتميز العضو بنشاطاته

وطبعا يجب ان تبحث.. يعني بعض الattributes تكون فاشلة، وبعضها تكون ناجحة

الباب مفتوح..... فهذا هو data re-presentation.. حتى عندما تقوم بclustering تستخدم هذا

يعني في هذا المثال، سيتم التعبير عن كل عضو بواسطة vector يحتوي على الاربعة خصائص التي ذكرتهم

مثلا هذا (2011, 123, 323, c_section). حيث ان 123 هو عدد مشاركاته، و 323 هو عدد نقاطه الخضراء، و c_section هو اسم القسم الذي يشارك به (قسم برمجة c)

هذا فقط data representation كما قلت.. والباب مفتوح.. ويجب ان تبحث بنفسك وتستخلص features مناسبة

انا غالبا اكتب scripts لاستخلاص هذه الfeatures

2

ملاحظة: يوجد

أعضاء في قائمة تجاهلي. لذا عدم ردي عليهم لا يدل على موافقتي الضمية لمحتويات مشاركاتهم.

sigsubway.png

مواضيع مشابهة