الفريق العربي للبرمجةأرشيف المنتديات · 2000 – 2023
نسخة أرشيفية للقراءة فقط — التسجيل والمشاركة مغلقان، والمحتوى محفوظ كما كان.

تخزين معلومات من مواقع

بدأه libya_programmer في 12 نوفمبر 2010 · 9 رد · 990 مشاهدة · في لغة Python
مشاركة: واتساب X فيسبوك تيليجرام
#1 صاحب الموضوع

السلام عليكم

اعمل على فكرة مشروع بسيط وهي ان اقوم بعمل سكربت بايتون يقوم بقراءة صفحة انترنيت ويقوم بتخزين المعلومات الموجودة به . بشكل ابسط يوجد موقع بيع وانا اريد ان اخزن المعلومات الموجودة به عن المنتج والسعر اليا عن طريق السكربت البايتون.

المشكلة التي تواجهني ماهي البكج المناسب التي تساعدني في استكمال عملي

وفي حالة ان الموقع دينامك كيف يمكن الوصول الى اسم المنتج والسعر

امل المساعدة بالمودل المناسب شكرا مع السلامة

#2

الموقع بيوفر api للإستخدام ؟ لو لأ يبقة حلك ال scraping

جرب http://www.crummy.com/software/BeautifulSoup/ مع http://wwwsearch.sourceforge.net/mechanize/

(map share people)

فضلا لاتقم بمراسلتي من أجل أسئلة لها أقسامها في المنتدى حتى تعم الفائدة على الجميع وللحصول على إجابات أفضل من أعضاء أكثر خبرة.
Weblog
@bitbucket
@xmonader

#3

مرحبا

أظن أن ما تطلبه مشابه لعمل محركات البحث، ابحث في ذلك الأمر.

مؤسس شبكة مواقع إجابتي أول شبكة مواقع عربية للأسئلة والأجوبة

#4

شكرا جزيلا اخي احمد على الرد ......اتمنى من الله ان يوفقني ويوفقك للخير

#5
ahmed_youssef كتب:

الموقع بيوفر api للإستخدام ؟ لو لأ يبقة حلك ال scraping

جرب http://www.crummy.com/software/BeautifulSoup/ مع http://wwwsearch.sourceforge.net/mechanize/

السلام عليكم

اخي احمد اشكرك على ردكم الكريم , جربت بيوتفل سوب ولكن وجدته يحتاج الى الكثير من الوقت وفيه الكثير من التعقيدات , اخي ابحث عن حلول اسرع

اتمنى ان تكون فهمت المطلوب

اريد معرفة المنتاجات المعروضة في موقع ما مع اثمانها مع وجود امكانية لتنفيذ السكربت على مواقع مختلفة

امل ان اجد شيء في المصادر المفتوحة يساعدني

لكم مني فائق الاحترام

#6

السلام عليكم

لازم تعرف شكل الملف فى الموقع دا وهتتغير طريقة المعالجة بناء على كل موقع حسب الإختلاف

اما وثائق BeautifulSoup فسهلة جدا فى التعلم عندك مشكلة فى اى جزئية تحديدا ؟

(map share people)

فضلا لاتقم بمراسلتي من أجل أسئلة لها أقسامها في المنتدى حتى تعم الفائدة على الجميع وللحصول على إجابات أفضل من أعضاء أكثر خبرة.
Weblog
@bitbucket
@xmonader

#7

اخي احمد شكرا على اهتمامك

لنفترض اننا نريد ان نقوم بتخزين كل المنتجات المعروضة داخل موقع ebay.com وعند زيارة الموقع المذطور نجد ان البضائع تم تصنيفها على هيئة كتلوكات وكل كتلوك ممكن ان يكون كتلوك ايضا المهم الان هو كيف يمكن الوصول كل على حده بحيت يكون عندنا مخرجات عل هيئة اسم المنتج , وصف للمنتج و السعر مثلا

انا حاولت

import urllib2

from BeautifulSoup import BeautifulSoup

page = urllib2.urlopen("http://www.ebay.com")

soup = BeautifulSoup(page)

a = soup.findAll('h')

p = soup.findAll('p')

print ' There are ', len(a),' head '

print ' There are ', len(p), 'Pergraph'

prit ' all heads in page'

for links in a:

print links

print

كيف يمكنني الوصول الى كل الكتلوكات مع التعرف على المنتجات التابعه لها

#8

يعني الموقع ebay ؟

فلو كدا فمتوفر ليه API

http://developer.ebay.com/

http://code.google.com/p/ebay-sdk-python/

(map share people)

فضلا لاتقم بمراسلتي من أجل أسئلة لها أقسامها في المنتدى حتى تعم الفائدة على الجميع وللحصول على إجابات أفضل من أعضاء أكثر خبرة.
Weblog
@bitbucket
@xmonader

#9
ahmed_youssef كتب:

يعني الموقع ebay ؟

فلو كدا فمتوفر ليه API

http://developer.ebay.com/

http://code.google.com/p/ebay-sdk-python/

اخي احمد ليس الموقع ebay ولكني قدمته كمثال هذا احدث شيء جديد الا وهو api امل الافاده في هذا الموضوع

انا اريدك ان اوضح كيفت الاستفاده من Beautiful Soup اوبجيكت والميتود

#10

انا عايز اساعدك المشكلة ان مش بتدي المشكلة بتوضيح كامل

لو الموقع مش بيوفرلك API يبقة هتعتمد على ال screen scraping ووقتها المشكلة لو اتغير شكل الصفحةاللى بتقراها لأ سبب

بإختصار كائن BeautifulSoup بياخد html text لصفحة ما وبعد كدا تقدر تبحث عن شئ معين مثلا بالإسم او الأب او المحتوي او حتي فلترات اضافية من عندك

http://www.crummy.com/software/BeautifulSoup/documentation.html#Searching%20Within%20the%20Parse%20Tree

(map share people)

فضلا لاتقم بمراسلتي من أجل أسئلة لها أقسامها في المنتدى حتى تعم الفائدة على الجميع وللحصول على إجابات أفضل من أعضاء أكثر خبرة.
Weblog
@bitbucket
@xmonader

مواضيع مشابهة