اليوم 3: Extracting Multiple Elements | كورس Web Scraping من الصفر
Code With Afif
0:00 / 0:00
اليوم 3: Extracting Multiple Elements | كورس Web Scraping من الصفر
21 просмотр · 8 часов назад
Code With Afif
958 подписчиков
21 просмотр · 8 часов назад
مرحباً بكم في اليوم الثالث من كورس Web Scraping من الصفر باستخدام Python! 🐍
في هذا الدرس، ننتقل من مرحلة استخراج عنصر واحد إلى استخراج كافة العناصر المتكررة في الصفحة وتنظيمها، بدلاً من طباعة النصوص بشكل عشوائي داخل التيرمينال.
نتعلم كيفية دمج دالتي find_all و find معاً، واستخدام حلقة التكرار (for loop) للمرور على كل اقتباس، تنظيف النصوص من الفراغات الزائدة عبر .strip()، وهيكلة البيانات داخل قائمة من القواميس (List of Dictionaries) تمهيداً لحفظها في ملفات CSV و JSON أو قواعد البيانات.
---
📌 ماذا ستتعلم في هذا الفيديو؟
✅ الفرق بين جلب عنصر واحد وجلب عناصر متعددة وتخزينها في قائمة (List).
✅ استخدام soup.find_all() لاستخراج جميع بطاقات الاقتباسات (div.quote).
✅ المرور عبر العناصر عنصراً بعنصر باستخدام حلقة التكرار (for loop).
✅ استخراج نصوص الاقتباسات وأسماء الكتاب بشكل منفصل لكل بطاقة باستخدام find().
✅ تنظيف النصوص المنسقة وإزالة المسافات والأسطر الفارغة الزائدة باستخدام .strip().
✅ هيكلة وتنظيم بيانات كل مقولة وكاتبها داخل Dictionary.
✅ تجميع القواميس داخل List مركزية باستخدام دالة append().
✅ استعراض البيانات واستخراج القيم بواسطة الـ Keys في بايثون.
✅ فهم مسار تدفق البيانات (Scrape - Collect - Organize - Save) للتحضير للدروس القادمة.
---
⏱️ الفصول والتقسيم الزمني الكامل (Timestamps):
00:00 - مقدمة وهدف الدرس
00:50 - تذكير بالفرق بين find() و find_all()
02:28 - جلب صفحة الويب والتحقق من الاستجابة (Status Code 200)
04:24 - استخراج جميع العناصر باستخدام find_all()
06:38 - المرور على كل عنصر بالـ For Loop
08:31 - استخراج نص المقولة واسم الكاتب
14:12 - تنظيف النصوص وإزالة الفراغات بـ strip()
15:29 - تنظيم البيانات في Dictionaries و List
24:16 - خلاصة ومراجعة مسار استخراج وتنظيم البيانات
---
#Python #WebScraping #BeautifulSoup #BS4 #ForLoop #DataStructures #CodeWithAfif #تعلم_بايثون #بايثون #برمجة