Перейти к содержимому

اليوم 2: BeautifulSoup | كورس Web Scraping من الصفر

Code With Afif

0:00 / 0:00

اليوم 2: BeautifulSoup | كورس Web Scraping من الصفر

210 просмотров · 7 дней назад
Code With Afif
1 тыс. подписчиков
210 просмотров · 7 дней назад
مرحباً بكم في اليوم الثاني من كورس Web Scraping من الصفر باستخدام Python! 🐍 بعدما تعلمنا في اليوم الأول كيفية جلب كود الـ HTML بالكامل عبر Requests، نكتشف اليوم كيف نحلل هذه البيانات ونستخرج منها بدقة ما نحتاجه فقط باستخدام مكتبة BeautifulSoup (bs4). نتعرف على كيفية التعامل مع شجرة الـ HTML، الفرق بين دوال البحث find و find_all، كيفية تصفية العناصر بالـ Classes والـ IDs، واستخراج النصوص الصافية بدون وسوم. --- 📌 ماذا ستتعلم في هذا الفيديو؟ ✅ لماذا نحتاج مكتبة BeautifulSoup مع Requests كفريق عمل متكامل؟ ✅ تثبيت واستدعاء المكتبة بشكل صحيح (pip install beautifulsoup4 / bs4). ✅ تحويل كود الـ HTML إلى كائن سوب قابل للبحث عبر html.parser. ✅ دور وسوم الـ HTML الأساسية (h1, p, a, div, small) في تحديد مكان البيانات. ✅ شرح دالة find() وآلية بحثها من أعلى الصفحة وتوقفها عند أول عنصر مطابق. ✅ الفرق الجوهري بين find() و find_all() واسترجاع قائمة بكل العناصر المتطابقة. ✅ استخراج النصوص الصافية فقط باستخدام خاصية .text. ✅ البحث الدقيق والمتقدم عن طريق الفلاتر (Class Filtering بـ class_ و IDs). ✅ الفرق بين Class و ID في هيكلة صفحات الويب وكيفية استغلالهما برمجياً. ✅ تطبيق عملي كامل: استخراج أول Quote وعنوان الصفحة وتطبيق أفضل ممارسات التحقق. --- ⏱️ الفصول والتقسيم الزمني الكامل (Timestamps): 00:00 - تذكير بالدرس السابق والمشكل مع Requests 03:22 - علاش كنحتاجو BeautifulSoup وتثبيتها (bs4) 05:12 - تحويل HTML إلى كائن BeautifulSoup (html.parser) 07:18 - فهم الـ Tags في HTML (h1, p, a, div) 08:33 - البحث عن أول عنصر باستخدام find() 11:00 - الفرق بين find() و find_all() 13:31 - استخراج النص الصافي فقط (.text) 14:50 - البحث الدقيق بالكلاسات (class_) والـ ID 20:18 - مثال تطبيقي شامل لاستخراج العنوان وأول مقولة --- #Python #WebScraping #BeautifulSoup #BS4 #HTML #Parsing #CodeWithAfif #تعلم_بايثون #بايثون #برمجة