
Python ve Scrapy ile Web Scraping Kursu
Python ve Scrapy — mevcut en güçlü web kazıma framework'lerinden biri — kullanarak herhangi bir web sitesinden veri toplamayı öğreneceksin. Bu kurs, seni ortam kurulumundan, sayfalama, anti-bot önlemleri ve JavaScript işlenmiş sayfaları yöneten, üretime hazır örümcekler oluşturmaya kadar götürüyor. Kursun sonunda, bir portföy projen ve veri toplamayı büyük ölçekte otomatikleştirmek için pratik becerilerin olacak.
Neler öğreneceksiniz:
Başlangıçtan itibaren profesyonel bir Python ve Scrapy geliştirme ortamı yapılandıracaksın.
Sayfalama bağlantılarını takip eden ve tüm çok sayfalı web sitelerini otomatik olarak tarayan örümcekler oluşturacaksın.
Yapılandırılmış verileri CSV, JSON, SQLite ve MongoDB'ye çıkaracak, temizleyecek ve depolayacaksın.
Yaygın anti-kazıma savunmalarını atlatmak için proxy döndürme, kullanıcı aracısı taklidi ve AutoThrottle uygulayacaksın.
Playwright entegrasyonunu kullanarak JavaScript işlenmiş sayfaları ve tek sayfa uygulamaları kazıyacaksın.
Yeniden kullanılabilir iş hatları, öğe şemaları ve otomatik zamanlama ile uçtan uca kazıma projeleri tasarlayacaksın.
Nasıl pratik şekilde çalışırsınız Python ve Scrapy ile Web Scraping Kursu
Nasıl pratik yaparsınız Python ve Scrapy ile Web Scraping Kursu
Şirketiniz için ekibinizi eğitmek isteyenlere özel
Dedika Kurumsal'da, kurs kendi işinize ve şirketinizin ihtiyaçlarına uygun egzersizler ve örneklerle gelir.
Kurs İçeriği
8 Bölüm • 37 Ders4 ile 360 saat arasında (siz karar verin)
Bölüm 1GizleDetayları GizleDetayları GörPython ve Scrapy Ortam Kurulumu
Python ve Scrapy Ortam Kurulumu
Ders 1 • Python Projeleri için Sanal Ortamlar
Proje bağımlılıklarını temiz bir şekilde yönetmek için izole sanal ortamlar oluştur. Yalıtım, birden çok projede paket çakışmalarını önler.
Ders 2 • Scrapy Projeleri için Kod Düzenleyici Kurulumu
Python desteği, linting ve sözdizimi vurgulaması olan bir kod düzenleyici yapılandır. Doğru araçlar, geliştirmeyi hızlandırır ve sözdizimi hatalarını azaltır.
Ders 3 • Scrapy ve Bağımlılıklarını Yükleme
Scrapy'yi pip ile yükle ve yaygın bağımlılık sorunlarını çöz. Temiz bir kurulum, ortamın örümcek geliştirmeye hazır olduğunu onaylar.
Ders 4 • Python Kurulumu ve Yapılandırması
Python'u yükle ve komut satırı erişimi için PATH değişkenlerini yapılandır. Buradaki doğru kurulum, kurs boyunca ortam hatalarını önler.
Bölüm 2GizleDetayları GizleDetayları GörKazıyıcılar için Web Temelleri
Kazıyıcılar için Web Temelleri
Ders 1 • Kazıyıcı Araştırması için Tarayıcı Geliştirici Araçları
Öğeleri incelemek, ağ trafiğini izlemek ve seçicileri kopyalamak için tarayıcı geliştirici araçlarını kullan. Bu araştırma iş akışı, örümcek tasarımını doğrudan şekillendirir.
Ders 2 • Gelişmiş Seçim için XPath İfadeleri
CSS'nin tek başına yapamayacağından daha fazla esneklikle DOM'da gezinmek için XPath ifadeleri yaz. XPath, karmaşık geçiş modellerini işler.
Ders 3 • HTTP İstekleri ve Yanıtları Nasıl Çalışır
Bir HTTP isteğinin tarayıcıdan sunucuya ve geri dönüşünün yaşam döngüsünü izle. Bu model, Scrapy'nin sayfaları getirirken neyi kopyaladığını açıklar.
Ders 4 • Veri Hedefleme için CSS Seçiciler
Bir HTML belgesindeki belirli öğeleri belirlemek için CSS seçici sözdizimini kullan. Bu seçiciler, Scrapy örümceklerinde birincil hedefleme aracıdır.
Ders 5 • HTML Yapısı ve DOM
HTML belgelerini iç içe geçmiş ağaç yapıları olarak oku ve yorumla. DOM'u anlamak, doğru CSS ve XPath seçicileri yazmak için gereklidir.
Bölüm 3GizleDetayları GizleDetayları Görİlk Scrapy Örümceğini Oluşturma
İlk Scrapy Örümceğini Oluşturma
Ders 1 • Örümcekleri Çalıştırma ve Hata Ayıklama
scrapy crawl komutuyla örümcekleri çalıştır ve günlük çıktısını yorumla. Hata ayıklama becerileri, bozuk örümceklerde harcanan zamanı azaltır.
Ders 2 • Bir Scrapy Örümcek Sınıfının Anatomisi
Spider temel sınıfını ve gerekli özniteliklerini ve yöntemlerini incele. Her örümcek bu yapıyı miras alır, bu nedenle ustalaşmak temeldir.
Ders 3 • Seçicilerle Veri Çıkarma
Metin ve öznitelikleri çıkarmak için parse yöntemi içinde CSS ve XPath seçicilerini uygula. Doğru çıkarma, herhangi bir örümceğin temel becerisidir.
Ders 4 • Scrapy Proje Yapısı Açıklandı
Bir Scrapy projesi oluştur ve oluşturulan her dosyanın rolünü anla. Yapıyı bilmek, yanlış yere konulmuş kodu ve yapılandırma hatalarını önler.
Bölüm 4GizleDetayları GizleDetayları GörScrapy Öğeleri ve Veri Modelleme
Scrapy Öğeleri ve Veri Modelleme
Ders 1 • İşlemcilerle Veri Temizleme
Alan değerlerini temizlemek, dönüştürmek ve normalleştirmek için özel işlemci işlevleri yaz. Yükleyici seviyesinde temiz veri, aşağı akış iş hattı karmaşıklığını azaltır.
Ders 2 • Scrapy Öğelerini Tanımlama
Kazınmış kayıtları temsil etmek için türlenmiş alanlara sahip Item sınıfları bildir. Items, bir projedeki tüm örümceklerde tutarlı bir şema uygular.
Ders 3 • Temiz Veri İçin ItemLoader Kullanma
Alan değerlerinde girdi ve çıktı işlemeyi otomatikleştirmek için ItemLoader'ları uygula. Yükleyiciler, bakım kolaylığı için çıkarma mantığını temizleme mantığından ayırır.
Ders 4 • Kazınmış Verileri Doğrulama
Depolamaya ulaşmadan önce bozuk kayıtları yakalamak için alan düzeyinde doğrulama ekle. Erken doğrulama, bozuk verilerin iş hatlarına girmesini önler.
Bölüm 5GizleDetayları GizleDetayları GörBirden Çok Sayfa ve Siteyi Tarama
Birden Çok Sayfa ve Siteyi Tarama
Ders 1 • Scrapy İstekleriyle Bağlantıları Takip Etme
Tarayıcıya ek URL'ler getirmesini söylemek için parse yöntemlerinden scrapy.Request nesneleri ver. Bağlantı takibi, tam site taramalarının arkasındaki mekanizmadır.
Ders 2 • Kural Tabanlı Tarama için CrawlSpider Kullanma
Bağlantı takip kalıplarını bildirimsel olarak tanımlamak için CrawlSpider alt sınıfından ve Rule nesnelerinden yararlan. Rule'lar, büyük, yapılandırılmış siteler için tekrar eden kod miktarını azaltır.
Ders 3 • Tarama Derinliğini ve Kapsamını Yönetme
Taramaları odaklanmış ve verimli tutmak için derinlik sınırları ve URL filtreleri yapılandır. Kapsam kontrolü, kaynakları boşa harcayan kontrolsüz taramaları önler.
Ders 4 • Sayfalama Stratejileri
Numaralandırılmış ve imleç tabanlı sayfalama düzenlerinde sonraki sayfa bağlantılarını algıla ve takip et. Sayfalamayı yönetmek, tam veri kümesi çıkarmanın kilidini açar.
Ders 5 • İstekler Arasında Veri Aktarma
Bir istekten diğerine bağlam taşımak için cb_kwargs ve meta sözlüklerini kullan. Paylaşılan bağlam, çok sayfalı kayıt birleştirmeyi sağlar.
Bölüm 6GizleDetayları GizleDetayları GörScrapy İş Hatları ve Veri Depolama
Scrapy İş Hatları ve Veri Depolama
Ders 1 • Verileri CSV ve JSON'a Dışa Aktarma
Öğeleri düz dosyalara yazmak için Scrapy'nin yerleşik besleme dışa aktarıcılarını kullan. Düz dosya dışa aktarımları, örümcekten kullanılabilir veriye giden en hızlı yoldur.
Ders 2 • Özel İş Hattı Bileşenleri Yazma
Depolamadan önce öğeleri temizleyen, yineleme kontrolü yapan veya zenginleştiren iş hattı sınıfları oluştur. Özel iş hatları, dışa aktarıcıların ifade edemediği mantığı işler.
Ders 3 • Verileri MongoDB'de Depolama
PyMongo kullanarak öğeleri bir MongoDB koleksiyonuna ekleyen bir iş hattı yaz. Belge depolama, değişken veya iç içe alanlara sahip kazınmış veriler için uygundur.
Ders 4 • Verileri Bir SQL Veritabanında Depolama
Bir iş hattını ilişkisel bir veritabanına bağla ve öğeleri satır satır ekle. Veritabanı depolama, sorgulama ve uzun vadeli veri yönetimini sağlar.
Ders 5 • İş Hattı Mimarisi
Öğelerin örümceklerden sıralı iş hattı bileşenleri aracılığıyla nasıl aktığını izle. Bu akışı anlamak, etkili işleme zincirleri tasarlamak için gereklidir.
Bölüm 7GizleDetayları GizleDetayları GörAnti-Kazıma Önlemlerini Ele Alma
Anti-Kazıma Önlemlerini Ele Alma
Ders 1 • Bot Algılama Tekniklerini Anlama
Otomatik trafiği belirlemek için kullanılan sunucu tarafı sinyallerini katalogla. Algılama yöntemlerini bilmek, sonraki bölümlerde uygulanan karşı önlemleri bilgilendirir.
Ders 2 • İstekleri AutoThrottle ile Hız Sınırlama
İstek hızlarını sunucu yanıt sürelerine uyarlamak için Scrapy'nin AutoThrottle uzantısını etkinleştir. Nazik tarama, hız sınırı yasaklama riskini azaltır.
Ders 3 • Kullanıcı Temsilcilerini ve Başlıkları Döndürme
İstek başına kullanıcı temsilcisi dizelerini ve HTTP başlıklarını rastgeleleştiren ara katman yazılımı yapılandır. Başlık döndürme, bot algılamayı tetikleyen parmak izini azaltır.
Ders 4 • Vekil Döndürme Kullanma
Trafiği birden çok IP adresine dağıtmak için istekleri dönen vekil havuzları üzerinden yönlendir. Vekil döndürme, IP tabanlı yasaklamalara karşı birincil savunmadır.
Ders 5 • Çerezleri ve Oturumları Yönetme
Gerektiğinde oturumları sürdürmek veya istekleri yalıtmak için çerez işlemeyi kontrol et. Doğru oturum yönetimi, giriş duvarı bloklarını ve oturum tabanlı algılamayı önler.
Bölüm 8GizleDetayları GizleDetayları GörJavaScript ile İşlenmiş Sayfaları Kazıma
JavaScript ile İşlenmiş Sayfaları Kazıma
Ders 1 • Sonsuz Kaydırma ve Tembel Yüklemeyi Ele Alma
Kaydırma eylemlerini otomatikleştir ve gizli içeriği ortaya çıkarmak için tembel yükleme olaylarını tetikle. Bu teknikler, modern akış tarzı sayfalarda veri kümesi çıkarmayı tamamlar.
Ders 2 • JavaScript ile İşlenmiş İçeriği Belirleme
Bir kazıma stratejisi seçmeden önce sunucu tarafından işlenmiş HTML ile istemci tarafından işlenmiş içerik arasında ayrım yap. Doğru tanımlama, yanlış yaklaşımda boşa harcanan çabayı önler.
Ders 3 • Tarayıcı Otomasyonunun Performans Ödünleşimleri
Başsız tarayıcıların hızını, kaynak maliyetini ve güvenilirliğini doğrudan HTTP istekleriyle karşılaştır. Bilinçli ödünleşim kararları, projeleri sürdürülebilir ve verimli tutar.
Ders 4 • Scrapy'yi Playwright ile Entegre Etme
JavaScript'i Scrapy'nin istek iş hattı içinde işlemek için scrapy-playwright kütüphanesini kullan. Playwright entegrasyonu, API müdahalesinin mümkün olmadığı siteleri halleder.
Ders 5 • API Çağrılarını Doğrudan Ele Geçirme
Bir tarayıcının yaptığı temel API isteklerini tersine mühendislikle çöz ve bunları doğrudan Scrapy ile çağır. Doğrudan API çağrıları, tarayıcı otomasyonundan daha hızlı ve daha kararlıdır.
Geçerli tamamlama sertifikanız
Bu kurs sizin için:
Veri analisti olmak isteyenler: üçüncü taraf sağlayıcılara güvenmeden gerçek veri kümelerine ihtiyaç duyar.
Python meraklıları: eğitimleri geçip gerçekten işe yarar bir şey inşa etmeye hazırdır.
Serbest çalışan geliştiriciler: otomatik veri toplamayı faturalandırılabilir bir hizmet olarak sunmak ister.
Kariyer değiştirenler: veri veya arka uç rollerini hedefler ve somut bir portföy projesine ihtiyaç duyar.
Araştırmacılar ve akademisyenler: elle kopyalama yapmadan web verilerini tekrar tekrar toplamalıdır.
Küçük işletme sahipleri: rakiplerini izlemek veya pazar bilgilerini otomatik olarak bir araya getirmek ister.
Öğrencilerimiz ne diyor
Dersleriniz mükemmel. Bir yıllık paketi aldım ve sonunda ilgilendiğim çeşitli konuları platform değiştirmek zorunda kalmadan takip etme fırsatım var... yaptığınız her şey için teşekkür ederim, sizi başkalarına da tavsiye ettim...

Derslerin doğrudan konuya odaklanmasını ve bölümleri değiştirebilmemi, ihtiyacım olmayan içerikleri atlayabilmemi seviyorum.

İçeriği ve video sunumu ile transkripsiyon yöntemini seviyorum, bu süreci hızlandırıyor!

Platform hızlı, kullanımı kolay. İçerik çeşitliliği ve tamamlayıcı videolar öğrenmeye çok yardımcı oluyor.

Başlıca yetkinlikler
SSS
Dedika kimdir?
Sertifika Türkiye’de geçerli mi?
Kurslar ücretsiz mi?
Kursların ders yükü nedir?
Kurslar nasıl bir yapıya sahip?
Kurslar nasıl çalışıyor?
Kursların süresi nedir?
Kursların maliyeti veya fiyatı nedir?
Eğitimde uzaktan eğitim (EAD) veya online kurs nedir ve nasıl çalışır?
PDF Kursu




















