Coğrafi hedefli web scraping, belirli bir coğrafi konumdaki kullanıcı gibi görünerek web sitelerinden veri çıkarmak için proxy sunucuları kullanma sürecidir. Bu teknik, işletmelerin bölgesel engelleri aşmasına, yerelleştirilmiş içeriğe erişmesine ve ülkeye, eyalete veya şehre göre değişen doğru pazar istihbaratı toplamasına olanak tanır. İstekleri GProxy'nin küresel ağı üzerinden yönlendiren geliştiriciler, scraper'larının yerel bir tüketiciyle aynı verileri görmesini sağlayabilir; bu da fiyat izleme, SEO analizi ve reklam doğrulama için kritiktir.
Coğrafi konumun mekaniği ve neden önemli olduğu
Web siteleri ziyaretçinin konumunu öncelikle IP adresi üzerinden belirler. Bir istek sunucuya ulaştığında, sunucu IP'yi bir coğrafi konum veritabanıyla (MaxMind veya IP2Location gibi) karşılaştırır. Bu veritabanları IP aralıklarını ülke, ISP ve çoğu zaman şehir veya posta kodu dahil olmak üzere belirli fiziksel konumlara eşler. Bir scraper, Japon bir e-ticaret sitesine erişmek için Virginia'daki bir veri merkezi IP'sini kullanırsa, site sayfanın farklı bir sürümünü sunabilir, farklı para birimi gösterebilir veya sınır ötesi scraping'i önlemek için isteği tamamen engelleyebilir.
IP adresinin ötesinde, modern web siteleri konumu doğrulamak için ikincil sinyaller de kullanır. Bunlar şunlardır:
- HTTP başlıkları:
Accept-Languagebaşlığı sunucuya kullanıcının hangi dili tercih ettiğini bildirir. Alman bir IP ileen-USdil başlığı arasındaki uyumsuzluk anti-bot mekanizmalarını tetikleyebilir. - Saat dilimi: Tarayıcının yerel saatini tespit etmek için JavaScript kullanılabilir. IP Londra'yı işaret ediyorsa ama sistem saati Pacific Standard Time gösteriyorsa, scraper işaretlenir.
- CDN uç sunucuları: Cloudflare veya Akamai gibi içerik dağıtım ağları (CDN) trafiği en yakın uç sunucuya yönlendirir. Bir istek beklenen bölgesel uç sunucuyu atlarsa, daha yakından incelenebilir.
Büyük ölçekli veri toplamada hassasiyet pazarlık konusu değildir. GProxy'nin coğrafi hedefli proxy'sini kullanmak tüm bu sinyallerin hizalanmasını sağlar ve meşru bir yerel kullanıcıyı taklit eden sorunsuz bir deneyim sunar. Bu, verilerin aynı şehirdeki mahalleler arasında bile değiştiği "hiper-yerel" scraping için özellikle hayati önemdedir.

Coğrafi hedefli scraping için stratejik kullanım senaryoları
Yerelleştirilmiş veri ihtiyacı birçok sektöre yayılır. Coğrafi hedefleme olmadan toplanan veriler genellikle "genel" olur veya veri merkezinin konumunu yansıtır ki bu rekabet analizi için nadiren işe yarar.
1. E-ticarette fiyat istihbaratı
Amazon, Walmart ve Target gibi büyük perakendeciler dinamik fiyatlandırma modelleri kullanır. Aynı SKU'nun fiyatı; yerel rekabet, kargo maliyetleri ve bölgesel talep nedeniyle kullanıcının posta koduna göre değişebilir. Pazarın gerçek resmini görmek için scraper'ların birden fazla metropol bölgesindeki proxy'ler arasında rotasyon yapması gerekir. Örneğin bir perakendeci, bölgesel pazarlama harcamasını ayarlamak için belirli bir televizyonun New York ve Los Angeles fiyatlarını karşılaştırmak isteyebilir.
2. SEO ve SERP izleme
Arama motoru sonuç sayfaları (SERP) yüksek düzeyde kişiselleştirilmiştir. Chicago'da yapılan "en iyi pizza" araması, Roma'daki aynı aramadan tamamen farklı sonuçlar verir. SEO uzmanları farklı bölgelerdeki anahtar kelime sıralamalarını takip etmek için coğrafi hedefli proxy'ler kullanır. Bu, "Local Pack"i (harita sonuçlarını) izlemelerine ve müşterilerinin doğru kitleye görünür olmasını sağlamalarına imkân verir. GProxy'nin residential proxy'leri burada idealdir, çünkü arama motorları veri merkezi IP aralıklarına karşı özellikle hassastır.
3. Reklam doğrulama ve uyumluluk
Reklamverenlerin, reklamlarının doğru sitelerde ve doğru bölgelerde göründüğünden ve "cloaking" yapılmadığından emin olması gerekir. Reklam dolandırıcılığı genellikle bir ülkedeki kullanıcılara meşru reklamlar gösterirken diğerlerine zararlı içerik sunmayı içerir. Markalar, farklı ülkelerdeki proxy'leri kullanarak yerelleştirilmiş kampanyalarının planlandığı gibi çalıştığını ve marka güvenliğinin bölgesel kötü niyetli aktörler tarafından tehlikeye atılmadığını doğrulayabilir.
4. Seyahat ve konaklama
Havayolları ve oteller "bölgesel fiyatlandırma" konusunda ün salmıştır. Londra'dan New York'a bir uçuş, Birleşik Krallık merkezli bir IP'den rezerve edildiğinde ABD merkezli bir IP'ye kıyasla farklı fiyatlanabilir. Toplayıcılar ve seyahat acenteleri, müşterilerine en iyi fırsatları bulmak ve küresel envanterin tamamına erişmek için coğrafi hedefli proxy'ler kullanır.
Coğrafi hedefleme için doğru proxy türünü seçmek
Her proxy aynı değildir. Veri merkezi, residential ve mobil proxy'ler arasındaki seçim, hedef sitenin güvenlik düzeyine ve gereken coğrafi hassasiyete bağlıdır.
| Proxy türü | Coğrafi hassasiyet | Tespit riski | Maliyet | En iyi kullanım senaryosu |
|---|---|---|---|---|
| Veri merkezi | Ülke/Bölge | Yüksek | Düşük | Düşük güvenlikli sitelerde yüksek hızlı scraping. |
| Residential | Şehir/ISP/Posta kodu | Düşük | Orta | SEO, e-ticaret, SERP scraping. |
| Mobil | Operatör/Şehir | Çok düşük | Yüksek | Sosyal medya, yüksek güvenlikli uygulama scraping'i. |
Residential proxy'ler çoğu coğrafi hedefli görev için altın standarttır. Bu IP'ler internet servis sağlayıcıları (ISP) tarafından gerçek hanelere atandığından, organik trafikten ayırt edilemezler. GProxy devasa bir residential IP havuzuna erişim sunar ve şehir düzeyine kadar ayrıntılı hedefleme yapmanıza imkân verir. Bu, veri merkezi alt ağlarının tamamını sık sık kara listeye alan PerimeterX veya Akamai gibi gelişmiş anti-bot çözümlerini aşmak için şarttır.

Teknik uygulama: Python ve GProxy ile scraping
Scraping betiğinize coğrafi hedefleme eklemek basittir. GProxy dahil çoğu proxy sağlayıcısı, hedef konumu proxy kimlik doğrulama dizesi içinde veya özel bir API uç noktası aracılığıyla belirtmenize izin verir.
Aşağıda, residential proxy kullanarak bir web sitesinin yerelleştirilmiş sürümünü çekmek için Python requests kütüphanesini kullanan bir örnek var. Bu senaryoda belirli bir şehri hedefliyoruz (örneğin Londra, Birleşik Krallık).
import requests
# GProxy residential proxy kimlik bilgileri
# Biçim: username-country-GB-city-London:password
proxy_host = "proxy.gproxy.com"
proxy_port = "1000"
username = "your_username-country-GB-city-London"
password = "your_password"
proxies = {
"http": f"http://{username}:{password}@{proxy_host}:{proxy_port}",
"https": f"http://{username}:{password}@{proxy_host}:{proxy_port}",
}
target_url = "https://www.example-ecommerce.com/product-page"
headers = {
"User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/115.0.0.0 Safari/537.36",
"Accept-Language": "en-GB,en;q=0.9"
}
try:
response = requests.get(target_url, proxies=proxies, headers=headers, timeout=30)
print(f"Status Code: {response.status_code}")
# İçeriğin yerelleştirilmiş olduğunu doğrula
if "£" in response.text:
print("Successfully accessed the UK version of the site.")
else:
print("Content may not be localized correctly.")
except Exception as e:
print(f"Error: {e}")
Sticky oturumlar ile rotasyonlu proxy'ler arasında seçim
Scraping yaparken rotasyonlu proxy'ler ile sticky oturumlar arasında karar vermeniz gerekir. Binlerce ayrı ürün sayfasını çekiyorsanız, rotasyonlu proxy (her isteğin yeni bir IP aldığı yapı) daha verimli ve takibi daha zordur. Ancak sepete ürün ekleyip ödeme adımına geçmek gibi çok adımlı bir işlem yapmanız gerekiyorsa, sticky oturuma ihtiyacınız vardır. Sticky oturum, belirli bir süre boyunca (örneğin 10–30 dakika) aynı IP adresini korumanızı sağlar; böylece site IP değişikliği yüzünden oturumunuzu kapatmaz veya oturum verilerinizi silmez.
Gelişmiş anti-bot önlemlerini aşmak
Scraping teknolojisi geliştikçe savunmalar da gelişiyor. Web siteleri artık botları tespit etmek için davranışsal analiz ve tarayıcı parmak izi kullanıyor. Mükemmel bir coğrafi hedefli IP'yle bile, "parmak izi" tutarsızsa bir scraper yakalanabilir.
- TLS parmak izi: Web siteleri, istemcinizin (örneğin Python'un
requestsveyaurllibkütüphanesinin) TLS el sıkışmasını nasıl başlattığını analiz eder. Bunu aşmak için Chrome gibi gerçek bir tarayıcının TLS el sıkışmasını taklit edebilencurl_cffiveyahttpxgibi kütüphaneleri kullanın. - Başlık tutarlılığı: Proxy'niz Paris'teyse ama
Accept-Languagebaşlığınızzh-CN(Çince) olarak ayarlıysa büyük olasılıkla engellenirsiniz. Başlıklarınızı daima proxy'nizin konumuyla hizalayın. - JavaScript çalıştırma: Birçok site "ara sayfa" kullanır (Cloudflare'ın 5 saniyelik doğrulaması gibi). Bu durumlarda basit bir HTTP istemcisi yetmez. JavaScript'i çalıştırıp doğrulamayı geçmek için GProxy'nin residential IP'leriyle birlikte Playwright veya Selenium gibi bir headless tarayıcıya ihtiyacınız olabilir.
- Canvas parmak izi: Donanım ve yazılım yapılandırmasını tespit etmek için tarayıcıda gizli bir görüntü çizilmesini içerir. Playwright için "stealth" eklentileri kullanmak bu değerleri rastgeleleştirmeye yardımcı olur.
Küresel veri toplama için en iyi uygulamalar
Yüksek başarı oranını korumak ve IP yasaklarından kaçınmak için şu sektör uygulamalarını izleyin:
- Robots.txt'ye saygı gösterin: Her yargı bölgesinde hukuken bağlayıcı olmasa da robots.txt'ye uymak radarın altında kalmanıza ve hukuki sorunlardan kaçınmanıza yardımcı olur.
- Rastgele gecikmeler ekleyin: İstekleri asla sabit aralıklarla göndermeyin. İnsan gezinme davranışını taklit etmek için 2 ile 10 saniye arasında bir "jitter" (rastgele gecikme) kullanın.
- Proxy sağlığını izleyin: Proxy'lerinizin başarı oranını düzenli olarak kontrol edin. Belirli bir bölge (örneğin Almanya) 403 Forbidden hataları döndürmeye başlarsa, o havuzu rotasyona sokmanın veya başlık yapılandırmanızı gözden geçirmenin zamanı gelmiş olabilir.
- Yerelleştirilmiş User-Agent kullanın: Bazı siteler mobil ve masaüstü kullanıcılarına farklı düzenler sunar. User-Agent'ınızı taklit etmek istediğiniz cihaz türüyle eşleştirin.
GProxy, otomatik bir rotasyon motoru sunarak bu süreci basitleştirir. Binlerce IP'yi elle yönetmek yerine tek bir giriş noktasına bağlanırsınız; rotasyon ve coğrafi hedefleme mantığını sistem arka planda halleder. Bu, kodunuzun karmaşıklığını azaltır ve scraping altyapınızın ömrünü uzatır.
Öne çıkanlar
Coğrafi hedefli web scraping artık bir lüks değil; küreselleşmiş bir pazarda faaliyet gösteren veri odaklı her kuruluş için zorunluluktur. Residential proxy'lerden yararlanarak bölgesel kısıtlamaları aşabilir ve dünyanın her yerindeki yerel kullanıcılarla aynı verilere erişebilirsiniz.
- Pratik ipucu 1: Tespit riskini azaltmak için HTTP
Accept-LanguageveRefererbaşlıklarınızı daima proxy'nizin coğrafi konumuyla hizalayın. - Pratik ipucu 2: Ağır anti-bot korumalı sitelerde, maliyeti daha yüksek olsa bile veri merkezi IP'leri yerine residential veya mobil proxy'leri tercih edin; daha yüksek başarı oranı sayesinde ROI daha iyi olur.
- Pratik ipucu 3: Çok sayfalı iş akışları için sticky oturumları, tek sayfadan yapılan büyük ölçekli veri çıkarma işleri için rotasyonlu proxy'leri kullanın.
GProxy'nin güçlü ağından yararlanarak ve bu rehberde anlatılan teknik stratejileri izleyerek, dünyanın herhangi bir köşesinden doğru ve yerelleştirilmiş veri toplayabilen dayanıklı bir scraping mimarisi kurabilirsiniz.
Bunları da okuyun
Facebook Ads için Proxy: Her Konumdan Reklam Yayınlama
Twitch için proxy'ler: yayın ve izlenme artırma
Trafik arbitrajı için proxy'ler: multi-accounting ve cloaking
Yapay zekâ için proxy'ler: ChatGPT, Midjourney, Claude erişimi
E-posta Pazarlaması ve Toplu Gönderim için Proxy'ler
