← Proyectos

03 · Data · Scraping · 2024

Scrapers inmobiliarios Finca Raíz

Freelance / investigación

Diseño e implementación de pipelines de extracción

Pipelines en Python para extraer listados del portal Finca Raíz con requests, Selenium y undetected-chromedriver.

ScraperPython
Finca RaízPortal
DatasetJSON/CSV

Problema

Obtener datos estructurados de un portal con protecciones anti-bot, sin romper el flujo de investigación.

Enfoque

Capa de scraping resiliente: HTTP donde alcanza, Selenium + undetected-chromedriver cuando hay challenge, normalización a dataset limpio.

Resultado

  • Extracción automatizada de listados
  • Dataset listo para análisis / ARIA
  • Manejo de bloqueos y reintentos

Capacidades

  • requests para endpoints ligeros
  • Selenium + undetected-chromedriver
  • Normalización de campos (precio, zona, m²)

Arquitectura

Python — orquestaciónrequests / Selenium — capturaCSV/JSON — salida estructuradaPythonrequestsSeleniumundetected-chromedriver

Detalle técnico

driver = uc.Chrome(options=options)
driver.get(listing_url)
cards = driver.find_elements(By.CSS_SELECTOR, ".property-card")
for card in cards:
    rows.append(parse_card(card))