Site Contact & Lead Scraper avatar

Site Contact & Lead Scraper

Pricing

Pay per usage

Go to Apify Store
Site Contact & Lead Scraper

Site Contact & Lead Scraper

Extract emails, phones, social media links and addresses from any website in seconds. No external APIs or keys needed.

Pricing

Pay per usage

Rating

0.0

(0)

Developer

Perria

Perria

Maintained by Community

Actor stats

0

Bookmarked

2

Total users

1

Monthly active users

7 days ago

Last modified

Share

Extrae emails, teléfonos, redes sociales y direcciones físicas de cualquier sitio web en segundos. Sin APIs externas, sin configuraciones complicadas. Solo proporciona una URL y obtén los datos de contacto listos para usar.

¿Qué extrae?

  • Emails — detectados por regex, filtrando placeholders y ejemplos falsos.
  • Teléfonos — formato internacional (mínimo 7, máximo 15 dígitos).
  • Redes sociales — enlaces a Facebook, Instagram, LinkedIn, X (Twitter) y TikTok.
  • Dirección física — desde microdatos schema.org o patrones de texto.

Cómo usarlo

Input

CampoTipoDefaultDescripción
startUrlsarray (requerido)[]URLs o dominios a rastrear
maxCrawlDepthinteger2Profundidad máxima de rastreo (1–5)
maxRequestsPerCrawlinteger50Máximo de páginas por dominio (1–500)

Ejemplo de input

{
"startUrls": [
"https://apify.com",
"microsoft.com"
],
"maxCrawlDepth": 2,
"maxRequestsPerCrawl": 50
}

Ejemplo de output (por dominio)

{
"domain": "apify.com",
"url": "https://apify.com",
"emails": ["support@apify.com"],
"phones": [],
"socialMedia": {
"linkedin": "https://www.linkedin.com/company/apifytech",
"x": "https://x.com/apify_platform",
"facebook": "https://www.facebook.com/apifytech"
},
"address": "Na Strži 1709/8, Nusle, 140 00 Praha 4, Czech Republic",
"pagesVisited": 23,
"contactCount": 5
}

Cómo funciona

  1. CheerioCrawler visita la home y páginas típicas de contacto (/contact, /about, /contacto, /sobre-nosotros), además de los enlaces del footer.
  2. Extrae datos con regex (emails, teléfonos), selectores CSS (redes sociales) y microdatos schema.org (dirección).
  3. Si un dominio no produce resultados con Cheerio, se activa un fallback con PlaywrightCrawler para renderizar páginas que dependen de JavaScript.
  4. Los resultados se deduplican por dominio y se guardan en el Dataset.

Límites y notas

  • No requiere API keys ni servicios de terceros (Hunter.io, Clearbit, etc.).
  • No accede a contenido protegido por login o CAPTCHA.
  • No valida la entrega de emails (solo verifica formato).
  • Respeta maxRequestsPerCrawl por dominio para controlar el uso de recursos.