Site Contact & Lead Scraper
Pricing
Pay per usage
Go to Apify Store
Site Contact & Lead Scraper
Extract emails, phones, social media links and addresses from any website in seconds. No external APIs or keys needed.
Pricing
Pay per usage
Rating
0.0
(0)
Developer
Perria
Maintained by CommunityActor stats
0
Bookmarked
2
Total users
1
Monthly active users
7 days ago
Last modified
Categories
Share
Extrae emails, teléfonos, redes sociales y direcciones físicas de cualquier sitio web en segundos. Sin APIs externas, sin configuraciones complicadas. Solo proporciona una URL y obtén los datos de contacto listos para usar.
¿Qué extrae?
- Emails — detectados por regex, filtrando placeholders y ejemplos falsos.
- Teléfonos — formato internacional (mínimo 7, máximo 15 dígitos).
- Redes sociales — enlaces a Facebook, Instagram, LinkedIn, X (Twitter) y TikTok.
- Dirección física — desde microdatos schema.org o patrones de texto.
Cómo usarlo
Input
| Campo | Tipo | Default | Descripción |
|---|---|---|---|
startUrls | array (requerido) | [] | URLs o dominios a rastrear |
maxCrawlDepth | integer | 2 | Profundidad máxima de rastreo (1–5) |
maxRequestsPerCrawl | integer | 50 | Máximo de páginas por dominio (1–500) |
Ejemplo de input
{"startUrls": ["https://apify.com","microsoft.com"],"maxCrawlDepth": 2,"maxRequestsPerCrawl": 50}
Ejemplo de output (por dominio)
{"domain": "apify.com","url": "https://apify.com","emails": ["support@apify.com"],"phones": [],"socialMedia": {"linkedin": "https://www.linkedin.com/company/apifytech","x": "https://x.com/apify_platform","facebook": "https://www.facebook.com/apifytech"},"address": "Na Strži 1709/8, Nusle, 140 00 Praha 4, Czech Republic","pagesVisited": 23,"contactCount": 5}
Cómo funciona
- CheerioCrawler visita la home y páginas típicas de contacto (
/contact,/about,/contacto,/sobre-nosotros), además de los enlaces del footer. - Extrae datos con regex (emails, teléfonos), selectores CSS (redes sociales) y microdatos schema.org (dirección).
- Si un dominio no produce resultados con Cheerio, se activa un fallback con PlaywrightCrawler para renderizar páginas que dependen de JavaScript.
- Los resultados se deduplican por dominio y se guardan en el Dataset.
Límites y notas
- No requiere API keys ni servicios de terceros (Hunter.io, Clearbit, etc.).
- No accede a contenido protegido por login o CAPTCHA.
- No valida la entrega de emails (solo verifica formato).
- Respeta
maxRequestsPerCrawlpor dominio para controlar el uso de recursos.