DR Real Estate Instagram Scraper
Pricing
Pay per usage
DR Real Estate Instagram Scraper
Scrapes Instagram posts from Dominican Republic real estate agents (Punta Cana, Cap Cana, Santo Domingo, Las Terrenas) and pre-processes them with mechanical extraction (detected prices, phones, hashtags) so you can plug in your own LLM or business logic for final structuring.
Pricing
Pay per usage
Rating
0.0
(0)
Developer
Max Medina
Maintained by CommunityActor stats
0
Bookmarked
2
Total users
1
Monthly active users
2 months ago
Last modified
Categories
Share
English · Español
Scrapes Instagram posts from Dominican Republic real estate agents (Punta Cana, Cap Cana, Santo Domingo, Las Terrenas, etc.) and applies lightweight mechanical pre-processing — no LLM involved. It's designed as a data-collection layer: you bring your own structuring logic (an LLM, your own regex, or manual review) on top of the clean, consistent fields this Actor produces.
Why this exists
Most real estate inventory in the Dominican Republic — especially around Punta Cana / Cap Cana — is listed by individual agents on Instagram rather than on centralized property portals. This Actor targets that specific gap.
What it does
- Takes a list of Instagram usernames (individual agents work best — brand
umbrella accounts like the parent
apartamentosrdskew heavily institutional/marketing content with a much lower listing ratio). - Calls
apify/instagram-post-scraperas a sub-actor to fetch recent posts. - Runs each post through mechanical extraction:
- Detected USD prices (regex on
US$X,XXX/USD X,XXXpatterns) - Detected Dominican phone numbers
- Hashtags
- Zone name mentions (matched against a fixed list of known DR zones)
- A
likelyListingboolean flag
- Detected USD prices (regex on
- Pushes one row per post to the output dataset.
What it does NOT do (by design)
- No LLM extraction. It won't tell you the actual bedroom count, whether
a price is a reservation deposit vs. the final sale price, or parse prices
that only appear baked into an image (not in the caption or Instagram's
auto-generated alt text). Validated against a 271-post real sample, the
mechanical
likelyListingflag lands close to true listing rate (~30%), but it is a signal, not a guarantee — false positives/negatives exist. - No image OCR / vision. Only text (caption + Instagram's auto alt text) is analyzed.
- No listing deduplication across accounts or over time.
If you want fully structured fields (exact price, bedrooms, m², zone,
confidence score), the recommended pattern is to pipe this Actor's dataset
through your own LLM call afterward — the captionRaw and altTextRaw
fields carry everything needed for that.
Input
| Field | Type | Description |
|---|---|---|
instagramUsernames | array of strings | Instagram usernames to scrape (no @) |
resultsLimitPerAccount | integer | Max posts per account (default 20) |
onlyLikelyListings | boolean | Drop posts without listing signals (default false) |
Output (one row per post)
{"instagramUsername": "nathalydls.apartamentosrd","agentFullName": "Nathaly de los Santos | Asesora Inmobiliaria | Inversiones","postUrl": "https://www.instagram.com/p/DaQLsYxhrOa/","postTimestamp": "2026-07-01T14:00:11.000Z","postType": "Video","captionRaw": "...","altTextRaw": "...","likesCount": 12,"commentsCount": 0,"detectedPricesUsd": [170000],"detectedPhone": "849-459-2321","detectedHashtags": ["Naco", "ApartamentoEnVenta"],"mentionedZones": ["Santo Domingo", "Naco"],"likelyListing": true,"captionWordCount": 110,"scrapedAt": "2026-07-17T15:01:34.506Z"}
Finding good target accounts
Individual agent sub-accounts under a brand (e.g. [name].apartamentosrd)
tend to have a much higher listing ratio than the parent brand account.
Look at who the parent account tags/mentions, or check its "Followed by"
list, to discover these agent accounts.
Cost
This Actor's only paid dependency is apify/instagram-post-scraper
(Apify's own actor, pay-per-event at ~$0.0017 per post — about 37% cheaper
than the generic apify/instagram-scraper, with identical data quality
validated against a 15-post side-by-side test). All processing after that
is local and free.
Español
English · Español
Extrae publicaciones de Instagram de agentes inmobiliarios de la República Dominicana (Punta Cana, Cap Cana, Santo Domingo, Las Terrenas, etc.) y aplica un pre-procesamiento mecánico ligero — sin usar ningún LLM. Está diseñado como una capa de recolección de datos: tú aportas tu propia lógica de estructuración (un LLM, tus propias expresiones regulares o revisión manual) sobre los campos limpios y consistentes que produce este Actor.
Por qué existe
La mayor parte del inventario inmobiliario en la República Dominicana — especialmente en la zona de Punta Cana / Cap Cana — la publican agentes individuales en Instagram y no en portales inmobiliarios centralizados. Este Actor apunta específicamente a ese vacío.
Qué hace
- Recibe una lista de nombres de usuario de Instagram (los agentes
individuales funcionan mejor; las cuentas paraguas de marca como la cuenta
matriz
apartamentosrdtienden a contenido institucional/marketing con una proporción de listados mucho menor). - Llama a
apify/instagram-post-scrapercomo sub-actor para obtener las publicaciones recientes. - Procesa cada publicación con extracción mecánica:
- Precios en USD detectados (regex sobre patrones
US$X,XXX/USD X,XXX) - Números de teléfono dominicanos detectados
- Hashtags
- Menciones de nombres de zonas (contra una lista fija de zonas conocidas de RD)
- Un indicador booleano
likelyListing
- Precios en USD detectados (regex sobre patrones
- Envía una fila por publicación al dataset de salida.
Qué NO hace (por diseño)
- Sin extracción con LLM. No te dirá la cantidad real de habitaciones, si
un precio es un depósito de reserva o el precio final de venta, ni analizará
precios que solo aparecen incrustados en una imagen (no en el texto ni en el
texto alternativo automático de Instagram). Validado contra una muestra real
de 271 publicaciones, el indicador
likelyListingse acerca a la tasa real de listados (~30%), pero es una señal, no una garantía: existen falsos positivos/negativos. - Sin OCR / visión por computadora. Solo se analiza texto (descripción + texto alternativo automático de Instagram).
- Sin deduplicación de listados entre cuentas o a lo largo del tiempo.
Si quieres campos totalmente estructurados (precio exacto, habitaciones, m²,
zona, puntuación de confianza), el patrón recomendado es pasar el dataset de
este Actor por tu propia llamada a un LLM después — los campos captionRaw y
altTextRaw contienen todo lo necesario para eso.
Entrada
| Campo | Tipo | Descripción |
|---|---|---|
instagramUsernames | arreglo de textos | Nombres de usuario de Instagram a extraer (sin @) |
resultsLimitPerAccount | entero | Máx. publicaciones por cuenta (por defecto 20) |
onlyLikelyListings | booleano | Descarta publicaciones sin señales de listado (por defecto false) |
Salida (una fila por publicación)
Ver el ejemplo JSON en la sección en inglés más arriba. Los campos son los mismos independientemente del idioma.
Encontrar buenas cuentas objetivo
Las sub-cuentas de agentes individuales bajo una marca (p. ej.
[nombre].apartamentosrd) suelen tener una proporción de listados mucho mayor
que la cuenta matriz de la marca. Mira a quién etiqueta/menciona la cuenta
matriz, o revisa su lista de "Seguida por", para descubrir estas cuentas de
agentes.
Costo
La única dependencia de pago de este Actor es apify/instagram-post-scraper
(actor propio de Apify, pago por evento a ~$0.0017 por publicación — cerca de
37% más barato que el genérico apify/instagram-scraper, con calidad de datos
idéntica validada en una prueba lado a lado de 15 publicaciones). Todo el
procesamiento posterior es local y gratuito.


