DR Real Estate Instagram Scraper avatar

DR Real Estate Instagram Scraper

Pricing

Pay per usage

Go to Apify Store
DR Real Estate Instagram Scraper

DR Real Estate Instagram Scraper

Scrapes Instagram posts from Dominican Republic real estate agents (Punta Cana, Cap Cana, Santo Domingo, Las Terrenas) and pre-processes them with mechanical extraction (detected prices, phones, hashtags) so you can plug in your own LLM or business logic for final structuring.

Pricing

Pay per usage

Rating

0.0

(0)

Developer

Max Medina

Max Medina

Maintained by Community

Actor stats

0

Bookmarked

2

Total users

1

Monthly active users

2 months ago

Last modified

Share

English · Español

Scrapes Instagram posts from Dominican Republic real estate agents (Punta Cana, Cap Cana, Santo Domingo, Las Terrenas, etc.) and applies lightweight mechanical pre-processing — no LLM involved. It's designed as a data-collection layer: you bring your own structuring logic (an LLM, your own regex, or manual review) on top of the clean, consistent fields this Actor produces.

Why this exists

Most real estate inventory in the Dominican Republic — especially around Punta Cana / Cap Cana — is listed by individual agents on Instagram rather than on centralized property portals. This Actor targets that specific gap.

What it does

  1. Takes a list of Instagram usernames (individual agents work best — brand umbrella accounts like the parent apartamentosrd skew heavily institutional/marketing content with a much lower listing ratio).
  2. Calls apify/instagram-post-scraper as a sub-actor to fetch recent posts.
  3. Runs each post through mechanical extraction:
    • Detected USD prices (regex on US$X,XXX / USD X,XXX patterns)
    • Detected Dominican phone numbers
    • Hashtags
    • Zone name mentions (matched against a fixed list of known DR zones)
    • A likelyListing boolean flag
  4. Pushes one row per post to the output dataset.

What it does NOT do (by design)

  • No LLM extraction. It won't tell you the actual bedroom count, whether a price is a reservation deposit vs. the final sale price, or parse prices that only appear baked into an image (not in the caption or Instagram's auto-generated alt text). Validated against a 271-post real sample, the mechanical likelyListing flag lands close to true listing rate (~30%), but it is a signal, not a guarantee — false positives/negatives exist.
  • No image OCR / vision. Only text (caption + Instagram's auto alt text) is analyzed.
  • No listing deduplication across accounts or over time.

If you want fully structured fields (exact price, bedrooms, m², zone, confidence score), the recommended pattern is to pipe this Actor's dataset through your own LLM call afterward — the captionRaw and altTextRaw fields carry everything needed for that.

Input

FieldTypeDescription
instagramUsernamesarray of stringsInstagram usernames to scrape (no @)
resultsLimitPerAccountintegerMax posts per account (default 20)
onlyLikelyListingsbooleanDrop posts without listing signals (default false)

Output (one row per post)

{
"instagramUsername": "nathalydls.apartamentosrd",
"agentFullName": "Nathaly de los Santos | Asesora Inmobiliaria | Inversiones",
"postUrl": "https://www.instagram.com/p/DaQLsYxhrOa/",
"postTimestamp": "2026-07-01T14:00:11.000Z",
"postType": "Video",
"captionRaw": "...",
"altTextRaw": "...",
"likesCount": 12,
"commentsCount": 0,
"detectedPricesUsd": [170000],
"detectedPhone": "849-459-2321",
"detectedHashtags": ["Naco", "ApartamentoEnVenta"],
"mentionedZones": ["Santo Domingo", "Naco"],
"likelyListing": true,
"captionWordCount": 110,
"scrapedAt": "2026-07-17T15:01:34.506Z"
}

Finding good target accounts

Individual agent sub-accounts under a brand (e.g. [name].apartamentosrd) tend to have a much higher listing ratio than the parent brand account. Look at who the parent account tags/mentions, or check its "Followed by" list, to discover these agent accounts.

Cost

This Actor's only paid dependency is apify/instagram-post-scraper (Apify's own actor, pay-per-event at ~$0.0017 per post — about 37% cheaper than the generic apify/instagram-scraper, with identical data quality validated against a 15-post side-by-side test). All processing after that is local and free.


Español

English · Español

Extrae publicaciones de Instagram de agentes inmobiliarios de la República Dominicana (Punta Cana, Cap Cana, Santo Domingo, Las Terrenas, etc.) y aplica un pre-procesamiento mecánico ligero — sin usar ningún LLM. Está diseñado como una capa de recolección de datos: tú aportas tu propia lógica de estructuración (un LLM, tus propias expresiones regulares o revisión manual) sobre los campos limpios y consistentes que produce este Actor.

Por qué existe

La mayor parte del inventario inmobiliario en la República Dominicana — especialmente en la zona de Punta Cana / Cap Cana — la publican agentes individuales en Instagram y no en portales inmobiliarios centralizados. Este Actor apunta específicamente a ese vacío.

Qué hace

  1. Recibe una lista de nombres de usuario de Instagram (los agentes individuales funcionan mejor; las cuentas paraguas de marca como la cuenta matriz apartamentosrd tienden a contenido institucional/marketing con una proporción de listados mucho menor).
  2. Llama a apify/instagram-post-scraper como sub-actor para obtener las publicaciones recientes.
  3. Procesa cada publicación con extracción mecánica:
    • Precios en USD detectados (regex sobre patrones US$X,XXX / USD X,XXX)
    • Números de teléfono dominicanos detectados
    • Hashtags
    • Menciones de nombres de zonas (contra una lista fija de zonas conocidas de RD)
    • Un indicador booleano likelyListing
  4. Envía una fila por publicación al dataset de salida.

Qué NO hace (por diseño)

  • Sin extracción con LLM. No te dirá la cantidad real de habitaciones, si un precio es un depósito de reserva o el precio final de venta, ni analizará precios que solo aparecen incrustados en una imagen (no en el texto ni en el texto alternativo automático de Instagram). Validado contra una muestra real de 271 publicaciones, el indicador likelyListing se acerca a la tasa real de listados (~30%), pero es una señal, no una garantía: existen falsos positivos/negativos.
  • Sin OCR / visión por computadora. Solo se analiza texto (descripción + texto alternativo automático de Instagram).
  • Sin deduplicación de listados entre cuentas o a lo largo del tiempo.

Si quieres campos totalmente estructurados (precio exacto, habitaciones, m², zona, puntuación de confianza), el patrón recomendado es pasar el dataset de este Actor por tu propia llamada a un LLM después — los campos captionRaw y altTextRaw contienen todo lo necesario para eso.

Entrada

CampoTipoDescripción
instagramUsernamesarreglo de textosNombres de usuario de Instagram a extraer (sin @)
resultsLimitPerAccountenteroMáx. publicaciones por cuenta (por defecto 20)
onlyLikelyListingsbooleanoDescarta publicaciones sin señales de listado (por defecto false)

Salida (una fila por publicación)

Ver el ejemplo JSON en la sección en inglés más arriba. Los campos son los mismos independientemente del idioma.

Encontrar buenas cuentas objetivo

Las sub-cuentas de agentes individuales bajo una marca (p. ej. [nombre].apartamentosrd) suelen tener una proporción de listados mucho mayor que la cuenta matriz de la marca. Mira a quién etiqueta/menciona la cuenta matriz, o revisa su lista de "Seguida por", para descubrir estas cuentas de agentes.

Costo

La única dependencia de pago de este Actor es apify/instagram-post-scraper (actor propio de Apify, pago por evento a ~$0.0017 por publicación — cerca de 37% más barato que el genérico apify/instagram-scraper, con calidad de datos idéntica validada en una prueba lado a lado de 15 publicaciones). Todo el procesamiento posterior es local y gratuito.