Instagram 貼文爬蟲 avatar

Instagram 貼文爬蟲

Pricing

from $1.50 / 1,000 results

Go to Apify Store
Instagram 貼文爬蟲

Instagram 貼文爬蟲

擷取公開 Instagram 帳號的貼文、Reels 與輪播內容,提供媒體下載連結、互動數據、文字說明等完整資料。

Pricing

from $1.50 / 1,000 results

Rating

5.0

(1)

Developer

Rush

Rush

Maintained by Community

Actor stats

2

Bookmarked

30

Total users

1

Monthly active users

10 days ago

Last modified

Share

Instagram 貼文爬蟲 — 提取貼文摘要與媒體下載連結

擷取公開 Instagram 帳號的貼文、Reels 與輪播內容,取得媒體下載連結、互動數據、貼文內容、主題標籤、提及等完整資料。支援一次處理最多 10 個帳號,無需登入。

這個爬蟲能做什麼?

Instagram 貼文爬蟲可從公開的 Instagram 帳號與個別貼文網址中擷取結構化資料。它能蒐集圖片、影片、Reels 以及完整輪播貼文(所有滑動項目,不只封面圖),同時提供互動數據、貼文內容與詳細資訊。

此爬蟲會自動偵測置頂貼文、從貼文內容中解析主題標籤與提及,並支援日期篩選 — 設定日期後,擷取到更早的貼文就會停止載入後續頁面。

可以擷取哪些資料?

  • 貼文、Reels 與輪播 — 所有內容類型,提供圖片與影片的直接下載連結
  • 完整貼文內容 — 不截斷的完整文字,自動擷取主題標籤與 @提及
  • 互動數據 — 按讚數、留言數、影片觀看次數與影片時長
  • 置頂貼文偵測 — 自動識別被釘選在帳號頂部的貼文
  • 標記使用者與共同作者 — 媒體中被標記的人與協作貼文的共同作者
  • Reel 音樂資訊 — 曲名與演出者
  • 日期篩選 — 只擷取特定日期之後的貼文,自動提前停止載入
  • 彈性輸入 — 同一次執行中可混合使用者名稱、帳號網址與個別貼文網址

如何使用

  1. 點擊 Try for free 在 Apify Console 中開啟此爬蟲。
  2. 在輸入中加入 Instagram 使用者名稱、帳號網址或貼文網址。
  3. 設定每個帳號要擷取的貼文數量(預設 50,最少 1)。
  4. 可選擇設定日期篩選或排除置頂貼文。
  5. 點擊 Start,等待資料出現在 Dataset 頁籤。

輸入設定

設定必填預設值說明
usernames-Instagram 使用者名稱、帳號網址或貼文/Reel 網址。每次最多 10 個項目。
maxPosts50每個帳號的貼文數量上限(最少 1)。不適用於個別貼文網址。
postsNewerThan-只擷取近期貼文。可輸入日期(2026-01-15)或相對時間(7 days2 weeks1 month)。
excludePinnedPostsfalse略過帳號頂部的置頂貼文,只擷取一般時間軸上的貼文。

支援的輸入格式

可在輸入列表中自由混合以下格式:

  • 使用者名稱natgeo
  • 帳號網址https://www.instagram.com/natgeo/
  • 貼文網址https://www.instagram.com/p/ABC123/
  • Reel 網址https://www.instagram.com/reel/ABC123/

輸入範例

{
"usernames": [
"natgeo",
"https://www.instagram.com/nasa/",
"https://www.instagram.com/p/XYZ789abc/"
],
"maxPosts": 25,
"postsNewerThan": "1 month",
"excludePinnedPosts": true
}

輸出說明

每一列代表一則貼文或 Reel。欄位名稱如下(實際輸出即為這些名稱):

內容與媒體

欄位說明
postUrl貼文或 Reel 的直接連結
mediaDownloadUrl媒體的直接下載連結;輪播貼文為所有項目的陣列
mediaTypeimage(圖片)、video(影片)或 carousel(輪播)
caption完整貼文文字,含主題標籤與提及
hashtags從貼文文字擷取的主題標籤
mentions從貼文文字擷取的被提及帳號
displayUrl縮圖/預覽圖連結
videoUrl影片檔案的直接連結

互動數據

欄位說明
likes按讚數
comments留言數
videoViewCount觀看數
videoDuration影片長度(秒)
commentsDisabled是否關閉留言

詳細資訊

欄位說明
username / author帳號名稱
shortcodeInstagram 貼文識別碼
ownerId帳號的 Instagram ID
timestamp發布時間(ISO 8601)
scrapedAt擷取時間(ISO 8601)
index貼文序號(1, 2, 3…)
isPinned是否被釘選在帳號頂部
locationName標註的地點名稱
dimensions媒體寬高(像素)
isVideo / hasAudio是否為影片/是否含聲音
taggedUsers在媒體中被標註的帳號(與貼文文字中的提及不同)
musicNameReel 的音樂名稱與演出者
coauthors合作貼文的共同作者
title / description貼文文字開頭/Instagram 提供的圖片文字說明

範例輸出

{
"username": "natgeo",
"postUrl": "https://www.instagram.com/reel/ABC123xyz/",
"mediaDownloadUrl": "https://scontent.cdninstagram.com/.../video.mp4",
"mediaType": "video",
"caption": "貼文文字,含 #主題標籤 與 @提及",
"hashtags": ["travel"],
"mentions": ["natgeo"],
"likes": 5230,
"comments": 187,
"timestamp": "2026-02-18T14:30:00.000Z",
"shortcode": "ABC123xyz",
"videoViewCount": 84500,
"videoDuration": 62.1,
"isPinned": false
}

輪播貼文的 mediaDownloadUrl 為陣列,每個項目包含 typeurlwidthheight,可逐項取得所有滑動內容。

Instagram 公開哪些資料

Instagram 不會對未登入的讀者公開每則貼文的每一項資料。以下欄位只有在 Instagram 確實公開時才會填入;沒有的時候會留空,留空一律代表「Instagram 沒有公開」,不是「零」

欄位什麼時候會有值
videoViewCountReels。圖片、以及 Instagram 未公開觀看數的影片為空。
isPinned從帳號擷取的貼文。以單篇貼文連結查詢時 Instagram 不提供,為空。
commentsDisabled只有 Instagram 明確標示時。公開讀取通常為空。
likes / comments一律提供,除非帳號隱藏了數字 — 此時留空而非填 0
locationNamemusicNametaggedUserscoauthors只有貼文本身具備時。

置頂貼文偵測

Instagram 允許使用者將最多 3 篇貼文釘選在帳號頂部。這些貼文會出現在一般時間軸之前,即使它們可能是很久以前發布的。

從帳號擷取的貼文會標記 isPinned。你也可以透過 excludePinnedPosts 設定完全排除置頂貼文,這對需要按時間順序精確分析的場景特別有用。

日期篩選

使用 postsNewerThan 只擷取近期貼文。可指定:

  • 具體日期2026-01-15
  • 相對時間7 days2 weeks1 month1 year

當爬蟲到達比你指定日期更早的貼文時,會自動停止載入後續頁面,節省時間與運算資源。這對監控高頻發文帳號的近期內容特別有效。

使用建議

  • 從小規模開始 — 先用一個帳號加 10 篇貼文測試,確認輸出符合需求後再擴大規模。
  • 善用日期篩選 — 對於高頻發文帳號,設定 postsNewerThan 可避免載入數千篇舊貼文。
  • 混合輸入格式 — 同一次執行中可同時使用使用者名稱、帳號網址與個別貼文網址。
  • 輪播完整擷取 — 此爬蟲會擷取輪播貼文的所有滑動項目,不只是封面圖。檢查 mediaDownloadUrl 陣列可取得完整內容。
  • 輸入有誤會被略過 — 拼錯的帳號名稱、或不是帳號/貼文的網址,會在執行摘要中列出並略過,同一次執行的其他項目照常擷取。
  • 需要 Proxy 權限 — 此 Actor 透過 Apify Proxy(住宅)讀取 Instagram,你的方案需開通該權限,Proxy 流量會照常計入你的 Apify 帳戶。
  • 下載連結有時效 — 媒體下載連結為暫時性連結,建議在擷取後數小時內下載或處理。

整合

你可以透過 Apify 平台的整合功能 將 Instagram 貼文爬蟲與幾乎任何雲端服務或網頁應用連接。支援 Make、Zapier、Slack、Airbyte、GitHub、Google Sheets、Google Drive 等。

你也可以透過 Apify API 以程式方式存取資料集。可匯出的格式包括 JSON、CSV、Excel、XML、HTML 和 RSS。

使用情境

  • 社群媒體經營者 — 追蹤品牌帳號的內容表現與發文節奏
  • 研究人員 — 蒐集公開社群媒體資料,用於學術研究或市場分析
  • 內容創作者 — 監控互動趨勢、找出最佳表現內容、研究競爭對手策略
  • 開發人員 — 將 Instagram 資料匯入儀表板、分析工具或自訂應用程式
  • 分析師 — 搭配日期篩選與排除置頂功能,進行精確的時間軸分析

常見問題

可以擷取私人帳號的資料嗎? 不行,只能存取公開資料。遇到私人帳號時會明確標示為「不公開帳號」,不會誤報成「這個帳號沒有貼文」。

為什麼有些欄位是空的? Instagram 對未登入的讀者公開的資料因貼文而異。請參考上方「Instagram 公開哪些資料」表格,了解每個欄位在什麼情況下會有值。空值一律代表 Instagram 沒有公開該項資料,不代表零

為什麼某個帳號回傳的貼文數比預期少? 該帳號的公開貼文可能較少、日期篩選可能排除了較舊的貼文,或 Instagram 在該次執行中沒有提供更多公開結果。當擷取結果少於實際可得的數量時,執行摘要會明確說明,不會把不完整的結果當成完整結果呈現。

輸入清單裡有一項填錯會怎樣? 該項會在執行摘要中列出並略過,同一次執行的其他項目照常擷取。

可以擷取留言或追蹤者嗎? 此爬蟲專注於貼文資料。如需其他 Instagram 資料,請在 Apify Store 搜尋相關爬蟲。

注意事項

  • 僅適用於公開帳號(無法存取私人帳號)
  • 下載連結為暫時性連結,可能在數小時後過期
  • 在高流量時段,Instagram 可能限制部分帳號的可用資料
  • Instagram 允許最多 3 篇置頂貼文,且一律顯示在帳號最前面
  • 爬蟲內建請求間隔控制,以遵守速率限制

免責聲明

本工具收集公開可取得的資料,供研究與分析使用。使用者須自行確保其使用方式符合 Instagram 的服務條款及所有適用法律。

  • Instagram 決定哪些內容公開發布,且隨時可能變更,因此每個帳號可取得的貼文數量會有差異,不同次執行也可能不同
  • 開發者不對使用本工具所造成的後果負責,包括資料遺失或法律責任
  • 取得的資料應依照適用的資料保護法規處理

更多 Actor

需要其他 Instagram 資料嗎?看看 futurizerush 的其他爬蟲 —— 留言、粉絲、主題標籤與使用者貼文。