Instagram 貼文爬蟲
Pricing
from $1.50 / 1,000 results
Pricing
from $1.50 / 1,000 results
Rating
5.0
(1)
Developer
Rush
Maintained by CommunityActor stats
2
Bookmarked
30
Total users
1
Monthly active users
10 days ago
Last modified
Categories
Share
Instagram 貼文爬蟲 — 提取貼文摘要與媒體下載連結
擷取公開 Instagram 帳號的貼文、Reels 與輪播內容,取得媒體下載連結、互動數據、貼文內容、主題標籤、提及等完整資料。支援一次處理最多 10 個帳號,無需登入。
這個爬蟲能做什麼?
Instagram 貼文爬蟲可從公開的 Instagram 帳號與個別貼文網址中擷取結構化資料。它能蒐集圖片、影片、Reels 以及完整輪播貼文(所有滑動項目,不只封面圖),同時提供互動數據、貼文內容與詳細資訊。
此爬蟲會自動偵測置頂貼文、從貼文內容中解析主題標籤與提及,並支援日期篩選 — 設定日期後,擷取到更早的貼文就會停止載入後續頁面。
可以擷取哪些資料?
- 貼文、Reels 與輪播 — 所有內容類型,提供圖片與影片的直接下載連結
- 完整貼文內容 — 不截斷的完整文字,自動擷取主題標籤與 @提及
- 互動數據 — 按讚數、留言數、影片觀看次數與影片時長
- 置頂貼文偵測 — 自動識別被釘選在帳號頂部的貼文
- 標記使用者與共同作者 — 媒體中被標記的人與協作貼文的共同作者
- Reel 音樂資訊 — 曲名與演出者
- 日期篩選 — 只擷取特定日期之後的貼文,自動提前停止載入
- 彈性輸入 — 同一次執行中可混合使用者名稱、帳號網址與個別貼文網址
如何使用
- 點擊 Try for free 在 Apify Console 中開啟此爬蟲。
- 在輸入中加入 Instagram 使用者名稱、帳號網址或貼文網址。
- 設定每個帳號要擷取的貼文數量(預設 50,最少 1)。
- 可選擇設定日期篩選或排除置頂貼文。
- 點擊 Start,等待資料出現在 Dataset 頁籤。
輸入設定
| 設定 | 必填 | 預設值 | 說明 |
|---|---|---|---|
usernames | 是 | - | Instagram 使用者名稱、帳號網址或貼文/Reel 網址。每次最多 10 個項目。 |
maxPosts | 否 | 50 | 每個帳號的貼文數量上限(最少 1)。不適用於個別貼文網址。 |
postsNewerThan | 否 | - | 只擷取近期貼文。可輸入日期(2026-01-15)或相對時間(7 days、2 weeks、1 month)。 |
excludePinnedPosts | 否 | false | 略過帳號頂部的置頂貼文,只擷取一般時間軸上的貼文。 |
支援的輸入格式
可在輸入列表中自由混合以下格式:
- 使用者名稱:
natgeo - 帳號網址:
https://www.instagram.com/natgeo/ - 貼文網址:
https://www.instagram.com/p/ABC123/ - Reel 網址:
https://www.instagram.com/reel/ABC123/
輸入範例
{"usernames": ["natgeo","https://www.instagram.com/nasa/","https://www.instagram.com/p/XYZ789abc/"],"maxPosts": 25,"postsNewerThan": "1 month","excludePinnedPosts": true}
輸出說明
每一列代表一則貼文或 Reel。欄位名稱如下(實際輸出即為這些名稱):
內容與媒體
| 欄位 | 說明 |
|---|---|
postUrl | 貼文或 Reel 的直接連結 |
mediaDownloadUrl | 媒體的直接下載連結;輪播貼文為所有項目的陣列 |
mediaType | image(圖片)、video(影片)或 carousel(輪播) |
caption | 完整貼文文字,含主題標籤與提及 |
hashtags | 從貼文文字擷取的主題標籤 |
mentions | 從貼文文字擷取的被提及帳號 |
displayUrl | 縮圖/預覽圖連結 |
videoUrl | 影片檔案的直接連結 |
互動數據
| 欄位 | 說明 |
|---|---|
likes | 按讚數 |
comments | 留言數 |
videoViewCount | 觀看數 |
videoDuration | 影片長度(秒) |
commentsDisabled | 是否關閉留言 |
詳細資訊
| 欄位 | 說明 |
|---|---|
username / author | 帳號名稱 |
shortcode | Instagram 貼文識別碼 |
ownerId | 帳號的 Instagram ID |
timestamp | 發布時間(ISO 8601) |
scrapedAt | 擷取時間(ISO 8601) |
index | 貼文序號(1, 2, 3…) |
isPinned | 是否被釘選在帳號頂部 |
locationName | 標註的地點名稱 |
dimensions | 媒體寬高(像素) |
isVideo / hasAudio | 是否為影片/是否含聲音 |
taggedUsers | 在媒體中被標註的帳號(與貼文文字中的提及不同) |
musicName | Reel 的音樂名稱與演出者 |
coauthors | 合作貼文的共同作者 |
title / description | 貼文文字開頭/Instagram 提供的圖片文字說明 |
範例輸出
{"username": "natgeo","postUrl": "https://www.instagram.com/reel/ABC123xyz/","mediaDownloadUrl": "https://scontent.cdninstagram.com/.../video.mp4","mediaType": "video","caption": "貼文文字,含 #主題標籤 與 @提及","hashtags": ["travel"],"mentions": ["natgeo"],"likes": 5230,"comments": 187,"timestamp": "2026-02-18T14:30:00.000Z","shortcode": "ABC123xyz","videoViewCount": 84500,"videoDuration": 62.1,"isPinned": false}
輪播貼文的 mediaDownloadUrl 為陣列,每個項目包含 type、url、width、height,可逐項取得所有滑動內容。
Instagram 公開哪些資料
Instagram 不會對未登入的讀者公開每則貼文的每一項資料。以下欄位只有在 Instagram 確實公開時才會填入;沒有的時候會留空,留空一律代表「Instagram 沒有公開」,不是「零」。
| 欄位 | 什麼時候會有值 |
|---|---|
videoViewCount | Reels。圖片、以及 Instagram 未公開觀看數的影片為空。 |
isPinned | 從帳號擷取的貼文。以單篇貼文連結查詢時 Instagram 不提供,為空。 |
commentsDisabled | 只有 Instagram 明確標示時。公開讀取通常為空。 |
likes / comments | 一律提供,除非帳號隱藏了數字 — 此時留空而非填 0。 |
locationName、musicName、taggedUsers、coauthors | 只有貼文本身具備時。 |
置頂貼文偵測
Instagram 允許使用者將最多 3 篇貼文釘選在帳號頂部。這些貼文會出現在一般時間軸之前,即使它們可能是很久以前發布的。
從帳號擷取的貼文會標記 isPinned。你也可以透過 excludePinnedPosts 設定完全排除置頂貼文,這對需要按時間順序精確分析的場景特別有用。
日期篩選
使用 postsNewerThan 只擷取近期貼文。可指定:
- 具體日期:
2026-01-15 - 相對時間:
7 days、2 weeks、1 month、1 year
當爬蟲到達比你指定日期更早的貼文時,會自動停止載入後續頁面,節省時間與運算資源。這對監控高頻發文帳號的近期內容特別有效。
使用建議
- 從小規模開始 — 先用一個帳號加 10 篇貼文測試,確認輸出符合需求後再擴大規模。
- 善用日期篩選 — 對於高頻發文帳號,設定
postsNewerThan可避免載入數千篇舊貼文。 - 混合輸入格式 — 同一次執行中可同時使用使用者名稱、帳號網址與個別貼文網址。
- 輪播完整擷取 — 此爬蟲會擷取輪播貼文的所有滑動項目,不只是封面圖。檢查
mediaDownloadUrl陣列可取得完整內容。 - 輸入有誤會被略過 — 拼錯的帳號名稱、或不是帳號/貼文的網址,會在執行摘要中列出並略過,同一次執行的其他項目照常擷取。
- 需要 Proxy 權限 — 此 Actor 透過 Apify Proxy(住宅)讀取 Instagram,你的方案需開通該權限,Proxy 流量會照常計入你的 Apify 帳戶。
- 下載連結有時效 — 媒體下載連結為暫時性連結,建議在擷取後數小時內下載或處理。
整合
你可以透過 Apify 平台的整合功能 將 Instagram 貼文爬蟲與幾乎任何雲端服務或網頁應用連接。支援 Make、Zapier、Slack、Airbyte、GitHub、Google Sheets、Google Drive 等。
你也可以透過 Apify API 以程式方式存取資料集。可匯出的格式包括 JSON、CSV、Excel、XML、HTML 和 RSS。
使用情境
- 社群媒體經營者 — 追蹤品牌帳號的內容表現與發文節奏
- 研究人員 — 蒐集公開社群媒體資料,用於學術研究或市場分析
- 內容創作者 — 監控互動趨勢、找出最佳表現內容、研究競爭對手策略
- 開發人員 — 將 Instagram 資料匯入儀表板、分析工具或自訂應用程式
- 分析師 — 搭配日期篩選與排除置頂功能,進行精確的時間軸分析
常見問題
可以擷取私人帳號的資料嗎? 不行,只能存取公開資料。遇到私人帳號時會明確標示為「不公開帳號」,不會誤報成「這個帳號沒有貼文」。
為什麼有些欄位是空的? Instagram 對未登入的讀者公開的資料因貼文而異。請參考上方「Instagram 公開哪些資料」表格,了解每個欄位在什麼情況下會有值。空值一律代表 Instagram 沒有公開該項資料,不代表零。
為什麼某個帳號回傳的貼文數比預期少? 該帳號的公開貼文可能較少、日期篩選可能排除了較舊的貼文,或 Instagram 在該次執行中沒有提供更多公開結果。當擷取結果少於實際可得的數量時,執行摘要會明確說明,不會把不完整的結果當成完整結果呈現。
輸入清單裡有一項填錯會怎樣? 該項會在執行摘要中列出並略過,同一次執行的其他項目照常擷取。
可以擷取留言或追蹤者嗎? 此爬蟲專注於貼文資料。如需其他 Instagram 資料,請在 Apify Store 搜尋相關爬蟲。
注意事項
- 僅適用於公開帳號(無法存取私人帳號)
- 下載連結為暫時性連結,可能在數小時後過期
- 在高流量時段,Instagram 可能限制部分帳號的可用資料
- Instagram 允許最多 3 篇置頂貼文,且一律顯示在帳號最前面
- 爬蟲內建請求間隔控制,以遵守速率限制
免責聲明
本工具收集公開可取得的資料,供研究與分析使用。使用者須自行確保其使用方式符合 Instagram 的服務條款及所有適用法律。
- Instagram 決定哪些內容公開發布,且隨時可能變更,因此每個帳號可取得的貼文數量會有差異,不同次執行也可能不同
- 開發者不對使用本工具所造成的後果負責,包括資料遺失或法律責任
- 取得的資料應依照適用的資料保護法規處理
更多 Actor
需要其他 Instagram 資料嗎?看看 futurizerush 的其他爬蟲 —— 留言、粉絲、主題標籤與使用者貼文。