Wikipedia Article Scraper
Pricing
from $1.00 / 1,000 item scrapeds
Wikipedia Article Scraper
Scrape Wikipedia articles via public MediaWiki API — no proxy, no auth. Modes: summary (extract + thumbnail), full_text, search, random, category. Supports 250+ language editions.
Pricing
from $1.00 / 1,000 item scrapeds
Rating
0.0
(0)
Developer
Hojun Lee
Maintained by CommunityActor stats
0
Bookmarked
2
Total users
1
Monthly active users
2 days ago
Last modified
Categories
Share
Scrape Wikipedia articles at scale using the public MediaWiki API and REST API — no proxy, no API key, no auth required. Supports 250+ language editions.
Features
| Mode | What it does |
|---|---|
summary | Short extract + thumbnail image for one or more article titles |
full_text | Complete article plain text (all sections) |
search | Search by keyword and return a list of matching articles |
random | Fetch N random articles |
category | List all articles in a Wikipedia category |
Input
| Field | Type | Default | Description |
|---|---|---|---|
mode | string | summary | Scraping mode: summary, full_text, search, random, category |
titles | string[] | [] | Article titles for summary / full_text modes |
searchQuery | string | "" | Search keyword (search mode) |
category | string | "" | Category name without Category: prefix (category mode) |
language | string | en | Wikipedia language code (en, ko, ja, de, fr, es, …) |
maxItems | integer | 10 | Maximum articles to return (1–500) |
includeImages | boolean | true | Include thumbnail image URL |
Example inputs
Fetch article summaries
{"mode": "summary","titles": ["Artificial intelligence", "Python (programming language)"],"language": "en"}
Get full article text
{"mode": "full_text","titles": ["Quantum computing"],"language": "en"}
Keyword search
{"mode": "search","searchQuery": "neural network deep learning","maxItems": 20}
Random articles
{"mode": "random","maxItems": 5,"language": "ko"}
Category members
{"mode": "category","category": "Machine_learning","maxItems": 50}
Output
Each item in the dataset:
{"title": "Artificial intelligence","url": "https://en.wikipedia.org/wiki/Artificial_intelligence","language": "en","summary": "Artificial intelligence (AI) is intelligence demonstrated by machines…","text": "…full article text…","thumbnail": "https://upload.wikimedia.org/wikipedia/commons/thumb/…","categories": ["Artificial intelligence", "Computer science"],"last_modified": "2026-09-01T00:00:00Z"}
textis populated only infull_textmode.thumbnailis omitted whenincludeImagesisfalse.
Pricing (Pay-Per-Event)
| Event | Price |
|---|---|
| Actor start | $0.005 |
| Per article scraped | $0.003 |
Scraping 100 articles costs ~$0.305 (start + 100 × $0.003).
Supported Languages
Any Wikipedia language edition: en, ko, ja, zh, de, fr, es, pt, it, ru, ar, hi, nl, pl, sv, vi, and 240+ more. Pass the two-letter (or longer) ISO language code as language.
Notes
- Uses Wikipedia's REST API for summaries and the MediaWiki Action API for full text, search, random, and category queries.
- No scraping of HTML pages — API responses only.
- Respects Wikipedia's Terms of Use.
- Rate-limited naturally by Wikipedia's API (no aggressive throttling needed).
Related actors
- PubMed Medical Papers Tracker — Academic biomedical literature to complement Wikipedia health/science article research
- Google News Scraper — Current news to contextualize Wikipedia's encyclopedic coverage
- Wikidata SPARQL Query Runner — Structured knowledge graph queries over the same Wikimedia data infrastructure
Feedback
If this actor powers your knowledge extraction, a review helps others find it: Leave a review on Apify Store
Keywords: Wikipedia scraper, MediaWiki API extractor, Wikipedia article text scraper, Wikipedia summary API, multilingual Wikipedia data, Wikipedia full text extractor, Wikipedia category scraper, knowledge base automation, Wikipedia search API, encyclopedia data scraper, Wikipedia article metadata, no proxy required, 250 language Wikipedia, PPE per article