arXiv Articles Scraper - Low-costπ²π₯ππ
Pricing
from $0.00005 / actor start
arXiv Articles Scraper - Low-costπ²π₯ππ
π Easily scrape arXiv papers by keyword or subject. Extract titles, abstracts, authors, categories, submission dates, PDF links, DOIs, paper URLs & more. Perfect for literature reviews, academic research, trend analysis, citation discovery and AI training datasets.
Pricing
from $0.00005 / actor start
Rating
0.0
(0)
Developer
Prime Scrape
Maintained by CommunityActor stats
0
Bookmarked
2
Total users
1
Monthly active users
3 days ago
Last modified
Categories
Share
ππ arXiv Article Metadata Scraper | Bulk Keyword Scraper | Apify Actor
π Extract arXiv Research Papers in Seconds (No Code)
The arXiv Article Metadata Scraper (Apify Actor) is a powerful, scalable and SEO-optimized academic research scraping tool for extracting structured scientific paper metadata from arXiv.
Scrape thousands of research papers using bulk keywords, collect detailed publication metadata, and export clean structured datasets for academic research, literature reviews, AI training datasets, NLP projects, bibliometric analysis, and scientific intelligence.
π₯ Why This arXiv Scraper?
β Best arXiv scraper on Apify
β Supports Bulk Keyword Scraping (multi-search)
β Fast & scalable paper extraction
β 100% structured JSON / CSV / Excel output
β Perfect for academic & AI research
β Ideal for researchers, universities & data scientists
β No coding required
π― What This Scraper Does (arXiv Research Paper Data Extraction)
This Apify Actor extracts real-time research paper metadata directly from arXiv search results.
π Core Features
β Scrape arXiv research papers
β Bulk keyword scraping (SEO BOOST π)
β Supports multiple search keywords
β Automatic pagination
β Extract paper titles
β Extract authors
β Extract abstracts
β Extract subject categories
β Extract submission dates
β Extract comments
β Extract PDF links
β Extract article URLs
β Clean structured datasets
β High-speed extraction engine
β‘ Input Configuration (Simple & Powerful)
π₯ BULK KEYWORD MODE (SEO BOOST π)
{"keywords": ["artificial intelligence","large language models","computer vision","machine learning","quantum computing","robotics","cybersecurity","climate change"],"maxitems": 100}
π Extracted Research Paper Data (Structured Output)
| Field | Description |
|---|---|
| arxiv_id | Unique arXiv paper identifier |
| arxiv_link | Article page URL |
| pdf_link | Direct PDF URL |
| domain | Subject category |
| title | Research paper title |
| authors | List of authors |
| abstract | Paper abstract |
| submitted_info | Submission information |
| comments | Additional publication comments |
π‘ Use Cases (High Demand SEO Keywords)
This arXiv scraper is perfect for:
π Academic research
π€ AI research datasets
π Literature reviews
π§ Machine learning datasets
π Bibliometric analysis
π¬ Scientific publication monitoring
π University research
π Research paper discovery
π Scientific trend analysis
π Citation & publication intelligence
π NLP training datasets
π Knowledge graph creation
π Key Features (Apify SEO Optimized)
β‘ Bulk keyword scraping support
π Complete arXiv coverage
π Automatic pagination
π§ Clean structured output
π High-speed scraping engine
π Auto retry & stability system
πΎ Export-ready datasets
βοΈ Scalable cloud execution (Apify Actor)
π€ Output Formats Supported
β JSON (API Ready)
β CSV
β Excel XLSX
β XML
β HTML
π¦ Example Output
{"arxiv_id": "arXiv:2508.06484","arxiv_link": "https://arxiv.org/abs/2508.06484","pdf_link": "https://arxiv.org/pdf/2508.06484.pdf","domain": "cs.HC","title": "Non-programmers Assessing AI-Generated Code: A Case Study","authors": ["Yuvraj Virk","Dongyu Liu"],"abstract": "Non-technical end-users increasingly rely on AI code generation...","submitted_info": "Submitted 8 August, 2025; originally announced August 2025.","comments": "Accepted by VL/HCC 2025"}
π₯ Why This is the BEST arXiv Scraper on Apify?
β Optimized for Apify search ranking
β Enterprise-grade scraping engine
β Bulk keyword support (rare feature)
β Fast large-scale extraction
β Clean structured datasets
β Reliable pagination
β Marketplace-ready performance
β Perfect for SEO traffic & marketplace visibility
πΈ Pricing
This scraper runs on a pay-per-result pricing model.
You only pay for successfully extracted records.
π³ Price: $1.49 / 1,000 results
β FAQ (SEO BOOST SECTION)
Can I scrape multiple keywords at once?
Yes β Bulk Keyword Mode is fully supported.
Can I collect thousands of research papers?
Yes β simply increase maxitems.
Does it extract abstracts and authors?
Yes β complete paper metadata including titles, authors, abstracts, subject categories, submission information and PDF links are extracted.
Is coding required?
No β this is a 100% no-code Apify Actor.
Can I export the data?
Yes β JSON, CSV, Excel, XML and HTML are fully supported.
β οΈ Disclaimer
This tool is not affiliated with arXiv. It is an independent data extraction solution built for publicly available research paper metadata.
π Related Actors (Academic Intelligence Suite)
We are building a complete PrimeScrape Academic Intelligence Suite.
π Coming Soon π
π PrimeScrape Ecosystem
Built for data scraping, automation, AI training datasets, scientific intelligence and market research at scale.
π Research paper extraction
π Academic intelligence
π Publication analytics
π€ AI datasets
π Scientific trend monitoring
βοΈ Automation pipelines
π¬ Support
βββββ Leave a review if you like this scraper.
π© Contact us for custom scraping solutions, enterprise requests and large-scale academic data extraction.