arXiv Articles Scraper - Low-costπŸ’²πŸ”₯πŸ“šπŸš€ avatar

arXiv Articles Scraper - Low-costπŸ’²πŸ”₯πŸ“šπŸš€

Pricing

from $0.00005 / actor start

Go to Apify Store
arXiv Articles Scraper - Low-costπŸ’²πŸ”₯πŸ“šπŸš€

arXiv Articles Scraper - Low-costπŸ’²πŸ”₯πŸ“šπŸš€

πŸ“š Easily scrape arXiv papers by keyword or subject. Extract titles, abstracts, authors, categories, submission dates, PDF links, DOIs, paper URLs & more. Perfect for literature reviews, academic research, trend analysis, citation discovery and AI training datasets.

Pricing

from $0.00005 / actor start

Rating

0.0

(0)

Developer

Prime Scrape

Prime Scrape

Maintained by Community

Actor stats

0

Bookmarked

2

Total users

1

Monthly active users

3 days ago

Last modified

Share

arXiv Article Metadata Scraper


πŸ“šπŸš€ arXiv Article Metadata Scraper | Bulk Keyword Scraper | Apify Actor

πŸš€ Extract arXiv Research Papers in Seconds (No Code)

The arXiv Article Metadata Scraper (Apify Actor) is a powerful, scalable and SEO-optimized academic research scraping tool for extracting structured scientific paper metadata from arXiv.

Scrape thousands of research papers using bulk keywords, collect detailed publication metadata, and export clean structured datasets for academic research, literature reviews, AI training datasets, NLP projects, bibliometric analysis, and scientific intelligence.


πŸ”₯ Why This arXiv Scraper?

βœ” Best arXiv scraper on Apify

βœ” Supports Bulk Keyword Scraping (multi-search)

βœ” Fast & scalable paper extraction

βœ” 100% structured JSON / CSV / Excel output

βœ” Perfect for academic & AI research

βœ” Ideal for researchers, universities & data scientists

βœ” No coding required


🎯 What This Scraper Does (arXiv Research Paper Data Extraction)

This Apify Actor extracts real-time research paper metadata directly from arXiv search results.

πŸ“Œ Core Features

βœ… Scrape arXiv research papers

βœ… Bulk keyword scraping (SEO BOOST πŸš€)

βœ… Supports multiple search keywords

βœ… Automatic pagination

βœ… Extract paper titles

βœ… Extract authors

βœ… Extract abstracts

βœ… Extract subject categories

βœ… Extract submission dates

βœ… Extract comments

βœ… Extract PDF links

βœ… Extract article URLs

βœ… Clean structured datasets

βœ… High-speed extraction engine


⚑ Input Configuration (Simple & Powerful)

πŸ”₯ BULK KEYWORD MODE (SEO BOOST πŸš€)

{
"keywords": [
"artificial intelligence",
"large language models",
"computer vision",
"machine learning",
"quantum computing",
"robotics",
"cybersecurity",
"climate change"
],
"maxitems": 100
}

πŸ“Š Extracted Research Paper Data (Structured Output)

FieldDescription
arxiv_idUnique arXiv paper identifier
arxiv_linkArticle page URL
pdf_linkDirect PDF URL
domainSubject category
titleResearch paper title
authorsList of authors
abstractPaper abstract
submitted_infoSubmission information
commentsAdditional publication comments

πŸ’‘ Use Cases (High Demand SEO Keywords)

This arXiv scraper is perfect for:

πŸ“š Academic research

πŸ€– AI research datasets

πŸ“„ Literature reviews

🧠 Machine learning datasets

πŸ“Š Bibliometric analysis

πŸ”¬ Scientific publication monitoring

πŸŽ“ University research

πŸ“– Research paper discovery

🌍 Scientific trend analysis

πŸ“ˆ Citation & publication intelligence

πŸ“ NLP training datasets

πŸ” Knowledge graph creation


πŸš€ Key Features (Apify SEO Optimized)

⚑ Bulk keyword scraping support

🌍 Complete arXiv coverage

πŸ“Œ Automatic pagination

🧠 Clean structured output

πŸ“Š High-speed scraping engine

πŸ” Auto retry & stability system

πŸ’Ύ Export-ready datasets

βš™οΈ Scalable cloud execution (Apify Actor)


πŸ“€ Output Formats Supported

βœ” JSON (API Ready)

βœ” CSV

βœ” Excel XLSX

βœ” XML

βœ” HTML


πŸ“¦ Example Output

{
"arxiv_id": "arXiv:2508.06484",
"arxiv_link": "https://arxiv.org/abs/2508.06484",
"pdf_link": "https://arxiv.org/pdf/2508.06484.pdf",
"domain": "cs.HC",
"title": "Non-programmers Assessing AI-Generated Code: A Case Study",
"authors": [
"Yuvraj Virk",
"Dongyu Liu"
],
"abstract": "Non-technical end-users increasingly rely on AI code generation...",
"submitted_info": "Submitted 8 August, 2025; originally announced August 2025.",
"comments": "Accepted by VL/HCC 2025"
}

πŸ”₯ Why This is the BEST arXiv Scraper on Apify?

βœ” Optimized for Apify search ranking

βœ” Enterprise-grade scraping engine

βœ” Bulk keyword support (rare feature)

βœ” Fast large-scale extraction

βœ” Clean structured datasets

βœ” Reliable pagination

βœ” Marketplace-ready performance

βœ” Perfect for SEO traffic & marketplace visibility


πŸ’Έ Pricing

This scraper runs on a pay-per-result pricing model.

You only pay for successfully extracted records.

πŸ’³ Price: $1.49 / 1,000 results


❓ FAQ (SEO BOOST SECTION)

Can I scrape multiple keywords at once?

Yes β€” Bulk Keyword Mode is fully supported.

Can I collect thousands of research papers?

Yes β€” simply increase maxitems.

Does it extract abstracts and authors?

Yes β€” complete paper metadata including titles, authors, abstracts, subject categories, submission information and PDF links are extracted.

Is coding required?

No β€” this is a 100% no-code Apify Actor.

Can I export the data?

Yes β€” JSON, CSV, Excel, XML and HTML are fully supported.


⚠️ Disclaimer

This tool is not affiliated with arXiv. It is an independent data extraction solution built for publicly available research paper metadata.


We are building a complete PrimeScrape Academic Intelligence Suite.

πŸ‘‰ Coming Soon πŸš€


🌍 PrimeScrape Ecosystem

Built for data scraping, automation, AI training datasets, scientific intelligence and market research at scale.

πŸ“š Research paper extraction

πŸŽ“ Academic intelligence

πŸ“Š Publication analytics

πŸ€– AI datasets

πŸ“ˆ Scientific trend monitoring

βš™οΈ Automation pipelines


πŸ“¬ Support

⭐⭐⭐⭐⭐ Leave a review if you like this scraper.

πŸ“© Contact us for custom scraping solutions, enterprise requests and large-scale academic data extraction.