网页表格转 Excel / CSV · Table to CSV Extractor avatar

网页表格转 Excel / CSV · Table to CSV Extractor

Pricing

$10.00 / 1,000 抓取一个页面

Go to Apify Store
网页表格转 Excel / CSV · Table to CSV Extractor

网页表格转 Excel / CSV · Table to CSV Extractor

输入网址,自动抽取网页里所有 HTML 表格,第一张表直接转成 CSV / Excel 下载。支持列表与链接抽取,遵守 robots.txt,只抓公开页面。适合查数据、做研究、整理公开统计表。Table to CSV, HTML table scraper, web table extractor.

Pricing

$10.00 / 1,000 抓取一个页面

Rating

0.0

(0)

Developer

Li Sun

Li Sun

Maintained by Community

Actor stats

0

Bookmarked

2

Total users

1

Monthly active users

20 hours ago

Last modified

Share

网页表格转 Excel / CSV

给它一个网址,它把页面里所有 HTML 表格抽出来,第一张表直接变成可下载的 CSV(也能拿到完整 JSON)。 不写代码、不装插件、不需要登录目标网站。

你会拿到什么

每个页面一条记录,包含:

字段说明
url页面地址
title / meta_description页面标题与描述
tables_count这个页面里找到几个表格
table_header第一张表的表头
table_as_records第一张表按行转成的结构化记录(可直接导出 CSV/Excel)
tables所有表格的原始二维数组
list_items页面里的列表条目(可选)
links页面里的链接与文字(可选)

在 Apify 控制台的 Export 里可一键导出为 CSV / Excel / JSON。

典型用途

  • 把维基百科、统计局、政府公开页上的统计表转成 Excel 做分析
  • 整理榜单/目录页(列表 + 链接)
  • 把价格表、赛程表、排班表这类固定格式表格批量落地
  • 做数据研究时,先把网页表格变干净的结构化数据

用法

  1. 在 Input 里填入一个或多个网址(每行一个)
  2. 需要列表或链接就勾上对应选项
  3. 点 Start,运行结束后在 Export 里下载 CSV

输入参数:

参数默认说明
urls—要抓的网址,支持多个
want_tables开抽取表格(主功能)
want_lists关抽取列表条目
want_links关抽取所有链接
want_meta开抽取标题与描述
respect_robots开遵守 robots.txt,禁止抓取的页面会跳过并说明
delay_seconds1每页间隔,避免给对方服务器压力
max_pages10单次最多抓多少页

使用边界(请遵守)

  • 只抓公开页面。 不绕过登录、不绕过验证码。
  • 不用于收集个人信息。 请自行确认你的抓取目标与用途合法合规。
  • 默认遵守 robots.txt;请勿关闭后用于高频抓取。
  • 若目标网站条款明确禁止自动抓取,请不要使用本工具抓取该站点。

计费

按成功解析的页面数计费(page-extracted 事件)。抓取失败的页面不计费。

已知限制

  • 表格由静态 HTML 渲染时效果最好;纯前端 JS 动态生成的表格可能抓不到内容(那些页面返回的 HTML 里没有表格数据)。
  • 合并单元格(rowspan)会把内容放在首行,colspan 会自动补齐空列。
  • 不含 OCR:表格里的图片文字识别不了。