1from apify_client import ApifyClient
2
3
4
5client = ApifyClient("<YOUR_API_TOKEN>")
6
7
8run_input = {
9 "documentUrls": [{ "url": "https://www.federalreserve.gov/releases/g19/current/g19.pdf" }],
10 "ocrMode": "auto",
11 "ocrLanguage": "eng",
12 "maxPagesPerDocument": 50,
13 "maxDocuments": 100,
14 "datasetUrlField": "url",
15 "keyValueStoreKeys": [],
16 "extractionSchema": {},
17 "llmProvider": "anthropic",
18 "maxFileSizeMb": 100,
19 "proxyConfiguration": { "useApifyProxy": False },
20}
21
22
23run = client.actor("cylindrical_lighthouse/document-intelligence").call(run_input=run_input)
24
25
26print(f"💾 Check your data here: https://console.apify.com/storage/datasets/{run.default_dataset_id}")
27for item in client.dataset(run.default_dataset_id).iterate_items():
28 print(item)
29
30