@keystrokehq/scrapegraph_ai 0.1.0 → 0.1.3
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/dist/action.cjs.map +1 -1
- package/dist/action.mjs.map +1 -1
- package/dist/actions/convert-webpage-to-markdown-v2.cjs +4 -4
- package/dist/actions/convert-webpage-to-markdown-v2.cjs.map +1 -1
- package/dist/actions/convert-webpage-to-markdown-v2.d.cts +38 -3
- package/dist/actions/convert-webpage-to-markdown-v2.d.cts.map +1 -1
- package/dist/actions/convert-webpage-to-markdown-v2.d.mts +38 -3
- package/dist/actions/convert-webpage-to-markdown-v2.d.mts.map +1 -1
- package/dist/actions/convert-webpage-to-markdown-v2.mjs +4 -4
- package/dist/actions/convert-webpage-to-markdown-v2.mjs.map +1 -1
- package/dist/actions/generate-schema.cjs +5 -5
- package/dist/actions/generate-schema.cjs.map +1 -1
- package/dist/actions/generate-schema.d.cts +16 -3
- package/dist/actions/generate-schema.d.cts.map +1 -1
- package/dist/actions/generate-schema.d.mts +16 -3
- package/dist/actions/generate-schema.d.mts.map +1 -1
- package/dist/actions/generate-schema.mjs +5 -5
- package/dist/actions/generate-schema.mjs.map +1 -1
- package/dist/actions/get-agentic-scraper-history.cjs +8 -8
- package/dist/actions/get-agentic-scraper-history.cjs.map +1 -1
- package/dist/actions/get-agentic-scraper-history.d.cts +27 -3
- package/dist/actions/get-agentic-scraper-history.d.cts.map +1 -1
- package/dist/actions/get-agentic-scraper-history.d.mts +27 -3
- package/dist/actions/get-agentic-scraper-history.d.mts.map +1 -1
- package/dist/actions/get-agentic-scraper-history.mjs +8 -8
- package/dist/actions/get-agentic-scraper-history.mjs.map +1 -1
- package/dist/actions/get-crawler-history.cjs +7 -7
- package/dist/actions/get-crawler-history.cjs.map +1 -1
- package/dist/actions/get-crawler-history.d.cts +36 -3
- package/dist/actions/get-crawler-history.d.cts.map +1 -1
- package/dist/actions/get-crawler-history.d.mts +36 -3
- package/dist/actions/get-crawler-history.d.mts.map +1 -1
- package/dist/actions/get-crawler-history.mjs +7 -7
- package/dist/actions/get-crawler-history.mjs.map +1 -1
- package/dist/actions/get-credits.cjs +3 -3
- package/dist/actions/get-credits.cjs.map +1 -1
- package/dist/actions/get-credits.d.cts +7 -3
- package/dist/actions/get-credits.d.cts.map +1 -1
- package/dist/actions/get-credits.d.mts +7 -3
- package/dist/actions/get-credits.d.mts.map +1 -1
- package/dist/actions/get-credits.mjs +3 -3
- package/dist/actions/get-credits.mjs.map +1 -1
- package/dist/actions/get-endpoint-suggestions.cjs +6 -6
- package/dist/actions/get-endpoint-suggestions.cjs.map +1 -1
- package/dist/actions/get-endpoint-suggestions.d.cts +21 -3
- package/dist/actions/get-endpoint-suggestions.d.cts.map +1 -1
- package/dist/actions/get-endpoint-suggestions.d.mts +21 -3
- package/dist/actions/get-endpoint-suggestions.d.mts.map +1 -1
- package/dist/actions/get-endpoint-suggestions.mjs +6 -6
- package/dist/actions/get-endpoint-suggestions.mjs.map +1 -1
- package/dist/actions/get-live-session-url.cjs +3 -3
- package/dist/actions/get-live-session-url.cjs.map +1 -1
- package/dist/actions/get-live-session-url.d.cts +12 -3
- package/dist/actions/get-live-session-url.d.cts.map +1 -1
- package/dist/actions/get-live-session-url.d.mts +12 -3
- package/dist/actions/get-live-session-url.d.mts.map +1 -1
- package/dist/actions/get-live-session-url.mjs +3 -3
- package/dist/actions/get-live-session-url.mjs.map +1 -1
- package/dist/actions/get-markdownify-history.cjs +4 -4
- package/dist/actions/get-markdownify-history.cjs.map +1 -1
- package/dist/actions/get-markdownify-history.d.cts +24 -3
- package/dist/actions/get-markdownify-history.d.cts.map +1 -1
- package/dist/actions/get-markdownify-history.d.mts +24 -3
- package/dist/actions/get-markdownify-history.d.mts.map +1 -1
- package/dist/actions/get-markdownify-history.mjs +4 -4
- package/dist/actions/get-markdownify-history.mjs.map +1 -1
- package/dist/actions/get-scrape-history.cjs +4 -4
- package/dist/actions/get-scrape-history.cjs.map +1 -1
- package/dist/actions/get-scrape-history.d.cts +25 -3
- package/dist/actions/get-scrape-history.d.cts.map +1 -1
- package/dist/actions/get-scrape-history.d.mts +25 -3
- package/dist/actions/get-scrape-history.d.mts.map +1 -1
- package/dist/actions/get-scrape-history.mjs +4 -4
- package/dist/actions/get-scrape-history.mjs.map +1 -1
- package/dist/actions/get-searchscraper-history.cjs +3 -3
- package/dist/actions/get-searchscraper-history.cjs.map +1 -1
- package/dist/actions/get-searchscraper-history.d.cts +26 -3
- package/dist/actions/get-searchscraper-history.d.cts.map +1 -1
- package/dist/actions/get-searchscraper-history.d.mts +26 -3
- package/dist/actions/get-searchscraper-history.d.mts.map +1 -1
- package/dist/actions/get-searchscraper-history.mjs +3 -3
- package/dist/actions/get-searchscraper-history.mjs.map +1 -1
- package/dist/actions/get-sitemap-history.cjs +9 -9
- package/dist/actions/get-sitemap-history.cjs.map +1 -1
- package/dist/actions/get-sitemap-history.d.cts +22 -3
- package/dist/actions/get-sitemap-history.d.cts.map +1 -1
- package/dist/actions/get-sitemap-history.d.mts +22 -3
- package/dist/actions/get-sitemap-history.d.mts.map +1 -1
- package/dist/actions/get-sitemap-history.mjs +9 -9
- package/dist/actions/get-sitemap-history.mjs.map +1 -1
- package/dist/actions/get-smartscraper-history.cjs +5 -5
- package/dist/actions/get-smartscraper-history.cjs.map +1 -1
- package/dist/actions/get-smartscraper-history.d.cts +26 -3
- package/dist/actions/get-smartscraper-history.d.cts.map +1 -1
- package/dist/actions/get-smartscraper-history.d.mts +26 -3
- package/dist/actions/get-smartscraper-history.d.mts.map +1 -1
- package/dist/actions/get-smartscraper-history.mjs +5 -5
- package/dist/actions/get-smartscraper-history.mjs.map +1 -1
- package/dist/actions/get-usage-timeline.cjs +4 -4
- package/dist/actions/get-usage-timeline.cjs.map +1 -1
- package/dist/actions/get-usage-timeline.d.cts +17 -3
- package/dist/actions/get-usage-timeline.d.cts.map +1 -1
- package/dist/actions/get-usage-timeline.d.mts +17 -3
- package/dist/actions/get-usage-timeline.d.mts.map +1 -1
- package/dist/actions/get-usage-timeline.mjs +4 -4
- package/dist/actions/get-usage-timeline.mjs.map +1 -1
- package/dist/actions/get-webhook-logs.cjs +2 -2
- package/dist/actions/get-webhook-logs.cjs.map +1 -1
- package/dist/actions/get-webhook-logs.d.cts +20 -3
- package/dist/actions/get-webhook-logs.d.cts.map +1 -1
- package/dist/actions/get-webhook-logs.d.mts +20 -3
- package/dist/actions/get-webhook-logs.d.mts.map +1 -1
- package/dist/actions/get-webhook-logs.mjs +2 -2
- package/dist/actions/get-webhook-logs.mjs.map +1 -1
- package/dist/actions/list-scheduled-jobs.cjs +13 -13
- package/dist/actions/list-scheduled-jobs.cjs.map +1 -1
- package/dist/actions/list-scheduled-jobs.d.cts +30 -3
- package/dist/actions/list-scheduled-jobs.d.cts.map +1 -1
- package/dist/actions/list-scheduled-jobs.d.mts +30 -3
- package/dist/actions/list-scheduled-jobs.d.mts.map +1 -1
- package/dist/actions/list-scheduled-jobs.mjs +13 -13
- package/dist/actions/list-scheduled-jobs.mjs.map +1 -1
- package/dist/actions/markdownify-status.cjs +4 -4
- package/dist/actions/markdownify-status.cjs.map +1 -1
- package/dist/actions/markdownify-status.d.cts +18 -3
- package/dist/actions/markdownify-status.d.cts.map +1 -1
- package/dist/actions/markdownify-status.d.mts +18 -3
- package/dist/actions/markdownify-status.d.mts.map +1 -1
- package/dist/actions/markdownify-status.mjs +4 -4
- package/dist/actions/markdownify-status.mjs.map +1 -1
- package/dist/actions/save-endpoint.cjs +4 -4
- package/dist/actions/save-endpoint.cjs.map +1 -1
- package/dist/actions/save-endpoint.d.cts +45 -3
- package/dist/actions/save-endpoint.d.cts.map +1 -1
- package/dist/actions/save-endpoint.d.mts +45 -3
- package/dist/actions/save-endpoint.d.mts.map +1 -1
- package/dist/actions/save-endpoint.mjs +4 -4
- package/dist/actions/save-endpoint.mjs.map +1 -1
- package/dist/actions/search-scraper-status.cjs +3 -3
- package/dist/actions/search-scraper-status.cjs.map +1 -1
- package/dist/actions/search-scraper-status.d.cts +16 -3
- package/dist/actions/search-scraper-status.d.cts.map +1 -1
- package/dist/actions/search-scraper-status.d.mts +16 -3
- package/dist/actions/search-scraper-status.d.mts.map +1 -1
- package/dist/actions/search-scraper-status.mjs +3 -3
- package/dist/actions/search-scraper-status.mjs.map +1 -1
- package/dist/actions/search-scraper.cjs +4 -4
- package/dist/actions/search-scraper.cjs.map +1 -1
- package/dist/actions/search-scraper.d.cts +24 -3
- package/dist/actions/search-scraper.d.cts.map +1 -1
- package/dist/actions/search-scraper.d.mts +24 -3
- package/dist/actions/search-scraper.d.mts.map +1 -1
- package/dist/actions/search-scraper.mjs +4 -4
- package/dist/actions/search-scraper.mjs.map +1 -1
- package/dist/actions/smart-crawler-status.cjs +7 -7
- package/dist/actions/smart-crawler-status.cjs.map +1 -1
- package/dist/actions/smart-crawler-status.d.cts +22 -3
- package/dist/actions/smart-crawler-status.d.cts.map +1 -1
- package/dist/actions/smart-crawler-status.d.mts +22 -3
- package/dist/actions/smart-crawler-status.d.mts.map +1 -1
- package/dist/actions/smart-crawler-status.mjs +7 -7
- package/dist/actions/smart-crawler-status.mjs.map +1 -1
- package/dist/actions/smart-scraper-start.cjs +4 -4
- package/dist/actions/smart-scraper-start.cjs.map +1 -1
- package/dist/actions/smart-scraper-start.d.cts +48 -3
- package/dist/actions/smart-scraper-start.d.cts.map +1 -1
- package/dist/actions/smart-scraper-start.d.mts +48 -3
- package/dist/actions/smart-scraper-start.d.mts.map +1 -1
- package/dist/actions/smart-scraper-start.mjs +4 -4
- package/dist/actions/smart-scraper-start.mjs.map +1 -1
- package/dist/actions/smart-scraper-status.cjs +4 -4
- package/dist/actions/smart-scraper-status.cjs.map +1 -1
- package/dist/actions/smart-scraper-status.d.cts +14 -3
- package/dist/actions/smart-scraper-status.d.cts.map +1 -1
- package/dist/actions/smart-scraper-status.d.mts +14 -3
- package/dist/actions/smart-scraper-status.d.mts.map +1 -1
- package/dist/actions/smart-scraper-status.mjs +4 -4
- package/dist/actions/smart-scraper-status.mjs.map +1 -1
- package/dist/actions/start-smart-crawler.cjs +1 -1
- package/dist/actions/start-smart-crawler.cjs.map +1 -1
- package/dist/actions/start-smart-crawler.d.cts +47 -3
- package/dist/actions/start-smart-crawler.d.cts.map +1 -1
- package/dist/actions/start-smart-crawler.d.mts +47 -3
- package/dist/actions/start-smart-crawler.d.mts.map +1 -1
- package/dist/actions/start-smart-crawler.mjs +1 -1
- package/dist/actions/start-smart-crawler.mjs.map +1 -1
- package/dist/actions/submit-feedback.cjs +5 -5
- package/dist/actions/submit-feedback.cjs.map +1 -1
- package/dist/actions/submit-feedback.d.cts +16 -3
- package/dist/actions/submit-feedback.d.cts.map +1 -1
- package/dist/actions/submit-feedback.d.mts +16 -3
- package/dist/actions/submit-feedback.d.mts.map +1 -1
- package/dist/actions/submit-feedback.mjs +5 -5
- package/dist/actions/submit-feedback.mjs.map +1 -1
- package/dist/actions/submit-product-feedback.cjs +1 -1
- package/dist/actions/submit-product-feedback.cjs.map +1 -1
- package/dist/actions/submit-product-feedback.d.cts +41 -3
- package/dist/actions/submit-product-feedback.d.cts.map +1 -1
- package/dist/actions/submit-product-feedback.d.mts +41 -3
- package/dist/actions/submit-product-feedback.d.mts.map +1 -1
- package/dist/actions/submit-product-feedback.mjs +1 -1
- package/dist/actions/submit-product-feedback.mjs.map +1 -1
- package/dist/actions/toonify.cjs +1 -1
- package/dist/actions/toonify.cjs.map +1 -1
- package/dist/actions/toonify.d.cts +9 -3
- package/dist/actions/toonify.d.cts.map +1 -1
- package/dist/actions/toonify.d.mts +9 -3
- package/dist/actions/toonify.d.mts.map +1 -1
- package/dist/actions/toonify.mjs +1 -1
- package/dist/actions/toonify.mjs.map +1 -1
- package/dist/actions/validate-api-key.cjs +2 -2
- package/dist/actions/validate-api-key.cjs.map +1 -1
- package/dist/actions/validate-api-key.d.cts +6 -3
- package/dist/actions/validate-api-key.d.cts.map +1 -1
- package/dist/actions/validate-api-key.d.mts +6 -3
- package/dist/actions/validate-api-key.d.mts.map +1 -1
- package/dist/actions/validate-api-key.mjs +2 -2
- package/dist/actions/validate-api-key.mjs.map +1 -1
- package/dist/catalog.cjs +7 -1
- package/dist/catalog.cjs.map +1 -1
- package/dist/catalog.d.cts +8 -0
- package/dist/catalog.d.mts +8 -0
- package/dist/catalog.mjs +7 -1
- package/dist/catalog.mjs.map +1 -1
- package/package.json +2 -2
|
@@ -1,9 +1,28 @@
|
|
|
1
1
|
import { z } from "zod";
|
|
2
2
|
|
|
3
3
|
//#region src/actions/smart-crawler-status.d.ts
|
|
4
|
-
declare const ScrapegraphAiSmartCrawlerStatusInput: z.
|
|
5
|
-
|
|
6
|
-
|
|
4
|
+
declare const ScrapegraphAiSmartCrawlerStatusInput: z.ZodObject<{
|
|
5
|
+
task_id: z.ZodString;
|
|
6
|
+
}, z.core.$strip>;
|
|
7
|
+
declare const ScrapegraphAiSmartCrawlerStatusOutput: z.ZodObject<{
|
|
8
|
+
result: z.ZodNullable<z.ZodObject<{
|
|
9
|
+
pages: z.ZodArray<z.ZodObject<{
|
|
10
|
+
url: z.ZodNullable<z.ZodString>;
|
|
11
|
+
html: z.ZodOptional<z.ZodNullable<z.ZodString>>;
|
|
12
|
+
markdown: z.ZodNullable<z.ZodString>;
|
|
13
|
+
}, z.core.$loose>>;
|
|
14
|
+
status: z.ZodNullable<z.ZodString>;
|
|
15
|
+
llm_result: z.ZodOptional<z.ZodNullable<z.ZodRecord<z.ZodString, z.ZodUnknown>>>;
|
|
16
|
+
crawled_urls: z.ZodArray<z.ZodString>;
|
|
17
|
+
credits_used: z.ZodOptional<z.ZodNullable<z.ZodNumber>>;
|
|
18
|
+
elapsed_time: z.ZodOptional<z.ZodNullable<z.ZodNumber>>;
|
|
19
|
+
pages_processed: z.ZodOptional<z.ZodNullable<z.ZodNumber>>;
|
|
20
|
+
}, z.core.$loose>>;
|
|
21
|
+
status: z.ZodNullable<z.ZodString>;
|
|
22
|
+
}, z.core.$loose>;
|
|
23
|
+
declare const scrapegraphAiSmartCrawlerStatus: import("@keystrokehq/action").WorkflowActionDefinition<{
|
|
24
|
+
task_id: string;
|
|
25
|
+
}, unknown, import("@keystrokehq/shared").ResolvedCredentials<readonly [import("@keystrokehq/shared").Credential]>, readonly [import("@keystrokehq/shared").Credential]>;
|
|
7
26
|
//#endregion
|
|
8
27
|
export { scrapegraphAiSmartCrawlerStatus };
|
|
9
28
|
//# sourceMappingURL=smart-crawler-status.d.mts.map
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"smart-crawler-status.d.mts","names":[],"sources":["../../src/actions/smart-crawler-status.ts"],"mappings":";;;cAIa,oCAAA,
|
|
1
|
+
{"version":3,"file":"smart-crawler-status.d.mts","names":[],"sources":["../../src/actions/smart-crawler-status.ts"],"mappings":";;;cAIa,oCAAA,EAAoC,CAAA,CAAA,SAAA;;;cAiBpC,qCAAA,EAAqC,CAAA,CAAA,SAAA;;;;;;;;;;;;;;;;cAKrC,+BAAA,gCAA+B,wBAAA"}
|
|
@@ -3,19 +3,19 @@ import { z } from "zod";
|
|
|
3
3
|
//#region src/actions/smart-crawler-status.ts
|
|
4
4
|
const ScrapegraphAiSmartCrawlerStatusInput = z.object({ task_id: z.string().describe("The unique identifier of the SmartCrawler task to check status for. Obtained from starting a SmartCrawler job.") }).describe("Request model for checking the status of a SmartCrawler job.");
|
|
5
5
|
const ScrapegraphAiSmartCrawlerStatus_SmartCrawlerPageSchema = z.object({
|
|
6
|
-
url: z.string().describe("URL of the crawled page."),
|
|
6
|
+
url: z.string().describe("URL of the crawled page.").nullable(),
|
|
7
7
|
html: z.string().describe("Raw HTML content of the page if available.").nullable().optional(),
|
|
8
|
-
markdown: z.string().describe("Extracted content in Markdown format.")
|
|
9
|
-
}).describe("Represents a single crawled page with extracted content.");
|
|
8
|
+
markdown: z.string().describe("Extracted content in Markdown format.").nullable()
|
|
9
|
+
}).passthrough().describe("Represents a single crawled page with extracted content.");
|
|
10
10
|
const ScrapegraphAiSmartCrawlerStatus_SmartCrawlerResultSchema = z.object({
|
|
11
11
|
pages: z.array(ScrapegraphAiSmartCrawlerStatus_SmartCrawlerPageSchema).describe("Details and extracted content for each page."),
|
|
12
|
-
status: z.string().describe("Status of the crawl job (e.g., 'done', 'processing', 'queued', 'failed')."),
|
|
12
|
+
status: z.string().describe("Status of the crawl job (e.g., 'done', 'processing', 'queued', 'failed').").nullable(),
|
|
13
13
|
llm_result: z.record(z.string(), z.unknown()).describe("Structured extraction result from the LLM. Only present when extraction_mode was enabled.").nullable().optional(),
|
|
14
14
|
crawled_urls: z.array(z.string()).describe("List of all URLs visited during crawling."),
|
|
15
15
|
credits_used: z.number().int().describe("Number of credits consumed by this crawl job.").nullable().optional(),
|
|
16
16
|
elapsed_time: z.number().describe("Time taken to complete the crawl in seconds.").nullable().optional(),
|
|
17
17
|
pages_processed: z.number().int().describe("Total number of pages processed.").nullable().optional()
|
|
18
|
-
}).describe("Structured result object for the crawl job.");
|
|
18
|
+
}).passthrough().describe("Structured result object for the crawl job.");
|
|
19
19
|
const scrapegraphAiSmartCrawlerStatus = action("SCRAPEGRAPH_AI_SMART_CRAWLER_STATUS", {
|
|
20
20
|
slug: "scrapegraph_ai-smart-crawler-status",
|
|
21
21
|
name: "SmartCrawler Status",
|
|
@@ -23,8 +23,8 @@ const scrapegraphAiSmartCrawlerStatus = action("SCRAPEGRAPH_AI_SMART_CRAWLER_STA
|
|
|
23
23
|
input: ScrapegraphAiSmartCrawlerStatusInput,
|
|
24
24
|
output: z.object({
|
|
25
25
|
result: ScrapegraphAiSmartCrawlerStatus_SmartCrawlerResultSchema.nullable(),
|
|
26
|
-
status: z.string().describe("Overall request status (e.g., 'success').")
|
|
27
|
-
}).describe("Response model for SmartCrawler status checks.")
|
|
26
|
+
status: z.string().describe("Overall request status (e.g., 'success').").nullable()
|
|
27
|
+
}).passthrough().describe("Response model for SmartCrawler status checks.")
|
|
28
28
|
});
|
|
29
29
|
//#endregion
|
|
30
30
|
export { scrapegraphAiSmartCrawlerStatus };
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"smart-crawler-status.mjs","names":[],"sources":["../../src/actions/smart-crawler-status.ts"],"sourcesContent":["import { z } from \"zod\";\n\nimport { action } from \"../action\";\n\nexport const ScrapegraphAiSmartCrawlerStatusInput
|
|
1
|
+
{"version":3,"file":"smart-crawler-status.mjs","names":[],"sources":["../../src/actions/smart-crawler-status.ts"],"sourcesContent":["import { z } from \"zod\";\n\nimport { action } from \"../action\";\n\nexport const ScrapegraphAiSmartCrawlerStatusInput = z.object({\n task_id: z.string().describe(\"The unique identifier of the SmartCrawler task to check status for. Obtained from starting a SmartCrawler job.\"),\n}).describe(\"Request model for checking the status of a SmartCrawler job.\");\nconst ScrapegraphAiSmartCrawlerStatus_SmartCrawlerPageSchema = z.object({\n url: z.string().describe(\"URL of the crawled page.\").nullable(),\n html: z.string().describe(\"Raw HTML content of the page if available.\").nullable().optional(),\n markdown: z.string().describe(\"Extracted content in Markdown format.\").nullable(),\n}).passthrough().describe(\"Represents a single crawled page with extracted content.\");\nconst ScrapegraphAiSmartCrawlerStatus_SmartCrawlerResultSchema = z.object({\n pages: z.array(ScrapegraphAiSmartCrawlerStatus_SmartCrawlerPageSchema).describe(\"Details and extracted content for each page.\"),\n status: z.string().describe(\"Status of the crawl job (e.g., 'done', 'processing', 'queued', 'failed').\").nullable(),\n llm_result: z.record(z.string(), z.unknown()).describe(\"Structured extraction result from the LLM. Only present when extraction_mode was enabled.\").nullable().optional(),\n crawled_urls: z.array(z.string()).describe(\"List of all URLs visited during crawling.\"),\n credits_used: z.number().int().describe(\"Number of credits consumed by this crawl job.\").nullable().optional(),\n elapsed_time: z.number().describe(\"Time taken to complete the crawl in seconds.\").nullable().optional(),\n pages_processed: z.number().int().describe(\"Total number of pages processed.\").nullable().optional(),\n}).passthrough().describe(\"Structured result object for the crawl job.\");\nexport const ScrapegraphAiSmartCrawlerStatusOutput = z.object({\n result: ScrapegraphAiSmartCrawlerStatus_SmartCrawlerResultSchema.nullable(),\n status: z.string().describe(\"Overall request status (e.g., 'success').\").nullable(),\n}).passthrough().describe(\"Response model for SmartCrawler status checks.\");\n\nexport const scrapegraphAiSmartCrawlerStatus = action(\"SCRAPEGRAPH_AI_SMART_CRAWLER_STATUS\", {\n slug: \"scrapegraph_ai-smart-crawler-status\",\n name: \"SmartCrawler Status\",\n description: \"Check the status and retrieve results of a SmartCrawler web crawling job. Use this action to poll for completion and get the extracted content from a previously started SmartCrawler job. Returns the job status, crawled URLs, page content in markdown/HTML format, and LLM extraction results (if enabled). Implement a polling timeout (e.g., max retries or elapsed time cap) to avoid indefinite loops when waiting for long-running jobs.\",\n input: ScrapegraphAiSmartCrawlerStatusInput,\n output: ScrapegraphAiSmartCrawlerStatusOutput,\n});\n"],"mappings":";;;AAIA,MAAa,uCAAuC,EAAE,OAAO,EAC3D,SAAS,EAAE,OAAO,CAAC,CAAC,SAAS,gHAAgH,EAC/I,CAAC,CAAC,CAAC,SAAS,8DAA8D;AAC1E,MAAM,yDAAyD,EAAE,OAAO;CACtE,KAAK,EAAE,OAAO,CAAC,CAAC,SAAS,0BAA0B,CAAC,CAAC,SAAS;CAC9D,MAAM,EAAE,OAAO,CAAC,CAAC,SAAS,4CAA4C,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;CAC5F,UAAU,EAAE,OAAO,CAAC,CAAC,SAAS,uCAAuC,CAAC,CAAC,SAAS;AAClF,CAAC,CAAC,CAAC,YAAY,CAAC,CAAC,SAAS,0DAA0D;AACpF,MAAM,2DAA2D,EAAE,OAAO;CACxE,OAAO,EAAE,MAAM,sDAAsD,CAAC,CAAC,SAAS,8CAA8C;CAC9H,QAAQ,EAAE,OAAO,CAAC,CAAC,SAAS,2EAA2E,CAAC,CAAC,SAAS;CAClH,YAAY,EAAE,OAAO,EAAE,OAAO,GAAG,EAAE,QAAQ,CAAC,CAAC,CAAC,SAAS,2FAA2F,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;CACxK,cAAc,EAAE,MAAM,EAAE,OAAO,CAAC,CAAC,CAAC,SAAS,2CAA2C;CACtF,cAAc,EAAE,OAAO,CAAC,CAAC,IAAI,CAAC,CAAC,SAAS,+CAA+C,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;CAC7G,cAAc,EAAE,OAAO,CAAC,CAAC,SAAS,8CAA8C,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;CACtG,iBAAiB,EAAE,OAAO,CAAC,CAAC,IAAI,CAAC,CAAC,SAAS,kCAAkC,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;AACrG,CAAC,CAAC,CAAC,YAAY,CAAC,CAAC,SAAS,6CAA6C;AAMvE,MAAa,kCAAkC,OAAO,uCAAuC;CAC3F,MAAM;CACN,MAAM;CACN,aAAa;CACb,OAAO;CACP,QAVmD,EAAE,OAAO;EAC5D,QAAQ,yDAAyD,SAAS;EAC1E,QAAQ,EAAE,OAAO,CAAC,CAAC,SAAS,2CAA2C,CAAC,CAAC,SAAS;CACpF,CAAC,CAAC,CAAC,YAAY,CAAC,CAAC,SAAS,gDAOhB;AACV,CAAC"}
|
|
@@ -5,8 +5,8 @@ const ScrapegraphAiSmartScraperStartInput = zod.z.object({
|
|
|
5
5
|
mock: zod.z.boolean().describe("If true, return mock test data instead of actual extraction. Useful for testing without consuming credits.").optional(),
|
|
6
6
|
wait: zod.z.boolean().default(false).describe("If true, wait for job completion and return full results. If false (default), return request_id immediately for async polling. Poll using SCRAPEGRAPH_AI_SMART_SCRAPER_STATUS with the returned `request_id`.").optional(),
|
|
7
7
|
steps: zod.z.array(zod.z.record(zod.z.string(), zod.z.unknown())).describe("Browser interaction actions to perform before extraction (e.g., click buttons, fill forms). Each step is a dict with action type and parameters.").optional(),
|
|
8
|
-
cookies: zod.z.
|
|
9
|
-
headers: zod.z.
|
|
8
|
+
cookies: zod.z.record(zod.z.string(), zod.z.unknown()).describe("Cookies to include in the request for authentication or session management.").optional(),
|
|
9
|
+
headers: zod.z.record(zod.z.string(), zod.z.unknown()).describe("Custom HTTP headers for the scraping request (e.g., User-Agent, Accept-Language). Used when fetching website_url.").optional(),
|
|
10
10
|
stealth: zod.z.boolean().describe("Enable anti-bot detection techniques. Adds +4 credit cost per request. Use for sites with bot protection.").optional(),
|
|
11
11
|
plain_text: zod.z.boolean().describe("Return extracted content as plain text instead of JSON. Useful for simple text extraction.").optional(),
|
|
12
12
|
total_pages: zod.z.number().int().describe("Number of pages to scrape for paginated content (1-100). Default is 1.").optional(),
|
|
@@ -21,7 +21,7 @@ const ScrapegraphAiSmartScraperStartInput = zod.z.object({
|
|
|
21
21
|
const ScrapegraphAiSmartScraperStartOutput = zod.z.object({
|
|
22
22
|
error: zod.z.string().describe("Error message if the job failed (when wait=True).").nullable().optional(),
|
|
23
23
|
result: zod.z.record(zod.z.string(), zod.z.unknown()).describe("Extracted information based on the prompt (when wait=True and completed).").nullable().optional(),
|
|
24
|
-
status: zod.z.string().describe("Overall request status (e.g., 'success')."),
|
|
24
|
+
status: zod.z.string().describe("Overall request status (e.g., 'success').").nullable(),
|
|
25
25
|
job_status: zod.z.enum([
|
|
26
26
|
"queued",
|
|
27
27
|
"processing",
|
|
@@ -31,7 +31,7 @@ const ScrapegraphAiSmartScraperStartOutput = zod.z.object({
|
|
|
31
31
|
request_id: zod.z.string().describe("Request ID when wait=False.").nullable().optional(),
|
|
32
32
|
user_prompt: zod.z.string().describe("The original prompt provided by the user (when wait=True).").nullable().optional(),
|
|
33
33
|
website_url: zod.z.string().describe("The URL of the webpage that was processed (when wait=True).").nullable().optional()
|
|
34
|
-
}).describe("Response schema returned after initiating a SmartScraper job.");
|
|
34
|
+
}).passthrough().describe("Response schema returned after initiating a SmartScraper job.");
|
|
35
35
|
const scrapegraphAiSmartScraperStart = require_action.action("SCRAPEGRAPH_AI_SMART_SCRAPER_START", {
|
|
36
36
|
slug: "scrapegraph_ai-smart-scraper-start",
|
|
37
37
|
name: "Start Smart Scraper",
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"smart-scraper-start.cjs","names":["z","action"],"sources":["../../src/actions/smart-scraper-start.ts"],"sourcesContent":["import { z } from \"zod\";\n\nimport { action } from \"../action\";\n\nexport const ScrapegraphAiSmartScraperStartInput
|
|
1
|
+
{"version":3,"file":"smart-scraper-start.cjs","names":["z","action"],"sources":["../../src/actions/smart-scraper-start.ts"],"sourcesContent":["import { z } from \"zod\";\n\nimport { action } from \"../action\";\n\nexport const ScrapegraphAiSmartScraperStartInput = z.object({\n mock: z.boolean().describe(\"If true, return mock test data instead of actual extraction. Useful for testing without consuming credits.\").optional(),\n wait: z.boolean().default(false).describe(\"If true, wait for job completion and return full results. If false (default), return request_id immediately for async polling. Poll using SCRAPEGRAPH_AI_SMART_SCRAPER_STATUS with the returned `request_id`.\").optional(),\n steps: z.array(z.record(z.string(), z.unknown())).describe(\"Browser interaction actions to perform before extraction (e.g., click buttons, fill forms). Each step is a dict with action type and parameters.\").optional(),\n cookies: z.record(z.string(), z.unknown()).describe(\"Cookies to include in the request for authentication or session management.\").optional(),\n headers: z.record(z.string(), z.unknown()).describe(\"Custom HTTP headers for the scraping request (e.g., User-Agent, Accept-Language). Used when fetching website_url.\").optional(),\n stealth: z.boolean().describe(\"Enable anti-bot detection techniques. Adds +4 credit cost per request. Use for sites with bot protection.\").optional(),\n plain_text: z.boolean().describe(\"Return extracted content as plain text instead of JSON. Useful for simple text extraction.\").optional(),\n total_pages: z.number().int().describe(\"Number of pages to scrape for paginated content (1-100). Default is 1.\").optional(),\n user_prompt: z.string().describe(\"Natural language description of what information to extract from the webpage. Be specific about the data you want (e.g., 'Extract the product name, price, and description').\"),\n website_url: z.string().describe(\"Full URL of the webpage to scrape (must include https://). Required if website_html and website_markdown are not provided.\").optional(),\n website_html: z.string().describe(\"Raw HTML content to scrape (max 2MB). Use this if you already have the page HTML. Required if website_url and website_markdown are not provided.\").optional(),\n output_schema: z.record(z.string(), z.unknown()).describe(\"JSON Schema defining the structure of extracted data. Helps ensure consistent, structured output.\").optional(),\n render_heavy_js: z.boolean().describe(\"Enable enhanced JavaScript rendering for Single Page Applications (SPAs) and heavy JS sites. May increase processing time.\").optional(),\n website_markdown: z.string().describe(\"Raw Markdown content to scrape (max 2MB). Use this if you already have the page content as Markdown. Required if website_url and website_html are not provided.\").optional(),\n number_of_scrolls: z.number().int().describe(\"Number of scroll iterations for infinite scroll pages (0-50). Default is 0. Use for pages that load content on scroll.\").optional(),\n}).describe(\"Request schema for initiating a SmartScraper job.\");\nexport const ScrapegraphAiSmartScraperStartOutput = z.object({\n error: z.string().describe(\"Error message if the job failed (when wait=True).\").nullable().optional(),\n result: z.record(z.string(), z.unknown()).describe(\"Extracted information based on the prompt (when wait=True and completed).\").nullable().optional(),\n status: z.string().describe(\"Overall request status (e.g., 'success').\").nullable(),\n job_status: z.enum([\"queued\", \"processing\", \"completed\", \"failed\"]).describe(\"Current status of the scraping job (when wait=True).\").nullable().optional(),\n request_id: z.string().describe(\"Request ID when wait=False.\").nullable().optional(),\n user_prompt: z.string().describe(\"The original prompt provided by the user (when wait=True).\").nullable().optional(),\n website_url: z.string().describe(\"The URL of the webpage that was processed (when wait=True).\").nullable().optional(),\n}).passthrough().describe(\"Response schema returned after initiating a SmartScraper job.\");\n\nexport const scrapegraphAiSmartScraperStart = action(\"SCRAPEGRAPH_AI_SMART_SCRAPER_START\", {\n slug: \"scrapegraph_ai-smart-scraper-start\",\n name: \"Start Smart Scraper\",\n description: \"Start AI-powered web scraping with natural language extraction prompts. When `wait` is false (default), returns a `request_id`; poll for results using SCRAPEGRAPH_AI_SMART_SCRAPER_STATUS. Check `error` and `job_status` fields in the response before using extracted data.\",\n input: ScrapegraphAiSmartScraperStartInput,\n output: ScrapegraphAiSmartScraperStartOutput,\n});\n"],"mappings":";;;AAIA,MAAa,sCAAsCA,IAAAA,EAAE,OAAO;CAC1D,MAAMA,IAAAA,EAAE,QAAQ,CAAC,CAAC,SAAS,4GAA4G,CAAC,CAAC,SAAS;CAClJ,MAAMA,IAAAA,EAAE,QAAQ,CAAC,CAAC,QAAQ,KAAK,CAAC,CAAC,SAAS,+MAA+M,CAAC,CAAC,SAAS;CACpQ,OAAOA,IAAAA,EAAE,MAAMA,IAAAA,EAAE,OAAOA,IAAAA,EAAE,OAAO,GAAGA,IAAAA,EAAE,QAAQ,CAAC,CAAC,CAAC,CAAC,SAAS,kJAAkJ,CAAC,CAAC,SAAS;CACxN,SAASA,IAAAA,EAAE,OAAOA,IAAAA,EAAE,OAAO,GAAGA,IAAAA,EAAE,QAAQ,CAAC,CAAC,CAAC,SAAS,6EAA6E,CAAC,CAAC,SAAS;CAC5I,SAASA,IAAAA,EAAE,OAAOA,IAAAA,EAAE,OAAO,GAAGA,IAAAA,EAAE,QAAQ,CAAC,CAAC,CAAC,SAAS,mHAAmH,CAAC,CAAC,SAAS;CAClL,SAASA,IAAAA,EAAE,QAAQ,CAAC,CAAC,SAAS,2GAA2G,CAAC,CAAC,SAAS;CACpJ,YAAYA,IAAAA,EAAE,QAAQ,CAAC,CAAC,SAAS,4FAA4F,CAAC,CAAC,SAAS;CACxI,aAAaA,IAAAA,EAAE,OAAO,CAAC,CAAC,IAAI,CAAC,CAAC,SAAS,wEAAwE,CAAC,CAAC,SAAS;CAC1H,aAAaA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,+KAA+K;CAChN,aAAaA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,4HAA4H,CAAC,CAAC,SAAS;CACxK,cAAcA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,kJAAkJ,CAAC,CAAC,SAAS;CAC/L,eAAeA,IAAAA,EAAE,OAAOA,IAAAA,EAAE,OAAO,GAAGA,IAAAA,EAAE,QAAQ,CAAC,CAAC,CAAC,SAAS,mGAAmG,CAAC,CAAC,SAAS;CACxK,iBAAiBA,IAAAA,EAAE,QAAQ,CAAC,CAAC,SAAS,4HAA4H,CAAC,CAAC,SAAS;CAC7K,kBAAkBA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,iKAAiK,CAAC,CAAC,SAAS;CAClN,mBAAmBA,IAAAA,EAAE,OAAO,CAAC,CAAC,IAAI,CAAC,CAAC,SAAS,wHAAwH,CAAC,CAAC,SAAS;AAClL,CAAC,CAAC,CAAC,SAAS,mDAAmD;AAC/D,MAAa,uCAAuCA,IAAAA,EAAE,OAAO;CAC3D,OAAOA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,mDAAmD,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;CACpG,QAAQA,IAAAA,EAAE,OAAOA,IAAAA,EAAE,OAAO,GAAGA,IAAAA,EAAE,QAAQ,CAAC,CAAC,CAAC,SAAS,2EAA2E,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;CACpJ,QAAQA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,2CAA2C,CAAC,CAAC,SAAS;CAClF,YAAYA,IAAAA,EAAE,KAAK;EAAC;EAAU;EAAc;EAAa;CAAQ,CAAC,CAAC,CAAC,SAAS,sDAAsD,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;CACzJ,YAAYA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,6BAA6B,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;CACnF,aAAaA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,4DAA4D,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;CACnH,aAAaA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,6DAA6D,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;AACtH,CAAC,CAAC,CAAC,YAAY,CAAC,CAAC,SAAS,+DAA+D;AAEzF,MAAa,iCAAiCC,eAAAA,OAAO,sCAAsC;CACzF,MAAM;CACN,MAAM;CACN,aAAa;CACb,OAAO;CACP,QAAQ;AACV,CAAC"}
|
|
@@ -1,9 +1,54 @@
|
|
|
1
1
|
import { z } from "zod";
|
|
2
2
|
|
|
3
3
|
//#region src/actions/smart-scraper-start.d.ts
|
|
4
|
-
declare const ScrapegraphAiSmartScraperStartInput: z.
|
|
5
|
-
|
|
6
|
-
|
|
4
|
+
declare const ScrapegraphAiSmartScraperStartInput: z.ZodObject<{
|
|
5
|
+
mock: z.ZodOptional<z.ZodBoolean>;
|
|
6
|
+
wait: z.ZodOptional<z.ZodDefault<z.ZodBoolean>>;
|
|
7
|
+
steps: z.ZodOptional<z.ZodArray<z.ZodRecord<z.ZodString, z.ZodUnknown>>>;
|
|
8
|
+
cookies: z.ZodOptional<z.ZodRecord<z.ZodString, z.ZodUnknown>>;
|
|
9
|
+
headers: z.ZodOptional<z.ZodRecord<z.ZodString, z.ZodUnknown>>;
|
|
10
|
+
stealth: z.ZodOptional<z.ZodBoolean>;
|
|
11
|
+
plain_text: z.ZodOptional<z.ZodBoolean>;
|
|
12
|
+
total_pages: z.ZodOptional<z.ZodNumber>;
|
|
13
|
+
user_prompt: z.ZodString;
|
|
14
|
+
website_url: z.ZodOptional<z.ZodString>;
|
|
15
|
+
website_html: z.ZodOptional<z.ZodString>;
|
|
16
|
+
output_schema: z.ZodOptional<z.ZodRecord<z.ZodString, z.ZodUnknown>>;
|
|
17
|
+
render_heavy_js: z.ZodOptional<z.ZodBoolean>;
|
|
18
|
+
website_markdown: z.ZodOptional<z.ZodString>;
|
|
19
|
+
number_of_scrolls: z.ZodOptional<z.ZodNumber>;
|
|
20
|
+
}, z.core.$strip>;
|
|
21
|
+
declare const ScrapegraphAiSmartScraperStartOutput: z.ZodObject<{
|
|
22
|
+
error: z.ZodOptional<z.ZodNullable<z.ZodString>>;
|
|
23
|
+
result: z.ZodOptional<z.ZodNullable<z.ZodRecord<z.ZodString, z.ZodUnknown>>>;
|
|
24
|
+
status: z.ZodNullable<z.ZodString>;
|
|
25
|
+
job_status: z.ZodOptional<z.ZodNullable<z.ZodEnum<{
|
|
26
|
+
queued: "queued";
|
|
27
|
+
processing: "processing";
|
|
28
|
+
completed: "completed";
|
|
29
|
+
failed: "failed";
|
|
30
|
+
}>>>;
|
|
31
|
+
request_id: z.ZodOptional<z.ZodNullable<z.ZodString>>;
|
|
32
|
+
user_prompt: z.ZodOptional<z.ZodNullable<z.ZodString>>;
|
|
33
|
+
website_url: z.ZodOptional<z.ZodNullable<z.ZodString>>;
|
|
34
|
+
}, z.core.$loose>;
|
|
35
|
+
declare const scrapegraphAiSmartScraperStart: import("@keystrokehq/action").WorkflowActionDefinition<{
|
|
36
|
+
user_prompt: string;
|
|
37
|
+
mock?: boolean | undefined;
|
|
38
|
+
wait?: boolean | undefined;
|
|
39
|
+
steps?: Record<string, unknown>[] | undefined;
|
|
40
|
+
cookies?: Record<string, unknown> | undefined;
|
|
41
|
+
headers?: Record<string, unknown> | undefined;
|
|
42
|
+
stealth?: boolean | undefined;
|
|
43
|
+
plain_text?: boolean | undefined;
|
|
44
|
+
total_pages?: number | undefined;
|
|
45
|
+
website_url?: string | undefined;
|
|
46
|
+
website_html?: string | undefined;
|
|
47
|
+
output_schema?: Record<string, unknown> | undefined;
|
|
48
|
+
render_heavy_js?: boolean | undefined;
|
|
49
|
+
website_markdown?: string | undefined;
|
|
50
|
+
number_of_scrolls?: number | undefined;
|
|
51
|
+
}, unknown, import("@keystrokehq/shared").ResolvedCredentials<readonly [import("@keystrokehq/shared").Credential]>, readonly [import("@keystrokehq/shared").Credential]>;
|
|
7
52
|
//#endregion
|
|
8
53
|
export { scrapegraphAiSmartScraperStart };
|
|
9
54
|
//# sourceMappingURL=smart-scraper-start.d.cts.map
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"smart-scraper-start.d.cts","names":[],"sources":["../../src/actions/smart-scraper-start.ts"],"mappings":";;;cAIa,mCAAA,
|
|
1
|
+
{"version":3,"file":"smart-scraper-start.d.cts","names":[],"sources":["../../src/actions/smart-scraper-start.ts"],"mappings":";;;cAIa,mCAAA,EAAmC,CAAA,CAAA,SAAA;;;;;;;;;;;;;;;;;cAiBnC,oCAAA,EAAoC,CAAA,CAAA,SAAA;;;;;;;;;;;;;;cAUpC,8BAAA,gCAA8B,wBAAA"}
|
|
@@ -1,9 +1,54 @@
|
|
|
1
1
|
import { z } from "zod";
|
|
2
2
|
|
|
3
3
|
//#region src/actions/smart-scraper-start.d.ts
|
|
4
|
-
declare const ScrapegraphAiSmartScraperStartInput: z.
|
|
5
|
-
|
|
6
|
-
|
|
4
|
+
declare const ScrapegraphAiSmartScraperStartInput: z.ZodObject<{
|
|
5
|
+
mock: z.ZodOptional<z.ZodBoolean>;
|
|
6
|
+
wait: z.ZodOptional<z.ZodDefault<z.ZodBoolean>>;
|
|
7
|
+
steps: z.ZodOptional<z.ZodArray<z.ZodRecord<z.ZodString, z.ZodUnknown>>>;
|
|
8
|
+
cookies: z.ZodOptional<z.ZodRecord<z.ZodString, z.ZodUnknown>>;
|
|
9
|
+
headers: z.ZodOptional<z.ZodRecord<z.ZodString, z.ZodUnknown>>;
|
|
10
|
+
stealth: z.ZodOptional<z.ZodBoolean>;
|
|
11
|
+
plain_text: z.ZodOptional<z.ZodBoolean>;
|
|
12
|
+
total_pages: z.ZodOptional<z.ZodNumber>;
|
|
13
|
+
user_prompt: z.ZodString;
|
|
14
|
+
website_url: z.ZodOptional<z.ZodString>;
|
|
15
|
+
website_html: z.ZodOptional<z.ZodString>;
|
|
16
|
+
output_schema: z.ZodOptional<z.ZodRecord<z.ZodString, z.ZodUnknown>>;
|
|
17
|
+
render_heavy_js: z.ZodOptional<z.ZodBoolean>;
|
|
18
|
+
website_markdown: z.ZodOptional<z.ZodString>;
|
|
19
|
+
number_of_scrolls: z.ZodOptional<z.ZodNumber>;
|
|
20
|
+
}, z.core.$strip>;
|
|
21
|
+
declare const ScrapegraphAiSmartScraperStartOutput: z.ZodObject<{
|
|
22
|
+
error: z.ZodOptional<z.ZodNullable<z.ZodString>>;
|
|
23
|
+
result: z.ZodOptional<z.ZodNullable<z.ZodRecord<z.ZodString, z.ZodUnknown>>>;
|
|
24
|
+
status: z.ZodNullable<z.ZodString>;
|
|
25
|
+
job_status: z.ZodOptional<z.ZodNullable<z.ZodEnum<{
|
|
26
|
+
queued: "queued";
|
|
27
|
+
processing: "processing";
|
|
28
|
+
completed: "completed";
|
|
29
|
+
failed: "failed";
|
|
30
|
+
}>>>;
|
|
31
|
+
request_id: z.ZodOptional<z.ZodNullable<z.ZodString>>;
|
|
32
|
+
user_prompt: z.ZodOptional<z.ZodNullable<z.ZodString>>;
|
|
33
|
+
website_url: z.ZodOptional<z.ZodNullable<z.ZodString>>;
|
|
34
|
+
}, z.core.$loose>;
|
|
35
|
+
declare const scrapegraphAiSmartScraperStart: import("@keystrokehq/action").WorkflowActionDefinition<{
|
|
36
|
+
user_prompt: string;
|
|
37
|
+
mock?: boolean | undefined;
|
|
38
|
+
wait?: boolean | undefined;
|
|
39
|
+
steps?: Record<string, unknown>[] | undefined;
|
|
40
|
+
cookies?: Record<string, unknown> | undefined;
|
|
41
|
+
headers?: Record<string, unknown> | undefined;
|
|
42
|
+
stealth?: boolean | undefined;
|
|
43
|
+
plain_text?: boolean | undefined;
|
|
44
|
+
total_pages?: number | undefined;
|
|
45
|
+
website_url?: string | undefined;
|
|
46
|
+
website_html?: string | undefined;
|
|
47
|
+
output_schema?: Record<string, unknown> | undefined;
|
|
48
|
+
render_heavy_js?: boolean | undefined;
|
|
49
|
+
website_markdown?: string | undefined;
|
|
50
|
+
number_of_scrolls?: number | undefined;
|
|
51
|
+
}, unknown, import("@keystrokehq/shared").ResolvedCredentials<readonly [import("@keystrokehq/shared").Credential]>, readonly [import("@keystrokehq/shared").Credential]>;
|
|
7
52
|
//#endregion
|
|
8
53
|
export { scrapegraphAiSmartScraperStart };
|
|
9
54
|
//# sourceMappingURL=smart-scraper-start.d.mts.map
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"smart-scraper-start.d.mts","names":[],"sources":["../../src/actions/smart-scraper-start.ts"],"mappings":";;;cAIa,mCAAA,
|
|
1
|
+
{"version":3,"file":"smart-scraper-start.d.mts","names":[],"sources":["../../src/actions/smart-scraper-start.ts"],"mappings":";;;cAIa,mCAAA,EAAmC,CAAA,CAAA,SAAA;;;;;;;;;;;;;;;;;cAiBnC,oCAAA,EAAoC,CAAA,CAAA,SAAA;;;;;;;;;;;;;;cAUpC,8BAAA,gCAA8B,wBAAA"}
|
|
@@ -8,8 +8,8 @@ const scrapegraphAiSmartScraperStart = action("SCRAPEGRAPH_AI_SMART_SCRAPER_STAR
|
|
|
8
8
|
mock: z.boolean().describe("If true, return mock test data instead of actual extraction. Useful for testing without consuming credits.").optional(),
|
|
9
9
|
wait: z.boolean().default(false).describe("If true, wait for job completion and return full results. If false (default), return request_id immediately for async polling. Poll using SCRAPEGRAPH_AI_SMART_SCRAPER_STATUS with the returned `request_id`.").optional(),
|
|
10
10
|
steps: z.array(z.record(z.string(), z.unknown())).describe("Browser interaction actions to perform before extraction (e.g., click buttons, fill forms). Each step is a dict with action type and parameters.").optional(),
|
|
11
|
-
cookies: z.
|
|
12
|
-
headers: z.
|
|
11
|
+
cookies: z.record(z.string(), z.unknown()).describe("Cookies to include in the request for authentication or session management.").optional(),
|
|
12
|
+
headers: z.record(z.string(), z.unknown()).describe("Custom HTTP headers for the scraping request (e.g., User-Agent, Accept-Language). Used when fetching website_url.").optional(),
|
|
13
13
|
stealth: z.boolean().describe("Enable anti-bot detection techniques. Adds +4 credit cost per request. Use for sites with bot protection.").optional(),
|
|
14
14
|
plain_text: z.boolean().describe("Return extracted content as plain text instead of JSON. Useful for simple text extraction.").optional(),
|
|
15
15
|
total_pages: z.number().int().describe("Number of pages to scrape for paginated content (1-100). Default is 1.").optional(),
|
|
@@ -24,7 +24,7 @@ const scrapegraphAiSmartScraperStart = action("SCRAPEGRAPH_AI_SMART_SCRAPER_STAR
|
|
|
24
24
|
output: z.object({
|
|
25
25
|
error: z.string().describe("Error message if the job failed (when wait=True).").nullable().optional(),
|
|
26
26
|
result: z.record(z.string(), z.unknown()).describe("Extracted information based on the prompt (when wait=True and completed).").nullable().optional(),
|
|
27
|
-
status: z.string().describe("Overall request status (e.g., 'success')."),
|
|
27
|
+
status: z.string().describe("Overall request status (e.g., 'success').").nullable(),
|
|
28
28
|
job_status: z.enum([
|
|
29
29
|
"queued",
|
|
30
30
|
"processing",
|
|
@@ -34,7 +34,7 @@ const scrapegraphAiSmartScraperStart = action("SCRAPEGRAPH_AI_SMART_SCRAPER_STAR
|
|
|
34
34
|
request_id: z.string().describe("Request ID when wait=False.").nullable().optional(),
|
|
35
35
|
user_prompt: z.string().describe("The original prompt provided by the user (when wait=True).").nullable().optional(),
|
|
36
36
|
website_url: z.string().describe("The URL of the webpage that was processed (when wait=True).").nullable().optional()
|
|
37
|
-
}).describe("Response schema returned after initiating a SmartScraper job.")
|
|
37
|
+
}).passthrough().describe("Response schema returned after initiating a SmartScraper job.")
|
|
38
38
|
});
|
|
39
39
|
//#endregion
|
|
40
40
|
export { scrapegraphAiSmartScraperStart };
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"smart-scraper-start.mjs","names":[],"sources":["../../src/actions/smart-scraper-start.ts"],"sourcesContent":["import { z } from \"zod\";\n\nimport { action } from \"../action\";\n\nexport const ScrapegraphAiSmartScraperStartInput
|
|
1
|
+
{"version":3,"file":"smart-scraper-start.mjs","names":[],"sources":["../../src/actions/smart-scraper-start.ts"],"sourcesContent":["import { z } from \"zod\";\n\nimport { action } from \"../action\";\n\nexport const ScrapegraphAiSmartScraperStartInput = z.object({\n mock: z.boolean().describe(\"If true, return mock test data instead of actual extraction. Useful for testing without consuming credits.\").optional(),\n wait: z.boolean().default(false).describe(\"If true, wait for job completion and return full results. If false (default), return request_id immediately for async polling. Poll using SCRAPEGRAPH_AI_SMART_SCRAPER_STATUS with the returned `request_id`.\").optional(),\n steps: z.array(z.record(z.string(), z.unknown())).describe(\"Browser interaction actions to perform before extraction (e.g., click buttons, fill forms). Each step is a dict with action type and parameters.\").optional(),\n cookies: z.record(z.string(), z.unknown()).describe(\"Cookies to include in the request for authentication or session management.\").optional(),\n headers: z.record(z.string(), z.unknown()).describe(\"Custom HTTP headers for the scraping request (e.g., User-Agent, Accept-Language). Used when fetching website_url.\").optional(),\n stealth: z.boolean().describe(\"Enable anti-bot detection techniques. Adds +4 credit cost per request. Use for sites with bot protection.\").optional(),\n plain_text: z.boolean().describe(\"Return extracted content as plain text instead of JSON. Useful for simple text extraction.\").optional(),\n total_pages: z.number().int().describe(\"Number of pages to scrape for paginated content (1-100). Default is 1.\").optional(),\n user_prompt: z.string().describe(\"Natural language description of what information to extract from the webpage. Be specific about the data you want (e.g., 'Extract the product name, price, and description').\"),\n website_url: z.string().describe(\"Full URL of the webpage to scrape (must include https://). Required if website_html and website_markdown are not provided.\").optional(),\n website_html: z.string().describe(\"Raw HTML content to scrape (max 2MB). Use this if you already have the page HTML. Required if website_url and website_markdown are not provided.\").optional(),\n output_schema: z.record(z.string(), z.unknown()).describe(\"JSON Schema defining the structure of extracted data. Helps ensure consistent, structured output.\").optional(),\n render_heavy_js: z.boolean().describe(\"Enable enhanced JavaScript rendering for Single Page Applications (SPAs) and heavy JS sites. May increase processing time.\").optional(),\n website_markdown: z.string().describe(\"Raw Markdown content to scrape (max 2MB). Use this if you already have the page content as Markdown. Required if website_url and website_html are not provided.\").optional(),\n number_of_scrolls: z.number().int().describe(\"Number of scroll iterations for infinite scroll pages (0-50). Default is 0. Use for pages that load content on scroll.\").optional(),\n}).describe(\"Request schema for initiating a SmartScraper job.\");\nexport const ScrapegraphAiSmartScraperStartOutput = z.object({\n error: z.string().describe(\"Error message if the job failed (when wait=True).\").nullable().optional(),\n result: z.record(z.string(), z.unknown()).describe(\"Extracted information based on the prompt (when wait=True and completed).\").nullable().optional(),\n status: z.string().describe(\"Overall request status (e.g., 'success').\").nullable(),\n job_status: z.enum([\"queued\", \"processing\", \"completed\", \"failed\"]).describe(\"Current status of the scraping job (when wait=True).\").nullable().optional(),\n request_id: z.string().describe(\"Request ID when wait=False.\").nullable().optional(),\n user_prompt: z.string().describe(\"The original prompt provided by the user (when wait=True).\").nullable().optional(),\n website_url: z.string().describe(\"The URL of the webpage that was processed (when wait=True).\").nullable().optional(),\n}).passthrough().describe(\"Response schema returned after initiating a SmartScraper job.\");\n\nexport const scrapegraphAiSmartScraperStart = action(\"SCRAPEGRAPH_AI_SMART_SCRAPER_START\", {\n slug: \"scrapegraph_ai-smart-scraper-start\",\n name: \"Start Smart Scraper\",\n description: \"Start AI-powered web scraping with natural language extraction prompts. When `wait` is false (default), returns a `request_id`; poll for results using SCRAPEGRAPH_AI_SMART_SCRAPER_STATUS. Check `error` and `job_status` fields in the response before using extracted data.\",\n input: ScrapegraphAiSmartScraperStartInput,\n output: ScrapegraphAiSmartScraperStartOutput,\n});\n"],"mappings":";;AA+BA,MAAa,iCAAiC,OAAO,sCAAsC;CACzF,MAAM;CACN,MAAM;CACN,aAAa;CACb,OA/BiD,EAAE,OAAO;EAC1D,MAAM,EAAE,QAAQ,CAAC,CAAC,SAAS,4GAA4G,CAAC,CAAC,SAAS;EAClJ,MAAM,EAAE,QAAQ,CAAC,CAAC,QAAQ,KAAK,CAAC,CAAC,SAAS,+MAA+M,CAAC,CAAC,SAAS;EACpQ,OAAO,EAAE,MAAM,EAAE,OAAO,EAAE,OAAO,GAAG,EAAE,QAAQ,CAAC,CAAC,CAAC,CAAC,SAAS,kJAAkJ,CAAC,CAAC,SAAS;EACxN,SAAS,EAAE,OAAO,EAAE,OAAO,GAAG,EAAE,QAAQ,CAAC,CAAC,CAAC,SAAS,6EAA6E,CAAC,CAAC,SAAS;EAC5I,SAAS,EAAE,OAAO,EAAE,OAAO,GAAG,EAAE,QAAQ,CAAC,CAAC,CAAC,SAAS,mHAAmH,CAAC,CAAC,SAAS;EAClL,SAAS,EAAE,QAAQ,CAAC,CAAC,SAAS,2GAA2G,CAAC,CAAC,SAAS;EACpJ,YAAY,EAAE,QAAQ,CAAC,CAAC,SAAS,4FAA4F,CAAC,CAAC,SAAS;EACxI,aAAa,EAAE,OAAO,CAAC,CAAC,IAAI,CAAC,CAAC,SAAS,wEAAwE,CAAC,CAAC,SAAS;EAC1H,aAAa,EAAE,OAAO,CAAC,CAAC,SAAS,+KAA+K;EAChN,aAAa,EAAE,OAAO,CAAC,CAAC,SAAS,4HAA4H,CAAC,CAAC,SAAS;EACxK,cAAc,EAAE,OAAO,CAAC,CAAC,SAAS,kJAAkJ,CAAC,CAAC,SAAS;EAC/L,eAAe,EAAE,OAAO,EAAE,OAAO,GAAG,EAAE,QAAQ,CAAC,CAAC,CAAC,SAAS,mGAAmG,CAAC,CAAC,SAAS;EACxK,iBAAiB,EAAE,QAAQ,CAAC,CAAC,SAAS,4HAA4H,CAAC,CAAC,SAAS;EAC7K,kBAAkB,EAAE,OAAO,CAAC,CAAC,SAAS,iKAAiK,CAAC,CAAC,SAAS;EAClN,mBAAmB,EAAE,OAAO,CAAC,CAAC,IAAI,CAAC,CAAC,SAAS,wHAAwH,CAAC,CAAC,SAAS;CAClL,CAAC,CAAC,CAAC,SAAS,mDAeH;CACP,QAfkD,EAAE,OAAO;EAC3D,OAAO,EAAE,OAAO,CAAC,CAAC,SAAS,mDAAmD,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;EACpG,QAAQ,EAAE,OAAO,EAAE,OAAO,GAAG,EAAE,QAAQ,CAAC,CAAC,CAAC,SAAS,2EAA2E,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;EACpJ,QAAQ,EAAE,OAAO,CAAC,CAAC,SAAS,2CAA2C,CAAC,CAAC,SAAS;EAClF,YAAY,EAAE,KAAK;GAAC;GAAU;GAAc;GAAa;EAAQ,CAAC,CAAC,CAAC,SAAS,sDAAsD,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;EACzJ,YAAY,EAAE,OAAO,CAAC,CAAC,SAAS,6BAA6B,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;EACnF,aAAa,EAAE,OAAO,CAAC,CAAC,SAAS,4DAA4D,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;EACnH,aAAa,EAAE,OAAO,CAAC,CAAC,SAAS,6DAA6D,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;CACtH,CAAC,CAAC,CAAC,YAAY,CAAC,CAAC,SAAS,+DAOhB;AACV,CAAC"}
|
|
@@ -5,11 +5,11 @@ const ScrapegraphAiSmartScraperStatusInput = zod.z.object({ request_id: zod.z.st
|
|
|
5
5
|
const ScrapegraphAiSmartScraperStatusOutput = zod.z.object({
|
|
6
6
|
error: zod.z.string().describe("Error message explaining why the request failed. Only populated when status is 'failed'.").nullable().optional(),
|
|
7
7
|
result: zod.z.record(zod.z.string(), zod.z.unknown()).describe("Extracted data from the website. Only populated when status is 'completed'. Structure depends on the output_schema provided in the original request.").nullable().optional(),
|
|
8
|
-
status: zod.z.string().describe("Current status of the request: 'queued' (waiting to be processed), 'processing' (being processed), 'completed' (finished successfully), or 'failed' (error occurred)"),
|
|
9
|
-
request_id: zod.z.string().describe("The unique identifier (UUID) of the SmartScraper request"),
|
|
10
|
-
user_prompt: zod.z.string().describe("The natural language prompt describing what information to extract"),
|
|
8
|
+
status: zod.z.string().describe("Current status of the request: 'queued' (waiting to be processed), 'processing' (being processed), 'completed' (finished successfully), or 'failed' (error occurred)").nullable(),
|
|
9
|
+
request_id: zod.z.string().describe("The unique identifier (UUID) of the SmartScraper request").nullable(),
|
|
10
|
+
user_prompt: zod.z.string().describe("The natural language prompt describing what information to extract").nullable(),
|
|
11
11
|
website_url: zod.z.string().describe("URL of the website being scraped. May be null if website_html was provided instead of a URL.").nullable().optional()
|
|
12
|
-
}).describe("Response model for SmartScraper status checks.");
|
|
12
|
+
}).passthrough().describe("Response model for SmartScraper status checks.");
|
|
13
13
|
const scrapegraphAiSmartScraperStatus = require_action.action("SCRAPEGRAPH_AI_SMART_SCRAPER_STATUS", {
|
|
14
14
|
slug: "scrapegraph_ai-smart-scraper-status",
|
|
15
15
|
name: "SmartScraper Status",
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"smart-scraper-status.cjs","names":["z","action"],"sources":["../../src/actions/smart-scraper-status.ts"],"sourcesContent":["import { z } from \"zod\";\n\nimport { action } from \"../action\";\n\nexport const ScrapegraphAiSmartScraperStatusInput
|
|
1
|
+
{"version":3,"file":"smart-scraper-status.cjs","names":["z","action"],"sources":["../../src/actions/smart-scraper-status.ts"],"sourcesContent":["import { z } from \"zod\";\n\nimport { action } from \"../action\";\n\nexport const ScrapegraphAiSmartScraperStatusInput = z.object({\n request_id: z.string().describe(\"The unique identifier (UUID) of the SmartScraper request returned by the Start SmartScraper action\"),\n}).describe(\"Request model for checking the status of a SmartScraper job.\");\nexport const ScrapegraphAiSmartScraperStatusOutput = z.object({\n error: z.string().describe(\"Error message explaining why the request failed. Only populated when status is 'failed'.\").nullable().optional(),\n result: z.record(z.string(), z.unknown()).describe(\"Extracted data from the website. Only populated when status is 'completed'. Structure depends on the output_schema provided in the original request.\").nullable().optional(),\n status: z.string().describe(\"Current status of the request: 'queued' (waiting to be processed), 'processing' (being processed), 'completed' (finished successfully), or 'failed' (error occurred)\").nullable(),\n request_id: z.string().describe(\"The unique identifier (UUID) of the SmartScraper request\").nullable(),\n user_prompt: z.string().describe(\"The natural language prompt describing what information to extract\").nullable(),\n website_url: z.string().describe(\"URL of the website being scraped. May be null if website_html was provided instead of a URL.\").nullable().optional(),\n}).passthrough().describe(\"Response model for SmartScraper status checks.\");\n\nexport const scrapegraphAiSmartScraperStatus = action(\"SCRAPEGRAPH_AI_SMART_SCRAPER_STATUS\", {\n slug: \"scrapegraph_ai-smart-scraper-status\",\n name: \"SmartScraper Status\",\n description: \"Check the status and retrieve results of a SmartScraper web scraping job. Use this action to poll for completion after starting a SmartScraper job with wait=false. The request_id is returned by the Start SmartScraper action. Typical workflow: 1. Start a scraping job with SCRAPEGRAPH_AI_SMART_SCRAPER_START (wait=false) 2. Use the returned request_id to check status with this action 3. Poll until status is 'completed' or 'failed' 4. When completed, the 'result' field contains the extracted data. When completed, also check the 'error' field before consuming 'result', as 'failed' status populates 'error' instead of 'result'.\",\n input: ScrapegraphAiSmartScraperStatusInput,\n output: ScrapegraphAiSmartScraperStatusOutput,\n});\n"],"mappings":";;;AAIA,MAAa,uCAAuCA,IAAAA,EAAE,OAAO,EAC3D,YAAYA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,oGAAoG,EACtI,CAAC,CAAC,CAAC,SAAS,8DAA8D;AAC1E,MAAa,wCAAwCA,IAAAA,EAAE,OAAO;CAC5D,OAAOA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,0FAA0F,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;CAC3I,QAAQA,IAAAA,EAAE,OAAOA,IAAAA,EAAE,OAAO,GAAGA,IAAAA,EAAE,QAAQ,CAAC,CAAC,CAAC,SAAS,sJAAsJ,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;CAC/N,QAAQA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,sKAAsK,CAAC,CAAC,SAAS;CAC7M,YAAYA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,0DAA0D,CAAC,CAAC,SAAS;CACrG,aAAaA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,oEAAoE,CAAC,CAAC,SAAS;CAChH,aAAaA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,8FAA8F,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;AACvJ,CAAC,CAAC,CAAC,YAAY,CAAC,CAAC,SAAS,gDAAgD;AAE1E,MAAa,kCAAkCC,eAAAA,OAAO,uCAAuC;CAC3F,MAAM;CACN,MAAM;CACN,aAAa;CACb,OAAO;CACP,QAAQ;AACV,CAAC"}
|
|
@@ -1,9 +1,20 @@
|
|
|
1
1
|
import { z } from "zod";
|
|
2
2
|
|
|
3
3
|
//#region src/actions/smart-scraper-status.d.ts
|
|
4
|
-
declare const ScrapegraphAiSmartScraperStatusInput: z.
|
|
5
|
-
|
|
6
|
-
|
|
4
|
+
declare const ScrapegraphAiSmartScraperStatusInput: z.ZodObject<{
|
|
5
|
+
request_id: z.ZodString;
|
|
6
|
+
}, z.core.$strip>;
|
|
7
|
+
declare const ScrapegraphAiSmartScraperStatusOutput: z.ZodObject<{
|
|
8
|
+
error: z.ZodOptional<z.ZodNullable<z.ZodString>>;
|
|
9
|
+
result: z.ZodOptional<z.ZodNullable<z.ZodRecord<z.ZodString, z.ZodUnknown>>>;
|
|
10
|
+
status: z.ZodNullable<z.ZodString>;
|
|
11
|
+
request_id: z.ZodNullable<z.ZodString>;
|
|
12
|
+
user_prompt: z.ZodNullable<z.ZodString>;
|
|
13
|
+
website_url: z.ZodOptional<z.ZodNullable<z.ZodString>>;
|
|
14
|
+
}, z.core.$loose>;
|
|
15
|
+
declare const scrapegraphAiSmartScraperStatus: import("@keystrokehq/action").WorkflowActionDefinition<{
|
|
16
|
+
request_id: string;
|
|
17
|
+
}, unknown, import("@keystrokehq/shared").ResolvedCredentials<readonly [import("@keystrokehq/shared").Credential]>, readonly [import("@keystrokehq/shared").Credential]>;
|
|
7
18
|
//#endregion
|
|
8
19
|
export { scrapegraphAiSmartScraperStatus };
|
|
9
20
|
//# sourceMappingURL=smart-scraper-status.d.cts.map
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"smart-scraper-status.d.cts","names":[],"sources":["../../src/actions/smart-scraper-status.ts"],"mappings":";;;cAIa,oCAAA,
|
|
1
|
+
{"version":3,"file":"smart-scraper-status.d.cts","names":[],"sources":["../../src/actions/smart-scraper-status.ts"],"mappings":";;;cAIa,oCAAA,EAAoC,CAAA,CAAA,SAAA;;;cAGpC,qCAAA,EAAqC,CAAA,CAAA,SAAA;;;;;;;;cASrC,+BAAA,gCAA+B,wBAAA"}
|
|
@@ -1,9 +1,20 @@
|
|
|
1
1
|
import { z } from "zod";
|
|
2
2
|
|
|
3
3
|
//#region src/actions/smart-scraper-status.d.ts
|
|
4
|
-
declare const ScrapegraphAiSmartScraperStatusInput: z.
|
|
5
|
-
|
|
6
|
-
|
|
4
|
+
declare const ScrapegraphAiSmartScraperStatusInput: z.ZodObject<{
|
|
5
|
+
request_id: z.ZodString;
|
|
6
|
+
}, z.core.$strip>;
|
|
7
|
+
declare const ScrapegraphAiSmartScraperStatusOutput: z.ZodObject<{
|
|
8
|
+
error: z.ZodOptional<z.ZodNullable<z.ZodString>>;
|
|
9
|
+
result: z.ZodOptional<z.ZodNullable<z.ZodRecord<z.ZodString, z.ZodUnknown>>>;
|
|
10
|
+
status: z.ZodNullable<z.ZodString>;
|
|
11
|
+
request_id: z.ZodNullable<z.ZodString>;
|
|
12
|
+
user_prompt: z.ZodNullable<z.ZodString>;
|
|
13
|
+
website_url: z.ZodOptional<z.ZodNullable<z.ZodString>>;
|
|
14
|
+
}, z.core.$loose>;
|
|
15
|
+
declare const scrapegraphAiSmartScraperStatus: import("@keystrokehq/action").WorkflowActionDefinition<{
|
|
16
|
+
request_id: string;
|
|
17
|
+
}, unknown, import("@keystrokehq/shared").ResolvedCredentials<readonly [import("@keystrokehq/shared").Credential]>, readonly [import("@keystrokehq/shared").Credential]>;
|
|
7
18
|
//#endregion
|
|
8
19
|
export { scrapegraphAiSmartScraperStatus };
|
|
9
20
|
//# sourceMappingURL=smart-scraper-status.d.mts.map
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"smart-scraper-status.d.mts","names":[],"sources":["../../src/actions/smart-scraper-status.ts"],"mappings":";;;cAIa,oCAAA,
|
|
1
|
+
{"version":3,"file":"smart-scraper-status.d.mts","names":[],"sources":["../../src/actions/smart-scraper-status.ts"],"mappings":";;;cAIa,oCAAA,EAAoC,CAAA,CAAA,SAAA;;;cAGpC,qCAAA,EAAqC,CAAA,CAAA,SAAA;;;;;;;;cASrC,+BAAA,gCAA+B,wBAAA"}
|
|
@@ -8,11 +8,11 @@ const scrapegraphAiSmartScraperStatus = action("SCRAPEGRAPH_AI_SMART_SCRAPER_STA
|
|
|
8
8
|
output: z.object({
|
|
9
9
|
error: z.string().describe("Error message explaining why the request failed. Only populated when status is 'failed'.").nullable().optional(),
|
|
10
10
|
result: z.record(z.string(), z.unknown()).describe("Extracted data from the website. Only populated when status is 'completed'. Structure depends on the output_schema provided in the original request.").nullable().optional(),
|
|
11
|
-
status: z.string().describe("Current status of the request: 'queued' (waiting to be processed), 'processing' (being processed), 'completed' (finished successfully), or 'failed' (error occurred)"),
|
|
12
|
-
request_id: z.string().describe("The unique identifier (UUID) of the SmartScraper request"),
|
|
13
|
-
user_prompt: z.string().describe("The natural language prompt describing what information to extract"),
|
|
11
|
+
status: z.string().describe("Current status of the request: 'queued' (waiting to be processed), 'processing' (being processed), 'completed' (finished successfully), or 'failed' (error occurred)").nullable(),
|
|
12
|
+
request_id: z.string().describe("The unique identifier (UUID) of the SmartScraper request").nullable(),
|
|
13
|
+
user_prompt: z.string().describe("The natural language prompt describing what information to extract").nullable(),
|
|
14
14
|
website_url: z.string().describe("URL of the website being scraped. May be null if website_html was provided instead of a URL.").nullable().optional()
|
|
15
|
-
}).describe("Response model for SmartScraper status checks.")
|
|
15
|
+
}).passthrough().describe("Response model for SmartScraper status checks.")
|
|
16
16
|
});
|
|
17
17
|
//#endregion
|
|
18
18
|
export { scrapegraphAiSmartScraperStatus };
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"smart-scraper-status.mjs","names":[],"sources":["../../src/actions/smart-scraper-status.ts"],"sourcesContent":["import { z } from \"zod\";\n\nimport { action } from \"../action\";\n\nexport const ScrapegraphAiSmartScraperStatusInput
|
|
1
|
+
{"version":3,"file":"smart-scraper-status.mjs","names":[],"sources":["../../src/actions/smart-scraper-status.ts"],"sourcesContent":["import { z } from \"zod\";\n\nimport { action } from \"../action\";\n\nexport const ScrapegraphAiSmartScraperStatusInput = z.object({\n request_id: z.string().describe(\"The unique identifier (UUID) of the SmartScraper request returned by the Start SmartScraper action\"),\n}).describe(\"Request model for checking the status of a SmartScraper job.\");\nexport const ScrapegraphAiSmartScraperStatusOutput = z.object({\n error: z.string().describe(\"Error message explaining why the request failed. Only populated when status is 'failed'.\").nullable().optional(),\n result: z.record(z.string(), z.unknown()).describe(\"Extracted data from the website. Only populated when status is 'completed'. Structure depends on the output_schema provided in the original request.\").nullable().optional(),\n status: z.string().describe(\"Current status of the request: 'queued' (waiting to be processed), 'processing' (being processed), 'completed' (finished successfully), or 'failed' (error occurred)\").nullable(),\n request_id: z.string().describe(\"The unique identifier (UUID) of the SmartScraper request\").nullable(),\n user_prompt: z.string().describe(\"The natural language prompt describing what information to extract\").nullable(),\n website_url: z.string().describe(\"URL of the website being scraped. May be null if website_html was provided instead of a URL.\").nullable().optional(),\n}).passthrough().describe(\"Response model for SmartScraper status checks.\");\n\nexport const scrapegraphAiSmartScraperStatus = action(\"SCRAPEGRAPH_AI_SMART_SCRAPER_STATUS\", {\n slug: \"scrapegraph_ai-smart-scraper-status\",\n name: \"SmartScraper Status\",\n description: \"Check the status and retrieve results of a SmartScraper web scraping job. Use this action to poll for completion after starting a SmartScraper job with wait=false. The request_id is returned by the Start SmartScraper action. Typical workflow: 1. Start a scraping job with SCRAPEGRAPH_AI_SMART_SCRAPER_START (wait=false) 2. Use the returned request_id to check status with this action 3. Poll until status is 'completed' or 'failed' 4. When completed, the 'result' field contains the extracted data. When completed, also check the 'error' field before consuming 'result', as 'failed' status populates 'error' instead of 'result'.\",\n input: ScrapegraphAiSmartScraperStatusInput,\n output: ScrapegraphAiSmartScraperStatusOutput,\n});\n"],"mappings":";;AAgBA,MAAa,kCAAkC,OAAO,uCAAuC;CAC3F,MAAM;CACN,MAAM;CACN,aAAa;CACb,OAhBkD,EAAE,OAAO,EAC3D,YAAY,EAAE,OAAO,CAAC,CAAC,SAAS,oGAAoG,EACtI,CAAC,CAAC,CAAC,SAAS,8DAcH;CACP,QAdmD,EAAE,OAAO;EAC5D,OAAO,EAAE,OAAO,CAAC,CAAC,SAAS,0FAA0F,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;EAC3I,QAAQ,EAAE,OAAO,EAAE,OAAO,GAAG,EAAE,QAAQ,CAAC,CAAC,CAAC,SAAS,sJAAsJ,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;EAC/N,QAAQ,EAAE,OAAO,CAAC,CAAC,SAAS,sKAAsK,CAAC,CAAC,SAAS;EAC7M,YAAY,EAAE,OAAO,CAAC,CAAC,SAAS,0DAA0D,CAAC,CAAC,SAAS;EACrG,aAAa,EAAE,OAAO,CAAC,CAAC,SAAS,oEAAoE,CAAC,CAAC,SAAS;EAChH,aAAa,EAAE,OAAO,CAAC,CAAC,SAAS,8FAA8F,CAAC,CAAC,SAAS,CAAC,CAAC,SAAS;CACvJ,CAAC,CAAC,CAAC,YAAY,CAAC,CAAC,SAAS,gDAOhB;AACV,CAAC"}
|
|
@@ -23,7 +23,7 @@ const ScrapegraphAiStartSmartCrawlerInput = zod.z.object({
|
|
|
23
23
|
render_heavy_js: zod.z.boolean().default(false).describe("Enable enhanced JavaScript rendering for Single Page Applications (SPAs) and sites with heavy JavaScript. May increase processing time. Default is false.").optional(),
|
|
24
24
|
same_domain_only: zod.z.boolean().default(true).describe("Whether to restrict crawling to only pages on the same domain as the starting URL. Default is true.").optional()
|
|
25
25
|
}).describe("Request schema to start a SmartCrawler job for multi-page AI extraction.");
|
|
26
|
-
const ScrapegraphAiStartSmartCrawlerOutput = zod.z.object({ task_id: zod.z.string().describe("Unique identifier for the crawl task. Use this ID to check the status or retrieve results later.") }).describe("Response schema returned after initiating a SmartCrawler job.");
|
|
26
|
+
const ScrapegraphAiStartSmartCrawlerOutput = zod.z.object({ task_id: zod.z.string().describe("Unique identifier for the crawl task. Use this ID to check the status or retrieve results later.").nullable() }).passthrough().describe("Response schema returned after initiating a SmartCrawler job.");
|
|
27
27
|
const scrapegraphAiStartSmartCrawler = require_action.action("SCRAPEGRAPH_AI_START_SMART_CRAWLER", {
|
|
28
28
|
slug: "scrapegraph_ai-start-smart-crawler",
|
|
29
29
|
name: "Start Smart Crawler (Async)",
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"start-smart-crawler.cjs","names":["z","action"],"sources":["../../src/actions/start-smart-crawler.ts"],"sourcesContent":["import { z } from \"zod\";\n\nimport { action } from \"../action\";\n\nexport const ScrapegraphAiStartSmartCrawlerInput
|
|
1
|
+
{"version":3,"file":"start-smart-crawler.cjs","names":["z","action"],"sources":["../../src/actions/start-smart-crawler.ts"],"sourcesContent":["import { z } from \"zod\";\n\nimport { action } from \"../action\";\n\nexport const ScrapegraphAiStartSmartCrawlerInput = z.object({\n url: z.string().describe(\"The starting URL for the crawl. Must be a valid HTTP or HTTPS URL.\"),\n depth: z.number().int().default(1).describe(\"Maximum crawl depth - how many link levels to follow from the start URL. Default is 1.\").optional(),\n rules: z.object({\n exclude: z.array(z.string()).describe(\"Array of regex patterns to exclude URLs from crawling.\").optional(),\n same_domain: z.boolean().describe(\"Whether to restrict crawling to the same domain as the starting URL.\").optional(),\n exclude_paths: z.array(z.string()).describe(\"Array of path patterns to exclude from the crawl (e.g., ['/admin/*']). Takes precedence over include_paths.\").optional(),\n include_paths: z.array(z.string()).describe(\"Array of path patterns to include in the crawl (e.g., ['/blog/*']). exclude_paths takes precedence.\").optional(),\n}).describe(\"Crawl rules for filtering URLs during the crawl process.\").optional(),\n prompt: z.string().describe(\"Instructions for what data to extract during the crawl. Required when extraction_mode=true. Be specific about the information you want extracted.\").optional(),\n schema: z.record(z.string(), z.unknown()).describe(\"JSON Schema object defining the structure of extracted data. Helps ensure consistent, structured output in extraction mode.\").optional(),\n breadth: z.number().int().describe(\"Maximum number of links to crawl per depth level. If not specified (null), unlimited breadth is allowed. Ignored when sitemap=true.\").optional(),\n sitemap: z.boolean().default(false).describe(\"Whether to use sitemap.xml for URL discovery instead of link following. When enabled, ignores breadth parameter. Default is false.\").optional(),\n stealth: z.boolean().default(false).describe(\"Enable stealth mode to bypass bot detection and anti-scraping measures. Adds +4 credits per page. Use for sites with bot protection. Default is false.\").optional(),\n max_pages: z.number().int().default(10).describe(\"Maximum total number of pages to crawl across all depth levels. Default is 10.\").optional(),\n batch_size: z.number().int().default(1).describe(\"Number of pages to process in each batch during the crawl. Higher values may speed up large crawls. Default is 1.\").optional(),\n webhook_url: z.string().describe(\"Webhook URL to receive the job completion notification. The result will be POSTed to this URL when the crawl finishes.\").optional(),\n cache_website: z.boolean().default(false).describe(\"Whether to cache the website content for faster subsequent crawls. Default is false.\").optional(),\n extraction_mode: z.boolean().default(true).describe(\"When true, enables AI-powered extraction using LLM (default, 10 credits/page). When false, enables markdown conversion mode (NO AI processing, 2 credits/page, 80% cheaper).\").optional(),\n render_heavy_js: z.boolean().default(false).describe(\"Enable enhanced JavaScript rendering for Single Page Applications (SPAs) and sites with heavy JavaScript. May increase processing time. Default is false.\").optional(),\n same_domain_only: z.boolean().default(true).describe(\"Whether to restrict crawling to only pages on the same domain as the starting URL. Default is true.\").optional(),\n}).describe(\"Request schema to start a SmartCrawler job for multi-page AI extraction.\");\nexport const ScrapegraphAiStartSmartCrawlerOutput = z.object({\n task_id: z.string().describe(\"Unique identifier for the crawl task. Use this ID to check the status or retrieve results later.\").nullable(),\n}).passthrough().describe(\"Response schema returned after initiating a SmartCrawler job.\");\n\nexport const scrapegraphAiStartSmartCrawler = action(\"SCRAPEGRAPH_AI_START_SMART_CRAWLER\", {\n slug: \"scrapegraph_ai-start-smart-crawler\",\n name: \"Start Smart Crawler (Async)\",\n description: \"Tool to start a multi-page web crawl using SmartCrawler for AI-powered data extraction. Use when you need to extract structured data from multiple pages of a website. Returns immediately with a task_id - use the status check action to monitor progress and retrieve results.\",\n input: ScrapegraphAiStartSmartCrawlerInput,\n output: ScrapegraphAiStartSmartCrawlerOutput,\n});\n"],"mappings":";;;AAIA,MAAa,sCAAsCA,IAAAA,EAAE,OAAO;CAC1D,KAAKA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,oEAAoE;CAC7F,OAAOA,IAAAA,EAAE,OAAO,CAAC,CAAC,IAAI,CAAC,CAAC,QAAQ,CAAC,CAAC,CAAC,SAAS,wFAAwF,CAAC,CAAC,SAAS;CAC/I,OAAOA,IAAAA,EAAE,OAAO;EAChB,SAASA,IAAAA,EAAE,MAAMA,IAAAA,EAAE,OAAO,CAAC,CAAC,CAAC,SAAS,wDAAwD,CAAC,CAAC,SAAS;EACzG,aAAaA,IAAAA,EAAE,QAAQ,CAAC,CAAC,SAAS,sEAAsE,CAAC,CAAC,SAAS;EACnH,eAAeA,IAAAA,EAAE,MAAMA,IAAAA,EAAE,OAAO,CAAC,CAAC,CAAC,SAAS,6GAA6G,CAAC,CAAC,SAAS;EACpK,eAAeA,IAAAA,EAAE,MAAMA,IAAAA,EAAE,OAAO,CAAC,CAAC,CAAC,SAAS,qGAAqG,CAAC,CAAC,SAAS;CAC9J,CAAC,CAAC,CAAC,SAAS,0DAA0D,CAAC,CAAC,SAAS;CAC/E,QAAQA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,mJAAmJ,CAAC,CAAC,SAAS;CAC1L,QAAQA,IAAAA,EAAE,OAAOA,IAAAA,EAAE,OAAO,GAAGA,IAAAA,EAAE,QAAQ,CAAC,CAAC,CAAC,SAAS,6HAA6H,CAAC,CAAC,SAAS;CAC3L,SAASA,IAAAA,EAAE,OAAO,CAAC,CAAC,IAAI,CAAC,CAAC,SAAS,qIAAqI,CAAC,CAAC,SAAS;CACnL,SAASA,IAAAA,EAAE,QAAQ,CAAC,CAAC,QAAQ,KAAK,CAAC,CAAC,SAAS,oIAAoI,CAAC,CAAC,SAAS;CAC5L,SAASA,IAAAA,EAAE,QAAQ,CAAC,CAAC,QAAQ,KAAK,CAAC,CAAC,SAAS,wJAAwJ,CAAC,CAAC,SAAS;CAChN,WAAWA,IAAAA,EAAE,OAAO,CAAC,CAAC,IAAI,CAAC,CAAC,QAAQ,EAAE,CAAC,CAAC,SAAS,gFAAgF,CAAC,CAAC,SAAS;CAC5I,YAAYA,IAAAA,EAAE,OAAO,CAAC,CAAC,IAAI,CAAC,CAAC,QAAQ,CAAC,CAAC,CAAC,SAAS,mHAAmH,CAAC,CAAC,SAAS;CAC/K,aAAaA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,wHAAwH,CAAC,CAAC,SAAS;CACpK,eAAeA,IAAAA,EAAE,QAAQ,CAAC,CAAC,QAAQ,KAAK,CAAC,CAAC,SAAS,sFAAsF,CAAC,CAAC,SAAS;CACpJ,iBAAiBA,IAAAA,EAAE,QAAQ,CAAC,CAAC,QAAQ,IAAI,CAAC,CAAC,SAAS,8KAA8K,CAAC,CAAC,SAAS;CAC7O,iBAAiBA,IAAAA,EAAE,QAAQ,CAAC,CAAC,QAAQ,KAAK,CAAC,CAAC,SAAS,2JAA2J,CAAC,CAAC,SAAS;CAC3N,kBAAkBA,IAAAA,EAAE,QAAQ,CAAC,CAAC,QAAQ,IAAI,CAAC,CAAC,SAAS,qGAAqG,CAAC,CAAC,SAAS;AACvK,CAAC,CAAC,CAAC,SAAS,0EAA0E;AACtF,MAAa,uCAAuCA,IAAAA,EAAE,OAAO,EAC3D,SAASA,IAAAA,EAAE,OAAO,CAAC,CAAC,SAAS,kGAAkG,CAAC,CAAC,SAAS,EAC5I,CAAC,CAAC,CAAC,YAAY,CAAC,CAAC,SAAS,+DAA+D;AAEzF,MAAa,iCAAiCC,eAAAA,OAAO,sCAAsC;CACzF,MAAM;CACN,MAAM;CACN,aAAa;CACb,OAAO;CACP,QAAQ;AACV,CAAC"}
|