mcp-scraper 0.4.4 → 0.4.6
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/dist/bin/api-server.cjs +579 -40
- package/dist/bin/api-server.cjs.map +1 -1
- package/dist/bin/api-server.js +3 -3
- package/dist/bin/mcp-scraper-cli.cjs +1 -1
- package/dist/bin/mcp-scraper-cli.cjs.map +1 -1
- package/dist/bin/mcp-scraper-cli.js +1 -1
- package/dist/bin/mcp-scraper-install.cjs +1 -1
- package/dist/bin/mcp-scraper-install.cjs.map +1 -1
- package/dist/bin/mcp-scraper-install.js +1 -1
- package/dist/bin/mcp-stdio-server.cjs +197 -3
- package/dist/bin/mcp-stdio-server.cjs.map +1 -1
- package/dist/bin/mcp-stdio-server.js +2 -2
- package/dist/bin/paa-harvest.cjs.map +1 -1
- package/dist/bin/paa-harvest.js +2 -2
- package/dist/chunk-5BB6Y3BB.js +7 -0
- package/dist/chunk-5BB6Y3BB.js.map +1 -0
- package/dist/{chunk-NJK5BTUK.js → chunk-5GAD2AN2.js} +2 -2
- package/dist/{chunk-FUVQR6GK.js → chunk-GL4BW4CP.js} +49 -1
- package/dist/chunk-GL4BW4CP.js.map +1 -0
- package/dist/{chunk-3UH3BEIZ.js → chunk-HE2LQPJ2.js} +2 -2
- package/dist/{chunk-Z34NGK64.js → chunk-IFXACD4K.js} +198 -4
- package/dist/chunk-IFXACD4K.js.map +1 -0
- package/dist/{chunk-5LO6EHEH.js → chunk-IVQYNY45.js} +14 -3
- package/dist/chunk-IVQYNY45.js.map +1 -0
- package/dist/{chunk-4ZZWFI6L.js → chunk-NYAWN7CZ.js} +3 -3
- package/dist/{db-H3S3M6KK.js → db-LIOTIWVN.js} +6 -2
- package/dist/{extract-bundle-UKE273TV.js → extract-bundle-COS56ZDO.js} +2 -2
- package/dist/index.cjs.map +1 -1
- package/dist/index.js +2 -2
- package/dist/{server-IKT3QVFB.js → server-R3KVQNOT.js} +316 -35
- package/dist/server-R3KVQNOT.js.map +1 -0
- package/dist/{site-extract-repository-THBVEXMP.js → site-extract-repository-LI2S3S6E.js} +4 -4
- package/dist/{worker-YHKUJR5P.js → worker-VASAJ7FZ.js} +5 -5
- package/package.json +2 -1
- package/dist/chunk-5LO6EHEH.js.map +0 -1
- package/dist/chunk-FUVQR6GK.js.map +0 -1
- package/dist/chunk-TZRPP45I.js +0 -7
- package/dist/chunk-TZRPP45I.js.map +0 -1
- package/dist/chunk-Z34NGK64.js.map +0 -1
- package/dist/server-IKT3QVFB.js.map +0 -1
- /package/dist/{chunk-NJK5BTUK.js.map → chunk-5GAD2AN2.js.map} +0 -0
- /package/dist/{chunk-3UH3BEIZ.js.map → chunk-HE2LQPJ2.js.map} +0 -0
- /package/dist/{chunk-4ZZWFI6L.js.map → chunk-NYAWN7CZ.js.map} +0 -0
- /package/dist/{db-H3S3M6KK.js.map → db-LIOTIWVN.js.map} +0 -0
- /package/dist/{extract-bundle-UKE273TV.js.map → extract-bundle-COS56ZDO.js.map} +0 -0
- /package/dist/{site-extract-repository-THBVEXMP.js.map → site-extract-repository-LI2S3S6E.js.map} +0 -0
- /package/dist/{worker-YHKUJR5P.js.map → worker-VASAJ7FZ.js.map} +0 -0
|
@@ -102,7 +102,7 @@ function renderInstallTerminal(options) {
|
|
|
102
102
|
}
|
|
103
103
|
|
|
104
104
|
// src/version.ts
|
|
105
|
-
var PACKAGE_VERSION = "0.4.
|
|
105
|
+
var PACKAGE_VERSION = "0.4.6";
|
|
106
106
|
|
|
107
107
|
// bin/mcp-scraper-install.ts
|
|
108
108
|
var noColor = process.argv.includes("--no-color") || process.env.NO_COLOR !== void 0 || process.env.FORCE_COLOR === "0" || !process.stdout.isTTY;
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"sources":["../../src/install-terminal.ts","../../src/version.ts","../../bin/mcp-scraper-install.ts"],"sourcesContent":["export interface InstallTerminalOptions {\n color?: boolean\n version: string\n apiKeyConfigured?: boolean\n}\n\ntype Tone = 'cyan' | 'lime' | 'amber' | 'red' | 'muted' | 'bold'\n\nconst CODES: Record<Tone | 'reset', string> = {\n reset: '\\x1b[0m',\n cyan: '\\x1b[36m',\n lime: '\\x1b[32m',\n amber: '\\x1b[33m',\n red: '\\x1b[31m',\n muted: '\\x1b[90m',\n bold: '\\x1b[1m',\n}\n\nfunction colorize(value: string, tone: Tone, enabled: boolean): string {\n if (!enabled) return value\n return `${CODES[tone]}${value}${CODES.reset}`\n}\n\nfunction toolRow(label: string, tools: string[], enabled: boolean): string {\n const padded = label.padEnd(9, ' ')\n return ` ${colorize(padded, 'muted', enabled)} ${tools.join(colorize(' . ', 'muted', enabled))}`\n}\n\nexport function renderInstallTerminal(options: InstallTerminalOptions): string {\n const color = options.color ?? true\n const apiKeyValue = options.apiKeyConfigured ? '$MCP_SCRAPER_API_KEY' : 'sk_live_your_key'\n const ascii = String.raw`\n __ __ ____ ____ \n| \\/ |/ ___| _ \\\n| |\\/| | | | |_) |\n| | | | |___| __/\n|_| |_|\\____|_|\n\n ____ ____ ____ _ ____ _____ ____\n/ ___| / ___| _ \\ / \\ | _ \\| ____| _ \\\n\\___ \\| | | |_) | / _ \\ | |_) | _| | |_) |\n ___) | |___| _ < / ___ \\| __/| |___| _ <\n|____/ \\____|_| \\_\\/_/ \\_\\_| |_____|_| \\_\\\n`\n\n const claudeCommand = [\n `MCP_SCRAPER_API_KEY=${apiKeyValue} npx -y -p mcp-scraper@latest \\\\`,\n ' mcp-scraper-cli agent install claude --apply',\n ].join('\\n')\n\n const codexConfig = [\n '[mcp_servers.mcp-scraper]',\n 'command = \"npx\"',\n 'args = [\"-y\", \"-p\", \"mcp-scraper@latest\", \"mcp-scraper\"]',\n `env = { MCP_SCRAPER_API_KEY = \"${apiKeyValue}\" }`,\n ].join('\\n')\n\n return [\n colorize(`mcp-scraper v${options.version}`, 'bold', color),\n colorize('> mcp-scraper-install', 'muted', color),\n colorize(ascii, 'amber', color),\n `${colorize('MCP Scraper Agent', 'cyan', color)} . v${options.version} . mcpscraper.dev`,\n '1/1 install surfaces ready',\n colorize('Newest: saved browser profiles that hold MANY site logins. Share the watch_url, user signs in, then verify with browser_profile_list. Browser sessions are direct/no-proxy by default.', 'lime', color),\n '',\n `${colorize('Tools', 'cyan', color)} ${colorize('(128 MCP tools)', 'muted', color)}`,\n toolRow('search', ['harvest_paa', 'search_serp', 'maps_search', 'maps_place_intel'], color),\n toolRow('extract', ['extract_url', 'map_site_urls', 'extract_site', 'audit_site', 'directory_workflow'], color),\n toolRow('build', ['rank_tracker_workflow', 'cron plan', 'database prompt'], color),\n toolRow('media', ['youtube_harvest', 'youtube_transcribe', 'facebook_ad_search', 'facebook_page_intel', 'facebook_ad_transcribe', 'facebook_video_transcribe', 'instagram_profile_content', 'instagram_media_download', 'reddit_thread'], color),\n toolRow('browser', ['browser_open', 'browser_profile_connect', 'browser_profile_list', 'browser_close', 'browser_screenshot', 'browser_read', 'browser_locate', 'browser_replay_mark', 'browser_replay_annotate'], color),\n toolRow('account', ['credits_info', 'reports', 'MCP resources'], color),\n toolRow('memory', ['memory-put', 'memory-get', 'memory-search', 'list-vaults', 'record-fact', 'list-scheduled-actions'], color),\n `${colorize('Workflows', 'cyan', color)} ${colorize('(MCP + CLI + API)', 'muted', color)}`,\n toolRow('route', ['workflow_list', 'workflow_suggest', 'workflow_run', 'workflow_step', 'workflow_status', 'workflow_artifact_read'], color),\n toolRow('seo', ['directory', 'agent-packet', 'competitive audit', 'map/serp comparison', 'PAA/AIO briefs', 'scheduled runs'], color),\n '',\n colorize('Usage tips:', 'amber', color),\n 'Run mcp-scraper-install for this visible card. Run mcp-scraper-cli for setup utilities and subcommands.',\n 'Run mcp-scraper in a human terminal to print this card; MCP clients get the same command as a silent stdio server.',\n 'Explicit card command: npx -y -p mcp-scraper@latest mcp-scraper-install',\n 'Customer auth setup: run browser_profile_connect, send the watch_url, let the user sign in, then call browser_profile_list until AUTHENTICATED.',\n 'Stack logins / reconnect: run browser_profile_connect again with the same profile name and another domain to add accounts or refresh a login.',\n 'Start with workflow_suggest for broad jobs like market analysis, ICP research, CRO audits, brand briefs, content gaps, and AI visibility.',\n 'For MCP clients, use mcp-scraper so one install can mix SERP, Maps, browser, reports, and saved MCP resources.',\n 'If you hit the concurrency limit, add an extra slot for $5/month with mcp-scraper-cli billing concurrency checkout.',\n '',\n `${colorize('Ready.', 'lime', color)} Install the combined MCP server with one command:`,\n '',\n colorize('Setup doctor', 'amber', color),\n 'npx -y -p mcp-scraper@latest mcp-scraper-cli doctor',\n '',\n colorize('Hosted profile setup', 'amber', color),\n 'In your MCP client, call browser_profile_connect with email=\"seo@example.com\" and domain=\"chatgpt.com\".',\n 'Give the returned watch_url to the user. After they sign in, call browser_profile_list, then browser_open with the returned profile. Add more logins by calling browser_profile_connect again with the same profile and a new domain.',\n '',\n colorize('Claude Code one-command setup', 'amber', color),\n claudeCommand,\n 'Then fully exit Claude Code and open a new Claude terminal. Check with: claude mcp list',\n '',\n colorize('Codex config', 'amber', color),\n codexConfig,\n '',\n colorize('Claude Desktop Extension', 'amber', color),\n 'Download: https://mcpscraper.dev/downloads/mcp-scraper.mcpb',\n '',\n colorize('Safety note:', 'muted', color),\n 'mcp-scraper prints this card only when stdin/stdout are an interactive TTY. In MCP clients it writes only JSON-RPC to stdout.',\n 'Use --stdio or MCP_SCRAPER_FORCE_STDIO=1 to force server mode from a terminal.',\n '',\n ].join('\\n')\n}\n","export const PACKAGE_VERSION = '0.4.4'\n","#!/usr/bin/env node\nimport { renderInstallTerminal } from '../src/install-terminal.js'\nimport { PACKAGE_VERSION } from '../src/version.js'\n\nconst noColor =\n process.argv.includes('--no-color') ||\n process.env.NO_COLOR !== undefined ||\n process.env.FORCE_COLOR === '0' ||\n !process.stdout.isTTY\n\nconst help = process.argv.includes('--help') || process.argv.includes('-h')\nif (help) {\n process.stdout.write([\n 'Usage: mcp-scraper-install [--no-color]',\n '',\n 'Prints the branded MCP Scraper terminal install card and copyable install commands.',\n 'mcp-scraper prints the same card in a human terminal and runs as the MCP stdio server in clients.',\n '',\n ].join('\\n'))\n process.exit(0)\n}\n\nprocess.stdout.write(renderInstallTerminal({\n version: PACKAGE_VERSION,\n color: !noColor,\n apiKeyConfigured: Boolean(process.env.MCP_SCRAPER_API_KEY?.trim()),\n}))\n"],"mappings":";;;;AAQA,IAAM,QAAwC;AAAA,EAC5C,OAAO;AAAA,EACP,MAAM;AAAA,EACN,MAAM;AAAA,EACN,OAAO;AAAA,EACP,KAAK;AAAA,EACL,OAAO;AAAA,EACP,MAAM;AACR;AAEA,SAAS,SAAS,OAAe,MAAY,SAA0B;AACrE,MAAI,CAAC,QAAS,QAAO;AACrB,SAAO,GAAG,MAAM,IAAI,CAAC,GAAG,KAAK,GAAG,MAAM,KAAK;AAC7C;AAEA,SAAS,QAAQ,OAAe,OAAiB,SAA0B;AACzE,QAAM,SAAS,MAAM,OAAO,GAAG,GAAG;AAClC,SAAO,KAAK,SAAS,QAAQ,SAAS,OAAO,CAAC,IAAI,MAAM,KAAK,SAAS,SAAS,SAAS,OAAO,CAAC,CAAC;AACnG;AAEO,SAAS,sBAAsB,SAAyC;AAC7E,QAAM,QAAQ,QAAQ,SAAS;AAC/B,QAAM,cAAc,QAAQ,mBAAmB,yBAAyB;AACxE,QAAM,QAAQ,OAAO;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAcrB,QAAM,gBAAgB;AAAA,IACpB,uBAAuB,WAAW;AAAA,IAClC;AAAA,EACF,EAAE,KAAK,IAAI;AAEX,QAAM,cAAc;AAAA,IAClB;AAAA,IACA;AAAA,IACA;AAAA,IACA,kCAAkC,WAAW;AAAA,EAC/C,EAAE,KAAK,IAAI;AAEX,SAAO;AAAA,IACL,SAAS,gBAAgB,QAAQ,OAAO,IAAI,QAAQ,KAAK;AAAA,IACzD,SAAS,yBAAyB,SAAS,KAAK;AAAA,IAChD,SAAS,OAAO,SAAS,KAAK;AAAA,IAC9B,GAAG,SAAS,qBAAqB,QAAQ,KAAK,CAAC,SAAS,QAAQ,OAAO;AAAA,IACvE;AAAA,IACA,SAAS,0LAA0L,QAAQ,KAAK;AAAA,IAChN;AAAA,IACA,GAAG,SAAS,SAAS,QAAQ,KAAK,CAAC,KAAK,SAAS,mBAAmB,SAAS,KAAK,CAAC;AAAA,IACnF,QAAQ,UAAU,CAAC,eAAe,eAAe,eAAe,kBAAkB,GAAG,KAAK;AAAA,IAC1F,QAAQ,WAAW,CAAC,eAAe,iBAAiB,gBAAgB,cAAc,oBAAoB,GAAG,KAAK;AAAA,IAC9G,QAAQ,SAAS,CAAC,yBAAyB,aAAa,iBAAiB,GAAG,KAAK;AAAA,IACjF,QAAQ,SAAS,CAAC,mBAAmB,sBAAsB,sBAAsB,uBAAuB,0BAA0B,6BAA6B,6BAA6B,4BAA4B,eAAe,GAAG,KAAK;AAAA,IAC/O,QAAQ,WAAW,CAAC,gBAAgB,2BAA2B,wBAAwB,iBAAiB,sBAAsB,gBAAgB,kBAAkB,uBAAuB,yBAAyB,GAAG,KAAK;AAAA,IACxN,QAAQ,WAAW,CAAC,gBAAgB,WAAW,eAAe,GAAG,KAAK;AAAA,IACtE,QAAQ,UAAU,CAAC,cAAc,cAAc,iBAAiB,eAAe,eAAe,wBAAwB,GAAG,KAAK;AAAA,IAC9H,GAAG,SAAS,aAAa,QAAQ,KAAK,CAAC,KAAK,SAAS,qBAAqB,SAAS,KAAK,CAAC;AAAA,IACzF,QAAQ,SAAS,CAAC,iBAAiB,oBAAoB,gBAAgB,iBAAiB,mBAAmB,wBAAwB,GAAG,KAAK;AAAA,IAC3I,QAAQ,OAAO,CAAC,aAAa,gBAAgB,qBAAqB,uBAAuB,kBAAkB,gBAAgB,GAAG,KAAK;AAAA,IACnI;AAAA,IACA,SAAS,eAAe,SAAS,KAAK;AAAA,IACtC;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA,GAAG,SAAS,UAAU,QAAQ,KAAK,CAAC;AAAA,IACpC;AAAA,IACA,SAAS,gBAAgB,SAAS,KAAK;AAAA,IACvC;AAAA,IACA;AAAA,IACA,SAAS,wBAAwB,SAAS,KAAK;AAAA,IAC/C;AAAA,IACA;AAAA,IACA;AAAA,IACA,SAAS,iCAAiC,SAAS,KAAK;AAAA,IACxD;AAAA,IACA;AAAA,IACA;AAAA,IACA,SAAS,gBAAgB,SAAS,KAAK;AAAA,IACvC;AAAA,IACA;AAAA,IACA,SAAS,4BAA4B,SAAS,KAAK;AAAA,IACnD;AAAA,IACA;AAAA,IACA,SAAS,gBAAgB,SAAS,KAAK;AAAA,IACvC;AAAA,IACA;AAAA,IACA;AAAA,EACF,EAAE,KAAK,IAAI;AACb;;;AC/GO,IAAM,kBAAkB;;;ACI/B,IAAM,UACJ,QAAQ,KAAK,SAAS,YAAY,KAClC,QAAQ,IAAI,aAAa,UACzB,QAAQ,IAAI,gBAAgB,OAC5B,CAAC,QAAQ,OAAO;AAElB,IAAM,OAAO,QAAQ,KAAK,SAAS,QAAQ,KAAK,QAAQ,KAAK,SAAS,IAAI;AAC1E,IAAI,MAAM;AACR,UAAQ,OAAO,MAAM;AAAA,IACnB;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,EACF,EAAE,KAAK,IAAI,CAAC;AACZ,UAAQ,KAAK,CAAC;AAChB;AAEA,QAAQ,OAAO,MAAM,sBAAsB;AAAA,EACzC,SAAS;AAAA,EACT,OAAO,CAAC;AAAA,EACR,kBAAkB,QAAQ,QAAQ,IAAI,qBAAqB,KAAK,CAAC;AACnE,CAAC,CAAC;","names":[]}
|
|
1
|
+
{"version":3,"sources":["../../src/install-terminal.ts","../../src/version.ts","../../bin/mcp-scraper-install.ts"],"sourcesContent":["export interface InstallTerminalOptions {\n color?: boolean\n version: string\n apiKeyConfigured?: boolean\n}\n\ntype Tone = 'cyan' | 'lime' | 'amber' | 'red' | 'muted' | 'bold'\n\nconst CODES: Record<Tone | 'reset', string> = {\n reset: '\\x1b[0m',\n cyan: '\\x1b[36m',\n lime: '\\x1b[32m',\n amber: '\\x1b[33m',\n red: '\\x1b[31m',\n muted: '\\x1b[90m',\n bold: '\\x1b[1m',\n}\n\nfunction colorize(value: string, tone: Tone, enabled: boolean): string {\n if (!enabled) return value\n return `${CODES[tone]}${value}${CODES.reset}`\n}\n\nfunction toolRow(label: string, tools: string[], enabled: boolean): string {\n const padded = label.padEnd(9, ' ')\n return ` ${colorize(padded, 'muted', enabled)} ${tools.join(colorize(' . ', 'muted', enabled))}`\n}\n\nexport function renderInstallTerminal(options: InstallTerminalOptions): string {\n const color = options.color ?? true\n const apiKeyValue = options.apiKeyConfigured ? '$MCP_SCRAPER_API_KEY' : 'sk_live_your_key'\n const ascii = String.raw`\n __ __ ____ ____ \n| \\/ |/ ___| _ \\\n| |\\/| | | | |_) |\n| | | | |___| __/\n|_| |_|\\____|_|\n\n ____ ____ ____ _ ____ _____ ____\n/ ___| / ___| _ \\ / \\ | _ \\| ____| _ \\\n\\___ \\| | | |_) | / _ \\ | |_) | _| | |_) |\n ___) | |___| _ < / ___ \\| __/| |___| _ <\n|____/ \\____|_| \\_\\/_/ \\_\\_| |_____|_| \\_\\\n`\n\n const claudeCommand = [\n `MCP_SCRAPER_API_KEY=${apiKeyValue} npx -y -p mcp-scraper@latest \\\\`,\n ' mcp-scraper-cli agent install claude --apply',\n ].join('\\n')\n\n const codexConfig = [\n '[mcp_servers.mcp-scraper]',\n 'command = \"npx\"',\n 'args = [\"-y\", \"-p\", \"mcp-scraper@latest\", \"mcp-scraper\"]',\n `env = { MCP_SCRAPER_API_KEY = \"${apiKeyValue}\" }`,\n ].join('\\n')\n\n return [\n colorize(`mcp-scraper v${options.version}`, 'bold', color),\n colorize('> mcp-scraper-install', 'muted', color),\n colorize(ascii, 'amber', color),\n `${colorize('MCP Scraper Agent', 'cyan', color)} . v${options.version} . mcpscraper.dev`,\n '1/1 install surfaces ready',\n colorize('Newest: saved browser profiles that hold MANY site logins. Share the watch_url, user signs in, then verify with browser_profile_list. Browser sessions are direct/no-proxy by default.', 'lime', color),\n '',\n `${colorize('Tools', 'cyan', color)} ${colorize('(128 MCP tools)', 'muted', color)}`,\n toolRow('search', ['harvest_paa', 'search_serp', 'maps_search', 'maps_place_intel'], color),\n toolRow('extract', ['extract_url', 'map_site_urls', 'extract_site', 'audit_site', 'directory_workflow'], color),\n toolRow('build', ['rank_tracker_workflow', 'cron plan', 'database prompt'], color),\n toolRow('media', ['youtube_harvest', 'youtube_transcribe', 'facebook_ad_search', 'facebook_page_intel', 'facebook_ad_transcribe', 'facebook_video_transcribe', 'instagram_profile_content', 'instagram_media_download', 'reddit_thread'], color),\n toolRow('browser', ['browser_open', 'browser_profile_connect', 'browser_profile_list', 'browser_close', 'browser_screenshot', 'browser_read', 'browser_locate', 'browser_replay_mark', 'browser_replay_annotate'], color),\n toolRow('account', ['credits_info', 'reports', 'MCP resources'], color),\n toolRow('memory', ['memory-put', 'memory-get', 'memory-search', 'list-vaults', 'record-fact', 'list-scheduled-actions'], color),\n `${colorize('Workflows', 'cyan', color)} ${colorize('(MCP + CLI + API)', 'muted', color)}`,\n toolRow('route', ['workflow_list', 'workflow_suggest', 'workflow_run', 'workflow_step', 'workflow_status', 'workflow_artifact_read'], color),\n toolRow('seo', ['directory', 'agent-packet', 'competitive audit', 'map/serp comparison', 'PAA/AIO briefs', 'scheduled runs'], color),\n '',\n colorize('Usage tips:', 'amber', color),\n 'Run mcp-scraper-install for this visible card. Run mcp-scraper-cli for setup utilities and subcommands.',\n 'Run mcp-scraper in a human terminal to print this card; MCP clients get the same command as a silent stdio server.',\n 'Explicit card command: npx -y -p mcp-scraper@latest mcp-scraper-install',\n 'Customer auth setup: run browser_profile_connect, send the watch_url, let the user sign in, then call browser_profile_list until AUTHENTICATED.',\n 'Stack logins / reconnect: run browser_profile_connect again with the same profile name and another domain to add accounts or refresh a login.',\n 'Start with workflow_suggest for broad jobs like market analysis, ICP research, CRO audits, brand briefs, content gaps, and AI visibility.',\n 'For MCP clients, use mcp-scraper so one install can mix SERP, Maps, browser, reports, and saved MCP resources.',\n 'If you hit the concurrency limit, add an extra slot for $5/month with mcp-scraper-cli billing concurrency checkout.',\n '',\n `${colorize('Ready.', 'lime', color)} Install the combined MCP server with one command:`,\n '',\n colorize('Setup doctor', 'amber', color),\n 'npx -y -p mcp-scraper@latest mcp-scraper-cli doctor',\n '',\n colorize('Hosted profile setup', 'amber', color),\n 'In your MCP client, call browser_profile_connect with email=\"seo@example.com\" and domain=\"chatgpt.com\".',\n 'Give the returned watch_url to the user. After they sign in, call browser_profile_list, then browser_open with the returned profile. Add more logins by calling browser_profile_connect again with the same profile and a new domain.',\n '',\n colorize('Claude Code one-command setup', 'amber', color),\n claudeCommand,\n 'Then fully exit Claude Code and open a new Claude terminal. Check with: claude mcp list',\n '',\n colorize('Codex config', 'amber', color),\n codexConfig,\n '',\n colorize('Claude Desktop Extension', 'amber', color),\n 'Download: https://mcpscraper.dev/downloads/mcp-scraper.mcpb',\n '',\n colorize('Safety note:', 'muted', color),\n 'mcp-scraper prints this card only when stdin/stdout are an interactive TTY. In MCP clients it writes only JSON-RPC to stdout.',\n 'Use --stdio or MCP_SCRAPER_FORCE_STDIO=1 to force server mode from a terminal.',\n '',\n ].join('\\n')\n}\n","export const PACKAGE_VERSION = '0.4.6'\n","#!/usr/bin/env node\nimport { renderInstallTerminal } from '../src/install-terminal.js'\nimport { PACKAGE_VERSION } from '../src/version.js'\n\nconst noColor =\n process.argv.includes('--no-color') ||\n process.env.NO_COLOR !== undefined ||\n process.env.FORCE_COLOR === '0' ||\n !process.stdout.isTTY\n\nconst help = process.argv.includes('--help') || process.argv.includes('-h')\nif (help) {\n process.stdout.write([\n 'Usage: mcp-scraper-install [--no-color]',\n '',\n 'Prints the branded MCP Scraper terminal install card and copyable install commands.',\n 'mcp-scraper prints the same card in a human terminal and runs as the MCP stdio server in clients.',\n '',\n ].join('\\n'))\n process.exit(0)\n}\n\nprocess.stdout.write(renderInstallTerminal({\n version: PACKAGE_VERSION,\n color: !noColor,\n apiKeyConfigured: Boolean(process.env.MCP_SCRAPER_API_KEY?.trim()),\n}))\n"],"mappings":";;;;AAQA,IAAM,QAAwC;AAAA,EAC5C,OAAO;AAAA,EACP,MAAM;AAAA,EACN,MAAM;AAAA,EACN,OAAO;AAAA,EACP,KAAK;AAAA,EACL,OAAO;AAAA,EACP,MAAM;AACR;AAEA,SAAS,SAAS,OAAe,MAAY,SAA0B;AACrE,MAAI,CAAC,QAAS,QAAO;AACrB,SAAO,GAAG,MAAM,IAAI,CAAC,GAAG,KAAK,GAAG,MAAM,KAAK;AAC7C;AAEA,SAAS,QAAQ,OAAe,OAAiB,SAA0B;AACzE,QAAM,SAAS,MAAM,OAAO,GAAG,GAAG;AAClC,SAAO,KAAK,SAAS,QAAQ,SAAS,OAAO,CAAC,IAAI,MAAM,KAAK,SAAS,SAAS,SAAS,OAAO,CAAC,CAAC;AACnG;AAEO,SAAS,sBAAsB,SAAyC;AAC7E,QAAM,QAAQ,QAAQ,SAAS;AAC/B,QAAM,cAAc,QAAQ,mBAAmB,yBAAyB;AACxE,QAAM,QAAQ,OAAO;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAcrB,QAAM,gBAAgB;AAAA,IACpB,uBAAuB,WAAW;AAAA,IAClC;AAAA,EACF,EAAE,KAAK,IAAI;AAEX,QAAM,cAAc;AAAA,IAClB;AAAA,IACA;AAAA,IACA;AAAA,IACA,kCAAkC,WAAW;AAAA,EAC/C,EAAE,KAAK,IAAI;AAEX,SAAO;AAAA,IACL,SAAS,gBAAgB,QAAQ,OAAO,IAAI,QAAQ,KAAK;AAAA,IACzD,SAAS,yBAAyB,SAAS,KAAK;AAAA,IAChD,SAAS,OAAO,SAAS,KAAK;AAAA,IAC9B,GAAG,SAAS,qBAAqB,QAAQ,KAAK,CAAC,SAAS,QAAQ,OAAO;AAAA,IACvE;AAAA,IACA,SAAS,0LAA0L,QAAQ,KAAK;AAAA,IAChN;AAAA,IACA,GAAG,SAAS,SAAS,QAAQ,KAAK,CAAC,KAAK,SAAS,mBAAmB,SAAS,KAAK,CAAC;AAAA,IACnF,QAAQ,UAAU,CAAC,eAAe,eAAe,eAAe,kBAAkB,GAAG,KAAK;AAAA,IAC1F,QAAQ,WAAW,CAAC,eAAe,iBAAiB,gBAAgB,cAAc,oBAAoB,GAAG,KAAK;AAAA,IAC9G,QAAQ,SAAS,CAAC,yBAAyB,aAAa,iBAAiB,GAAG,KAAK;AAAA,IACjF,QAAQ,SAAS,CAAC,mBAAmB,sBAAsB,sBAAsB,uBAAuB,0BAA0B,6BAA6B,6BAA6B,4BAA4B,eAAe,GAAG,KAAK;AAAA,IAC/O,QAAQ,WAAW,CAAC,gBAAgB,2BAA2B,wBAAwB,iBAAiB,sBAAsB,gBAAgB,kBAAkB,uBAAuB,yBAAyB,GAAG,KAAK;AAAA,IACxN,QAAQ,WAAW,CAAC,gBAAgB,WAAW,eAAe,GAAG,KAAK;AAAA,IACtE,QAAQ,UAAU,CAAC,cAAc,cAAc,iBAAiB,eAAe,eAAe,wBAAwB,GAAG,KAAK;AAAA,IAC9H,GAAG,SAAS,aAAa,QAAQ,KAAK,CAAC,KAAK,SAAS,qBAAqB,SAAS,KAAK,CAAC;AAAA,IACzF,QAAQ,SAAS,CAAC,iBAAiB,oBAAoB,gBAAgB,iBAAiB,mBAAmB,wBAAwB,GAAG,KAAK;AAAA,IAC3I,QAAQ,OAAO,CAAC,aAAa,gBAAgB,qBAAqB,uBAAuB,kBAAkB,gBAAgB,GAAG,KAAK;AAAA,IACnI;AAAA,IACA,SAAS,eAAe,SAAS,KAAK;AAAA,IACtC;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA,GAAG,SAAS,UAAU,QAAQ,KAAK,CAAC;AAAA,IACpC;AAAA,IACA,SAAS,gBAAgB,SAAS,KAAK;AAAA,IACvC;AAAA,IACA;AAAA,IACA,SAAS,wBAAwB,SAAS,KAAK;AAAA,IAC/C;AAAA,IACA;AAAA,IACA;AAAA,IACA,SAAS,iCAAiC,SAAS,KAAK;AAAA,IACxD;AAAA,IACA;AAAA,IACA;AAAA,IACA,SAAS,gBAAgB,SAAS,KAAK;AAAA,IACvC;AAAA,IACA;AAAA,IACA,SAAS,4BAA4B,SAAS,KAAK;AAAA,IACnD;AAAA,IACA;AAAA,IACA,SAAS,gBAAgB,SAAS,KAAK;AAAA,IACvC;AAAA,IACA;AAAA,IACA;AAAA,EACF,EAAE,KAAK,IAAI;AACb;;;AC/GO,IAAM,kBAAkB;;;ACI/B,IAAM,UACJ,QAAQ,KAAK,SAAS,YAAY,KAClC,QAAQ,IAAI,aAAa,UACzB,QAAQ,IAAI,gBAAgB,OAC5B,CAAC,QAAQ,OAAO;AAElB,IAAM,OAAO,QAAQ,KAAK,SAAS,QAAQ,KAAK,QAAQ,KAAK,SAAS,IAAI;AAC1E,IAAI,MAAM;AACR,UAAQ,OAAO,MAAM;AAAA,IACnB;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,IACA;AAAA,EACF,EAAE,KAAK,IAAI,CAAC;AACZ,UAAQ,KAAK,CAAC;AAChB;AAEA,QAAQ,OAAO,MAAM,sBAAsB;AAAA,EACzC,SAAS;AAAA,EACT,OAAO,CAAC;AAAA,EACR,kBAAkB,QAAQ,QAAQ,IAAI,qBAAqB,KAAK,CAAC;AACnE,CAAC,CAAC;","names":[]}
|
|
@@ -4,7 +4,7 @@ import {
|
|
|
4
4
|
} from "../chunk-5HNHYUJ5.js";
|
|
5
5
|
import {
|
|
6
6
|
PACKAGE_VERSION
|
|
7
|
-
} from "../chunk-
|
|
7
|
+
} from "../chunk-5BB6Y3BB.js";
|
|
8
8
|
|
|
9
9
|
// bin/mcp-scraper-install.ts
|
|
10
10
|
var noColor = process.argv.includes("--no-color") || process.env.NO_COLOR !== void 0 || process.env.FORCE_COLOR === "0" || !process.stdout.isTTY;
|
|
@@ -226,6 +226,9 @@ var HttpMcpToolExecutor = class {
|
|
|
226
226
|
extractUrl(input) {
|
|
227
227
|
return this.call("/extract-url", input);
|
|
228
228
|
}
|
|
229
|
+
diffPage(input) {
|
|
230
|
+
return this.call("/diff-page", input);
|
|
231
|
+
}
|
|
229
232
|
mapSiteUrls(input) {
|
|
230
233
|
return this.call("/map-urls", input);
|
|
231
234
|
}
|
|
@@ -480,7 +483,7 @@ render();
|
|
|
480
483
|
}
|
|
481
484
|
|
|
482
485
|
// src/version.ts
|
|
483
|
-
var PACKAGE_VERSION = "0.4.
|
|
486
|
+
var PACKAGE_VERSION = "0.4.6";
|
|
484
487
|
|
|
485
488
|
// src/mcp/browser-agent-tool-schemas.ts
|
|
486
489
|
var import_zod = require("zod");
|
|
@@ -501,7 +504,10 @@ var BrowserOpenInputSchema = {
|
|
|
501
504
|
url: import_zod.z.string().url().optional().describe("Optional URL to navigate to immediately after opening."),
|
|
502
505
|
profile: import_zod.z.string().optional().describe("Optional saved hosted profile name to load a logged-in session for a site."),
|
|
503
506
|
save_profile_changes: import_zod.z.boolean().optional().describe("Persist cookies/storage back to the named profile on close. Avoid parallel sessions writing to the same profile."),
|
|
504
|
-
timeout_seconds: import_zod.z.number().int().min(60).max(259200).optional().describe("Session lifetime before auto-termination. Defaults to 600.")
|
|
507
|
+
timeout_seconds: import_zod.z.number().int().min(60).max(259200).optional().describe("Session lifetime before auto-termination. Defaults to 600."),
|
|
508
|
+
extension_names: import_zod.z.array(import_zod.z.string()).optional().describe(
|
|
509
|
+
"Names of extensions previously added with browser_extension_import (see browser_extension_list for what's available) to load into this session. Loading extensions restarts the browser, adding a few seconds to startup."
|
|
510
|
+
)
|
|
505
511
|
};
|
|
506
512
|
var BrowserProfileConnectInputSchema = {
|
|
507
513
|
email: import_zod.z.string().optional().describe("Account email for the login. Derives a stable profile name and is recorded as a note. Does NOT import existing cookies \u2014 the user signs in fresh."),
|
|
@@ -728,6 +734,43 @@ var BrowserProfileListOutputSchema = {
|
|
|
728
734
|
connections: import_zod.z.array(BrowserProfileLogin).describe("All site logins saved in this profile, each with its current auth status and note."),
|
|
729
735
|
count: import_zod.z.number().int().min(0)
|
|
730
736
|
};
|
|
737
|
+
var BrowserExtensionImportInputSchema = {
|
|
738
|
+
store_url: import_zod.z.string().url().describe("Chrome Web Store URL of the extension to add, e.g. https://chromewebstore.google.com/detail/<slug>/<id>."),
|
|
739
|
+
name: import_zod.z.string().min(1).max(64).describe('Short name to save this extension under, e.g. "ani-ai". Reuse it later in extension_names on browser_open.')
|
|
740
|
+
};
|
|
741
|
+
var BrowserExtensionImportOutputSchema = {
|
|
742
|
+
ok: import_zod.z.boolean(),
|
|
743
|
+
tool: import_zod.z.literal("browser_extension_import"),
|
|
744
|
+
session_id: import_zod.z.null(),
|
|
745
|
+
name: import_zod.z.string().describe("The name this extension was saved under."),
|
|
746
|
+
source_url: import_zod.z.string().describe("The store URL this extension was imported from."),
|
|
747
|
+
size_bytes: import_zod.z.number().nullable().describe("Size of the extension package in bytes.")
|
|
748
|
+
};
|
|
749
|
+
var BrowserExtensionSummary = import_zod.z.object({
|
|
750
|
+
name: import_zod.z.string(),
|
|
751
|
+
source: import_zod.z.string().describe('Always "store" for extensions added via browser_extension_import.'),
|
|
752
|
+
source_url: NullableString,
|
|
753
|
+
size_bytes: import_zod.z.number().nullable(),
|
|
754
|
+
created_at: import_zod.z.string()
|
|
755
|
+
});
|
|
756
|
+
var BrowserExtensionListInputSchema = {};
|
|
757
|
+
var BrowserExtensionListOutputSchema = {
|
|
758
|
+
ok: import_zod.z.boolean(),
|
|
759
|
+
tool: import_zod.z.literal("browser_extension_list"),
|
|
760
|
+
session_id: import_zod.z.null(),
|
|
761
|
+
extensions: import_zod.z.array(BrowserExtensionSummary).describe("Every extension available to load via extension_names on browser_open."),
|
|
762
|
+
count: import_zod.z.number().int().min(0)
|
|
763
|
+
};
|
|
764
|
+
var BrowserExtensionDeleteInputSchema = {
|
|
765
|
+
name: import_zod.z.string().min(1).describe("Name of the extension to remove, as returned by browser_extension_list.")
|
|
766
|
+
};
|
|
767
|
+
var BrowserExtensionDeleteOutputSchema = {
|
|
768
|
+
ok: import_zod.z.boolean(),
|
|
769
|
+
tool: import_zod.z.literal("browser_extension_delete"),
|
|
770
|
+
session_id: import_zod.z.null(),
|
|
771
|
+
name: import_zod.z.string(),
|
|
772
|
+
deleted: import_zod.z.boolean()
|
|
773
|
+
};
|
|
731
774
|
var BrowserScreenshotOutputSchema = {
|
|
732
775
|
...BrowserBaseOutput,
|
|
733
776
|
tool: import_zod.z.literal("browser_screenshot"),
|
|
@@ -1407,6 +1450,71 @@ function registerBrowserAgentMcpTools(server2, opts) {
|
|
|
1407
1450
|
});
|
|
1408
1451
|
}
|
|
1409
1452
|
);
|
|
1453
|
+
server2.registerTool(
|
|
1454
|
+
"browser_extension_import",
|
|
1455
|
+
{
|
|
1456
|
+
title: "Add Browser Extension",
|
|
1457
|
+
description: "Add a Chrome extension from its Chrome Web Store page so it can be loaded into browser_open sessions via extension_names. One-time setup per extension \u2014 check what's already added with browser_extension_list first. The extension starts logged out in any session; sign into it once inside a session, pairing with a saved profile (browser_open's profile + save_profile_changes) to keep it signed in on future opens.",
|
|
1458
|
+
inputSchema: BrowserExtensionImportInputSchema,
|
|
1459
|
+
outputSchema: recordOutputSchema("browser_extension_import", BrowserExtensionImportOutputSchema),
|
|
1460
|
+
annotations: annotations("Add Browser Extension")
|
|
1461
|
+
},
|
|
1462
|
+
async (input) => {
|
|
1463
|
+
const res = await req("POST", "/agent/extensions/import", { store_url: input.store_url, name: input.name });
|
|
1464
|
+
if (!res.ok) return errorResult("browser_extension_import", res.data);
|
|
1465
|
+
return structuredResult({
|
|
1466
|
+
ok: true,
|
|
1467
|
+
tool: "browser_extension_import",
|
|
1468
|
+
session_id: null,
|
|
1469
|
+
name: res.data.name,
|
|
1470
|
+
source_url: res.data.source_url,
|
|
1471
|
+
size_bytes: res.data.size_bytes ?? null
|
|
1472
|
+
});
|
|
1473
|
+
}
|
|
1474
|
+
);
|
|
1475
|
+
server2.registerTool(
|
|
1476
|
+
"browser_extension_list",
|
|
1477
|
+
{
|
|
1478
|
+
title: "List Browser Extensions",
|
|
1479
|
+
description: "List extensions added via browser_extension_import, for use as extension_names on browser_open. Read-only, no cost.",
|
|
1480
|
+
inputSchema: BrowserExtensionListInputSchema,
|
|
1481
|
+
outputSchema: recordOutputSchema("browser_extension_list", BrowserExtensionListOutputSchema),
|
|
1482
|
+
annotations: annotations("List Browser Extensions", true)
|
|
1483
|
+
},
|
|
1484
|
+
async () => {
|
|
1485
|
+
const res = await req("GET", "/agent/extensions");
|
|
1486
|
+
if (!res.ok) return errorResult("browser_extension_list", res.data);
|
|
1487
|
+
const extensions = Array.isArray(res.data?.extensions) ? res.data.extensions : [];
|
|
1488
|
+
return structuredResult({
|
|
1489
|
+
ok: true,
|
|
1490
|
+
tool: "browser_extension_list",
|
|
1491
|
+
session_id: null,
|
|
1492
|
+
extensions,
|
|
1493
|
+
count: extensions.length
|
|
1494
|
+
});
|
|
1495
|
+
}
|
|
1496
|
+
);
|
|
1497
|
+
server2.registerTool(
|
|
1498
|
+
"browser_extension_delete",
|
|
1499
|
+
{
|
|
1500
|
+
title: "Remove Browser Extension",
|
|
1501
|
+
description: "Remove a previously added extension by name so it can no longer be loaded via extension_names.",
|
|
1502
|
+
inputSchema: BrowserExtensionDeleteInputSchema,
|
|
1503
|
+
outputSchema: recordOutputSchema("browser_extension_delete", BrowserExtensionDeleteOutputSchema),
|
|
1504
|
+
annotations: { title: "Remove Browser Extension", readOnlyHint: false, destructiveHint: true, idempotentHint: true, openWorldHint: false }
|
|
1505
|
+
},
|
|
1506
|
+
async (input) => {
|
|
1507
|
+
const res = await req("DELETE", `/agent/extensions/${encodeURIComponent(input.name)}`);
|
|
1508
|
+
if (!res.ok) return errorResult("browser_extension_delete", res.data);
|
|
1509
|
+
return structuredResult({
|
|
1510
|
+
ok: true,
|
|
1511
|
+
tool: "browser_extension_delete",
|
|
1512
|
+
session_id: null,
|
|
1513
|
+
name: input.name,
|
|
1514
|
+
deleted: true
|
|
1515
|
+
});
|
|
1516
|
+
}
|
|
1517
|
+
);
|
|
1410
1518
|
server2.registerTool(
|
|
1411
1519
|
"browser_open",
|
|
1412
1520
|
{
|
|
@@ -1425,7 +1533,8 @@ function registerBrowserAgentMcpTools(server2, opts) {
|
|
|
1425
1533
|
...profile && typeof saveProfileChanges === "boolean" ? { save_profile_changes: saveProfileChanges } : {},
|
|
1426
1534
|
disable_default_proxy: true,
|
|
1427
1535
|
timeout_seconds: input.timeout_seconds,
|
|
1428
|
-
...input.url ? { url: input.url } : {}
|
|
1536
|
+
...input.url ? { url: input.url } : {},
|
|
1537
|
+
...input.extension_names?.length ? { extension_names: input.extension_names } : {}
|
|
1429
1538
|
});
|
|
1430
1539
|
if (!open.ok) return errorResult("browser_open", open.data);
|
|
1431
1540
|
const session = open.data;
|
|
@@ -3099,6 +3208,56 @@ ${headingSection}${kpoSection}${brandingSection}${bodySectionFull}${memSection}$
|
|
|
3099
3208
|
}
|
|
3100
3209
|
return { ...textResult, structuredContent };
|
|
3101
3210
|
}
|
|
3211
|
+
var DIFF_PAGE_PREVIEW_HUNKS = 20;
|
|
3212
|
+
function formatDiffPage(raw, input) {
|
|
3213
|
+
const parsed = parseData(raw);
|
|
3214
|
+
if ("error" in parsed) return { content: [{ type: "text", text: parsed.error }], isError: true };
|
|
3215
|
+
const d = parsed.data;
|
|
3216
|
+
const url = d.url ?? input.url;
|
|
3217
|
+
const title = d.title ?? "Untitled";
|
|
3218
|
+
const statusLine = d.status === "baseline" ? d.isReset ? "\u{1F195} **Baseline reset** \u2014 prior history discarded, this check is now the new baseline." : "\u{1F195} **Baseline captured** \u2014 first check for this URL, nothing to compare yet." : d.status === "unchanged" ? `\u2705 **No changes** since ${d.previousCheckedAt ?? "the last check"}.` : `\u{1F504} **Changed** since ${d.previousCheckedAt ?? "the last check"} \u2014 +${d.summary.linesAdded}/-${d.summary.linesRemoved} lines (${d.summary.percentChanged ?? 0}% of content).`;
|
|
3219
|
+
const previewHunks = d.hunks.slice(0, DIFF_PAGE_PREVIEW_HUNKS);
|
|
3220
|
+
const diffBlock = previewHunks.length ? [
|
|
3221
|
+
"\n## Diff",
|
|
3222
|
+
"```diff",
|
|
3223
|
+
...previewHunks.flatMap((h) => h.lines.map((l) => `${h.type === "added" ? "+" : "-"} ${l}`)),
|
|
3224
|
+
"```",
|
|
3225
|
+
previewHunks.length < d.hunks.length ? `*(showing ${previewHunks.length} of ${d.hunks.length} returned hunks)*` : ""
|
|
3226
|
+
].filter(Boolean).join("\n") : "";
|
|
3227
|
+
const truncationNotes = [
|
|
3228
|
+
d.contentTruncated ? "\n\u26A0\uFE0F Page content exceeded the storable cap and was truncated before hashing/diffing \u2014 changes past that point are not visible to this comparison." : "",
|
|
3229
|
+
d.hunksTruncatedReason ? `
|
|
3230
|
+
\u26A0\uFE0F ${d.hunksTruncatedReason}` : ""
|
|
3231
|
+
].filter(Boolean).join("\n");
|
|
3232
|
+
const tips = `
|
|
3233
|
+
---
|
|
3234
|
+
\u{1F4A1} **Tips**
|
|
3235
|
+
- Call \`diff_page\` again anytime to re-check \u2014 this tool is on-demand, not automatic.
|
|
3236
|
+
- Want the page's current content with nothing to compare? use \`extract_url\`.`;
|
|
3237
|
+
const full = `# Page Diff: ${url}
|
|
3238
|
+
**${title}**
|
|
3239
|
+
|
|
3240
|
+
${statusLine}${diffBlock}${truncationNotes}${tips}`;
|
|
3241
|
+
return {
|
|
3242
|
+
...oneBlock(full),
|
|
3243
|
+
structuredContent: {
|
|
3244
|
+
url,
|
|
3245
|
+
title: d.title,
|
|
3246
|
+
status: d.status,
|
|
3247
|
+
isReset: d.isReset,
|
|
3248
|
+
previousCheckedAt: d.previousCheckedAt,
|
|
3249
|
+
currentCheckedAt: d.currentCheckedAt,
|
|
3250
|
+
contentHash: d.contentHash,
|
|
3251
|
+
previousContentHash: d.previousContentHash,
|
|
3252
|
+
summary: d.summary,
|
|
3253
|
+
hunks: d.hunks,
|
|
3254
|
+
contentTruncated: d.contentTruncated,
|
|
3255
|
+
hunksTruncated: d.hunksTruncated,
|
|
3256
|
+
hunksTruncatedReason: d.hunksTruncatedReason,
|
|
3257
|
+
totalChangedLineCount: d.totalChangedLineCount
|
|
3258
|
+
}
|
|
3259
|
+
};
|
|
3260
|
+
}
|
|
3102
3261
|
async function formatMapSiteUrls(raw, input, ctx) {
|
|
3103
3262
|
const parsed = parseData(raw);
|
|
3104
3263
|
if ("error" in parsed) return { content: [{ type: "text", text: parsed.error }], isError: true };
|
|
@@ -5064,6 +5223,11 @@ var ExtractUrlInputSchema = {
|
|
|
5064
5223
|
depositToVault: import_zod3.z.boolean().default(false).describe("Save the full page content into the user's MCP Memory vault server-side, embedded for semantic recall \u2014 the full body is NOT returned to chat."),
|
|
5065
5224
|
vaultName: import_zod3.z.string().trim().min(1).max(120).optional().describe("Optional vault to deposit into. Defaults to the user's personal vault.")
|
|
5066
5225
|
};
|
|
5226
|
+
var DiffPageInputSchema = {
|
|
5227
|
+
url: import_zod3.z.string().url().describe("Public http/https URL to check for changes since the last diff_page call."),
|
|
5228
|
+
allowLocal: import_zod3.z.boolean().default(false).describe("Allow localhost and private-network URLs. Local development only."),
|
|
5229
|
+
resetBaseline: import_zod3.z.boolean().default(false).describe("Discard any previously stored snapshot for this URL and capture the current content as a fresh baseline instead of diffing against history. Use when you deliberately want to restart change tracking.")
|
|
5230
|
+
};
|
|
5067
5231
|
var MapSiteUrlsInputSchema = {
|
|
5068
5232
|
url: import_zod3.z.string().url().describe("Public website URL or domain to crawl for internal URLs. Use before extract_site when the user asks to audit/map/crawl a site."),
|
|
5069
5233
|
maxUrls: import_zod3.z.number().int().min(1).max(1e4).optional().describe("Maximum URLs to discover. Use 100 for normal maps, up to 10000 for a full inventory. Large maps (over 500 URLs) write the complete inventory to a local file and return only a summary plus the file path instead of the full list inline.")
|
|
@@ -5457,6 +5621,29 @@ var ExtractUrlOutputSchema = {
|
|
|
5457
5621
|
error: import_zod3.z.string().optional()
|
|
5458
5622
|
}).optional()
|
|
5459
5623
|
};
|
|
5624
|
+
var DiffPageOutputSchema = {
|
|
5625
|
+
url: import_zod3.z.string(),
|
|
5626
|
+
title: NullableString2,
|
|
5627
|
+
status: import_zod3.z.enum(["baseline", "unchanged", "changed"]).describe('"baseline" = first-ever check for this URL, or resetBaseline was used \u2014 nothing to compare against. "unchanged" = content hash matched the stored snapshot. "changed" = a diff was computed.'),
|
|
5628
|
+
isReset: import_zod3.z.boolean().describe("True only when resetBaseline discarded a real prior snapshot \u2014 distinguishes an explicit reset from a URL's true first-ever check."),
|
|
5629
|
+
previousCheckedAt: NullableString2.describe("ISO timestamp of the snapshot this was compared against, or null if there was none."),
|
|
5630
|
+
currentCheckedAt: import_zod3.z.string().describe("ISO timestamp of this check, now stored as the new snapshot."),
|
|
5631
|
+
contentHash: import_zod3.z.string().describe("sha256 of the full (untruncated) page content just captured."),
|
|
5632
|
+
previousContentHash: NullableString2,
|
|
5633
|
+
summary: import_zod3.z.object({
|
|
5634
|
+
linesAdded: import_zod3.z.number().int().min(0),
|
|
5635
|
+
linesRemoved: import_zod3.z.number().int().min(0),
|
|
5636
|
+
percentChanged: import_zod3.z.number().min(0).max(100).nullable().describe('Proportion of changed lines relative to the larger of the two versions. Null when status is "baseline".')
|
|
5637
|
+
}),
|
|
5638
|
+
hunks: import_zod3.z.array(import_zod3.z.object({
|
|
5639
|
+
type: import_zod3.z.enum(["added", "removed"]).describe("Unchanged context lines are omitted \u2014 only added/removed lines are returned."),
|
|
5640
|
+
lines: import_zod3.z.array(import_zod3.z.string())
|
|
5641
|
+
})).describe("Ordered added/removed line hunks, capped for response size \u2014 see hunksTruncated."),
|
|
5642
|
+
contentTruncated: import_zod3.z.boolean().describe("True if the scraped page exceeded the 250,000-character storable cap and was truncated before hashing/diffing/storing \u2014 changes past that point are invisible to this comparison."),
|
|
5643
|
+
hunksTruncated: import_zod3.z.boolean().describe("True if the hunks list above was capped for response size \u2014 see hunksTruncatedReason."),
|
|
5644
|
+
hunksTruncatedReason: NullableString2,
|
|
5645
|
+
totalChangedLineCount: import_zod3.z.number().int().min(0).describe("Total changed lines found before any hunksTruncated capping was applied.")
|
|
5646
|
+
};
|
|
5460
5647
|
var ExtractSiteOutputSchema = {
|
|
5461
5648
|
url: import_zod3.z.string(),
|
|
5462
5649
|
pageCount: import_zod3.z.number().int().min(0),
|
|
@@ -6453,6 +6640,13 @@ function registerPaaExtractorMcpTools(server2, executor, options = {}) {
|
|
|
6453
6640
|
outputSchema: recordOutputSchema("extract_url", ExtractUrlOutputSchema),
|
|
6454
6641
|
annotations: liveWebToolAnnotations("Single URL Extract")
|
|
6455
6642
|
}, async (input) => formatExtractUrl(await executor.extractUrl(input), input));
|
|
6643
|
+
server2.registerTool("diff_page", {
|
|
6644
|
+
title: "Page Change Check",
|
|
6645
|
+
description: "Check whether a public URL has changed since you last checked it with this tool: scrapes the current page, diffs it against your last stored snapshot for that URL, and returns what was added or removed (or confirms no change). Stores the new snapshot as the baseline for next time \u2014 on-demand only, no automatic recurring checks. Use extract_url instead when you just want the page's current content with nothing to compare against.",
|
|
6646
|
+
inputSchema: DiffPageInputSchema,
|
|
6647
|
+
outputSchema: recordOutputSchema("diff_page", DiffPageOutputSchema),
|
|
6648
|
+
annotations: liveWebToolAnnotations("Page Change Check")
|
|
6649
|
+
}, async (input) => formatDiffPage(await executor.diffPage(input), input));
|
|
6456
6650
|
server2.registerTool("map_site_urls", {
|
|
6457
6651
|
title: "Site URL Map",
|
|
6458
6652
|
description: `Map/crawl a public website for a sitemap, URL inventory, or broken-link scan. Returns internal URLs with HTTP status; ${fileBehavior("maps over 500 URLs are written to a local CSV file instead of inlined.", "large results are stored as a retrievable artifact \u2014 you get an inline summary plus an artifactId for report_artifact_read.")}`,
|