| name | web-pilot |
| description | Search the web and read page contents without API keys. Use when you need to search via DuckDuckGo/Brave/Google (multi-page), extract readable text from URLs, browse interactively with a persistent visible browser (with tabs, click, screenshot, text search), download files/PDFs, or dismiss cookie banners. Supports JSON/markdown/text output. Powered by Playwright + Chromium. |
Web Pilot
Four scripts, zero API keys. All output is JSON by default.
Dependencies: requests, beautifulsoup4, playwright (with Chromium).
Optional: pdfplumber or PyPDF2 for PDF text extraction.
Install: pip install requests beautifulsoup4 playwright && playwright install chromium
1. Search the Web
python3 scripts/google_search.py "query" --pages N --engine ENGINE
--engine — duckduckgo (default), brave, or google
- Returns
[{title, url, snippet}, ...]
2. Read a Page (one-shot)
python3 scripts/read_page.py "https://url" [--max-chars N] [--visible] [--format json|markdown|text] [--no-dismiss]
--format — json (default), markdown, or text
- Auto-dismisses cookie consent banners (skip with
--no-dismiss)
3. Persistent Browser Session
python3 scripts/browser_session.py open
python3 scripts/browser_session.py navigate
python3 scripts/browser_session.py extract [--format FMT]
python3 scripts/browser_session.py screenshot [path] [--full]
python3 scripts/browser_session.py click
python3 scripts/browser_session.py search
python3 scripts/browser_session.py tab new
python3 scripts/browser_session.py tab list
python3 scripts/browser_session.py tab switch 1
python3 scripts/browser_session.py tab close [index]
python3 scripts/browser_session.py dismiss-cookies
python3 scripts/browser_session.py close