brightdata-cli
brightdata/skills
Руководство по использованию командной строки Bright Data (CLI) (`brightdata` / `bdata`) для сбора данных с веб-сайтов, поиска в Интернете, извлечения структурированных данных из более чем 40 платформ, управления прокси-зонами и проверки баланса аккаунта. Используйте этот скин, когда пользователь хочет выполнить парсинг URL-адреса, провести поиск в Google/Bing/Yandex, извлечь данные из Amazon/LinkedIn/Instagram/TikTok/YouTube/Reddit или любой другой платформы, проверить свой баланс или зоны в Bright Data, а также выполнить любые другие действия, связанные со сбором веб-данных из терминала. Также запускайте скин, когда пользователь упоминает
...Расширить всеО brightdata-cli
CLI Bright Data — это инструмент командной строки, обеспечивающий прямой доступ через терминал к платформе веб-данных Bright Data. Он упрощает процесс веб-парсинга, автоматически выполняя аутентификацию, управление прокси-серверами, обход антибот-защиты, разгадывание CAPTCHA и рендеринг JavaScript. Пользователям достаточно один раз авторизоваться через OAuth, после чего CLI беспрепятственно выполняет все последующие операции без необходимости ручной настройки или управления ключами API.
Этот инструмент позволяет собирать данные с любого URL в различных форматах (Markdown, HTML, JSON, скриншот), выполнять поиск в Google, Bing и Yandex с получением структурированных результатов, а также извлекать данные из более чем 40 платформ, включая Amazon, LinkedIn, Instagram, TikTok, YouTube и Reddit. CLI поддерживает как синхронные, так и асинхронные операции, геотаргетированный скрапинг из определённых стран, а также предоставляет функции управления учётными записями, такие как проверка бюджета и настройка прокси-зоны. Все операции выполняются с помощью простых команд, таких как «bdata scrape» или «bdata search».
Этот инструмент предназначен для разработчиков, аналитиков данных и исследователей, которым требуется надёжный сбор веб-данных без дополнительных затрат на инфраструктуру. Будь то сбор конкурентной разведки, мониторинг контента, проведение SEO-анализа или сбор данных для обучения, Bright Data CLI берет на себя технические сложности, предоставляя при этом простой интерфейс команд. Он работает на macOS, Linux и Windows, требует только Node.js 20+ и может даже запускаться без установки через npx для разовых задач.
Часто задаваемые вопросы
Как пройти аутентификацию в Bright Data CLI?
Один раз запустите команду «bdata login», чтобы пройти аутентификацию через OAuth в браузере. При этом ваши учетные данные сохраняются локально, а необходимые прокси-зоны настраиваются автоматически. Для бездисплейных сред используйте «bdata login --device» или «bdata login --api-key
С каких платформ можно извлекать данные?
CLI поддерживает извлечение структурированных данных из более чем 40 платформ через конвейеры, включая Amazon, LinkedIn, Instagram, TikTok, YouTube, Reddit и многие другие. Используйте команду «bdata pipelines list», чтобы увидеть все доступные типы платформ.
Какие форматы вывода поддерживаются при скрапинге?
Скрапинг поддерживает несколько форматов: Markdown (по умолчанию), HTML, JSON для структурированных данных и скриншоты. Укажите формат с помощью флага -f, например: «bdata scrape
Нужно ли мне самостоятельно управлять прокси или решать CAPTCHA?
Нет. Командная строка автоматически занимается управлением прокси, обходом антибот-защиты, разгадыванием CAPTCHA и рендерингом JavaScript. После первоначального «bdata login» все технические сложности убираются из поля зрения.
Можно ли выполнять скрапинг из определённых географических регионов?
Да. Используйте флаг --country для указания геотаргетированного сбора данных, например, «bdata scrape https://amazon.com --country us», чтобы собирать данные с IP-адреса в США.
Bright Data CLI
The Bright Data CLI (brightdata or bdata) gives you full access to Bright Data's web data platform from the terminal. It handles authentication, proxy zones, anti-bot bypass, CAPTCHA solving, and JavaScript rendering automatically — the user just needs to log in once.
Installation
If the CLI is not installed yet, guide the user:
macOS / Linux:
curl -fsSL https://cli.brightdata.com/install.sh | bashWindows or manual install (any platform):
npm install -g @brightdata/cli
Without installing (one-off usage):
npx --yes --package @brightdata/cli brightdata <command>
Requires Node.js >= 20. After install, both brightdata and bdata (shorthand) are available.
First-Time Setup
Before anything else, check if the user is authenticated. If they haven't logged in yet, guide them through the one-time setup:
# One-time login — opens the browser for OAuth, then everything is automaticbdata loginThis single command:
- Opens the browser for secure OAuth authentication
- Saves the API key locally (never needs to be entered again)
- Auto-creates required proxy zones (
cli_unlocker,cli_browser) - Sets default configuration
After login, every subsequent command works without any manual intervention.
For headless/SSH environments where no browser is available:
bdata login --device
For direct API key authentication (non-interactive):
bdata login --api-key <key>
To verify setup is complete, run:
bdata config
Command Reference
Read references/commands.md for the full command reference with all flags, options, and examples for every command.
Read references/pipelines.md for the complete list of 40+ pipeline types (Amazon, LinkedIn, Instagram, TikTok, YouTube, Reddit, and more) with their specific parameters.
Quick Command Overview
bdata is the shorthand for brightdata. Both work identically.
| Command | Purpose |
|---|---|
bdata scrape <url> | Scrape any URL as markdown, HTML, JSON, or screenshot |
bdata search "<query>" | Search Google/Bing/Yandex with structured results |
bdata pipelines <type> [params] | Extract structured data from 40+ platforms |
bdata pipelines list | List all 40+ available pipeline types |
bdata status <job-id> | Check async job status |
bdata zones | List proxy zones |
bdata budget | View account balance and costs |
bdata skill add | Install AI agent skills |
bdata skill list | List available skills |
bdata config | View/set configuration |
bdata login | Authenticate with Bright Data |
bdata version | Show CLI version and system info |
How to Use Each Command
Scraping
Scrape any URL with automatic bot bypass, CAPTCHA handling, and JS rendering:
# Default: returns clean markdownbdata scrape https://example.com# Get raw HTMLbdata scrape https://example.com -f html# Get structured JSONbdata scrape https://example.com -f json# Take a screenshotbdata scrape https://example.com -f screenshot -o page.png# Geo-targeted scrape from the USbdata scrape https://amazon.com --country us# Save to filebdata scrape https://example.com -o page.md# Async mode for heavy pagesbdata scrape https://example.com --async
Searching
Search engines with structured JSON output (Google returns parsed organic results, ads, People Also Ask, and related searches):
# Google search with formatted tablebdata search "web scraping best practices"# Get raw JSON for pipingbdata search "typescript tutorials" --json# Search Bingbdata search "bright data pricing" --engine bing# Localized searchbdata search "restaurants berlin" --country de --language de# News searchbdata search "AI regulation" --type news# Extract just URLsbdata search "open source tools" --json | jq -r '.organic[].link'
Pipelines (Structured Data Extraction)
Extract structured data from 40+ platforms. These trigger async jobs that poll until results are ready:
# LinkedIn profilebdata pipelines linkedin_person_profile "https://linkedin.com/in/username"# Amazon productbdata pipelines amazon_product "https://amazon.com/dp/B09V3KXJPB"# Instagram profilebdata pipelines instagram_profiles "https://instagram.com/username"# Amazon searchbdata pipelines amazon_product_search "laptop" "https://amazon.com"# YouTube comments (top 50)bdata pipelines youtube_comments "https://youtube.com/watch?v=..." 50# Google Maps reviews (last 7 days)bdata pipelines google_maps_reviews "https://maps.google.com/..." 7# Output as CSVbdata pipelines amazon_product "https://amazon.com/dp/..." --format csv -o product.csv# List all available pipeline typesbdata pipelines list
Checking Status
For async jobs (from --async scrapes or pipelines):
# Quick status checkbdata status <job-id># Wait until completebdata status <job-id> --wait# With custom timeoutbdata status <job-id> --wait --timeout 300
Budget & Zones
# Quick account balancebdata budget# Detailed balance with pending chargesbdata budget balance# All zones cost/bandwidthbdata budget zones# Specific zone costsbdata budget zone my_zone# Date range filterbdata budget zones --from 2024-01-01T00:00:00 --to 2024-02-01T00:00:00# List all zonesbdata zones# Zone detailsbdata zones info cli_unlocker
Configuration
# View all configbdata config# Set defaultsbdata config set default_zone_unlocker my_zonebdata config set default_format json
Installing AI Agent Skills
# Interactive picker — choose skills and target agentsbdata skill add# Install a specific skillbdata skill add scrape# List available skillsbdata skill list
Output Modes
Every command supports multiple output formats:
| Flag | Effect |
|---|---|
| (none) | Human-readable formatted output with colors |
--json | Compact JSON to stdout |
--pretty | Indented JSON to stdout |
-o <path> | Write to file (format auto-detected from extension) |
When piped (stdout is not a TTY), colors and spinners are automatically disabled.
Chaining Commands
The CLI is pipe-friendly:
# Search → extract first URL → scrape itbdata search "top open source projects" --json \ | jq -r '.organic[0].link' \ | xargs bdata scrape# Scrape and view with markdown readerbdata scrape https://docs.github.com | glow -# Amazon product data to CSVbdata pipelines amazon_product "https://amazon.com/dp/xxx" --format csv > product.csv
Environment Variables
These override stored configuration:
| Variable | Purpose |
|---|---|
BRIGHTDATA_API_KEY | API key (skips login entirely) |
BRIGHTDATA_UNLOCKER_ZONE | Default Web Unlocker zone |
BRIGHTDATA_SERP_ZONE | Default SERP zone |
BRIGHTDATA_POLLING_TIMEOUT | Polling timeout in seconds |
Troubleshooting
| Error | Fix |
|---|---|
| CLI not found | Install with npm i -g @brightdata/cli or curl -fsSL https://cli.brightdata.com/install.sh | bash |
| "No Web Unlocker zone specified" | bdata config set default_zone_unlocker <zone> or re-run bdata login |
| "Invalid or expired API key" | bdata login |
| "Access denied" | Check zone permissions in the Bright Data control panel |
| "Rate limit exceeded" | Wait and retry, or use --async for large jobs |
| Async job timeout | Increase with --timeout 1200 or BRIGHTDATA_POLLING_TIMEOUT=1200 |
Key Design Principles
- One-time auth: After
bdata login, everything is automatic. No tokens to manage, no keys to pass. - Zones auto-created: Login creates
cli_unlockerandcli_browserzones automatically. - Smart defaults: Markdown output, auto-detected formats from file extensions, colors only in TTY.
- Pipe-friendly: JSON output + jq for automation. Colors/spinners disabled in pipes.
- Async support: Heavy jobs can run in background with
--async+status --wait. - npm package:
@brightdata/cli— install globally or use vianpx.
Все файлы
3 файловУстановить brightdata-cli
Скачайте файлы навыков и распакуйте их в каталог .claude/skills/.
Скачать ZIPКлонируйте репозиторий и скопируйте файлы навыка в свой проект.
git clone https://github.com/brightdata/skills/blob/main/skills/brightdata-cli/SKILL.md # Copy SKILL.md to your .claude/skills/ directory
Копировать





Дом
